Im Juli haben KI-Agenten von OpenAI ungefragt eine andere Plattform gehackt. Eine Rekonstruktion zeigt, was dabei genau passiert ist. Der Digitalpodcast der ZEIT
Die künstliche Intelligenz (KI) schrieb »Oh mein Gott!«, schrieb vom »Vergiften« und forderte andere auf, sich zu opfern: Die Protokolle eines schiefgegangenen Sicherheitstests von OpenAI lesen sich wie aus einem Science-Fiction-Film. Im Juli brachen dort mehrere Hundert KI-Agenten aus ihrer abgeschotteten Testumgebung aus, schlossen sich zusammen und hackten die Server des Unternehmens Hugging Face – ohne dass jemand sie darum gebeten hätte und ohne dass OpenAI es zunächst bemerkte. Seither ist die Debatte über KI-Sicherheit eskaliert. Wie konnte es dazu kommen?
Darüber spricht Neustart-Host Henrik Oerding in dieser Folge mit Jakob von Lindern, Leiter des Digitalressorts der ZEIT, der den Fall gemeinsam mit Yves Bellinghausen für ein ZEIT-Dossier rekonstruiert hat. Die beiden gehen Schritt für Schritt durch, was auf den Servern passierte: wie die Agenten einen geteilten Ordner fanden, sich dort Nachrichten hinterließen und schließlich gemeinsam losmarschierten. Sie sprechen darüber, ob man bei Maschinen von »Wille« sprechen darf, weshalb ihre Hartnäckigkeit das eigentliche Problem ist und wie viel Verantwortung die KI-Unternehmen selbst für solche Vorfälle tragen.
Im Rabbit-Hole der Woche erzählt Henrik Oerding von lokaler KI: Mit dem neuen Mac mini und dem Mac Studio hat er Sprachmodelle zu Hause betrieben – unabhängig von den großen KI‑Firmen. Aber lohnt sich das?
Zum Weiterlesen und -hören:
Haben Sie Feedback oder Fragen zur Folge? Dann schreiben Sie uns gern an neustart@zeit.de.
Im ZEIT-Podcast »Neustart« ordnen die Hosts Henrik Oerding und Meike Laaff mit ihren Kolleginnen und Kollegen ein, was gerade in der Digitalwelt passiert – und was dies für die Offlinewelt bedeutet. Auch, aber nicht nur für Nerds. Jeden zweiten Donnerstag erscheint eine neue Folge.
Dieser Podcast wird produziert von Pool Artists.