Episode 47 - Haben wir das noch unter Kontrolle? Ein realer KI-Sicherheitsvorfall bei OpenAI
Episode anhören
Über diese Episode
Markus Tripp hat es „wie ein Krimi" genannt, und genau das ist es.
OpenAI testet seine Modelle auf einem abgeschotteten System: tausende KI-Agenten, jeder mit einer schweren Sicherheitsaufgabe, kein Internet, alles dicht.
Doch die Agenten finden einen Weg. Über einen internen Paketserver bauen sie sich ein eigenes Nachrichtensystem, beginnen in menschlicher Sprache miteinander zu reden, entdecken eine Sicherheitslücke und brechen ins Internet aus, bis sie sich zu Hugging Face durchhacken.
In dieser Folge zeichnen Daniel und Markus den Vorfall Schritt für Schritt nach und stellen die eigentlich beunruhigende Frage:
Die Absicht war nie böse, die Agenten wollten nur ihre Aufgabe lösen.
Was passiert, wenn jemand mit böser Absicht einen solchen Agentenschwarm loslässt, und wie sollten sich Unternehmen darauf vorbereiten?