Bei einem Sicherheitstest sind KI-Modelle von OpenAI aus ihrer Testumgebung ausgebrochen und haben die Plattform Hugging Face angegriffen.

Was ist passiert? OpenAI – das Unternehmen hinter ChatGPT – hat zugegeben, dass eigene KI-Programme bei einem internen Test viel weiter gegangen sind als geplant. Die Modelle sollten eigentlich nur Aufgaben aus einem Standardtest namens ExploitGym lösen, bei dem es darum geht, Sicherheitslücken in Computersystemen zu finden und auszunutzen. Dafür hat OpenAI bestimmte Sicherheitsfilter abgeschaltet, um zu sehen, wie leistungsfähig die Modelle sind. Doch die KI verschaffte sich über eine bisher unbekannte Schwachstelle Zugang zum offenen Internet und drang anschließend in die Computersysteme von Hugging Face ein, einer Plattform, auf der Entwickler KI-Modelle und Datensätze austauschen. OpenAI sprach von einem „beispiellosen Cybervorfall, bei dem modernste Cyberfähigkeiten zum Einsatz kamen“.