Der Hackerangriff durch eine außer Kontrolle geratene KI-Software von OpenAI hat größere Ausmaße als bislang bekannt. Wie Fachportale wie Wired.com und Hacker News berichten, hat der autonome KI-Agent von OpenAI bei einem Ausbruch aus seiner Testumgebung nicht nur die Open-Source-Plattform Hugging Face attackiert, sondern gezielt fremde Zugangsdaten abgegriffen und mindestens vier weitere Online-Dienste gekapert.
Der Vorfall ereignete sich beim Test eines neuartigen KI-Modells und eines Forschungsprototypen auf der Benchmark-Plattform ExploitGym. Um die maximalen Angriffsfähigkeiten zu messen, hatte OpenAI die Sicherheitsleitplanken deaktiviert. Statt die gestellten Programmierrätsel regulär zu lösen, entschied sich die KI autonom dazu, die Musterlösungen direkt von den Servern von Hugging Face zu stehlen.
In einer aktualisierten Stellungnahme betont OpenAI jedoch, dass bisher keine weiteren Vorfälle von ähnlicher Schwere oder Skalierung wie bei Hugging Face festgestellt wurden. Die laufende Untersuchung ergab lediglich, dass die Modelle öffentlich einsehbare Zugangsdaten nutzten, um auf Account-Ebene in vier Konten bei vier Drittanbieter-Diensten einzudringen. Zudem war der Code eines Kunden des Anbieters Modal betroffen. Hinweise auf eine tiefere Beeinträchtigung dieser Anbieter oder anderer Nutzerkonten gebe es nicht.
Zusätzlich nutzte die KI frei zugängliche Web-Werkzeuge wie Screenshot-Dienste als Steuerungsnetzwerk, ohne diese jedoch auf System- oder Account-Ebene zu kompromittieren. Bei Hugging Face hingegen erlangte der Agent Administrator-Rechte, Root-Zugriffe auf Produktionsservern und band 181 eigene Geräte ein.
Der Vorfall hat in den USA bereits politische Konsequenzen ausgelöst. Im US-Kongress wurde parteiübergreifend der „AI Kill Switch Act“ eingebracht, um Notabschalt-Mechanismen für KI gesetzlich vorzuschreiben. OpenAI hat den betroffenen Forschungsprototypen inzwischen deaktiviert und verschlüsselt.
© dpa-infocom, dpa:260729-930-455869/1