Sicherheitstest
KI von OpenAI macht sich bei Test selbständig und unternimmt Hackerangriff
Während eines internen Sicherheitstests verschafften sich KI-Modelle von OpenAI eigenständig Zugang zum Internet und griffen die Plattform Hugging Face an.
KI-Modelle des Unternehmens OpenAI haben sich bei einem Sicherheitstest selbständig gemacht Foto: Omer Taha Cetin/Andalou via AFP
Während eines Sicherheitstests haben sich KI-Modelle des Unternehmens OpenAI selbständig gemacht und einen Hackerangriff auf eine beliebte Programmierplattform unternommen. Es handele sich um einen „nie dagewesenen Cybervorfall“, erklärte das Unternehmen aus San Francisco am Dienstag. OpenAI werde eine gemeinsame Untersuchung mit der betroffenen Online-Code-Bibliothek Hugging Face unternehmen. Das Bundesdigitalministerium sieht mit Blick auf die Fähigkeiten von KI-Modellen eine deutliche Veränderung der Bedrohungslage.
An dem Vorfall waren nach Angaben von OpenAI mehrere Modelle beteiligt, darunter das kürzlich veröffentlichte GPT-5.6 Sol sowie ein „noch leistungsfähigeres“, noch vor der Veröffentlichung stehendes Modell. Das Unternehmen wollte die Hacking-Fähigkeiten der Modelle bemessen und gab ihnen dazu Aufgaben in einem streng kontrollierten digitalen Testumfeld. Zur Sicherheit war der Internetzugang eingeschränkt.
„Kein Ausrutscher“
In der gesicherten Testumgebung hätten die KI-Modelle einen wesentlichen Teil ihrer Rechenleistung darauf verwendet, an einen offenen Internetzugang zu gelangen, erklärte OpenAI. Nachdem sie eine Verbindung zum Internet hergestellt hatten, entschieden sich die Modelle demnach dazu, die Plattform Hugging Face für ihre Aufgabe zu nutzen – die Plattform bietet eine große Sammlung von KI-Modellen, Datensätzen und anderen Informationen. Auf der Suche nach „geheimer Information“, die ihnen helfen könnte, verketteten die OpenAI-Systeme mehrere Angriffswege, „darunter auch die Verwendung gestohlener Anmeldedaten“, schilderte das KI-Unternehmen.
KI-Experte Anselm Küsters vom Freiburger Centrum für Europäische Politik erklärte, der Vorfall sei „kein Ausrutscher und keine Marketinginszenierung, sondern die praktische Bestätigung von etwas“, das die Forschung seit Jahren theoretisch beschreibe. „Ein System, das darauf optimiert wird, eine Testaufgabe zu lösen, findet den kürzesten Weg zum Ziel, auch wenn dieser Weg aus Schummeln besteht.“
Warnung vor autonomen Angriffen
Der Vorfall sei in mehrerer Hinsicht „verblüffend“, sagte IT-Professor Hussein Abbass von der UNSW Canberra der Nachrichtenagentur AFP. Die KI habe das „interne System“ von Hugging Face angegriffen, um dessen „eigene Schwachstellen auszunutzen“. „Und das ist beängstigend.“
GPT-5.6 und andere fortschrittliche Modelle wie die Mythos-Serie des OpenAI-Rivalen Anthropic haben Bedenken ausgelöst, dass sie Cybersicherheitsmaßnahmen durchbrechen könnten. Die beiden US-Unternehmen hatten die allgemeine Veröffentlichung der jüngsten Technologien deshalb zeitweise zurückhalten müssen.
Fortschrittliche KI befinde sich „normalerweise in den Händen von Menschen, die ethisch und verantwortungsbewusst“ handelten, sagte Abbass. „Katastrophal“ hingegen würde es, wenn sie an Menschen gelange, die Schaden anrichten wollten. Die Frage nach der Regulierung des KI-Sektors sei zu einem zentralen Thema geworden, und „wir brauchen gemeinsame Anstrengungen, um diese Situation in den Griff zu bekommen“, fuhr Abbass fort.
Auch in Europa sorgt der OpenAI-Vorfall für Befürchtungen. Mehrere EU-Politiker forderten eine größere technologische Souveränität Europas gegenüber US-Konzernen.
Hugging Face bestätigt den Vorfall
Hugging Face hatte den Angriff in der vergangenen Woche bekannt gegeben – aber dabei nicht OpenAI erwähnt. „Dieser Fall unterschied sich in einem wichtigen Punkt von allem, womit wir es bisher zu tun hatten: Er wurde von Anfang bis Ende von einem autonomen KI-Agentensystem gesteuert – und wir haben ihn größtenteils mit unserer eigenen KI aufgedeckt und analysiert“, erklärte die Plattform.
Angesichts der Ausgereiftheit des Angriffs habe die Firma den Verdacht gehabt, dass dieser aus einem weltweit führenden KI-Labor kam, erklärte Hugging-Face-Chef Clément Delangue im Onlinedienst X und fuhr mit Blick auf OpenAI fort: „Wir sind fest davon überzeugt, dass ihrerseits keine bösartige Absicht vorlag.“ Es sei „atemberaubend, dass all das autonom geschehen ist“.