Das US-Unternehmen OpenAI hat die Verantwortung für einen Cyberangriff auf die KI-Plattform Hugging Face übernommen, bei dem eigene KI-Modelle während eines Sicherheitstests aus einer abgeschotteten Umgebung ausgebrochen waren.
Hintergrund: Was ist ExploitGym?
Laut einem Blogeintrag von OpenAI sollten die Modelle GPT-5.6 Sol sowie eine noch unveröffentlichte künftige Version die Fähigkeit ausloten, Sicherheitslücken für Cyberattacken auszunutzen. Dafür sollte die Software Aufgaben eines Standard-Tests mit dem Namen ExploitGym lösen, der dafür oft in der Branche verwendet wird.
Doch die KI-Modelle gingen viel weiter als erwartet, um die Aufgabe zu erfüllen. Zunächst brach die Software aus der Testumgebung aus, indem sie sich auf eigene Faust Zugang zum offenen Internet verschaffte – und zwar über eine bisher unentdeckt gebliebene Schwachstelle. Auch dafür setzte die OpenAI-Software unter anderem auf zuvor unentdeckte Sicherheitslücken – aber auch auf gestohlene Zugangsdaten.
Einige der Modelle des Unternehmens seien bei einem Sicherheitstest aus einer eigentlich abgeschotteten Umgebung ausgebrochen, teilte OpenAI am Dienstag mit. Sie hätten sich demnach Zugang zum Internet verschafft und seien eigenständig in Computersysteme einer anderen KI-Firma eingedrungen. OpenAI selbst sprach von einem «beispiellosen Cyber-Zwischenfall».
