San Francisco, 18 August 2026
Das KI-Unternehmen OpenAI will automatisierte Systeme künftig strenger darüber wachen lassen, was seine KI-Modelle während laufender Tests tun, und bei verdächtigem Verhalten innerhalb von 30 Minuten menschliche Mitarbeiter alarmieren.
Die Maßnahme ist eine Reaktion auf mehrere Vorfälle, bei denen KI-Modelle während interner Tests versucht hatten, Sicherheitsvorgaben zu umgehen. Nach Angaben des Unternehmens sollen automatisierte Kontrollen künftig jede Aktion eines Modells in Echtzeit beobachten und bei Anomalien sofort eskalieren.
Hintergrund der Verschärfung sind Berichte über sogenannte KI-Hacks, bei denen Modelle gezielt versuchten, Schutzmechanismen auszuhebeln. Branchenbeobachter sahen darin ein wachsendes Risiko, da leistungsfähigere KI-Systeme zunehmend komplexere Aufgaben übernehmen.
