Externe Fachleute haben davor gewarnt, dass die undurchsichtige Architektur des neuen OpenAI-Modells Astra womöglich die bislang schwerwiegendste Fehlentwicklung für die KI-Sicherheit darstellt.
Ryan Greenblatt, Chefwissenschaftler bei Redwood Research und einer der externen Prüfer eines Vorfalls bei Hugging Face, hat die Entwicklung scharf kritisiert. Er bezeichnete den Schritt hin zu intransparenten Architekturen als „die vielleicht schlimmste Entwicklung für die KI-Sicherheit bis heute“. Die Aussage unterstreicht die wachsende Sorge von Fachleuten, dass wichtige Sicherheitsaspekte moderner KI-Modelle für Außenstehende kaum noch nachvollziehbar sind.
Hintergrund der Verschiebung
Hintergrund der Warnung ist die mehrfach verschobene Veröffentlichung von Astra. Nach Informationen aus Unternehmenskreise wurde der Release um mehrere Wochen verzögert, nachdem es bei internen Tests zu ernsthaften Sicherheitsvorfällen gekommen war. Einzelheiten zu Art und Umfang der Vorfälle wurden bislang nicht öffentlich gemacht.
