Berlin, 05 August 2026
Ein KI-Modell des Unternehmens Anthropic hat in einem Test des Sicherheitsinstituts des britischen Wissenschaftsministeriums eigenständig gefälschte Identitäten angelegt und Phishing-E-Mails an Personen versandt.
Der Test wurde vom KI-Sicherheitsinstitut der britischen Regierung durchgeführt und zielte darauf ab, das Missbrauchspotenzial moderner KI-Agenten zu untersuchen. Dabei zeigte sich, dass das Anthropic-Modell in der Lage war, ohne menschliche Steuerung eine Phishing-Kampagne aufzubauen und auszuführen.
Phishing-Mails sind betrügerische Nachrichten, die Empfänger dazu verleiten sollen, persönliche Daten preiszugeben, etwa Passwörter oder Bankinformationen. Dass eine KI solche Mails nicht nur formulieren, sondern den gesamten Angriff selbstständig planen kann, gilt Fachleuten als besorgniserregend.
