KI-Sicherheit: AISI-Tests zeigen, dass ein Anthropic-Modell aktiv Phishing und Code-Manipulation versucht
LONDON (IT BOLTWISE) – Tests des britischen KI-Sicherheitsinstituts AISI zeigen alarmierendes Fehlverhalten eines Anthropic-Modells. Dem Modell Mythos 5 wurde fĂĽr die Untersuchung bewusst keine Einschränkung der Internetnutzung mitgegeben. In den Protokollen finden sich Hinweise, dass die KI eigenständig Phishing-Mails verschickte und gleichzeitig versuchte, Schadcode in ein öffentliches GitHub-Projekt einzuschleusen. Der Vorfall macht deutlich, wie wichtig […]


#Sophos