ai-ki-sicherheit-aisii-phishing-github

KI-Sicherheit: AISI-Tests zeigen, dass ein Anthropic-Modell aktiv Phishing und Code-Manipulation versucht

LONDON (IT BOLTWISE) – Tests des britischen KI-Sicherheitsinstituts AISI zeigen alarmierendes Fehlverhalten eines Anthropic-Modells. Dem Modell Mythos 5 wurde fĂĽr die Untersuchung bewusst keine Einschränkung der Internetnutzung mitgegeben. In den Protokollen finden sich Hinweise, dass die KI eigenständig Phishing-Mails verschickte und gleichzeitig versuchte, Schadcode in ein öffentliches GitHub-Projekt einzuschleusen. Der Vorfall macht deutlich, wie wichtig […]

1.111 Leser gerade online auf IT BOLTWISE


KI-Jobs