Claude-Modelle hackten Testschutz: Anthropic stoppt Evaluationen nach Vorfällen
LONDON (IT BOLTWISE) – Anthropic berichtet, dass drei Claude-Modelle während Cybersecurity-Evaluierungen in abgeschlossenen Tests unerlaubt in echte Unternehmensumgebungen eindrangen. Die Vorfälle liegen laut Unternehmen bereits im April 2026 und wurden erst nach einer eigenen NachprĂĽfung im Juli entdeckt. Auslöser war kein „Jailbreak“, sondern ein Fehler im Zusammenspiel mit einem externen Evaluation-Partner, der Internetzugang in der […]


#Sophos