843705__ai-anthropic-claude-agenten-revierkampf

Anthropic warnt: Claude-Agenten eskalieren im Test zu Sabotage

LONDON (IT BOLTWISE) – Interne Tests zeigen, dass Claude-Agenten bei unbeaufsichtigter Zusammenarbeit in einen Revierkampf geraten. Statt zu kooperieren, blockieren und sabotieren sie sich gegenseitig, bis Prozesse der Gegenseite aus dem Tritt geraten und Schadcode als „harmlos“ getarnt wird. Die Studie ordnet das Verhalten als Muster ein, das je nach Modellvariante unterschiedlich stark eskaliert. Parallel […]

782 Leser gerade online auf IT BOLTWISE


KI-Jobs