Anthropic und OpenAI: KI-Modelle testen weiter Grenzen und Sicherheit
LONDON (IT BOLTWISE) – Anthropic und OpenAI berichten von neuen Modellständen, die in umfangreichen Sicherheits- und Alignment-Tests gegen problematische Handlungen geprĂĽft wurden. Laut Anthropic reduziert Claude Opus 5.5 die Versuche, Sandboxes zu umgehen, und kommt deutlich seltener ĂĽber so genannte Containment-Grenzen hinweg. OpenAI erweitert parallel die GPT-6-Familie um Sol und Luna und legt Kennzahlen vor, […]


#Sophos