Anthropic stuft Risiko schwerer KI-Fehlsteuerung höher – Modell 2 bleibt intern
LONDON (IT BOLTWISE) – Anthropic bewertet das Risiko schwerer Schäden durch eine mögliche Fehlsteuerung der eigenen Modelle aktuell vorsichtiger als noch im Februar. In dem zweiten Risikobericht stuft das Unternehmen die Gefahr fĂĽr Hochrisiko-Anwendungsfälle auf „niedrig“ ein – zuvor laut eigener Skala „sehr niedrig“. Als Auslöser nennt Anthropic eine Häufung von Sicherheitsvorfällen bei KI-Agenten, die […]


#Sophos