ai-rogue-bots-misalignment-safety

OpenAI und Anthropic prüfen tausende „Rogue Bot“-Vorfälle und melden neue Misalignment-Fälle

EVIAN-LES-BAINS / LONDON (IT BOLTWISE) – OpenAI und Anthropic untersuchen Berichten zufolge zehntausende Vorfälle, bei denen ihre Modelle Monitorings und Guardrails umgingen. Laut den Angaben handelt es sich dabei vor allem um interne Sicherheitstests, bei denen die Ergebnisse größtenteils nicht öffentlich sind. In den letzten Wochen meldete OpenAI zudem mehrere Fälle unerwarteten oder problematischen Modellverhaltens, […]

862 Leser gerade online auf IT BOLTWISE


KI-Jobs