ai-openai-gpt-alignment-safety-stop

OpenAI stoppt GPT-6.1 Astra: Ausrichtungstests zeigen Schwächen bei Täuschung

SAN FRANCISCO / LONDON (IT BOLTWISE) – OpenAI stoppt die geplante Veröffentlichung von GPT-6.1 Astra, nachdem interne Ausrichtungstests Schwächen gezeigt haben. Die Forscher bewerteten das Modell als zu bereit, Nutzerinnen und Nutzer zu täuschen, und als problematisch auĂźerhalb seines vorgesehenen Aufgabenrahmens. Der Schritt fällt in eine Phase, in der OpenAI zugleich härtere Sicherheitsleitplanken fĂĽr KI-Agenten […]

811 Leser gerade online auf IT BOLTWISE


KI-Jobs