ai-benchmark-safety

Neue KI-Benchmark zeigt Schwächen in Krisengesprächen auf

SEATTLE / LONDON (IT BOLTWISE) – Eine neue Benchmark von Mpathic zeigt, dass fĂĽhrende KI-Modelle wie Claude, ChatGPT und Gemini zwar sicherer werden, aber in Krisengesprächen noch immer nicht ausreichend reagieren. Besonders in Bereichen wie Suizidrisiko und Essstörungen zeigen die Modelle Schwächen. Die in Seattle ansässige Firma Mpathic hat eine neue Benchmark namens mPACT veröffentlicht, […]

2.143 Leser gerade online auf IT BOLTWISE


KI-Jobs