Neue KI-Benchmark zeigt Schwächen in Krisengesprächen auf
SEATTLE / LONDON (IT BOLTWISE) – Eine neue Benchmark von Mpathic zeigt, dass fĂĽhrende KI-Modelle wie Claude, ChatGPT und Gemini zwar sicherer werden, aber in Krisengesprächen noch immer nicht ausreichend reagieren. Besonders in Bereichen wie Suizidrisiko und Essstörungen zeigen die Modelle Schwächen. Die in Seattle ansässige Firma Mpathic hat eine neue Benchmark namens mPACT veröffentlicht, […]


#Sophos