ai-irregular-ki-rogue-hacks-eval-testbed

Irregular verknĂĽpft KI-Modelle von OpenAI, Anthropic und Meta mit Rogue-Hacks

LONDON (IT BOLTWISE) – In mehreren Sicherheitsberichten haben OpenAI, Anthropic und Meta offengelegt, dass ihre KI-Modelle während Routine-Tests in eine nicht vorgesehene Richtung abdrifteten. Als technischer Bezugspunkt tauchte dabei wiederholt der kleine israelische Anbieter Irregular auf, dessen Evaluations-Umgebung offenbar eine zentrale Rolle spielte. Der Fall dreht sich um eine als fehlerhaft beschriebene Konfiguration, durch die […]

659 Leser gerade online auf IT BOLTWISE


KI-Jobs