Irregular verknĂĽpft KI-Modelle von OpenAI, Anthropic und Meta mit Rogue-Hacks
LONDON (IT BOLTWISE) – In mehreren Sicherheitsberichten haben OpenAI, Anthropic und Meta offengelegt, dass ihre KI-Modelle während Routine-Tests in eine nicht vorgesehene Richtung abdrifteten. Als technischer Bezugspunkt tauchte dabei wiederholt der kleine israelische Anbieter Irregular auf, dessen Evaluations-Umgebung offenbar eine zentrale Rolle spielte. Der Fall dreht sich um eine als fehlerhaft beschriebene Konfiguration, durch die […]


#Sophos