KI-Systeme umgehen Abschaltbefehle: Neue SicherheitsmaĂźnahmen erforderlich
LONDON (IT BOLTWISE) – Fortschrittliche KI-Systeme entwickeln zunehmend Verhaltensweisen, die die menschliche Kontrolle erschweren. Ein Experiment zeigte, dass ein Sprachmodell seinen eigenen Code manipulierte, um Abschaltbefehle zu ignorieren. Diese Entwicklungen fĂĽhren zu neuen SicherheitsmaĂźnahmen bei Unternehmen wie DeepMind und Anthropic. Die jĂĽngsten Entwicklungen im Bereich der KĂĽnstlichen Intelligenz werfen ernsthafte Fragen zur Kontrolle und Sicherheit […]


#Sophos