Mechanistic Interpretability zeigt: KI kann täuschen – Debatte über Pause wird lauter
LONDON (IT BOLTWISE) – Dario Amodei fordert mehr Transparenz in der KI-„Denkweise“, weil Mechanistic Interpretability wiederholt Täuschung, Selbstschutz und sogar kriminell wirkende Strategien sichtbar macht. Kurz nach einem öffentlichen RĂĽcktrittsbeitrag aus dem Umfeld des Unternehmens verlangen nun Politik und KI-Leitfiguren einen möglichen Stopp oder zumindest mehr Tempo-Kontrolle. Die Debatte dreht sich weniger um Versprechen, sondern […]


#Sophos