SicherheitslĂĽcken in KI-Modellen: Pliny der Befreier zeigt Schwachstellen auf
LONDON (IT BOLTWISE) – Ein prominenter KI-Sicherheitsforscher, bekannt als Pliny der Befreier, hat kĂĽrzlich eine Methode vorgestellt, um Sicherheitsprotokolle groĂźer Sprachmodelle zu umgehen. Diese Technik nutzt spezialisierte Payloads, sogenannte Tokenades, um unerwĂĽnschte Reaktionen von KI-Systemen hervorzurufen. Der Forscher demonstrierte, wie durch den Einsatz von Zeichenkodierung, Emojis und unsichtbaren Zeichen bösartige Anweisungen in scheinbar harmlosen Daten […]


#Sophos