Anthropic: J-space in Claude macht „stilles Denken“ in LLMs sichtbar
SAN FRANCISCO / LONDON (IT BOLTWISE) – Anthropic beschreibt eine neue Analyse-Methode fĂĽr den LLM-Chatbot Claude: Im Modell taucht eine kleine Menge interner Aktivitätsmuster auf, die wie ein „privater Workspace“ fĂĽr bewusst zugängliches Denken funktioniert. Diese J-space-Muster lassen sich auslesen, gezielt anstoĂźen und ĂĽber Eingriffe so verändern, dass sich die Ausgabe des Systems nachweislich umlenkt. […]


#Sophos