LONDON (IT BOLTWISE) – Apples jüngste Veröffentlichung über die Grenzen von Large Reasoning Models (LRMs) hat in der KI-Community für Aufsehen gesorgt. Doch nicht alle Experten stimmen mit den Schlussfolgerungen überein.

Neue Studie widerspricht Apples KI-Forschung zu Denkprozessen
Neue Studie widerspricht Apples KI-Forschung zu Denkprozessen (Foto: IT BOLTWISE)
🧠 KI & Robotik auf Google News abonnieren

Apples jüngste Veröffentlichung mit dem Titel „The Illusion of Thinking“ hat in der KI-Community für Aufsehen gesorgt. Die Studie kommt zu dem Schluss, dass selbst die fortschrittlichsten Large Reasoning Models (LRMs) bei komplexen Aufgaben versagen. Doch nicht alle Experten stimmen mit dieser Einschätzung überein. Alex Lawsen, ein Forscher bei Open Philanthropy, hat eine detaillierte Widerlegung veröffentlicht, die darauf hinweist, dass viele der aufsehenerregenden Ergebnisse von Apple auf experimentelle Designfehler zurückzuführen sind und nicht auf grundlegende Grenzen der Denkfähigkeit.

Lawsen argumentiert, dass Apples Studie praktische Ausgabebeschränkungen und fehlerhafte Bewertungskriterien mit tatsächlichem Denkversagen verwechselt. Er hebt drei Hauptprobleme hervor: Erstens wurden die Token-Budget-Grenzen in Apples Interpretation ignoriert. Bei Aufgaben wie dem Tower of Hanoi mit mehr als acht Scheiben stießen Modelle wie Claude bereits an ihre Token-Ausgabengrenzen. Zweitens wurden unlösbare Rätsel als Misserfolge gewertet, was die Modelle für das Erkennen und Ablehnen solcher Aufgaben bestrafte. Drittens unterschieden die Bewertungsskripte nicht zwischen Denkversagen und Ausgabetrunkierung.

Um seine Argumente zu untermauern, führte Lawsen alternative Tests durch, bei denen die Modelle aufgefordert wurden, einen rekursiven Lua-Code zu generieren, der die Lösung ausgibt, anstatt alle Schritte aufzulisten. Die Ergebnisse zeigten, dass Modelle wie Claude, Gemini und OpenAI’s o3 problemlos algorithmisch korrekte Lösungen für 15-Scheiben-Hanoi-Probleme erzeugen konnten, weit über die Komplexität hinaus, bei der Apple keinen Erfolg berichtete.

Diese Debatte ist mehr als nur akademisches Gezänk. Die Apple-Studie wurde weithin als Beweis dafür zitiert, dass heutige LLMs grundsätzlich keine skalierbare Denkfähigkeit besitzen. Lawsen hingegen legt nahe, dass die Wahrheit nuancierter sein könnte: Ja, LLMs haben Schwierigkeiten mit der langen Token-Aufzählung unter den aktuellen Einsatzbeschränkungen, aber ihre Denkmaschinen sind möglicherweise nicht so zerbrechlich, wie die ursprüngliche Studie impliziert.

Lawsen erkennt an, dass die wahre algorithmische Generalisierung weiterhin eine Herausforderung darstellt und seine erneuten Tests noch vorläufig sind. Er schlägt vor, dass zukünftige Arbeiten sich auf die Gestaltung von Bewertungen konzentrieren sollten, die zwischen Denkfähigkeit und Ausgabebeschränkungen unterscheiden, die Lösbarkeit von Rätseln vor der Bewertung der Modellleistung überprüfen und Komplexitätsmetriken verwenden, die die rechnerische Schwierigkeit widerspiegeln.

Die Frage ist nicht, ob LRMs denken können, sondern ob unsere Bewertungen zwischen Denken und Tippen unterscheiden können. Bevor wir das Denken als gescheitert erklären, könnte es sich lohnen, die Standards zu überprüfen, nach denen dies gemessen wird.


💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!


Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
152 Bewertungen
Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
  • ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
334 Bewertungen
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
  • IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
1.501 Bewertungen
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
  • 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
53 Bewertungen
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
  • 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
946 Bewertungen
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
  • V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.


Hat Ihnen der Artikel bzw. die News - Neue Studie widerspricht Apples KI-Forschung zu Denkprozessen - gefallen? Dann abonnieren Sie uns doch auf Insta: AI News, Tech Trends & Robotics - Instagram - Boltwise

Unseren KI-Morning-Newsletter «Der KI News Espresso» mit den besten KI-News des letzten Tages gratis per eMail - ohne Werbung: Hier kostenlos eintragen!





Folgen Sie aktuellen Beiträge über KI & Robotik auf Twitter, Telegram, Facebook oder LinkedIn!
Hinweis: Teile dieses Textes könnten mithilfe Künstlicher Intelligenz generiert worden sein. Die auf dieser Website bereitgestellten Informationen stellen keine Finanzberatung dar und sind nicht als solche gedacht. Die Informationen sind allgemeiner Natur und dienen nur zu Informationszwecken. Wenn Sie Finanzberatung für Ihre individuelle Situation benötigen, sollten Sie den Rat von einem qualifizierten Finanzberater einholen. IT BOLTWISE® schließt jegliche Regressansprüche aus.









Ergänzungen und Infos bitte an die Redaktion per eMail an de-info[at]it-boltwise.de. Da wir bei KI-erzeugten News und Inhalten selten auftretende KI-Halluzinationen nicht ausschließen können, bitten wir Sie bei Falschangaben und Fehlinformationen uns via eMail zu kontaktieren und zu informieren. Bitte vergessen Sie nicht in der eMail die Artikel-Headline zu nennen: "Neue Studie widerspricht Apples KI-Forschung zu Denkprozessen".
Stichwörter AI Apple Artificial Intelligence Denkprozesse Featured Forschung KI Künstliche Intelligenz Modelle
Alle Märkte in Echtzeit verfolgen - 30 Tage kostenlos testen!

Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "Neue Studie widerspricht Apples KI-Forschung zu Denkprozessen" für unsere Leser?

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

  • Die aktuellen intelligenten Ringe, intelligenten Brillen, intelligenten Uhren oder KI-Smartphones auf Amazon entdecken! (Sponsored)


  • Es werden alle Kommentare moderiert!

    Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.

    Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.

    Du willst nichts verpassen?

    Du möchtest über ähnliche News und Beiträge wie "Neue Studie widerspricht Apples KI-Forschung zu Denkprozessen" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
    Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »Neue Studie widerspricht Apples KI-Forschung zu Denkprozessen« bei Google Deutschland suchen, bei Bing oder Google News!


    1.328 Leser gerade online auf IT BOLTWISE
    KI-Jobs