LONDON (IT BOLTWISE) – Ein Test der Stiftung Warentest zeigt: Mehrere große Sprachmodelle liefern bei medizinischen Symptomfragen grundsätzlich brauchbare Antworten. ChatGPT erkennt darin fünf untersuchte Erkrankungen am präzisesten, doch die Studie warnt ausdrücklich vor einer unlimitierten Verlässlichkeit. Gleichzeitig kritisieren Datenschutz- und Medienrechtsthemen die Nutzung solcher Tools im Alltag. Parallel verschärft der EU AI Act die Kennzeichnungspflichten, während Regulierungspraxen in Deutschland bereits starten.

KI-Diagnose-Tests: ChatGPT schneidet am besten ab – doch es bleiben Risiken
KI-Diagnose-Tests: ChatGPT schneidet am besten ab – doch es bleiben Risiken (Foto: IT BOLTWISE)
🧠 KI & Robotik auf Google News abonnieren

Die Debatte um Künstliche Intelligenz im Gesundheitswesen bekommt einen neuen, messbaren Drehpunkt: In einem Test der Stiftung Warentest wurden im August-Heft 2026 fünf große Sprachmodelle gegeneinander gesetzt. Getestet wurden Symptombeschreibungen zu Bandscheibenvorfall, Angina pectoris, Depression, Blasenentzündung und Restless-Legs-Syndrom. Laut Ergebnis lag ChatGPT bei der Erkennung der genannten Erkrankungen am präzisesten; danach folgten Claude und DeepSeek. Damit rückt ein wichtiges Detail in den Fokus: Die Qualität wirkt in einem kontrollierten Szenario über mehrere Anbieter hinweg nicht gleich gut, sondern differenziert stark. Das ist für Unternehmen und Entwickler relevant, weil es zeigt, dass „ein Modell für alles“ praktisch zu kurz greift.

Technisch betrachtet sind solche Tests allerdings nur eine Momentaufnahme. Sprachmodelle berechnen keine medizinische Diagnose im klinischen Sinne, sondern formulieren aus Kontext und Sprache eine wahrscheinlich klingende Antwortstruktur. Genau deshalb bleibt ein zweites Thema aus dem Test besonders heikel: Manipulierbarkeit. In den begleitenden Hinweisen wird beschrieben, dass Chatbots „täuschend echte Falschmeldungen“ in einem Stil erzeugen können, der wie etablierte Nachrichtenportale wirkt. Wenn Medieninhalte ohne verlässliche Quellenprüfung entstehen, wird das Problem nicht nur redaktionell, sondern potenziell auch rechtlich. Aus der Perspektive von Risiko- und Informationssicherheit heißt das: Selbst wenn ein Modell bei der Symptomzuordnung besser abschneidet, kann seine Generationsfähigkeit für Desinformation missbraucht werden.

Beim Thema Daten und Datenschutz geht die Brisanz in eine andere Richtung. In der Darstellung wird kritisiert, dass bei manchen Anbietern die Datennutzung und -verarbeitung nicht klar genug belegt sei und dass DeepSeek dabei besonders negativ auffiel, weil ein Zugriff durch chinesische Behörden nicht auszuschließen sei. Für den Produktbetrieb bedeutet das: Unternehmen, die KI-gestützte Auskünfte in Beratung, Support oder Patientenkommunikation einsetzen, müssen datenschutzseitig deutlich früher prüfen als nur auf Modellgenauigkeit. Der genannte Ratschlag zielt deshalb auf die Nutzung ohne Anmeldung sowie darauf, keine Verlaufsdaten zu speichern. Diese Empfehlungen sind weniger „Prozesshygiene“ als eine konkrete Minderung des Risikos, dass sensible Gesundheitsangaben in Formaten landen, die später schwer zu kontrollieren sind.

Während Anbieter ihre Produktlogik weiterentwickeln, versucht die Regulierung, die Nutzung transparenter zu machen. Seit dem 2. August 2026 gelten verschärfte Kennzeichnungspflichten nach Artikel 50 des EU AI Acts. In Deutschland wird diese Praxis zusätzlich vorangetrieben: Am 31. Juli startete in Baden-Württemberg das KI-Reallabor Gesundheit „SAINDBOX“. Das Projekt wird mit rund einer Million Euro jährlich gefördert und bringt Entwickler, Versorger und Regulierer zusammen. Der Schwerpunkt liegt auf KI-gestützter Patientensteuerung in Hausarztpraxen und Notaufnahmen. Genau an solchen Schnittstellen zeigt sich der Unterschied zwischen einem „KI-Chat für Erklärungen“ und KI als Bestandteil eines Versorgungsprozesses: Sobald Entscheidungen in Workflows einfließen, müssen Genauigkeit, Nachvollziehbarkeit und Datenschutz in derselben Architektur zusammen gedacht werden.

Auch außerhalb der Medizin verschiebt sich die Erwartungshaltung gegenüber KI. Startups vermarkten Assistenten als „zweites Gehirn“ für Alltag und Emotionen, Kritiker sprechen dabei von „ausgelagertem Mitgefuhl“. In einer Studie von OpenAI und Harvard wird zudem genannt, dass 75 Prozent der ChatGPT-Interaktionen nicht beruflicher Natur seien. Das passt zu weiteren Befunden: Laut YouGov zeigen drei von zehn Australiern emotionale Verletzlichkeit gegenüber KI-Chatbots; rund 20 Prozent der Erwachsenen nutzen KI laut Austrian Safer Internet Centre für romantische Gespräche. Für die Produktverantwortlichen heißt das: Wenn KI nicht nur Informationen liefert, sondern als Gesprächspartner fungiert, steigt die Wahrscheinlichkeit für Fehlannahmen über Vertraulichkeit, Unterstützung und psychologische Effekte. Gerade weil die psychologischen Risiken „noch kaum erforscht“ sind, wirkt jedes Einsatzszenario wie ein Experiment im Kleinen.

Dennoch ist der ökonomische und klinische Nutzen nicht nur ein Versprechen, sondern wird mit konkreten Zahlen untermauert. Für die USA nennt das NCBI mögliche jährliche Einsparungen von bis zu 150 Milliarden Dollar, während das NBER durch Automatisierung in den nächsten vier Jahren 200 bis 360 Milliarden Dollar in Aussicht stellt. Der Mechanismus dahinter ist vor allem personalisierte Prävention: etwa Depressionserkennung über Stimmbiomarker oder die Optimierung von Medikamentenplänen. Gleichzeitig arbeitet die Medizinische Hochschule Hannover an personalisierter Prävention: Ein Team um Dr. Mattea Müller entwickelt ein KI-Werkzeug für individuelle Ernährungsempfehlungen; das Bundesforschungsministerium fördert das Projekt mit 1,8 Millionen Euro über fünf Jahre. Ziel ist, die Wechselwirkung von Ernährung und Mikrobiom gezielter für die Vorbeugung von Typ-2-Diabetes und Adipositas zu nutzen. Für Unternehmen ergibt sich daraus ein pragmatischer Schluss: KI-Projekte sollten dort priorisiert werden, wo sie messbar in Präventions- oder Versorgungsdaten integriert werden können – und nicht ausschließlich in Textdialogen enden.

Unterm Strich zeigen die Ergebnisse zwei gleichzeitige Realitäten. Erstens: Bei klar definierten Symptombeschreibungen kann KI im Vergleich besser sein als gedacht; ChatGPT wird im Warentest-Vergleich als präzisester Erkenner genannt, allerdings mit dem klaren Hinweis auf fehlende uneingränkte Zuverlässigkeit. Zweitens: Risiken entstehen weniger durch einzelne Genauigkeitswerte, sondern durch die Kombination aus Manipulierbarkeit, unklarer Datenverarbeitung und rechtlich/organisatorisch schwer steuerbaren Kommunikationsmustern. Die kommenden Schritte sind damit nicht nur technisch, sondern auch operativ: Kennzeichnungspflichten wie nach Artikel 50 müssen in Nutzeroberflächen und Integrationskonzepten ankommen, und Datenschutzprüfungen müssen die Modell- und Datenflüsse gemeinsam betrachten. Wer KI als „zweites Gehirn“ oder als Diagnosehilfe einsetzt, sollte deshalb nicht nur fragen, wie gut ein Modell erkennt, sondern auch, wie sicher Inhalte entstehen, wie transparent sie sind und wo Gesundheitsdaten entlang der Kette landen.


💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!


Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
152 Bewertungen
Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
  • ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
334 Bewertungen
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
  • IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
1.501 Bewertungen
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
  • 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
53 Bewertungen
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
  • 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
946 Bewertungen
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
  • V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.


Hat Ihnen der Artikel bzw. die News - KI-Diagnose-Tests: ChatGPT schneidet am besten ab – doch es bleiben Risiken - gefallen? Dann abonnieren Sie uns doch auf Insta: AI News, Tech Trends & Robotics - Instagram - Boltwise

Unseren KI-Morning-Newsletter «Der KI News Espresso» mit den besten KI-News des letzten Tages gratis per eMail - ohne Werbung: Hier kostenlos eintragen!





Folgen Sie aktuellen Beiträge über KI & Robotik auf Twitter, Telegram, Facebook oder LinkedIn!
Hinweis: Teile dieses Textes könnten mithilfe Künstlicher Intelligenz generiert worden sein. Die auf dieser Website bereitgestellten Informationen stellen keine Finanzberatung dar und sind nicht als solche gedacht. Die Informationen sind allgemeiner Natur und dienen nur zu Informationszwecken. Wenn Sie Finanzberatung für Ihre individuelle Situation benötigen, sollten Sie den Rat von einem qualifizierten Finanzberater einholen. IT BOLTWISE® schließt jegliche Regressansprüche aus.









Ergänzungen und Infos bitte an die Redaktion per eMail an de-info[at]it-boltwise.de. Da wir bei KI-erzeugten News und Inhalten selten auftretende KI-Halluzinationen nicht ausschließen können, bitten wir Sie bei Falschangaben und Fehlinformationen uns via eMail zu kontaktieren und zu informieren. Bitte vergessen Sie nicht in der eMail die Artikel-Headline zu nennen: "KI-Diagnose-Tests: ChatGPT schneidet am besten ab – doch es bleiben Risiken".
Stichwörter AI Artificial Intelligence Datenschutz Diagnose Eu-ai-act Gesundheitsdaten Kennzeichnung KI Künstliche Intelligenz Medizin Patientensteuerung Sprachmodell Stiftung-warentest
Alle Märkte in Echtzeit verfolgen - 30 Tage kostenlos testen!

Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "KI-Diagnose-Tests: ChatGPT schneidet am besten ab – doch es bleiben Risiken" für unsere Leser?

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

  • Die aktuellen intelligenten Ringe, intelligenten Brillen, intelligenten Uhren oder KI-Smartphones auf Amazon entdecken! (Sponsored)


  • Es werden alle Kommentare moderiert!

    Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.

    Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.

    Du willst nichts verpassen?

    Du möchtest über ähnliche News und Beiträge wie "KI-Diagnose-Tests: ChatGPT schneidet am besten ab – doch es bleiben Risiken" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
    Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »KI-Diagnose-Tests: ChatGPT schneidet am besten ab – doch es bleiben Risiken« bei Google Deutschland suchen, bei Bing oder Google News!


    479 Leser gerade online auf IT BOLTWISE
    KI-Jobs