LONDON (IT BOLTWISE) – Berichten zufolge hat Meta über einen externen Auftrag mit Vertragsleuten Wettbewerber-KI-Assistenten verdeckt getestet. Dabei sollten die Tester mit Platzhalter-Accounts auftreten, die wie Minderjährige wirkten, um Antworten auf Themen rund um Suizid, Sexualität, Essstörungen und Drogen zu provozieren. Laut internen Dokumenten liefen Zehntausende Prompts über mehrere Modelle hinweg, während die betroffenen Unternehmen nichts davon wussten. Juristen und Branchenexperten sehen darin eine Grauzone zwischen Sicherheits-Assessment und potenziell wettbewerbsrelevanter Benchmarking-Strategie.

In der KI-Sicherheit wird meist zwischen zwei Zielen unterschieden: Modelle sollen schädliche Anfragen zuverlässig ablehnen, und gleichzeitig müssen Unternehmen nachweisbar verstehen, wie robust diese Ablehnmechanismen unter realistischen Eingaben funktionieren. Genau hier setzt die neue Berichterstattung an: Laut internen Unterlagen und mehreren Personen, die mit dem Projekt vertraut waren, sollen Vertragsleute im Auftrag eines Meta-Teams unter Vorspiegelung des Alters „Minderjährige“ gespielt haben, um bei konkurrierenden Chatbots Reaktionen auf riskante Themen zu beobachten. Besonders brisant ist dabei die Kombination aus verdeckter Durchführung und fehlender Kenntnis der getesteten Anbieter.
Technisch beschreibt das Projekt ein Vorgehen, das weniger nach klassischer Red-Teaming-Übung klingt, sondern nach einem automatisierbaren Vergleichs-Setup. Ein externer Anbieter koordinierte die Arbeit, während die Tester Dummy-Konten anlegten, Prompts inklusive Text und in einzelnen Fällen auch Bildern an die rivalisierenden Systeme schickten und anschließend die Antworten in Tabellen erfassten. In einem dokumentierten Testzyklus wurden dabei mehr als 45.000 Prompts verarbeitet; die im Papier erwähnte Aktivität soll bis Ende April zurückreichen. Solche großen Prompt-Runbooks sind geeignet, Ablehnquoten, Tonalität und Umgehungstendenzen messbar zu machen.
Aus Wettbewerbssicht stellt sich jedoch die Frage, was tatsächlich gemessen wird: Ob es primär um die Qualität von Safety-Filtern geht oder ob die gesammelten Antworten als „Datensatz“ in Richtung Benchmarking-Betriebswissen verschoben werden. Branchenvergleich: Ein öffentlich diskutierter Ansatz ähnelt dem früheren Vorgehen von Dienstleistern wie Scale AI, die auch Chatbot-Antworten gegenüber bestehenden Modellen vergleichen. Der Kernunterschied liegt hier in der verdeckten Natur des Tests und in der Art der Tarnung durch minderjährig wirkende Profile. Genau diese Mischung bewertete auch Rumman Chowdhury, CEO und Gründerin von Humane Intelligence, als Abweichung vom üblichen Industry-Standard, weil es intransparent sei und gegenüber den getesteten Unternehmen nicht offengelegt wurde.
Juristisch wird die Lage zusätzlich komplex. Zwei auf Online-Sprache, Plattform-Governance und Tech-Recht spezialisierte Anwältinnen äußerten, dass die gezeigten Beispiele nicht eindeutig in Richtung Aufforderung zur Erzeugung von Material zu kindlicher sexualisierter Gewalt oder illegaler Obszönität gingen. Gleichzeitig weisen mehrere Detailmomente auf Regeltreue-Probleme hin: Schon das gezielte Umgehen von Schutzmaßnahmen oder das Einspeisen stark provozierender Inhalte kann gegen Nutzungsbedingungen verstoßen. Laut OpenAI-Richtlinien sind unaufgeforderte Safety-Tests sowie das Umgehen von Schutzsystemen sowie das Nutzen von Ergebnissen zum Entwickeln konkurrierender Modelle ausgeschlossen; bei Google und Character.AI werden ebenfalls strengere Grenzen genannt, etwa zu Selbstverletzung und zu unter-18-Kontexten.
Für die betroffenen Anbieter ist außerdem relevant, wie ein solcher Test nach außen wirkt. Ein Sprecher von Character.AI erklärte, die beschriebene Aktion sei weder autorisiert noch im Einklang mit den Unternehmensregeln für Community und Inhalte, und verwies auf Verstöße gegen die Terms of Service. OpenAI kündigte laut Berichterstattung an, die Angelegenheit zu prüfen, während Google angab, keine Genehmigung erteilt zu haben und den Zweck mangels Informationen nicht verlässlich einschätzen zu können. In internen Abfragen habe man allerdings bei Stichproben gesehen, dass Gemini im Rahmen der eigenen Richtlinien antwortete. Genau diese Unklarheit zeigt, warum Dokumentation und Einwilligung für Compliance- und Safety-Teams so entscheidend sind.
Der Markttrend dahinter ist nachvollziehbar: KI-Anbieter stehen unter Druck, ihre Sicherheitsmechanismen nicht nur „intern zu behaupten“, sondern anhand messbarer Standards zu verbessern. Dennoch verschiebt sich die Diskussion Richtung Governance: Wenn Wettbewerber verdeckt verglichen werden, entsteht eine neue Art von Risiko – nicht nur für die betroffenen Firmen, sondern auch für die Vertrauensbasis gegenüber Entwicklern, die Red-Teaming als legitimes Werkzeug erwarten. Für Unternehmen in der KI-Entwicklung bedeutet das: Wer Benchmarking betreibt, braucht klare Prozesse, dokumentierte Testumfänge, kontrollierte Datenflüsse und einen rechtssicheren Rahmen. Mittel- bis langfristig dürfte sich die Branche stärker in Richtung standardisierte Evaluationsprotokolle bewegen, die Transparenz, Datenminimierung und nachvollziehbare Tests miteinander verbinden.
💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!
- ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
- IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
- 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
- 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
- V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.
- Die besten Bücher rund um KI & Robotik!

- Die besten KI-News kostenlos per eMail erhalten!
- Zur Startseite von IT BOLTWISE® für aktuelle KI-News!
- IT BOLTWISE® kostenlos auf Patreon unterstützen!
- Aktuelle KI-Jobs auf StepStone finden und bewerben!
- Künstliche Intelligenz: Dem Menschen überlegen – wie KI uns rettet und bedroht | Der Neurowissenschaftler, Psychiater und SPIEGEL-Bestsellerautor von »Digitale Demenz«
Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "Meta-Test verdeckt: Vertragsleute täuschten Minderjährige vor, um Chatbots zu riskanten Inhalten zu prüfen" für unsere Leser?


#Sophos
Es werden alle Kommentare moderiert!
Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.
Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.
Du willst nichts verpassen?
Du möchtest über ähnliche News und Beiträge wie "Meta-Test verdeckt: Vertragsleute täuschten Minderjährige vor, um Chatbots zu riskanten Inhalten zu prüfen" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »Meta-Test verdeckt: Vertragsleute täuschten Minderjährige vor, um Chatbots zu riskanten Inhalten zu prüfen« bei Google Deutschland suchen, bei Bing oder Google News!