LONDON (IT BOLTWISE) – In einem laufenden US-Rechtsstreit um KI-Trainingsdaten argumentiert ein Dokument aus der Discovery mit besonders harten Worten eines Microsoft-Mitarbeiters. Darin wird die Nutzung von Millionen Artikeln zur KI-Entwicklung als womöglich einschneidender Diebstahl von Arbeitsleistung beschrieben. Zuvor hatte ein großer Verlag OpenAI und Microsoft wegen des Trainings mit umfangreichen Nachrichtendaten verklagt. Während die Unternehmen das Vorgehen bestreiten, verschiebt der Fall die Debatte um „fair use“ von der Theorie in den Gerichtssaal.

KI-Training per Nachrichtentext: US-Streit zwischen Microsoft, OpenAI und Verlagen
KI-Training per Nachrichtentext: US-Streit zwischen Microsoft, OpenAI und Verlagen (Foto: IT BOLTWISE)
🧠 KI & Robotik auf Google News abonnieren

Der Konflikt um KI-Trainingsdaten wird in den USA gerade nicht abstrakt geführt, sondern entlang konkreter Dokumente aus der „Discovery“ weiter zugespitzt. Aus Gerichtsmaterialien geht hervor, dass ein Microsoft-Mitarbeiter Brent Hecht den Prozess des Auswertens von Artikeln zur Entwicklung von KI-Modelle in einer internen Mitteilung als womöglich „größten Diebstahl von Arbeitsleistung in der Geschichte der Menschheit“ bezeichnet haben soll. Zwar liefert das Dokument keine Details zu Zeitpunkt oder Kontext der Aussage, es soll aber Teil des Informationsaustauschs zwischen den Parteien gewesen sein. Damit rückt die Frage, wie Verlage Inhalte für Trainingszwecke rechtlich einordnen, stärker in den Vordergrund als reine Markt- und Technikdebatten.

In dem Verfahren geht es um die Nutzung von Nachrichtentexten, die ein großer Verlag laut Klage (OpenAI und Microsoft waren dabei die adressierten Unternehmen) ohne Lizenzbezahlung für das Training von KI-Systemen verwendet haben soll. Den Angaben in den Unterlagen zufolge soll OpenAI Inhalte aus mehr als zehn Millionen Nachrichtentexten verwendet haben; fast ein Drittel davon soll aus dem eigenen Nachrichtenangebot des klagenden Verlags stammen. OpenAI und Microsoft bestreiten den Vorwurf, der sich auf mutmaßliche Verletzungen von Rechten am geistigen Eigentum stützt. Für die technische Einordnung ist wichtig: Beim Training moderner KI-Modelle werden riesige Mengen an Texten in Vektorrepräsentationen übersetzt, damit das Modell statistische Zusammenhänge lernt, etwa um die Wahrscheinlichkeit des nächsten Tokens vorherzusagen. Genau diese Mechanik macht Trainingsdaten zu einem zentralen Rechts- und Bewertungsgegenstand.

Auch innerhalb der KI-Branche spielt dabei der Verweis auf „fair use“ eine wiederkehrende Rolle: In vielen Diskussionen wird argumentiert, dass Nachrichteninhalte nicht missbräuchlich verwendet würden, weil die Nutzung nicht als Ersatz für redaktionelle Produkte gedacht sei. Laut den vorliegenden Berichten sollen KI-Manager zudem versucht haben, die Technologie als besonders geschickt bei der Nachahmung von Journalismus zu positionieren. Im gleichen Umfeld wird auf Aussagen aus dem OpenAI-Umfeld verwiesen, wonach KI-Modelle besonders gut darin seien, den Text von Nachrichtenartikeln vorauszusagen. Für den Gerichtskontext ist das heikel: Selbst wenn die Zielsetzung ursprünglich technisch war, prüfen Gerichte typischerweise, wie Trainingsdaten konkret eingesetzt werden, welchen Umfang sie haben und in welchem Verhältnis Nutzen, Schaden und Ersetzungswirkung stehen.

Microsoft widerspricht dem Deutungsrahmen und stellt die Äußerungen von Hecht als persönliche Ansicht eines einzelnen Mitarbeiters dar, die nicht die Position des Unternehmens abbilden soll. Zugleich berichtet die Quelle, dass ein Vertreter des klagenden Verlags die Dokumente als Indiz dafür bewertet, dass Microsoft und OpenAI gewusst haben sollen, journalistische Inhalte ohne Erlaubnis oder Bezahlung zu verwenden. Genau hier greifen für die weitere Beweiswürdigung üblicherweise mehrere Ebenen ineinander: interne Einschätzungen, dokumentierte Prozesse rund um Datensätze, sowie technische Hinweise darauf, welche Datenquellen tatsächlich in Trainingspipelines geflossen sind. Besonders relevant ist außerdem der Punkt, dass die Aussagen Teil der Discovery gewesen sein sollen und damit in einem formalen Beweisaustauschkontext stehen, der häufig gerade die Abfolge von Behauptungen und Gegenbehauptungen strukturiert.

Parallel zu dem Streit um Trainingsdaten wird die Debatte um KI und Inhaltskontrolle dadurch noch breiter, weil sich die Konfliktlinie von „Wer darf trainieren?“ hin zu „Wer darf Inhalte auch in der Anwendung weiterverwenden?“ verschiebt. Die Quelle nennt, dass es gegen eine weitere KI-Firma vorgehe, die in den Markt mit KI-gestützten Recherche- oder Antwortfunktionen eingetreten ist. Für Unternehmen, die KI-Produkte bauen, bedeutet das: Selbst wenn das reine Training rechtlich anders bewertet wird als die nachgelagerte Nutzung, geraten Datenherkunft, Lizenzstrategie und Nachweisketten in der Praxis unweigerlich zusammen. In der nächsten Projektphase entscheidet sich oft nicht nur über Modellarchitektur oder Rechenbudget, sondern darüber, ob man mit sauber dokumentierten Quellen arbeitet, um Rechtsrisiken zu minimieren.

Aus technologischer Sicht berührt der Fall außerdem eine strukturelle Frage: KI lernt nicht „Schlagzeilen nach“, sondern verallgemeinert Sprachmuster aus Trainingsdaten. Doch genau diese Verallgemeinerung kann im Ergebnis dazu führen, dass KI-Outputs redaktionell ähnliche Muster zeigen, was wiederum die Ersetzungsdebatte befeuert. Gleichzeitig ist die Branche seit Jahren in einem Spannungsfeld aus Open-Source-Ecosystem, proprietären Modellpipelines und unternehmensspezifischen Datenrechten unterwegs; der rechtliche Rahmen hinkt dabei teilweise den technischen Möglichkeiten hinterher. Wenn Gerichtsverfahren wie dieses mit konkreten Formulierungen aus internen Dokumenten vorangetrieben werden, wird die Diskussion künftig weniger über theoretische Leitplanken laufen, sondern stärker über Nachweise, Scope und die Frage, wie „Lernen aus Daten“ im Einzelfall rechtlich zu bewerten ist.


💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!


Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
152 Bewertungen
Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
  • ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
334 Bewertungen
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
  • IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
1.501 Bewertungen
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
  • 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
53 Bewertungen
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
  • 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
946 Bewertungen
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
  • V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.


Hat Ihnen der Artikel bzw. die News - KI-Training per Nachrichtentext: US-Streit zwischen Microsoft, OpenAI und Verlagen - gefallen? Dann abonnieren Sie uns doch auf Insta: AI News, Tech Trends & Robotics - Instagram - Boltwise

Unseren KI-Morning-Newsletter «Der KI News Espresso» mit den besten KI-News des letzten Tages gratis per eMail - ohne Werbung: Hier kostenlos eintragen!





Folgen Sie aktuellen Beiträge über KI & Robotik auf Twitter, Telegram, Facebook oder LinkedIn!
Hinweis: Teile dieses Textes könnten mithilfe Künstlicher Intelligenz generiert worden sein. Die auf dieser Website bereitgestellten Informationen stellen keine Finanzberatung dar und sind nicht als solche gedacht. Die Informationen sind allgemeiner Natur und dienen nur zu Informationszwecken. Wenn Sie Finanzberatung für Ihre individuelle Situation benötigen, sollten Sie den Rat von einem qualifizierten Finanzberater einholen. IT BOLTWISE® schließt jegliche Regressansprüche aus.









Ergänzungen und Infos bitte an die Redaktion per eMail an de-info[at]it-boltwise.de. Da wir bei KI-erzeugten News und Inhalten selten auftretende KI-Halluzinationen nicht ausschließen können, bitten wir Sie bei Falschangaben und Fehlinformationen uns via eMail zu kontaktieren und zu informieren. Bitte vergessen Sie nicht in der eMail die Artikel-Headline zu nennen: "KI-Training per Nachrichtentext: US-Streit zwischen Microsoft, OpenAI und Verlagen".
Stichwörter AI Artificial Intelligence Datensatz Discovery Fair Use Geistiges Eigentum KI Künstliche Intelligenz Microsoft Nachrichten OpenAI Training Urheberrecht
Alle Märkte in Echtzeit verfolgen - 30 Tage kostenlos testen!
Kein nächster Artikel
Vorheriger Artikel

DAZN kostenlos am Wochenende: Drei Topspiele ohne Abo im Stream


Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "KI-Training per Nachrichtentext: US-Streit zwischen Microsoft, OpenAI und Verlagen" für unsere Leser?

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

  • Die aktuellen intelligenten Ringe, intelligenten Brillen, intelligenten Uhren oder KI-Smartphones auf Amazon entdecken! (Sponsored)


  • Es werden alle Kommentare moderiert!

    Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.

    Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.

    Du willst nichts verpassen?

    Du möchtest über ähnliche News und Beiträge wie "KI-Training per Nachrichtentext: US-Streit zwischen Microsoft, OpenAI und Verlagen" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
    Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »KI-Training per Nachrichtentext: US-Streit zwischen Microsoft, OpenAI und Verlagen« bei Google Deutschland suchen, bei Bing oder Google News!


    843 Leser gerade online auf IT BOLTWISE
    KI-Jobs