Microsoft und OpenAI wurden erneut verklagt – diesmal sitzt auf der Klägerseite eine Gruppe lokaler Nachrichtenmedien, die sonst selten im Rampenlicht stehen. Unter der Führung der Emmerich Newspaper Group aus Mississippi reichten mehrere US-lokale Nachrichtenorganisationen kürzlich Klage ein und beschuldigen die beiden Tech-Konzerne, über lange Zeit und systematisch ohne Genehmigung und ohne jede Vergütung zehntausende urheberrechtlich geschützte Zeitungsartikel in den Trainingsprozess großer Modelle eingespeist und mit diesen KI-Produkten enormousen kommerziellen Wert verdient zu haben, während die Anbieter der Originalinhalte keinen einzigen Cent sahen.
Dieser Rechtsstreit ist kein Einzelfall. In den vergangenen Jahren hielt der Streit ständig an: Auch große Medien wie die New York Times hatten Microsoft und OpenAI bereits aus denselben Gründen verklagt. Doch mit dem Beitritt der Lokalmedien weitet sich die Front von den großen Tageszeitungen bis hin zu den Gemeindezeitungen. Die Kläger schreiben in ihrer Klageschrift unmissverständlich: Microsoft und OpenAI hätten Milliarden-Dollar-Einnahmen geschaffen und würden weitere schaffen, während die Inhaltsersteller "keinen Cent bekommen" hätten; noch auffälliger sei, dass einige Artikel, die sich eigentlich hinter einer Paywall und Zugangsbeschränkungen befanden, angeblich unter Umgehung dieser Beschränkungen entnommen und zum Training verwendet worden seien.
Die technisch detailliertesten Punkte der Klage betreffen die Urheberrechtskennzeichnungen. Die Kläger weisen darauf hin, dass in den betroffenen Artikeln ursprünglich Verwaltungsinformationen zum Urheberrecht eingebettet waren – Autorennamen, Name der Verlagsorganisation, Copyright-Vermerke, Nutzungsbedingungen – gewissermaßen der Personalausweis des Werkes. Sie beschuldigen Microsoft und OpenAI, diese Kennzeichnungen vor dem Einspeisen der Inhalte in das Training mitentfernt zu haben, sodass die Urheberschaft der Werke wie in einem Familienalbum heimlich herausgerissen wurde. Ein weiterer Beweis kommt von der Ausgabeseite: Die Kläger behaupten, ihre Nachrichteninhalte seien in den vergangenen Jahren mehrfach von KI-Systemen fast wörtlich wiederholt ausgegeben worden – was umgekehrt beweise, dass diese Materialien längst tief in den Modellen verschluckt worden seien.
Für die Lokalmedien geht es hier nicht nur um eine Urheberrechtsrechnung, sondern um eine Existenzrechnung. Die lokalen Zeitungen in den USA stehen ohnehin seit Jahren unter dem doppelten Druck sinkender Printauflagen und schrumpfender Werbeerlöse, und weil KI den Nutzern die Antworten direkt vor die Nase setzen kann, wird ihnen zusätzlich der ohnehin schon dünn gewordene Traffic entzogen. Die Kläger nennen das Vorgehen der Tech-Konzerne deshalb die "Todesglocke für den Lokaljournalismus" – in vielen der von ihnen bedienten Märkte ist die Emmerich Newspaper Group die einzige Nachrichtenquelle vor Ort; müssten solche Medien schrumpfen oder sogar schließen, würden die Informationskanäle der Nachbarschaft direkt abgeschnitten. Zur gemeinsamen Klage gehören neben Emmerich auch Ojai Media sowie mehrere Verlags- und Medienunternehmen von Coopwood – ausnahmslos unabhängige Zeitungs- und Zeitschriftenverlage.
Auf rechtlicher Ebene sind die Kläger der Ansicht, dass beide Unternehmen gegen den US Copyright Act und den Digital Millennium Copyright Act (DMCA) verstoßen und eine Urheberrechtsverletzung sowie damit zusammenhängende Gesetzesverstöße begangen haben. Die Klageschrift weist zudem auf einen markanten Doppelpunkt hin: Microsoft und OpenAI ignorierten einerseits angeblich die Urheberrechte der Verlage, während sie andererseits ihre eigenen Codes, Modelle und Systeme mit Lizenzen, Bezahlangeboten und juristischen Mitteln penibel schützen; die Kläger holen außerdem eigens eine ältere Angelegenheit von kürzlich heraus – OpenAI hatte sich öffentlich beschwert, Wettbewerber würden mit von ihm generierten Inhalten Modelle trainieren und damit seine eigenen Interessen schädigen, was in einem bemerkenswerten Kontrast zu dem steht, was ihm nun selbst vorgeworfen wird.
Die Forderungen der Lokalmedien sind klar: Sie wollen, dass das Gericht Schadensersatz und Entschädigungen zuspricht, vor allem aber einen Unterlassungsbefehl erlässt, der Microsoft und OpenAI zwingt, sämtliche Inhalte, die urheberrechtlich geschützte Werke der Kläger betreffen, vollständig aus den Trainingsdaten der Modelle zu löschen. Während immer mehr Nachrichtenorganisationen, Verlage und Inhaltsersteller zu rechtlichen Mitteln greifen, rückt die Frage, ob KI-Trainingsdaten überhaupt legal sind und nach welchen Mechanismen Inhalte lizenziert und vergütet werden sollen, fest auf den ersten Platz der am meisten beachteten Rechtsthemen der globalen KI-Industrie.