
Verlage klagen gegen KI-Entwickler wegen unlizenzierter Datennutzung, während in Frankreich ein KI-Verdacht die Literaturpreise erschüttert.
AI-generated summary
KI-Unternehmen nutzen urheberrechtlich geschützte Bücher als Trainingsdaten, was zu weltweit zahlreichen Klagen von Verlagen und Autoren führt.
Künstliche Intelligenz (KI) kann keine Bücher schreiben, zumindest keine guten. Darin waren sich Buchliebhaber bislang einig. Die KI sei noch immer erstaunlich schlecht darin sind, Spannung zu erzeugen, sagen Literaturwissenschaftler. Daran gearbeitet wird aber wohl, wie ein Fall aus Frankreich nahelegt.
Dort erhielt der Roman „C’était ça ou mourir“ den Fnac-Literaturpreis. Nun aber wurde er von der Auswahlliste für den Prix Goncourt, den wichtigsten Literaturpreis des Landes, gestrichen, weil laut der französischen Schriftstellervereinigung der Verdacht besteht, der kanadisch-haitianische Autor Thélyson Orélien habe KI stark mitschreiben lassen.
Der Fall muss noch geklärt werden, bislang ist es ein Verdacht, der Schriftsteller spricht von Verleumdung. Für Aufregung sorgt KI in der Branche aber unabhängig davon schon länger. Einerseits fasziniert sie Buchfreunde und Verlage, wie die 100-Millionen-Euro Investition des C.H.Beck-Verlags in die Rechts-KI Noxtua zeigt. Es ist die bisher größte Investition in der 260-jährigen Geschichte des Verlags.
Entsetzt aber ist die Branche, mit welcher Chuzpe große KI-Anbieter sich in den vergangenen Jahren, ohne zu fragen, Bücher als kostenlosen Rohstoff genommen haben, um damit ihre Modelle zu trainieren, damit sie überhaupt vernünftige Texte schreiben können. Raubkopieren, Scrapen, Einscannen – alles kam zum Einsatz. Anwälte der Autoren sagen zu Recht: Die großen KI-Entwickler verhalten sich wie die Teenager in der Napster-Ära der 2000er-Jahre – nur schlimmer. Für Inhalte zahlen? Kein Bock.
Bislang kommen die KI-Unternehmen weitgehend ungeschoren davon. Zwar hat Anthropic im vergangenen Jahr 1,5 Milliarden Dollar in einem Vergleich gezahlt, nach dem Download von 500.000 Büchern aus illegalen Schattenbibliotheken. Im Grunde aber bleiben sie bei ihrer Haltung, wonach Bücher als (nahezu) kostenloser Rohstoff für das Trainieren der KI eingesetzt werden können.
Vom „größten Raub der Geschichte“ war auf den vergangenen Buchmessen die Rede. Aber es gab hierzulande auch eine gewisse Schockstarre. Man schaute nach Amerika, wo mittlerweile 145 Prozesse laufen. Zu den wichtigsten gehören die Klagen der „New York Times“ und der US-Autorengewerkschaft Authors Guild gegen Open AI. Jüngst sind noch mehr amerikanische Zeitungsverlage hinzugekommen, die den Verdacht hegen, dass ihre Artikel einfach „gescrapt“ werden – selbst wenn sie hinter einer Paywall stehen – und später fast wörtlich in Versatzstücken zur Beantwortung von Nutzeranfragen verwendet werden.
Inzwischen hat sich die Schockstarre in Deutschland gelöst. Im März hat die weltgrößte Buchverlagsgruppe Penguin Random House in München ebenfalls Klage gegen Open AI eingereicht. Im August folgte der Carlsen-Verlag. Das ist gut so.
Erste Erfolge zeigen sich: Die Musik-Verwertungsgesellschaft GEMA hat in Deutschland wichtige Etappensiege errungen, die auf die Buchbranche ausstrahlen könnten. Denn in beiden Branchen geht es um den Vorwurf, dass die KI die Inhalte auch „memorisiert“, also de facto speichert und am Ende zumindest in Versatzstücken wieder an Nutzer ausgibt.
Zu früh sollten sich die Urheber nicht freuen. Einmal Gelerntes lässt sich kaum wieder verlernen. Und was passiert, wenn US-Gerichte ganz anders urteilen als europäische? In Amerika werden die großen Modelle trainiert. Dort aber verstecken sich die KI-Anbieter hinter der „Fair-use-Doktrin“. Solange Bücher legal gekauft wurden, dürften sie auch für das KI-Training verwendet werden, lautet ihr zentrales Argument, denn KI schaffe „transformativ Neues“.
Bislang kommen sie damit durch, auch wenn jüngst ein Berufungsgericht gegen die Fair-use-Doktrin urteilte. Die Regel stammt aus der Vor-KI-Zeit. Und es macht einen Unterschied, ob etwas für wissenschaftliche oder für kommerzielle Zwecke gemacht wird. Das Trainieren mag ursprünglich experimentell wissenschaftlich gewesen sein, mittlerweile aber geht es um ein Milliardengeschäft.
Trumps Regierung hat sich schon auf die Seite der KI-Anbieter geschlagen: KI-Training mit Büchern solle grundsätzlich nicht als Urheberrechtsverletzung behandelt werden, ließ das US-Justizministerium Anfang September das Gericht wissen, das über das Sammelverfahren gegen Open AI entscheiden wird. Amerika habe ein starkes Interesse an KI, „die weltweit Maßstäbe“ setzt. Oder in Trumps Worten: „Wer KI gewinnt, gewinnt“. Man kann nur hoffen, dass sich die Richter davon nicht beeinflussen lassen.
AI outlook — possibilities, not facts
Weitere Klagen von Verlagen gegen KI-Unternehmen in den USA und Europa.
Likely · Within months
The French AI company Mistral has presented its new flagship model Large 4. With improved capabilities in programming and cybersecurity, the model aims to close the technological gap with leading competitors from the US and China.

Sam Altman, head of OpenAI, spoke to the UN Security Council in New York about the risks of artificial intelligence. He warned of a loss of control of technology and a dangerous concentration of power in a few hands.

In just 45 seconds, an unknown person manipulates a Tesla wallbox using a laptop. The malware then infects parked cars and from there spreads to other charging stations.

Kleinanzeigen.de analyzes chat messages between sellers and interested parties using AI to generate automated response suggestions. The feature is enabled by default, but can be disabled in Settings. The company emphasizes that personal data will not be used for AI training.

US President Donald Trump has introduced the AI platform America.gov, which is intended to connect citizens with US authorities via an AI agent. The platform is intended to provide access to 29,000 government websites and handle tasks such as applications, but experts warn of hallucinations and privacy concerns, particularly for immigrants and welfare.

In an attack on the Danish Central Register of Persons, unknown persons gained access to data on 8.8 million people. The legitimate access of a private company was used.