Zum Hauptinhalt Zur Navigation Zur Suche

Wegen destruktiver KI-Scans: Anna's Archive ruft zum Scannen von Büchern auf

KI-Firmen scannen und zerstören massenhaft Bücher. Die Schattenbibliothek Anna's Archive befürchtet einen Verlust von Kulturgütern.
/ Johannes Hiltscher
9 Kommentare Auf Google folgen (öffnet im neuen Fenster)
Eine Bibliothek - analog und etwas kleiner als die Bibliothek von Alexandria, das Vorbild von Anna's Archive (Bild: Erik Mclean, Pexels)
Eine Bibliothek - analog und etwas kleiner als die Bibliothek von Alexandria, das Vorbild von Anna's Archive Bild: Erik Mclean, Pexels / CC0 1.0

Am Anfang standen Vermutungen, mittlerweile ist bestätigt, dass KI-Unternehmen massenhaft alte Bücher aufkaufen. Diese werden gescannt und anschließend vernichtet.

So fällt die Nutzung nach US-Recht unter die Fair-Use-Regel, was nach Ansicht der KI-Unternehmen Probleme mit dem Urheberrecht vermeidet. Schnell wurden Sorgen vor einem Verlust seltener Bücher (g+) laut.

Damit begründet auch die weltweit größte Schattenbibliothek, Anna's Archive, ihren jüngsten Aufruf(öffnet im neuen Fenster): Nutzer sollen selbst Bücher scannen und sie dem Archiv zur Verfügung stellen. Teile des kulturellen Erbes der Menschheit drohten andernfalls von den KI-Unternehmen monopolisiert zu werden.

Digitale "Bibliothek von Alexandria"

Anna's Archive hat dabei große Ambitionen: Eine digitale Bibliothek von Alexandria solle aufgebaut werden. Es gehe um nicht weniger als die Bewahrung der menschlichen Zivilisation. So sollten originäre Texte weiterhin frei zugänglich bleiben, während KI-generierte Inhalte das Internet überschwemmten.

Die Zunahme von KI-Inhalten im frei zugänglichen Teil des Internets ist wohl auch der Grund, aus dem Unternehmen alte Bücher nutzen, um Trainingsdaten zu gewinnen. Der Umfang des kulturellen Verlusts ist dabei unklar: Viele der wahrscheinlich für das KI-Training genutzten Bücher wurden auch von den Antiquaren, die sie verkauften, als kaum bis nicht verkäuflich eingeordnet.

Anna's Archive ist allerdings umstritten, da die Schattenbibliothek gegen Urheberrechte verstößt. Das störte aber beispielsweise Nvidia nicht, das mit der Schattenbibliothek über Zugriff für sein KI-Training verhandelte. Auch Meta soll Trainingsdaten von Anna's Archive bezogen haben.


Relevante Themen