KI-Unternehmen kaufen Bücher für Trainingsdaten
KI-Unternehmen erwerben gebrauchte Bücher für das Training ihrer großen Sprachmodelle. Eine Gerichtsentscheidung erlaubt den Kauf und die Zerstörung von Büchern für KI-Training.

Unternehmen im Bereich der künstlichen Intelligenz (KI) kaufen in großem Umfang gebrauchte Bücher, um diese als Trainingsdaten für ihre großen Sprachmodelle (Large Language Models, LLMs) zu nutzen. Diese Praxis hat nach einer Gerichtsvereinbarung zu Jahresbeginn an Bedeutung gewonnen.
Die Gerichtsentscheidung legte fest, dass der Erwerb physischer Bücher und deren Aufbereitung für das KI-Training in bestimmten Fällen als "Fair Use" (faire Nutzung) gilt. Dies ermöglicht den Unternehmen den Zugang zu umfangreichen Textressourcen.
Ziel dieser Strategie ist es, den LLM-Modellen vielfältige und qualitativ hochwertige Daten zur Verfügung zu stellen, um deren Fähigkeiten im Verstehen und Generieren menschenähnlicher Sprache zu verbessern. Bücher bieten ein breites Spektrum an Wissen und Stilrichtungen.
Diese Vorgehensweise löst Diskussionen über Urheberrechtsfragen und die Beschaffung von Daten in der KI-Entwicklung aus. Die Entscheidung könnte zukünftige Praktiken bei der Sammlung von Trainingsdaten beeinflussen.