AI-företag köper böcker för träningsdata
AI-företag skaffar begagnade böcker för att träna sina stora språkmodeller. Företag kan köpa och förstöra böcker för AI-träning efter en domstolsförlikning.

AI-företag köper stora mängder begagnade böcker för att använda dem som träningsdata för sina stora språkmodeller (LLM). Denna strategi blev aktuell efter en upphovsrättsförlikning som ingicks tidigare i år.
Ett domstolsbeslut fastslog att köp av fysiska böcker och deras användning för AI-träning, inklusive potentiell förstörelse, i vissa fall betraktas som "rimligt bruk". Detta ger företagen tillgång till omfattande textmaterial.
Syftet med strategin är att förse LLM-modellerna med mångsidig och högkvalitativ data, vilket kan förbättra deras förmåga att förstå och generera mänskligt språk. Bokinnehåll erbjuder ett brett spektrum av information och stilar.
Åtgärderna väcker dock debatt om upphovsrätt och metoder för datainsamling inom AI-utveckling. Beslutet påverkar hur data samlas in för framtida AI-träning.