📣 Envoyez-nous votre communiqué de presse
Site mis à jour toutes les 15 minutes
Technologie

Les entreprises d'IA achètent des livres pour leurs données d'entraînement

Les entreprises d'IA acquièrent des livres d'occasion pour entraîner leurs grands modèles linguistiques. Un accord judiciaire récent permet aux entreprises d'acheter et de détruire des livres pour l'entraînement IA.

3 septembre 2026
Les entreprises d'IA achètent des livres pour leurs données d'entraînement

Les entreprises spécialisées dans l'intelligence artificielle (IA) procèdent à l'achat de livres d'occasion en grande quantité afin de les utiliser comme données d'entraînement pour leurs grands modèles linguistiques (LLM). Cette pratique a pris de l'ampleur suite à un accord transactionnel concernant le droit d'auteur conclu plus tôt cette année.

La décision de justice a établi que l'acquisition de livres physiques et leur traitement à des fins d'entraînement de l'IA sont considérés comme du "fair use" (usage équitable) dans certaines circonstances. Cela accorde aux entreprises un accès à des ressources textuelles considérables.

L'objectif de cette démarche est de fournir aux modèles LLM des données diversifiées et de haute qualité, ce qui peut améliorer leur capacité à comprendre et à générer du texte de manière similaire à celle des humains. Les livres offrent un large éventail de connaissances et de styles d'écriture.

Cette approche soulève des interrogations quant aux implications du droit d'auteur et aux méthodes d'acquisition de données dans le domaine du développement de l'IA. La décision pourrait influencer les pratiques futures de collecte de données d'entraînement.

Source originale: fastcompany.com