Amazon, autrefois libraire en ligne, détruit des livres rares pour entraîner ses modèles d’intelligence artificielle.
Ces ouvrages, dont le contenu est souvent unique et peu numérisé, représentent une source de données inestimable pour les grands modèles linguistiques (LLM). Alors que les modèles actuels ont déjà assimilé la quasi-totalité des informations disponibles en ligne, les textes rares offrent une nouvelle profondeur et une richesse lexicale inédite pour leur apprentissage.
Cette pratique, révélée par TechCrunch AI, interroge la conservation du patrimoine littéraire face aux impératifs de développement de l’IA. L’entreprise, qui a bâti son empire sur la vente de livres, se trouve désormais à la croisée des chemins entre l’accès à la connaissance et la destruction physique d’œuvres pour l’avancement technologique.
La valeur intrinsèque de ces artefacts physiques est ainsi mise en balance avec leur potentiel en tant que matière première pour l’entraînement d’intelligences artificielles toujours plus sophistiquées.
Source : TechCrunch AI