- Un tribunal fédéral américain a approuvé un accord d’environ 1,5 milliard de dollars (1.5b) dans le cadre d’un recours collectif pour atteinte au droit d’auteur lié à des livres piratés utilisés pour entraîner Claude d’Anthropic
- Anthropic versera environ 3 000 dollars par livre à des milliers d’auteurs et d’éditeurs, et des revendications de droits ont été déposées pour plus de 91 % des quelque 482 000 livres concernés
- Une décision antérieure a estimé que l’entraînement d’IA en lui-même à partir de livres protégés par le droit d’auteur n’était pas illégal, mais que l’acquisition de millions de livres sur des sites pirates était fautive
- Les plaignants qualifient cet accord de plus importante indemnisation connue en matière de droit d’auteur et prévoient de distribuer les indemnités aux participants le plus rapidement possible
- Lancée en 2024 par trois autrices et auteurs, dont Andrea Bartz, cette action devient le premier accord majeur parmi des dizaines de procès liés au droit d’auteur et à l’IA en cours devant les tribunaux
Approbation d’un accord de 1,5 milliard de dollars
- La juge fédérale de district Araceli Martínez-Olguín a approuvé un accord de recours collectif prévoyant qu’Anthropic verse environ 3 000 dollars par livre à des milliers d’auteurs
- Le montant total de l’accord est de 1,5 milliard de dollars et concerne des livres piratés utilisés pour entraîner le chatbot Claude
- Le tribunal a estimé que cet accord offrait une réparation concrète aux auteurs et éditeurs lésés
- Pour environ 91 % des quelque 482 000 livres concernés, des auteurs ou éditeurs ont revendiqué leurs droits, les rendant éligibles au paiement
Montant de l’indemnisation et procédure de paiement
- L’avocat des plaignants, Justin Nelson, a déclaré que cet accord constituait la plus importante indemnisation connue en matière de droit d’auteur
- Les plaignants prévoient de distribuer les indemnités aux membres du recours collectif le plus rapidement possible
Une décision distinguant entraînement d’IA et acquisition illégale
- Le juge fédéral de district américain à la retraite William Alsup a donné son approbation préliminaire à l’accord en septembre 2025
- Une décision antérieure a distingué l’entraînement de l’IA de l’acquisition des livres
- Elle a estimé que le fait d’entraîner un chatbot IA avec des livres protégés par le droit d’auteur n’était pas illégal en soi
- Elle a jugé fautif le fait qu’Anthropic ait acquis des millions de livres via des sites pirates
- Aparna Sridhar, vice-présidente des affaires juridiques d’Anthropic, a qualifié la décision d’importante car elle confirme que l’entraînement de l’IA à partir de livres relève du fair use (usage loyal) au regard du droit d’auteur
- L’entreprise a indiqué que plus de 91 % des auteurs et éditeurs concernés avaient revendiqué leur part du paiement, et qu’elle espérait la clôture de l’affaire
Origine et portée du procès
- L’autrice de thrillers à succès Andrea Bartz a intenté l’action initiale en 2024 avec deux autres auteurs
- Cet accord est le premier accord majeur parmi des dizaines de procès liés au droit d’auteur et à l’IA encore examinés par les tribunaux
1 commentaires
Avis sur Hacker News
Un règlement ponctuel de 1,5 milliard de dollars ne changera rien. Il faudrait légiférer pour imposer le paiement de redevances si l’IA reproduit telles quelles des idées existantes. Si un LLM peut copier instantanément ce que des humains ont créé et le transmettre à tous ses abonnés, le système doit changer
D’après le jugement, Anthropic aurait peut-être pu entrer dans un LLM même des livres piratés, si l’entreprise avait prévu de les supprimer ensuite. Le problème était qu’elle avait conservé de façon permanente des copies piratées dans une bibliothèque centrale sur ses serveurs, y compris des livres qui n’avaient pas réellement servi à l’entraînement. Les 1,5 milliard de dollars sont le règlement concernant cette bibliothèque illégale ; le fait qu’ils aient été utilisés pour l’entraînement n’est pas juridiquement pertinent en soi. Cela dit, si l’entreprise n’avait pas été une société d’IA, elle aurait très probablement conclu un accord pour un montant bien moindre
Si vous avez le temps, la réponse du juge rejetant la requête vaut la lecture
Le point important pour les éditeurs et les auteurs est que 3 000 dollars seront versés par livre éligible. Dans un contrat d’édition traditionnel avec un seul auteur, la somme est partagée à parts égales. Le juge a réduit presque de moitié les honoraires des avocats du recours collectif, de 12,5 %, soit 187,5 millions de dollars, à 6,8 %, soit 101 millions de dollars ; les frais de justice non remboursés s’élevaient à 2,6 millions de dollars. Les trois demandeurs principaux ne recevront chacun que 15 000 dollars
Cela rappelle le cas d’une personnalité bien connue de Reddit qui avait rendu des œuvres publiques sans même en tirer d’argent, et qui a fini poussée au suicide
Cela peut passer pour une théorie du complot, mais je pense qu’en explorant le réseau privé du MIT, il a peut-être découvert des faits sombres qui auraient été dévastateurs pour plusieurs personnes s’ils avaient été rendus publics. Étant donné que Jeffrey Epstein avait donné de grosses sommes au MIT et au Media Lab, il pourrait y avoir une histoire plus profonde derrière le récit dominant du « suicide »
La décision initiale du juge Alsup a estimé qu’il y avait responsabilité pour le piratage, mais que l’entraînement de LLM avec des livres relevait du fair use. Si cela vous intéresse, le jugement vaut la lecture
Je me demande pourquoi on ne les envoie pas en prison comme Kim Dotcom. Je me demande aussi pourquoi des agents fédéraux ne débarquent pas par la fenêtre de Dario. Ils ne se sont pas contentés de pirater : ils ont aussi revendu et réalisé des profits
À ceux qui estiment que seul Anthropic est en tort, j’aimerais aussi rappeler la réalité suivante : la plupart des auteurs gagnent moins que le revenu médian et ont un revenu annuel inférieur à 20 000 dollars. Les éditeurs versent une avance, puis ne reversent rien de plus aux auteurs tant que les revenus des ventes ne l’ont pas entièrement compensée ; la plupart n’atteignent jamais ce seuil.
Il pourrait être préférable que les éditeurs paient suffisamment les auteurs et leur commandent un livre tous les deux ou trois ans. Les données correspondantes sont disponibles dans l’enquête de l’Authors Guild
Beaucoup de livres ne récupèrent même pas leur avance ; si les auteurs n’avaient touché que des royalties, ils auraient probablement gagné encore moins. Augmenter les avances réduirait le nombre de contrats, car les ressources financières sont limitées. On considère que tout le monde peut écrire, donc l’offre est illimitée, mais la demande est très restreinte. Les données du lien montrent aussi que le revenu médian des auteurs passés par un éditeur est supérieur à celui des auteurs autoédités, ce qui indique que les éditeurs augmentent aussi la valeur économique des auteurs. Au final, la plupart des livres sombrent sans grande valeur économique, comme dans la musique ou le cinéma ; dire simplement « payez davantage les auteurs » n’est donc pas la solution
Si un particulier avait fait la même chose, il irait en prison ; quand c’est une entreprise, elle semble ne payer qu’une petite amende et recevoir une autorisation d’engloutir encore plus de contenus
Le point essentiel n’est pas que les livres aient été utilisés pour entraîner Claude, mais qu’il s’agissait de copies piratées
books3 a été créé pour clarifier si les entreprises d’IA pouvaient entraîner leurs modèles sur des livres. Il était peu probable que la conclusion soit « le piratage est autorisé si c’est uniquement pour l’entraînement », mais cela aurait permis à des hackers individuels d’entraîner leurs propres modèles d’IA, à condition d’avoir assez de ressources de calcul. Ces ressources peuvent par exemple être obtenues via Google TRC. Désormais, tout travail significatif nécessite des dizaines de millions de dollars. J’ai entendu dire qu’Eleuther avait un temps rassemblé des données d’entraînement du domaine public ; je me demande s’ils ont constitué un corpus assez vaste pour réduire l’importance de l’entraînement sur des livres
Les seigneurs des LLM actuels volent en pratique la somme des connaissances humaines, puis exigent le droit de la revendre au prix qu’ils fixent. Quand ils ont exposé leur objectif pour la première fois, ils auraient dû être rejetés par la société et se retrouver sans le sou, mais il y a trop de riches qui détestent les humains et veulent un monde où des esclaves informatiques exécutent leurs ordres
Ils semblent avoir oublié de consulter la MPAA et la RIAA avant de régler cette affaire. 3 000 dollars par livre, c’est ridicule. Je me demande combien c’était par chanson dans l’affaire Napster
Dans les rares affaires où les personnes refusaient l’accord et allaient au procès, elle choisissait environ 15 morceaux parmi plus de 1 000 pour fonder sa demande. Les dommages-intérêts légaux étant d’au minimum 750 dollars par œuvre violée, cela représentait environ 3 à 5 fois l’offre d’accord initiale. La plupart finissaient par négocier sérieusement avec la RIAA après que leurs avocats leur avaient expliqué qu’ils n’avaient aucune chance. Les très rares qui ont refusé jusqu’au bout ont très mal mené leur procès, ont été condamnés à des montants bien supérieurs au minimum, et ont connu une issue défavorable après avoir continué à se battre alors même que la RIAA leur proposait un montant inférieur
Cet accord renforce à plusieurs égards la motivation d’Anthropic à entrer en Bourse. La structure même de l’accord suppose la survie d’Anthropic : les 1,5 milliard de dollars seront versés en plusieurs fois, et les honoraires des avocats suivront le même calendrier.
Les plaignants du recours collectif deviennent de fait des créanciers d’Anthropic, et ont directement intérêt à ce que l’entreprise reste solvable pendant toute la période de paiement. L’objectif d’un procès civil est d’indemniser les victimes ; un jugement assez lourd pour mettre le payeur en faillite aurait certainement rendu la situation des auteurs encore plus défavorable