Tech

L'accord historique de 1,5 milliard de dollars d'Anthropic sur le droit d'auteur reçoit son approbation finale

TechCrunchil y a 9 h
Un marteau de juge posé sur une pile de livres de droit
Un marteau de juge posé sur une pile de livres de droitPhoto: KATRIN BOLOVTSOVA / Pexels

Un tribunal fédéral américain a accordé son approbation définitive à l'accord de 1,5 milliard de dollars conclu par Anthropic pour résoudre les accusations selon lesquelles l'entreprise d'IA aurait utilisé sans autorisation des livres protégés par le droit d'auteur pour entraîner ses modèles Claude, mettant ainsi fin à l'un des litiges juridiques les plus suivis nés de l'essor de l'IA générative. Cet accord, annoncé pour la première fois l'an dernier, figure parmi les plus importants règlements rendus publics par une entreprise d'IA concernant des accusations liées aux données d'entraînement.

L'affaire portait sur des allégations, formulées par un groupe d'auteurs, selon lesquelles Anthropic aurait utilisé des copies piratées ou autrement non autorisées de livres, y compris des œuvres obtenues auprès de bibliothèques dites fantômes hébergeant du contenu protégé sans accord de licence, dans le cadre des vastes jeux de données textuelles servant à entraîner ses grands modèles de langage. Les plaignants faisaient valoir que cette pratique constituait une violation du droit d'auteur à une échelle susceptible de toucher potentiellement des centaines de milliers d'œuvres individuelles.

Selon les termes de l'accord, Anthropic a accepté de verser la somme de 1,5 milliard de dollars pour indemniser les auteurs et titulaires de droits dont les œuvres ont été utilisées sans autorisation, sans pour autant reconnaître de faute dans le cadre de cet accord, une structure courante dans les grands règlements amiables d'entreprise qui permet de mettre fin à un litige sans constat formel de responsabilité par un tribunal. L'entreprise a indiqué que cet accord lui permettait de se concentrer sur le développement de ses produits plutôt que sur un contentieux prolongé.

Un juge fédéral chargé de l'affaire avait auparavant rendu une décision préliminaire qui avait suscité une attention considérable dans l'ensemble du secteur de l'IA, distinguant l'utilisation de livres légalement acquis pour l'entraînement de l'IA, que le juge suggérait pouvoir potentiellement relever du fair use, de l'utilisation de copies piratées, jugée avec bien plus de scepticisme. Cette distinction a été largement citée par les analystes juridiques comme un signal précoce de la manière dont les tribunaux pourraient aborder la vague plus large de litiges sur le droit d'auteur liés à l'IA encore en cours d'examen.

Cette affaire fait partie de plusieurs grands procès intentés contre des entreprises d'IA par des auteurs, éditeurs, organes de presse et autres créateurs de contenu depuis que le lancement de ChatGPT et d'outils similaires a déclenché une vague de contestations juridiques sur la manière dont les grands modèles de langage sont entraînés. D'autres litiges majeurs, impliquant notamment OpenAI, Meta et Stability AI, restent non résolus et progressent en parallèle devant les tribunaux, chacun testant des théories juridiques légèrement différentes sur le fair use, le préjudice de marché et la manière précise dont les données d'entraînement ont été obtenues.

Les analystes du secteur notent qu'un règlement de cette ampleur, bien qu'énorme en valeur absolue, a peu de chances d'être perçu par les entreprises d'IA comme un frein suffisamment dissuasif pour modifier largement leurs pratiques d'entraînement, compte tenu de l'ampleur des revenus et des investissements affluant vers le secteur. Certains observateurs juridiques estiment que les conséquences les plus déterminantes viendront des procès en cours susceptibles de produire des décisions d'appel contraignantes sur la question sous-jacente du fair use, plutôt que de règlements amiables qui résolvent des litiges individuels sans établir de jurisprudence générale.

Les associations de défense des auteurs impliquées dans le litige ont qualifié cet accord de reconnaissance importante que les entreprises d'IA ne peuvent pas traiter les œuvres créatives protégées comme un matériau d'entraînement librement disponible, tout en avertissant qu'un paiement en numéraire n'établit pas à lui seul un cadre juridique durable régissant la manière dont les entreprises d'IA devraient à l'avenir accorder des licences ou indemniser l'utilisation de contenu protégé.

Anthropic, aux côtés d'autres grands laboratoires d'IA, a parallèlement poursuivi des accords de licence directement avec des éditeurs et des détenteurs de contenu, une tendance que les observateurs du secteur interprètent comme une tentative de prévenir de nouveaux litiges en établissant des conditions négociées pour l'utilisation des données avant que les différends n'atteignent les tribunaux. L'ampleur et les modalités de tels accords varient considérablement et sont rarement divulguées dans le détail.

Ce règlement ne résout pas les questions réglementaires ou législatives plus larges relatives à l'IA et au droit d'auteur, qui restent d'actualité dans plusieurs juridictions, notamment les débats en cours au Congrès américain et dans diverses instances internationales sur la question de savoir si le droit d'auteur existant traite adéquatement l'utilisation d'œuvres créatives dans l'entraînement de systèmes d'apprentissage automatique, ou si une nouvelle législation est nécessaire.

Pour l'heure, cette approbation referme un chapitre important de l'histoire juridique d'Anthropic, mais le paysage juridique plus large entourant les données d'entraînement de l'IA reste incertain, les tribunaux, les législateurs et le secteur de l'IA lui-même continuant de déterminer quelles règles, le cas échéant, devraient régir la manière dont les modèles sont construits à partir des vastes trésors de textes, d'images et d'autres contenus créatifs disponibles en ligne.

Cet article est un résumé éditorial assisté par IA basé sur TechCrunch. L'image est une photo d'archive de KATRIN BOLOVTSOVA sur Pexels.

À lire ensuite

Rangées de baies de serveurs illuminées dans un centre de données
Plus dans Tech

Les essaims d'agents expliqués : comment l'exécution simultanée de nombreux modèles d'IA transforme l'économie des coûts

Un nombre croissant d'outils de codage par IA déploient désormais des dizaines d'agents IA travaillant en parallèle sur une tâche, plutôt que de s'appuyer sur un seul modèle. Voici ce qu'est réellement un « essaim d'agents », pourquoi cela change le calcul des coûts liés au développement logiciel assisté par IA, et quels compromis il introduit.

Hacker News
Des rangées de colis en carton empilés dans un entrepôt d'expédition
Tech

AliExpress écope d'une amende record de 625 millions de dollars de l'UE pour des jouets et cosmétiques dangereux

L'Union européenne a infligé à AliExpress une amende record de 625 millions de dollars en vertu de son règlement sur les services numériques, après que la place de marché en ligne n'a pas retiré des annonces de jouets dangereux et de cosmétiques nocifs malgré des avertissements répétés. L'entreprise dit être choquée par l'ampleur de la sanction.

Ars Technicail y a 9 h
Un afficheur numérique de cours boursiers montrant des chiffres en hausse et en baisse
Tech

SpaceX dans votre fonds indiciel, expliqué

Les fonds indiciels sont présentés comme l'un des moyens d'investissement les plus sûrs et les plus passifs, répartissant le risque sur l'ensemble du marché plutôt que de miser sur des entreprises individuelles. Alors que SpaceX se dirige vers une introduction en bourse à une valorisation d'environ 1 770 milliards de dollars, les investisseurs ordinaires en fonds indiciels pourraient finir par en détenir une part, qu'ils l'aient voulu ou non.

The Vergeil y a 9 h