IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)
Navigation

Inscrivez-vous gratuitement
pour pouvoir participer, suivre les réponses en temps réel, voter pour les messages, poser vos propres questions et recevoir la newsletter

  1. #41
    Communiqués de presse

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Avril 2025
    Messages
    866
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Paris (Île de France)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Avril 2025
    Messages : 866
    Par défaut La start-up spécialisée dans l'IA Anthropic a réglé un recours collectif pour violation du droit d'auteur
    Anthropic a réglé un recours collectif pour violation du droit d'auteur, dans lequel des auteurs accusaient l'entreprise d'avoir entraîné ses modèles d'IA à partir de leurs œuvres sans leur autorisation.

    La start-up spécialisée dans l'IA Anthropic a réglé un recours collectif pour violation du droit d'auteur, dans lequel des auteurs accusaient l'entreprise d'avoir entraîné ses modèles d'IA à partir de leurs œuvres sans leur autorisation. Anthropic, qui a formé son assistant IA Claude à l'aide de livres protégés par le droit d'auteur, a été poursuivie en justice par les auteurs Andrea Bartz, Charles Graeber et Kirk Wallace en août 2024.

    Une action en justice contre Anthropic révèle la façon dont l'entreprise a détruit des millions de livres imprimés dans le seul but de former son IA Claude. Anthropic a retiré la reliure des livres, les a numérisés en fichiers numériques et a jeté les originaux. Cette numérisation destructrice a joué en sa faveur : le juge a estimé que cela relève de l'usage loyal, car les livres achetés ont été transformés, utilisés en interne, sans création de nouveaux exemplaires. Mais l'affaire se complique : Anthropic a aussi téléchargé plus de 7 millions de livres numériques piratés. Pour ces copies pirates, Anthropic doit faire face à un procès pour des dommages-intérêts.

    Début août, un juge fédéral américain vient de certifier la plus grande action collective jamais intentée pour violation du droit d’auteur contre une entreprise technologique. La cible : Anthropic, créatrice du modèle Claude, accusée d’avoir bâti une partie de son succès sur des données issues d’une massive bibliothèque de livres piratés. Derrière cette affaire se joue un débat fondamental : l’IA peut-elle prospérer sur la base d’une appropriation massive de contenus protégés ? Et si la justice tranche sévèrement, l’impact pourrait être dévastateur non seulement pour Anthropic, mais pour l’ensemble du secteur.

    Dans ce contexte, Anthropic a réglé un recours collectif pour violation du droit d'auteur, dans lequel des auteurs accusaient l'entreprise d'avoir entraîné ses modèles d'IA à partir de leurs œuvres sans leur autorisation, selon un document judiciaire. Basée à San Francisco, Anthropic, qui a formé son assistant IA Claude à l'aide de livres protégés par le droit d'auteur, a été poursuivie en justice par les auteurs Andrea Bartz, Charles Graeber et Kirk Wallace en août 2024.


    En juin dernier, le juge fédéral américain William Alsup a statué que les modèles d'IA pouvaient légalement apprendre à partir de livres protégés par le droit d'auteur sans le consentement des auteurs. Cette décision a constitué une victoire partielle pour Anthropic. Alsup a estimé que cette utilisation était « extrêmement transformative » et « équitable », même si l'entreprise avait peut-être enfreint la loi en piratant une grande partie de ses sources. Selon le dossier déposé devant la Cour d'appel des États-Unis pour le 9e circuit, la société technologique et les auteurs concernés ont demandé à la cour de suspendre la procédure pendant qu'ils finalisent l'accord de règlement.

    La doctrine de l'« usage loyal », qui autorise la reproduction limitée de matériel protégé par le droit d'auteur sans consentement dans certaines circonstances, est un élément clé de la défense des sociétés d'IA contre les plaintes pour violation du droit d'auteur. « Cet accord historique profitera à tous les membres du groupe », a déclaré Justin Nelson, associé chez Susman Godfrey et avocat des auteurs. « Nous sommes impatients d'annoncer les détails de l'accord dans les semaines à venir. »

    Alsup avait initialement ordonné que l'affaire soit jugée en décembre afin de déterminer le montant des dommages-intérêts à verser pour piratage. Si l'affaire avait été jugée, les dommages-intérêts auraient pu atteindre 150 000 dollars par cas de violation délibérée du droit d'auteur et auraient pu coûter des milliards à la start-up. Début août, l'entreprise d'IA a tenté de faire appel, mais sa demande a été rejetée.

    Anthropic, fondée par d'anciens employés d'OpenAI et soutenue par Amazon, a piraté au moins 7 millions de livres provenant de Books3, Library Genesis et Pirate Library Mirror, des bibliothèques en ligne contenant des copies non autorisées d'ouvrages protégés par le droit d'auteur, afin de former son logiciel, selon le juge. Elle a également acheté des millions d'exemplaires imprimés en gros, en a retiré la reliure, en a découpé les pages et les a numérisées sous forme numérique et lisible par machine, ce que le juge Alsup a estimé relever du fair use, selon la décision du juge.

    « La simple conversion d'un livre imprimé en fichier numérique pour gagner de la place et permettre la recherche était transformatrice pour cette seule raison », a-t-il écrit. Anthropic a ensuite acheté les livres qu'elle avait initialement piratés. Alsup a déclaré que ces achats n'absolraient pas la société, mais qu'ils pouvaient réduire les dommages-intérêts.

    Cet accord intervient alors que de nombreuses autres affaires de violation du droit d'auteur contre des sociétés d'IA sont portées devant les tribunaux à travers le pays. Tout récemment, Walt Disney Co. et Universal Pictures ont poursuivi en justice la société d'intelligence artificielle Midjourney, que les studios accusent d'avoir entraîné ses modèles de génération d'images sur leurs contenus protégés par le droit d'auteur.

    Un autre exemple de cette situation, en 2023, Jane Friedman, journaliste, auteure et professeure, a découvert sur Amazon et Goodreads une demi-douzaine de livres frauduleux portant son nom, probablement remplis de contenu généré par l’intelligence artificielle (IA). Ces livres traitaient de sujets similaires à ceux qu’elle aborde dans ses ouvrages, comme l’écriture, la publication et la promotion de livres électroniques. Elle a demandé à Amazon et à Goodreads de retirer ces faux titres de leurs sites, mais elle s’est heurtée à des difficultés et à des résistances. Ce n'est que quand la plainte de Jane Friedman est devenue virale sur internet que les deux plateformes ont décidé de retirer lesdits livres.

    Source : Juge fédéral américain William Alsup

    Et vous ?

    Pensez-vous que cette décision est crédible ou pertinente ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    Anthropic remporte une victoire importante au sujet de « l'usage loyal » pour les plateformes d'IA, mais fait face à un procès pour des dommages-intérêts portant sur des millions d'œuvres piratées

    Disney et Universal intentent le premier procès majeur contre une entreprise spécialisée dans la génération d'images par IA, Midjourney, pour violation du droit d'auteur, affirmant : "C'est du vol"

    OpenAI déclare la course à l'IA « terminée » si l'entraînement sur des œuvres protégées par le droit d'auteur n'est pas considéré comme une utilisation équitable, ajoutant que les États-Unis seraient perdants
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  2. #42
    Communiqués de presse

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Avril 2025
    Messages
    866
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Paris (Île de France)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Avril 2025
    Messages : 866
    Par défaut Anthropic a accepté de verser 1,5 milliard de $ pour régler un procès pour vol d'œuvres protégées
    Anthropic a accepté de verser 1,5 milliard de $ pour régler un procès pour vol d'œuvres protégées par le droit d'auteur afin d'entraîner ses modèles d'IA, le plus important recouvrement de droits d'auteur

    La société d'intelligence artificielle (IA) Anthropic a accepté de verser 1,5 milliard de dollars pour régler un recours collectif intenté par des auteurs qui affirmaient que l'entreprise avait volé leurs œuvres pour entraîner ses modèles d'IA. Selon les avocats des auteurs, cet accord, qui doit être approuvé par le juge fédéral américain William Alsup, serait le plus important recouvrement de droits d'auteur jamais rendu public. Anthropic a déclaré que l'accord « résoudrait les réclamations restantes des plaignants ».

    En août 2025, un juge fédéral américain a certifié la plus vaste class action jamais intentée pour violation du droit d’auteur contre une entreprise technologique. La cible : Anthropic, créatrice du modèle Claude, accusée d’avoir bâti une partie de son succès sur des données issues d’une massive bibliothèque de livres piratés. Derrière cette affaire se joue un débat fondamental : l’IA peut-elle prospérer sur la base d’une appropriation massive de contenus protégés ? Et si la justice tranche sévèrement, l’impact pourrait être dévastateur non seulement pour Anthropic, mais pour l’ensemble du secteur.

    Récemment, pour régler ce recours collectif intenté par des auteurs, la société d'intelligence artificielle (IA) Anthropic a accepté de verser 1,5 milliard de dollars. Selon les avocats des auteurs, cet accord, qui doit être approuvé par le juge fédéral américain William Alsup, serait le plus important recouvrement de droits d'auteur jamais rendu public. Il intervient deux mois après que le juge Alsup a estimé que l'utilisation de livres pour entraîner l'IA ne violait pas la loi américaine sur le droit d'auteur, mais a ordonné à Anthropic de comparaître devant les tribunaux pour son utilisation de matériel piraté.

    Anthropic a déclaré que l'accord « résoudrait les réclamations restantes des plaignants ». Cet accord intervient alors que d'autres grandes entreprises technologiques, notamment OpenAI, le fabricant de ChatGPT, Microsoft et Meta, la société mère d'Instagram, font l'objet de poursuites judiciaires pour des violations similaires présumées du droit d'auteur.

    Anthropic, avec son chatbot Claude, se présente depuis longtemps comme l'alternative éthique parmi ses concurrents. « Nous restons déterminés à développer des systèmes d'IA sûrs qui aident les personnes et les organisations à étendre leurs capacités, à faire progresser la découverte scientifique et à résoudre des problèmes complexes », a déclaré Aparna Sridhar, directrice juridique adjointe chez Anthropic, qui est soutenue à la fois par Amazon et Alphabet, la société mère de Google.


    Le procès a été intenté contre Anthropic l'année dernière par Andrea Bartz, auteur à succès de thrillers policiers, dont les romans incluent We Were Never Here, ainsi que Charles Graeber, auteur de The Good Nurse, et Kirk Wallace Johnson, auteur de The Feather Thief. Ils ont accusé l'entreprise d'avoir volé leurs œuvres pour entraîner son chatbot Claude AI afin de bâtir une entreprise valant plusieurs milliards de dollars.

    Selon la décision rendue en juin par le juge Alsup, l'entreprise détient plus de sept millions de livres piratés dans une bibliothèque centrale et encourt jusqu'à 150 000 dollars de dommages et intérêts par œuvre protégée par le droit d'auteur. Sa décision a été l'une des premières à se prononcer sur la manière dont les grands modèles de langage (LLM) peuvent légitimement apprendre à partir de documents existants.

    Il a estimé que l'utilisation des livres des auteurs par Anthropic était « extrêmement transformative » et donc autorisée par la loi américaine. Mais il a rejeté la demande d'Anthropic de classer l'affaire. Anthropic devait être jugée en décembre pour avoir utilisé des copies piratées afin de constituer sa bibliothèque de documents. Entre temps, Anthropic a annoncé réviser ses Conditions générales et sa Politique de confidentialité.

    Désormais, les données issues des conversations des utilisateurs de Claude pourront être utilisées pour entraîner les modèles — sauf en cas de refus explicite. Une décision qui a marqué une rupture par rapport à la politique originelle d’Anthropic, qui affirmait vouloir limiter au maximum la collecte et l’usage des données, se différenciant ainsi de certains concurrents comme OpenAI. Pour beaucoup d’observateurs, il s’agit d’un tournant stratégique, dicté à la fois par la nécessité de rester compétitif et par les exigences financières colossales que représente l’entraînement des modèles de nouvelle génération.

    Les avocats des plaignants ont qualifié l'accord annoncé de « premier du genre à l'ère de l'IA ». « Il offrira une compensation significative pour chaque œuvre collective et créera un précédent obligeant les entreprises d'IA à rémunérer les titulaires de droits d'auteur », a déclaré l'avocat Justin Nelson, qui représente les auteurs. « Cet accord envoie un message fort aux entreprises d'IA et aux créateurs, leur indiquant qu'il est répréhensible de s'approprier des œuvres protégées par le droit d'auteur provenant de ces sites web pirates. »

    Selon Alex Yang, professeur de sciences de gestion et d'opérations à la London Business School, cet accord pourrait encourager une plus grande coopération entre les développeurs d'IA et les créateurs. « Vous avez besoin de ces nouvelles données d'entraînement provenant d'êtres humains », a déclaré Yang. « Si vous voulez accorder davantage de droits d'auteur aux contenus créés par l'IA, vous devez également renforcer les mécanismes qui rémunèrent les humains pour leurs contributions originales. »

    Cette décision intervient après qu'Anthropic a obtenu un financement de série F de 13 milliards de dollars, portant sa valorisation post-financement à 183 milliards de dollars, un montant extraordinaire. Le dernier tour de table, annoncé le 2 septembre 2025, marque l'un des plus importants investissements dans le secteur de l'intelligence artificielle à ce jour et consolide la position d'Anthropic en tant que leader mondial de l'innovation en matière d'IA.

    Et vous ?

    Pensez-vous que cet accord est crédible ou pertinent ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    Anthropic a acheté, découpé et numérisé des millions de livres physiques avant de détruire les originaux, dans le seul but d'entraîner son IA Claude. Il a également téléchargé 7 millions de livres piratés

    OpenAI déclare la course à l'IA « terminée » si l'entraînement sur des œuvres protégées par le droit d'auteur n'est pas considéré comme une utilisation équitable, ajoutant que les États-Unis seraient perdants

    Un juge fédéral américain se prononce sur l'argument de Meta concernant l'utilisation équitable des droits d'auteur sur l'IA : "Vous anéantissez le marché pour le travail de cette personne"
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  3. #43
    Membre confirmé
    Homme Profil pro
    Développeur en systèmes embarqués
    Inscrit en
    Mai 2015
    Messages
    678
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Âge : 55
    Localisation : Belgique

    Informations professionnelles :
    Activité : Développeur en systèmes embarqués

    Informations forums :
    Inscription : Mai 2015
    Messages : 678
    Par défaut C'est une bonne chose... Mais...
    Oui, c'est une bonne chose, personne n'aime voir son travail être "voler", qui plus est pour en tirer profit...

    Mais...

    • qui va récolter cet argent ?
    • qui va le recevoir ? Cela m'étonnerait que les créateurs d'origine s'y retrouvent.
    • qui va décider de cette répartition ? Un livre de 100 pages peut avoir une valeur bien plus grand que toute une série d'autres bouquins.
    • comment va être décidé cette répartition ?
    • comment et qui va "surveiller" cela ?
    • comment "savoir" quel IA a utilisé "quoi" ?
    • ...


    Pourquoi faire une "exception" avec l'IA ? L'idée d'admettre qu'il faut régler les choses "une fois le mal fait" est dangereux, il ne faudrait pas pendre avant et juger après... Tous les "créateurs de valeurs" n'ont pas forcément les moyens de se défendre.

    Les entreprises qui "exploitent" le travail d'autres devraient "négocier" avec le créateur d'origine avant d'utiliser son œuvre. Ce serait une bonne chose, même pour ces entreprises, qui n'utiliseraient plus tout et n'importe quoi pour alimenter leur IA.

    Et si tout cela n'est pas "techniquement" faisable et "ralentirait" le développement de l'IA, alors il faut que ces même entreprises dévoilent comment travaillent leurs IAs, ce qui permettrait à d'autres de développer de "meilleurs IA".

    Le "code" d'une IA utilisant des données "volées" devrait automatiquement être rendue public. Ce serait la moindre des choses. Parce qu'actuellement, ces entreprises 'trouvent" normal d'alimenter leur IA avec le travail d'autrui, mais font tout pour "garder secret" comment leur IA fonctionne...

    Ce n'est que mon avis, chacun pense ce qu'il veut, bien entendu.

    BàV et Peace & Love.

  4. #44
    Communiqués de presse

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Avril 2025
    Messages
    866
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Paris (Île de France)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Avril 2025
    Messages : 866
    Par défaut Un juge rejette l'accord à 1,5 milliard de dollars conclu par Anthropic AI concernant les droits d'auteur
    Un juge rejette l'accord à 1,5 milliard de dollars conclu par Anthropic concernant un recours collectif sur les droits d'auteur de près d'un demi-million de livres piratés pour former des chatbots

    Un juge fédéral a récemment rejeté l'accord à 1,5 milliard de dollars entre Anthropic et les auteurs qui affirment que près d'un demi-million de livres ont été piratés illégalement pour former des chatbots, laissant planer le spectre d'un éventuel procès. Après avoir passé près d'une heure à critiquer un accord qu'il estime semé d'embûches, le juge fédéral William Alsup a fixé une nouvelle audience à San Francisco le 25 septembre afin d'examiner si ses préoccupations avaient été prises en compte.

    Début septembre,la société d'intelligence artificielle (IA) Anthropic a accepté de verser 1,5 milliard de dollars pour régler un recours collectif intenté par des auteurs qui affirmaient que l'entreprise avait volé leurs œuvres pour entraîner ses modèles d'IA. Selon les avocats des auteurs, cet accord, qui doit être approuvé par le juge fédéral américain William Alsup, serait le plus important recouvrement de droits d'auteur jamais rendu public. Anthropic a déclaré que l'accord « résoudrait les réclamations restantes des plaignants ».

    Cependant, le juge fédéral a récemment rejeté l'accord à 1,5 milliard de dollars entre Anthropic et les auteurs qui affirment que près d'un demi-million de livres ont été piratés illégalement pour former des chatbots, laissant planer le spectre d'un éventuel procès. Après avoir passé près d'une heure à critiquer un accord qu'il estime semé d'embûches, le juge fédéral William Alsup a fixé une nouvelle audience à San Francisco le 25 septembre afin d'examiner si ses préoccupations avaient été prises en compte.

    « Nous verrons si je peux me résoudre à l'approuver », a déclaré Alsup avant de lever l'audience. Le juge Alsup avait rendu en juin un jugement mitigé dans cette affaire, estimant que la formation des chatbots IA à partir de livres protégés par le droit d'auteur n'était pas illégale, mais qu'Anthropic avait acquis de manière illicite des millions de livres sur des sites web pirates afin d'améliorer son chatbot Claude.

    Les doutes du juge sont apparus quelques jours seulement après qu'Anthropic et les avocats qui ont intenté le recours collectif aient annoncé un accord à 1,5 milliard de dollars visant à résoudre les accusations de piratage et à éviter un procès qui devait débuter en décembre. L'accord proposé prévoit de verser aux auteurs et aux éditeurs environ 3 000 dollars pour chacun des livres couverts par l'accord.


    Justin Nelson, l'avocat des auteurs, a déclaré à Alsup qu'environ 465 000 livres figuraient sur la liste des œuvres piratées par Anthropic. Le juge a déclaré qu'il avait besoin de garanties plus solides que ce nombre n'augmenterait pas, afin de s'assurer que l'entreprise ne soit pas prise au dépourvu par d'autres poursuites judiciaires « sortant de nulle part ». Le juge a fixé au 15 septembre la date limite pour la remise d'une « liste définitive » du nombre total de livres piratés.

    La principale préoccupation d'Alsup portait sur la manière dont le processus de réclamation serait géré afin de s'assurer que toutes les personnes éligibles en soient informées et que les auteurs ne soient pas « lésés ». Il a fixé au 22 septembre la date limite pour le dépôt des formulaires de réclamation qu'il examinera avant l'audience du 25 septembre afin de réexaminer l'accord. Le juge a également fait part de ses inquiétudes concernant deux grands groupes liés à l'affaire, l'Authors Guild et l'Association of American Publishers, qui agissent « en coulisses » de manière à faire pression sur certains auteurs pour qu'ils acceptent l'accord sans le comprendre pleinement.

    La PDG de l'Authors Guild, Mary Rasenberger, et la PDG de l'Association of American Publishers, Maria Pallante, ont toutes deux assisté à l'audience, mais n'ont pas pris la parole. Le trio d'auteurs - la romancière Andrea Bartz et les auteurs de non-fiction Charles Graeber et Kirk Wallace Johnson - qui a intenté un procès l'année dernière était également assis au premier rang de la tribune du tribunal, mais ne s'est pas adressé à Alsup. Avant l'audience, Johnson, auteur de « The Feather Thief » et d'autres livres, a décrit l'accord comme « le début d'un combat au nom des humains qui ne croient pas que nous devions tout sacrifier sur l'autel de l'IA ».

    Nelson, l'avocat des auteurs, a tenu à assurer à Alsup que lui-même et les autres avocats chargés de l'affaire étaient convaincus que l'argent serait réparti équitablement, car l'affaire a été largement couverte par les médias, certains articles faisant la une des grands journaux. « Il ne s'agit pas d'une affaire de garantie passée inaperçue », a déclaré Nelson. Alsup a toutefois clairement indiqué qu'il se méfiait de l'accord et a averti qu'il pourrait décider de laisser l'affaire aller en procès. « Je suis mal à l'aise avec tous ces parasites qui se cachent dans l'ombre », a déclaré le juge.

    Cette affaire est suivie de près par l'industrie de l'IA. En effet, derrière cette affaire se joue un débat fondamental : l’IA peut-elle prospérer sur la base d’une appropriation massive de contenus protégés ? Et si la justice tranche sévèrement, l’impact pourrait être dévastateur non seulement pour Anthropic, mais pour l’ensemble du secteur. Si le jugement final confirme la culpabilité d’Anthropic, l’industrie pourrait entrer dans une ère de purge, où seuls les acteurs capables d’investir massivement dans l’achat de données survivront. Dans ce scénario, l’IA perdrait peut-être en diversité et en innovation, mais gagnerait en légitimité et en respect du droit d’auteur.

    Pourtant, Dario Amodei, cofondateur et PDG d'Anthropic, avait déclaré en janvier que l'IA pourrait surpasser les capacités humaines dans presque tous les domaines dans un avenir très proche. Il a ajouté que « les progrès sont vraiment aussi rapides que les gens le pensent ». Le chercheur a également déclaré que cette évolution permettrait à l'industrie de fabriquer de meilleurs robots, tout en forçant l'humanité à redéfinir la manière dont l'économie mondiale est organisée. Toutefois, son point de vue était controversé et qualifié d'argument marketing.

    Source : Le juge fédéral William Alsup

    Et vous ?

    Pensez-vous que cette décision est crédible ou pertinente ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    Anthropic remporte une victoire importante au sujet de « l'usage loyal » pour les plateformes d'IA, mais fait face à un procès pour des dommages-intérêts portant sur des millions d'œuvres piratées

    Les entreprises d'IA affirment qu'elles ne peuvent pas respecter les droits d'auteur mais ces chercheurs ont essayé, démontrant que former des modèles d'IA puissants sans enfreindre la loi, c'est possible

    Plus de 13 500 artistes se mobilisent pour dénoncer l'exploitation de leurs œuvres par les entreprises d'IA sans leur consentement. L'initiative met en lumière les pratiques controversées dans l'industrie
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  5. #45
    Invité de passage
    Homme Profil pro
    Webmaster
    Inscrit en
    Septembre 2025
    Messages
    10
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Âge : 40
    Localisation : France, Bouches du Rhône (Provence Alpes Côte d'Azur)

    Informations professionnelles :
    Activité : Webmaster

    Informations forums :
    Inscription : Septembre 2025
    Messages : 10
    Par défaut oui
    oui normal qu'il l'ai rejeté

  6. #46
    Inactif  

    Homme Profil pro
    Administrateur de base de données
    Inscrit en
    Mars 2013
    Messages
    10 084
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Canada

    Informations professionnelles :
    Activité : Administrateur de base de données

    Informations forums :
    Inscription : Mars 2013
    Messages : 10 084
    Par défaut Comment Anthropic a créé Claude avec le Projet Panama : achat de livres physiques, section des reliures
    Comment Anthropic a créé Claude avec le Projet Panama : achat de livres physiques, section des reliures, scans des pages
    afin d'enrichir son IA avec une matière textuelle jugée plus « noble » que le flux chaotique du web

    Derrière les discours policés sur « l'intelligence artificielle responsable », des documents judiciaires récemment rendus publics dévoilent une réalité beaucoup plus brute : une industrie lancée dans une course effrénée pour absorber l’ensemble du patrimoine écrit mondial. Achat massif de livres papier, découpe industrielle, numérisation à grande échelle, mais aussi téléchargements de bibliothèques pirates : l’affaire dite Project Panama éclaire d’un jour cru la façon dont les grands acteurs de l’IA ont construit leurs modèles. Et pose, frontalement, la question du prix réel de l’innovation.

    Au cœur du dossier se trouve Anthropic, start-up devenue en quelques années l’un des piliers de l’IA générative. Selon des documents internes révélés dans le cadre d’un contentieux judiciaire, l’entreprise a lancé début 2024 un projet tenu volontairement secret : acheter des millions de livres physiques, en sectionner les reliures, scanner chaque page, puis recycler les ouvrages. L’objectif affiché en interne était clair : enrichir les modèles d’IA, notamment Claude, avec une matière textuelle jugée plus « noble » que le flux chaotique du web.

    Ce chantier titanesque, confié à des prestataires spécialisés dans la numérisation de masse, s’inspire directement de précédents célèbres dans la Silicon Valley. Anthropic a d’ailleurs recruté un ancien cadre de Google ayant participé au très controversé projet Google Books. Ici, la logique est poussée à l’extrême : le livre n’est plus un objet culturel, mais une ressource brute, transformée, ingérée, puis détruite.

    L'affaire Anthropic s'inscrit dans une vague de poursuites judiciaires intentées contre des entreprises d'IA par des auteurs, des artistes, des photographes et des organes de presse. Les documents déposés dans le cadre de ces affaires montrent que les grandes entreprises technologiques se livrent à une course effrénée, parfois clandestine, pour acquérir les œuvres collectées de l'humanité.

    Project Panama, ou l’industrialisation de la lecture

    Selon les documents déposés, en l'espace d'un an environ, l'entreprise aurait dépensé des dizaines de millions de dollars pour acquérir et découper la reliure de millions de livres, avant d'en scanner les pages afin d'alimenter en connaissances les modèles d'IA qui sous-tendent des produits tels que son célèbre chatbot, Claude.

    Les détails du projet Panama, qui n'avaient pas été divulgués auparavant, ont été révélés dans plus de 4 000 pages de documents dans le cadre d'un procès pour violation du droit d'auteur intenté par des auteurs de livres contre Anthropic, dont la valeur est estimée à 183 milliards de dollars par les investisseurs. La société a accepté de payer 1,5 milliard de dollars pour régler l'affaire en août, mais la décision prise la semaine dernière par un juge de district de lever les scellés sur une série de documents relatifs à l'affaire a révélé plus en détail la quête effrénée de livres menée par Anthropic.

    Les nouveaux documents, ainsi que les dossiers antérieurs dans d'autres affaires de droits d'auteur contre des entreprises d'IA, montrent les efforts déployés par des entreprises technologiques telles qu'Anthropic, Meta, Google et OpenAI pour obtenir des quantités colossales de données afin de « former » leurs logiciels.


    Pourquoi les livres valent de l’or pour les modèles d’IA

    Les échanges internes cités dans les dossiers judiciaires révèlent une obsession partagée par l’ensemble du secteur : les livres seraient le secret pour apprendre à une IA à « bien écrire ». Là où Internet regorge de contenus répétitifs, mal structurés ou approximatifs, les ouvrages publiés incarnent des styles, des structures narratives et une rigueur linguistique que les ingénieurs jugent indispensables.

    Cette conviction n’est pas propre à Anthropic. Chez Meta, des cadres évoquent l’accès à de vastes catalogues de livres comme une condition essentielle pour rester compétitif. Même raisonnement chez OpenAI ou Google, aujourd’hui également visés par des actions en justice similaires. Les livres sont devenus le carburant premium de l’IA générative.

    Les livres étaient considérés comme un enjeu crucial par ces entreprises, comme le montrent les dossiers judiciaires. Dans un document datant de janvier 2023, l'un des cofondateurs d'Anthropic a émis l'hypothèse que l'entraînement des modèles d'IA à partir de livres pourrait leur apprendre « à bien écrire » au lieu d'imiter « le langage de mauvaise qualité utilisé sur Internet ». Un e-mail interne de Meta datant de 2024 décrivait l'accès à une mine de livres numériques comme « essentiel » pour rester compétitif face à ses rivaux dans le domaine de l'IA.

    Mais les dossiers judiciaires suggèrent que les entreprises ne jugeaient pas pratique d'obtenir l'autorisation directe des éditeurs et des auteurs pour utiliser leurs œuvres. Au lieu de cela, Anthropic, Meta et d'autres entreprises ont trouvé des moyens d'acquérir des livres en vrac à l'insu des auteurs, selon les documents judiciaires, notamment en téléchargeant des copies piratées.

    L’angle mort du consentement et la tentation du piratage

    Le problème, c’est que négocier individuellement avec des éditeurs et des auteurs aurait pris des années, et coûté des sommes colossales. Les documents dévoilés montrent que plusieurs entreprises ont préféré des raccourcis beaucoup plus risqués : le téléchargement massif de bibliothèques dites « de l’ombre », comme LibGen, connues pour héberger des millions d’ouvrages piratés.

    Chez Meta, des ingénieurs ont exprimé par écrit leur malaise. Certains s’inquiètent de télécharger des torrents depuis des ordinateurs professionnels, d’autres redoutent les conséquences juridiques du partage involontaire de contenus piratés. Malgré ces alertes internes, les projets avancent. Une validation « après escalade » jusqu’à la direction générale, faisant référence à Mark Zuckerberg, est même mentionnée dans un courriel interne.

    Dans un document juridique récemment publié, Anthropic a révélé que le cofondateur Ben Mann avait personnellement téléchargé une grande quantité d'ouvrages de fiction et de non-fiction à partir d'une « bibliothèque fantôme » de livres et d'autres contenus enfreignant le droit d'auteur, appelée LibGen, pendant 11 jours en juin 2021. Une capture d'écran de son navigateur web incluse dans les documents montrait qu'il téléchargeait des fichiers à l'aide d'un logiciel de partage de fichiers.

    Un an plus tard, Mann a salué le lancement en juillet 2022 d'un nouveau site web appelé Pirate Library Mirror, qui prétendait disposer d'une immense base de données de livres et déclarait « violer délibérément la loi sur le droit d'auteur dans la plupart des pays ». Mann a envoyé un lien vers le site à d'autres employés d'Anthropic avec le message « juste à temps !!! ».

    Anthropic a déclaré dans des documents juridiques que la société n'avait jamais formé de modèle d'IA commercial générant des revenus à partir de ses données LibGen et n'avait jamais utilisé Pirate Library Mirror pour former un modèle d'IA complet.

    Ed Newton-Rex, ancien cadre dans le domaine de l'IA et compositeur de musique qui dirige aujourd'hui une organisation à but non lucratif défendant les droits des créateurs, a déclaré que ces révélations soulignaient le fait que les entreprises d'IA avaient une dette plus importante envers les créateurs qu'elles ne l'avaient jusqu'à présent. « Nous avons besoin de toute urgence d'une réinitialisation de l'ensemble du secteur de l'IA, afin que les créatifs commencent à être rémunérés équitablement pour leurs contributions essentielles », a-t-il déclaré.

    Google, Microsoft et OpenAI, le fabricant de ChatGPT, font également l'objet de poursuites judiciaires pour violation du droit d'auteur de la part d'auteurs de livres qui formulent des allégations similaires.

    Nom : claude.png
Affichages : 7669
Taille : 48,9 Ko

    La justice tranche… partiellement

    Sur le fond, plusieurs décisions récentes ont surpris observateurs et ayants droit. Des juges américains ont estimé que l’utilisation de livres pour entraîner des modèles d’IA pouvait relever du fair use, au motif que le processus serait « transformateur ». Comparaison est faite avec un enseignant qui apprend à écrire à ses élèves, sans reproduire mot pour mot les œuvres étudiées.

    Mais cette tolérance a des limites. Dans le cas d’Anthropic, si la numérisation de livres achetés légalement a été jugée recevable, l’acquisition préalable de millions d’ouvrages piratés a, elle, posé problème. Résultat : un accord transactionnel à 1,5 milliard de dollars pour éviter un procès, avec une indemnisation estimée à quelques milliers de dollars par titre pour les auteurs concernés.

    La plupart des poursuites judiciaires intentées contre des entreprises spécialisées dans l'IA sont toujours en cours, et James Grimmelmann, professeur de droit numérique et de l'information à Cornell Tech, a déclaré que les questions qu'elles soulèvent restent encore sans réponse sur le plan juridique. Mais dans deux décisions rendues récemment, les juges ont estimé que l'utilisation par les entreprises technologiques de livres pour entraîner des modèles d'IA sans l'autorisation de l'auteur ou de l'éditeur pouvait être légale en vertu d'une doctrine du droit d'auteur connue sous le nom de « fair use » (usage loyal).

    En juin, le juge William Alsup a estimé qu'Anthropic était en droit d'utiliser des livres pour entraîner des modèles d'IA, car ceux-ci traitent le matériel de manière « transformative ». Il a comparé le processus d'entraînement de l'IA à celui des enseignants qui « apprennent aux écoliers à bien écrire ». Le même mois, le juge Vince Chhabria a estimé dans l'affaire Meta que les auteurs des livres n'avaient pas démontré que les modèles d'IA de l'entreprise pouvaient nuire aux ventes de leurs livres.

    Mais les entreprises peuvent tout de même avoir des ennuis en raison de la manière dont elles ont acquis les livres. Dans le cas d'Anthropic, le projet de numérisation des livres a été jugé recevable, mais le juge a estimé que l'entreprise avait peut-être enfreint les droits d'auteur des auteurs en téléchargeant gratuitement des millions de livres piratés avant de lancer le projet Panama.

    Une industrie sous tension éthique et politique

    Au-delà des montants, ces révélations exposent une fracture profonde entre le discours public des entreprises d’IA et leurs pratiques internes. Les dirigeants plaident l’innovation, la transformation et le progrès collectif. Les documents judiciaires racontent plutôt une industrie « verrouillée » dans une compétition à très haute intensité, où chaque retard technologique peut coûter des milliards de valorisation.

    Pour les défenseurs des créateurs, le signal est clair : l’IA s’est construite sur une dette culturelle massive, encore très imparfaitement reconnue. Pour les juristes, le droit d’auteur entre dans une zone grise où l’entraînement des machines bouscule des principes établis depuis des décennies. Et pour le secteur lui-même, Project Panama pourrait devenir un cas d’école : celui d’un virage tardif vers des méthodes plus conformes à la loi, une fois la tempête judiciaire déclenchée.

    Ce qui se joue ici dépasse largement Anthropic ou Meta. C’est la question de savoir si l’intelligence artificielle du futur se développera dans un cadre contractuel et transparent, ou si elle continuera à avancer en terrain miné, en absorbant le patrimoine intellectuel mondial avant que les règles ne soient clairement posées.

    Source : documents judiciaire (1, 2, 3, 4, 5, 6), Anthropic

    Et vous ?

    Cela vous semble-t-il crédible ? Êtes-vous surpris ou pas du tout ?

    Peut-on encore parler « d'innovation responsable » quand des modèles d’IA ont été entraînés à partir de livres piratés téléchargés en masse, en toute connaissance des risques juridiques ?

    Le concept de fair use est-il réellement adapté à des systèmes industriels capables d’absorber et de réexploiter des millions d’œuvres, ou sert-il aujourd’hui de paravent légal à une prédation culturelle à grande échelle ?

    Les auteurs et éditeurs doivent-ils être rémunérés a posteriori, ou faut-il imposer un consentement explicite et contractuel avant toute utilisation de leurs œuvres par des IA commerciales ?

    Les entreprises d’IA auraient-elles pu exister sans l’accès massif et non négocié au patrimoine écrit mondial, ou cette dépendance révèle-t-elle une fragilité structurelle de leurs modèles économiques ?

    En validant l’usage transformateur des œuvres protégées, la justice ne crée-t-elle pas un précédent dangereux pour d’autres industries fondées sur l’extraction de contenus culturels ?

    Les utilisateurs finaux d’IA générative doivent-ils être informés de l’origine exacte des données ayant servi à entraîner les modèles qu’ils utilisent au quotidien ?
    Contribuez au club : Corrections, suggestions, critiques, ... : Contactez le service news et Rédigez des actualités

  7. #47
    Chroniqueur Actualités
    Avatar de Anthony
    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Novembre 2022
    Messages
    2 314
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Gironde (Aquitaine)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Novembre 2022
    Messages : 2 314
    Par défaut La FSF révèle que les données d'entraînement d'Anthropic comprenaient leur livre protégé par le droit d'auteur
    La Free Software Foundation révèle que les données d'entraînement d'Anthropic comprenaient le livre protégé par le droit d'auteur « Free as in Freedom : Richard Stallman's Crusade for Free Software »

    La Free Software Foundation (FSF) a confirmé que les ensembles de données d'entraînement d'Anthropic comprenaient son ouvrage protégé par le droit d'auteur intitulé « Free as in Freedom : Richard Stallman's Crusade for Free Software ». Cette révélation intervient dans le cadre d'un recours collectif, Bartz c. Anthropic, dans lequel il est allégué qu'Anthropic a illégalement utilisé des documents provenant des bases de données Library Genesis et Pirate Library Mirror pour entraîner ses grands modèles de langage (LLM). Bien que le tribunal ait jugé l'utilisation des livres équitable, la FSF demande aux développeurs d'intelligence artificielle (IA) qui entraînent leurs modèles à l'aide d'énormes ensembles de données téléchargés sur Internet de fournir les LLM à leurs utilisateurs en toute liberté, à titre de compensation.

    Anthropic PBC est une entreprise américaine spécialisée dans l'IA dont le siège social est situé à San Francisco. Elle a développé une famille de grands modèles de langage (LLM) baptisée Claude. Anthropic est une société d'intérêt public qui mène des activités de recherche et de développement en IA afin « d'étudier leurs propriétés de sécurité à la pointe de la technologie » et d'utiliser ces recherches pour déployer des modèles sûrs destinés au grand public.

    Pour rappel, en juillet 2025, un juge fédéral de Californie a autorisé trois auteurs (Andrea Bartz, Charles Graeber et Kirk Wallace Johnson) à mener une action collective nationale contre la start-up Anthropic, accusée d'avoir téléchargé illégalement des millions d'ouvrages provenant des bibliothèques pirates LibGen et PiLiMi afin d'entraîner son assistant IA, Claude. Le juge William Alsup a estimé que ces auteurs pouvaient représenter l’ensemble des écrivains américains dont les œuvres auraient été utilisées par Anthropic sans autorisation. Selon la plainte, entre 2021 et 2022, Anthropic aurait constitué un vaste référentiel de près de 7 millions de livres téléchargés illégalement dans le but d'entraîner son IA.

    La Free Software Foundation (FSF) est une organisation à but non lucratif de type 501(c)(3) fondée par Richard Stallman le 4 octobre 1985. L'organisation soutient le mouvement du logiciel libre et privilégie les logiciels distribués sous des conditions de copyleft (« partage à l'identique »), comme c'est le cas avec sa propre Licence publique générale GNU. La FSF a été constituée à Boston, où elle a également son siège.

    Nom : FSF.png
Affichages : 18004
Taille : 21,3 Ko

    Richard Matthew Stallman, également connu sous ses initiales, rms, est un militant américain du mouvement pour le logiciel libre et un programmeur. Il milite pour que les logiciels soient distribués de manière à ce que leurs utilisateurs aient la liberté de les utiliser, de les étudier, de les distribuer et de les modifier. Les logiciels qui garantissent ces libertés sont appelés « logiciels libres ». Stallman a lancé le projet GNU, fondé la Free Software Foundation (FSF) en octobre 1985, développé le compilateur GNU C et GNU Emacs, et rédigé toutes les versions de la licence publique générale GNU. Le livre intitulé « Free as in Freedom : Richard Stallman's Crusade for Free Software » (« Libre comme Liberté : la croisade de Richard Stallman pour les logiciels libres »), publié en 2002, est consacré à la vie de Richard Stallman.

    Le 13 mars dernier, la FSF a publié sur son site un communiqué indiquant qu'elle avait reçu une notification concernant un accord à l'amiable dans le cadre du procès pour violation du droit d'auteur opposant Bartz à Anthropic. Ce procès porte sur l'utilisation de bases de données de livres piratés pour entraîner de grands modèles de langage. Selon Krzysztof Siewicz, responsable des licences et de la conformité à la FSF, l'organisation engage rarement des poursuites en matière de droits d'auteur, mais lorsqu'elle le fait, son objectif est de défendre la liberté des utilisateurs plutôt que d'obtenir des dommages-intérêts.

    Le communiqué de la FSF est présenté ci-dessous : «

    La Free Software Foundation (FSF), comme beaucoup d’autres, a reçu une notification concernant un accord à l’amiable dans le cadre du procès pour violation du droit d’auteur Bartz c. Anthropic. Il s’agit d’un recours collectif alléguant qu’Anthropic a violé le droit d’auteur en téléchargeant des œuvres issues des ensembles de données Library Genesis et Pirate Library Mirror dans le but d’entraîner des grands modèles de langage (LLM). Selon cette notification, le tribunal de district a jugé que l'utilisation des livres pour entraîner des LLM relevait du fair use, mais a renvoyé au procès la question de savoir si leur téléchargement à cette fin était légal. Apparemment, les parties ont convenu de conclure un accord à l'amiable plutôt que d'attendre le procès et elles contactent actuellement les détenteurs potentiels de droits d'auteur pour leur proposer une compensation financière en lieu et place d'éventuels dommages-intérêts.

    La FSF détient les droits d'auteur de nombreux programmes du projet GNU, ainsi que de plusieurs ouvrages. Nous publions toutes les œuvres dont nous détenons les droits d'auteur sous des licences libres (au sens de liberté). Parmi les œuvres dont nous détenons les droits d'auteur figure « Free as in freedom : Richard Stallman's crusade for free software » de Sam Williams, qui figurait dans les ensembles de données utilisés par Anthropic comme données d'entraînement pour ses modèles de langage (LLM). Cet ouvrage a été publié par O'Reilly et par la FSF sous la licence GNU Free Documentation License (GNU FDL). Il s'agit d'une licence libre autorisant l'utilisation de l'œuvre à toutes fins sans contrepartie financière.

    Il va sans dire que la bonne chose à faire est de protéger la liberté informatique : partager l'intégralité des données d'entraînement avec chaque utilisateur du LLM, ainsi que le modèle complet, les paramètres de configuration de l'entraînement et le code source des logiciels associés. C'est pourquoi nous exhortons Anthropic et les autres développeurs de LLM qui entraînent leurs modèles à l'aide d'énormes ensembles de données téléchargés sur Internet à fournir ces LLM à leurs utilisateurs en toute liberté. Nous sommes une petite organisation aux ressources limitées et nous devons choisir nos combats, mais si la FSF devait participer à un procès tel que Bartz c. Anthropic et constater que nos droits d'auteur et notre licence ont été violés, nous demanderions certainement la liberté des utilisateurs à titre de compensation.

    »

    Cette affaire s’inscrit dans une série de procédures judiciaires opposant les développeurs d’IA aux détenteurs de droits d’auteur. En août 2025, l'entreprise Anthropic a ainsi accepté de régler le recours collectif pour violation du droit d'auteur dans lequel des auteurs accusaient l'entreprise d'avoir entraîné ses modèles d'IA à partir de leurs œuvres sans leur autorisation. La plainte, déposée en août 2024 par les auteurs Andrea Bartz, Charles Graeber et Kirk Wallace Johnson, contestait l'utilisation de livres protégés pour entraîner le système Claude.

    En juin 2025, le juge fédéral William Alsup avait toutefois jugé que l'apprentissage des modèles d'IA à partir d'œuvres protégées pouvait relever de l'« usage loyal », estimant que cette utilisation était « extrêmement transformative » et donc juridiquement défendable, même si le téléchargement initial de certaines sources pouvait constituer une infraction. Les parties ont ensuite demandé à la cour d'appel du neuvième circuit de suspendre la procédure afin de finaliser un accord de règlement présenté par les avocats des auteurs comme potentiellement bénéfique pour l'ensemble du groupe concerné.

    Source : Free Software Foundation

    Et vous ?

    Quel est votre avis sur le sujet ?
    Trouvez-vous cette initiative de la FSF crédible ou pertinente ?

    Voir aussi :

    Anthropic a acheté, découpé et numérisé des millions de livres physiques avant de détruire les originaux, dans le seul but d'entraîner son IA Claude, il a également téléchargé 7 millions de livres piratés

    Un juge rejette l'accord à 1,5 milliard de dollars conclu par Anthropic concernant un recours collectif sur les droits d'auteur de près d'un demi-million de livres piratés pour former des chatbots

    Anthropic a accepté de verser 1,5 milliard de $ pour régler un procès pour vol d'œuvres protégées par le droit d'auteur afin d'entraîner ses modèles d'IA, le plus important recouvrement de droits d'auteur
    Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  8. #48
    Invité de passage

    Homme Profil pro
    Conseil - Consultant en systèmes d'information
    Inscrit en
    Septembre 2025
    Messages
    264
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Vaucluse (Provence Alpes Côte d'Azur)

    Informations professionnelles :
    Activité : Conseil - Consultant en systèmes d'information
    Secteur : Conseil

    Informations forums :
    Inscription : Septembre 2025
    Messages : 264
    Billets dans le blog
    1
    Par défaut
    Il faudrait être parfois cohérent :

    "Piratage logiciel : Richard Stallman affirme que partager n’est pas voler et accuse l’industrie d’avoir transformé l’entraide numérique en faute morale,"
    https://www.developpez.net/forums/d2...tager-n-voler/

    Violer les droits des autres n'est pas un problème sauf lorsqu'il s'agit des siens...

  9. #49
    Membre confirmé
    Homme Profil pro
    autre
    Inscrit en
    Juin 2014
    Messages
    454
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Aveyron (Midi Pyrénées)

    Informations professionnelles :
    Activité : autre

    Informations forums :
    Inscription : Juin 2014
    Messages : 454
    Par défaut
    Le procès pour atteinte au copyright n'est pas mené par Stallman :
    Pour rappel, en juillet 2025, un juge fédéral de Californie a autorisé trois auteurs (Andrea Bartz, Charles Graeber et Kirk Wallace Johnson) à mener une action collective nationale contre la start-up Anthropic
    Bien que le tribunal ait jugé l'utilisation des livres équitable, la FSF demande aux développeurs d'intelligence artificielle (IA) qui entraînent leurs modèles à l'aide d'énormes ensembles de données téléchargés sur Internet de fournir les LLM à leurs utilisateurs en toute liberté, à titre de compensation.

  10. #50
    Invité de passage

    Homme Profil pro
    Conseil - Consultant en systèmes d'information
    Inscrit en
    Septembre 2025
    Messages
    264
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Vaucluse (Provence Alpes Côte d'Azur)

    Informations professionnelles :
    Activité : Conseil - Consultant en systèmes d'information
    Secteur : Conseil

    Informations forums :
    Inscription : Septembre 2025
    Messages : 264
    Billets dans le blog
    1
    Par défaut
    Citation Envoyé par _toma_ Voir le message
    Le procès pour atteinte au copyright n'est pas mené par Stallman :
    Non mais la revendication d'atteinte à ses droits est faite par sa fondation, la FSF, d'après l'article :

    "Nous sommes une petite organisation aux ressources limitées et nous devons choisir nos combats, mais si la FSF devait participer à un procès tel que Bartz c. Anthropic et constater que nos droits d'auteur et notre licence ont été violés, nous demanderions certainement la liberté des utilisateurs à titre de compensation."

  11. #51
    Membre confirmé
    Homme Profil pro
    autre
    Inscrit en
    Juin 2014
    Messages
    454
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Aveyron (Midi Pyrénées)

    Informations professionnelles :
    Activité : autre

    Informations forums :
    Inscription : Juin 2014
    Messages : 454
    Par défaut
    Ha oui j'avais pas vu.

  12. #52
    Invité de passage

    Homme Profil pro
    Conseil - Consultant en systèmes d'information
    Inscrit en
    Septembre 2025
    Messages
    264
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Vaucluse (Provence Alpes Côte d'Azur)

    Informations professionnelles :
    Activité : Conseil - Consultant en systèmes d'information
    Secteur : Conseil

    Informations forums :
    Inscription : Septembre 2025
    Messages : 264
    Billets dans le blog
    1
    Par défaut
    Et donc si j'ai bien suivi, le livre piraté non libre de M. Stallman mais diffusé par FSF en licence libre si pas d'usage commercial, la FSF envisagerait la possibilité d'un procès faisant que vu que Anthropic a utilisé d'une licence libre, le LLM d'Anthropic doit devenir libre en tant que dommage de réparation à cette violation de droits et acceptation de fait, par usage en traitement automatisé, d'un bien en licence libre...

  13. #53
    Membre extrêmement actif Avatar de OrthodoxWindows
    Homme Profil pro
    Étudiant
    Inscrit en
    Novembre 2021
    Messages
    1 414
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Drôme (Rhône Alpes)

    Informations professionnelles :
    Activité : Étudiant

    Informations forums :
    Inscription : Novembre 2021
    Messages : 1 414
    Par défaut
    Citation Envoyé par Access_to_folder Voir le message
    Et donc si j'ai bien suivi, le livre piraté non libre de M. Stallman mais diffusé par FSF en licence libre si pas d'usage commercial, la FSF envisagerait la possibilité d'un procès faisant que vu que Anthropic a utilisé d'une licence libre, le LLM d'Anthropic doit devenir libre en tant que dommage de réparation à cette violation de droits et acceptation de fait, par usage en traitement automatisé, d'un bien en licence libre...
    Ce qui est logique, car, comme vous l'avez dit vous-même, ce livre est placé en "en licence libre si pas d'usage commercial". Hors Anthropic, en l'utilisant pour un LLM commercial, viole potentiellement cette licence.
    Après, le débat de fond porte, comme toujours, sur si pour un LLM, ça va être plus de l'inspiration, ou plus du plagiat. Mais la logique de la FSF se tient si l'on en reste à ce qu'elle demande (le passage des LLM d'Anthropic concernés en non-commercial)

  14. #54
    Invité de passage

    Homme Profil pro
    Conseil - Consultant en systèmes d'information
    Inscrit en
    Septembre 2025
    Messages
    264
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Vaucluse (Provence Alpes Côte d'Azur)

    Informations professionnelles :
    Activité : Conseil - Consultant en systèmes d'information
    Secteur : Conseil

    Informations forums :
    Inscription : Septembre 2025
    Messages : 264
    Billets dans le blog
    1
    Par défaut
    Tout à fait, surtout par leur raison militante.
    Peut être que le Tribunal quant à lui jugera différemment, s'il la FSF s'engage dans la procédure, et accordera plutôt des dommages intérêts pour le préjudice subit ; les jurisprudences actuelles ne reconnaissent pas encore à l'IA un équivalent d'intelligence humaine quant à la compréhension de la licence. Une affaire intéressante à suivre (tentative de report de responsabilité d'un fait humain sur une IA ?).

  15. #55
    Chroniqueur Actualités

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Juin 2023
    Messages
    2 010
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Bénin

    Informations professionnelles :
    Activité : Rédacteur technique
    Secteur : High Tech - Éditeur de logiciels

    Informations forums :
    Inscription : Juin 2023
    Messages : 2 010
    Par défaut Un juge suspend l'accord de 1,5 Mds $ conclu par Anthropic pour régler un procès sur le droit d'auteur
    Un juge suspend l'accord de 1,5 Mds $ conclu par Anthropic pour régler un litige sur les droits d'auteur. Les avocats accusés d'avoir précipité l'accord pour s'octroyer 320 millions de dollars d'honoraires

    Un juge fédéral a suspendu la validation d'un accord historique de 1,5 milliard de dollars visant à résoudre un litige de droits d'auteur entre Anthropic et de nombreux auteurs. Des membres du recours collectif dénoncent une répartition inéquitable des fonds, qualifiant les indemnités individuelles de dérisoires face aux 320 millions de dollars réclamés par les avocats. Les objecteurs critiquent également l'absence de garanties concernant la destruction des copies piratées et l'utilisation future de leurs œuvres pour l'entraînement de l'IA. Face à ces accusations, la juge chargée de l'affaire exige désormais des clarifications sur la légitimité des honoraires d'avocats.

    L'affaire découle d'allégations selon lesquelles Anthropic aurait téléchargé plus de 7 millions de livres piratés pour entraîner des modèles d'IA, 91 % des œuvres éligibles ayant été revendiquées, un taux bien supérieur aux taux de participation habituels dans les recours collectifs. En juin 2025, un juge fédéral a statué que l'entreprise avait fait un usage équitable (fair use) des œuvres pour l'entraînement de son grand modèle de langage (LLM) Claude.

    Mais il a également conclu que le stockage de plus de 7 millions de livres piratés dans une "bibliothèque centrale" violait les droits d'auteur. Un procès était donc prévu en décembre pour fixer le montant des dommages-intérêts qui aurait pu s'élever à plusieurs centaines de milliards de dollars.

    Le 5 septembre 2025, un accord de 1,5 milliard de dollars a été signé. Il s'agit du plus important règlement amiable jamais conclu dans un contentieux de droit d'auteur. Il prévoit environ 3 000 dollars par œuvre concernée, soit quelque 480 000 œuvres au total. Anthropic s'est également engagé à détruire les copies illicites des œuvres. L'accord ne couvre que les actes antérieurs au 25 août 2025 et n'accorde et n'accorde aucun droit d'utilisation future.

    L'accord historique conclu par Anthropic suspendu par une juge

    En raison d'un certain nombre de problèmes, la juge fédérale américaine Araceli Martinez-Olguin a refusé de valider immédiatement l'accord de 1,5 milliard de dollars conclu entre Anthropic et les auteurs. Si de nombreux auteurs soutiennent l'accord, certains ont critiqué le montant de l'indemnisation, jugé trop faible, ou contesté les honoraires d'avocat, et plus de 25 d'entre eux se sont retirés du recours pour intenter une action en justice séparée.


    Le William Alsup, juge principal du tribunal de district des États-Unis pour le district nord de Californie, aujourd’hui à la retraite, avait initialement donné son feu vert à cet accord en septembre dernier. Cependant, des membres du recours collectif contestent vigoureusement les termes de cet accord historique. La juge Araceli Martinez a demandé des précisions supplémentaires sur les honoraires d'avocat et les indemnités versées au plaignant principal.

    Le cœur du conflit réside dans la disproportion flagrante entre les indemnités prévues pour les auteurs et les honoraires réclamés par leurs avocats. Alors que chaque auteur ne recevrait qu'une somme dérisoire estimée à 3 000 dollars, l'équipe juridique demande plus de 320 millions de dollars de frais. Selon Pierce Story, auteur et objecteur, ce montant colossal équivaudrait à un taux horaire astronomique de 10 000 à 12 000 dollars pour les avocats.

    Les plaignants accusent ainsi leurs représentants d'avoir bâclé les négociations afin de s'assurer un gain personnel massif, plutôt que d'explorer des solutions plus créatives pour maximiser la compensation des victimes. Les objecteurs estiment aussi que la rémunération des avocats devrait être calculée sur la base du nombre de plaignants réels et non sur le montant total du fonds, d'autant plus que de nombreux auteurs ne sont pas encore inscrits.

    Soupçons de manœuvres douteuses pour étouffer l'opposition

    Pierce Story souligne qu'une simple réduction des honoraires à 70 millions de dollars permettrait d'augmenter les indemnités individuelles de près de 25 %, tout en garantissant un paiement généreux pour le travail fourni par les avocats. Cette affaire fait partie des dizaines de procédures engagées par des titulaires de droits d'auteur contre des entreprises technologiques au sujet de l'entraînement de leurs grands modèles de langage aux États-Unis.

    « Chaque dollar que les avocats prélèvent sur le fonds de règlement est un dollar qui n’est pas versé aux personnes réellement lésées », affirme Pierce Story, opposant à l’accord et auteur de deux ouvrages concernés par celui-ci. Ruben Lee, un autre membre du groupe de plaignants, a abondé dans ce sens, notant : « je pense que le montant proposé est dérisoire et ne reflète en aucun cas la valeur réelle de l'utilisation non autorisée de mon œuvre ».

    La situation est aggravée par les tentatives apparentes de l'équipe juridique d'invalider ou de censurer les voix dissidentes. Des correspondances adressées au tribunal révèlent que les avocats ont cherché à exclure certaines objections légitimes du dossier en prétextant des retards de dépôt ou en déclarant à tort qu'elles n'avaient pas été transmises à la cour. Certains observateurs soupçonnent l'équipe juridique d'être en collusion avec Anthropic.

    Le manque de soin accordé aux plaignants va jusqu'à des erreurs grossières dans les documents officiels, où les noms de certaines objectrices ont été mélangés. Ce qui a suscité la grogne de nombreux plaignants. Plus grave encore, le juge William Alsup, qui s'occupait initialement de l'affaire, s'était inquiété de « voir cet accord enfoncé dans la gorge des auteurs » et avait recommandé une enquête indépendante sur ces honoraires exorbitants.

    Dans une lettre, Robert C. Jacobson, un auteur dont l’œuvre fait partie de l’accord, a fait savoir au juge que « l'équipe juridique avait qualifié son objection d’irrecevable », alors même que le tribunal avait reconnu « un retard dans l’enregistrement de certaines objections reçues plus tôt cette année ».

    Le manque de garanties pour l'avenir des œuvres concernées

    Outre l'aspect financier, les objecteurs dénoncent l'absence totale de mesures empêchant Anthropic de continuer à exploiter leurs œuvres à l'avenir. Ils sont fermement convaincus que l'accord ne devrait pas être approuvé tant qu'Anthropic n'aura pas accepté de restreindre l'utilisation future des œuvres piratées. L'auteur James R. Sills, dont deux œuvres sont concernées par l’accord, exige la destruction de toutes les copies, physiques ou numériques.

    Les objecteurs s'inquiètent également du manque de transparence concernant la manière exacte dont leurs créations ont été acquises et traitées par l'entreprise dirigée par Dario Amodei, ainsi que l'absence de cadre pour réguler l'utilisation commerciale continue des modèles déjà entraînés avec leurs livres.

    Citation Envoyé par James R. Sills

    À l’heure actuelle, Anthropic ne supprimera aucune copie physique numérisée d’œuvres ou de livres. Ainsi, ils peuvent actuellement utiliser ces œuvres. Le problème principal : je ne sais pas comment Anthropic a acquis ou piraté mes deux œuvres. Aucun auteur ne saura comment ses œuvres ont été obtenues par Anthropic. Ainsi, aucun auteur ne saura si ses œuvres seront détruites ou non. Par conséquent, toutes les formes de toutes les œuvres doivent être détruites et ne pas être utilisées par Anthropic.
    Les opposants ne remportent peut-être pas toutes leurs batailles, mais ils semblent avoir convaincu le tribunal d’examiner au moins leurs arguments formulés en termes très fermes, notamment leurs avertissements selon lesquels l’accord pourrait ne pas résister à un appel si ses termes ne sont pas réexaminés.

    Les prochaines étapes dans cette bataille judiciaire historique

    Face à cette fronde et aux menaces d'appel, le tribunal a exigé que les auteurs et Anthropic répondent de manière détaillée à ces objections d'ici le 21 mai. Anthropic devra également fournir les raisons pour lesquelles il refuse d'honorer les retraits tardifs du recours collectif. Preuve que la bataille est loin d'être terminée et que les tensions restent vives, un groupe de 25 membres objecteurs vient de déposer une toute nouvelle action en justice contre Anthropic.

    La Free Software Foundation (FSF) a confirmé que les données d'entraînement d'Anthropic comprenaient son ouvrage protégé intitulé « Free as in Freedom: Richard Stallman's Crusade for Free Software ». Cette révélation intervient dans le cadre d'un recours collectif, Bartz c. Anthropic, qui accuse Anthropic d'avoir illégalement utilisé des documents provenant des bases de données Library Genesis et Pirate Library Mirror pour entraîner ses grands modèles de langage.

    Bien que le tribunal ait jugé l'utilisation des livres équitable, la FSF demande aux développeurs d'IA qui entraînent leurs modèles à l'aide d'énormes ensembles de données téléchargés sur Internet de fournir les grands modèles de langage à leurs utilisateurs en toute liberté, à titre de compensation.

    Sources : objections adressées au tribunal (1, 2, 3, 4), nouvelle action en justice contre Anthropic (PDF)

    Et vous ?

    Quel est votre avis sur le sujet ?
    Que pensez-vous de la suspension de l'accord entre Anthropic et les auteurs ?
    Que pensez-vous des plaintes formulées par les objecteurs de l'accord avec Anthropic ?
    L'équipe juridique est accusée de collusion avec le défendeur Anthropic. Que pensez-vous de cette allégation ?
    L'équipe juridique réclame des honoraires de 320 millions sur le règlement de 1,5 milliard de dollars. Qu'en pensez-vous ?

    Voir aussi

    Anthropic a accepté de verser 1,5 milliard de $ pour régler un procès pour vol d'œuvres protégées par le droit d'auteur afin d'entraîner ses modèles d'IA, le plus important recouvrement de droits d'auteur

    Un juge rejette l'accord à 1,5 milliard de dollars conclu par Anthropic concernant un recours collectif sur les droits d'auteur de près d'un demi-million de livres piratés pour former des chatbots

    Anthropic remporte une victoire importante au sujet de « l'usage loyal » pour les plateformes d'IA, mais fait face à un procès pour des dommages-intérêts portant sur des millions d'œuvres piratées

  16. #56
    Communiqués de presse

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Avril 2025
    Messages
    866
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Paris (Île de France)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Avril 2025
    Messages : 866
    Par défaut Un juge approuve l'accord de règlement de 1,5 milliard $ conclu par Anthropic en matière de droits d'auteur
    Un juge approuve l'accord de règlement de 1,5 milliard $ conclu par Anthropic en matière de droits d'auteur, mais 350 auteurs, mécontents du faible montant de l'indemnisation, ont choisi de se retirer

    La juge fédérale de district Araceli Martínez-Olguín a donné son accord définitif au règlement de 1,5 milliard de dollars conclu par Anthropic avec un groupe d’auteurs, mettant ainsi fin au plus grand recours collectif en matière de droits d’auteur de l’histoire des États-Unis. Cependant, tous les auteurs n’ont pas accepté les conditions, certains estimant que l’indemnité d’environ 3 000 dollars par œuvre était inférieure à ce qu’ils auraient pu obtenir devant les tribunaux, tandis que d’autres s’opposaient au montant des honoraires d’avocat initialement demandés. Au final, seuls 350 auteurs ont réussi à se retirer avant cette date limite, choisissant plutôt d’intenter des actions en justice indépendantes et distinctes contre Anthropic, qui sont toujours en cours.

    En août 2025, un juge fédéral américain a certifié la plus vaste action collectif jamais intentée pour violation du droit d’auteur contre une entreprise technologique. La cible : la société d'intelligence artificielle (IA) Anthropic, créatrice du modèle Claude, accusée d’avoir bâti une partie de son succès sur des données issues d’une massive bibliothèque de livres piratés. Derrière cette affaire se joue un débat fondamental : l’IA peut-elle prospérer sur la base d’une appropriation massive de contenus protégés ? Et si la justice tranche sévèrement, l’impact pourrait être dévastateur non seulement pour Anthropic, mais pour l’ensemble du secteur.

    En septembre 2025, pour régler ce recours collectif, Anthropic a accepté de verser 1,5 milliard de dollars. Selon les avocats des auteurs, cet accord serait le plus important recouvrement de droits d'auteur jamais rendu public. Anthropic a déclaré que l'accord « résoudrait les réclamations restantes des plaignants ». Les avocats des plaignants ont qualifié l'accord annoncé de « premier du genre à l'ère de l'IA ». « Il offrira une compensation significative pour chaque œuvre collective et créera un précédent obligeant les entreprises d'IA à rémunérer les titulaires de droits d'auteur », a déclaré l'avocat Justin Nelson, qui représente les auteurs. Mais l'accord devait encore être approuvé par le juge fédéral américain William Alsup.

    Récemment, la juge fédérale de district Araceli Martínez-Olguín a donné son accord définitif au règlement de 1,5 milliard de dollars conclu par Anthropic avec un groupe d’auteurs, mettant ainsi fin au plus grand recours collectif en matière de droits d’auteur de l’histoire des États-Unis. Le tribunal approuve le règlement, bien que 350 auteurs aient choisi de se retirer complètement de l’accord pour intenter leurs propres poursuites.

    Nom : 1.jpg
Affichages : 493
Taille : 25,3 Ko
    Araceli Martínez-Olguín, Juge du tribunal fédéral de première instance du district nord de Californie

    L’affaire remonte à 2024, lorsque la romancière à succès Andrea Bartz, aux côtés des écrivains Charles Graeber et Kirk Wallace Johnson, a intenté un recours collectif contre Anthropic. La plainte accusait cette entreprise d’IA soutenue par Amazon d’utiliser des copies piratées et non autorisées de leurs livres, issues de bibliothèques clandestines telles que Library Genesis, pour entraîner son chatbot Claude.

    Un procès avait initialement été prévu en décembre dernier afin de déterminer le montant dû par Anthropic au titre de ce piratage présumé, les dommages-intérêts potentiels pouvant atteindre plusieurs centaines de milliards de dollars. Cependant, Anthropic a choisi de conclure un accord à l’amiable, en divulguant d’abord les termes de celui-ci en août dernier, avant d’en révéler l’intégralité dans un document déposé auprès du tribunal plus tard dans l’année.

    Le juge Martínez-Olguín a rejeté les objections des détracteurs qui estimaient que le montant versé était trop faible compte tenu de l’ampleur de la violation présumée. Il a estimé que ces critiques ne reposaient pas sur une évaluation réaliste des risques et des avantages qu’aurait comporté un procès. Le juge William Alsup, aujourd’hui à la retraite, qui avait initialement présidé l’affaire, avait dans un premier temps refusé d’approuver l’accord à l’amiable l’année dernière, craignant que les auteurs ne soient pas suffisamment informés de leurs options avant d’être liés par cet accord.

    Tous les auteurs n’ont pas accepté les conditions, certains estimant que l’indemnité d’environ 3 000 dollars par œuvre était inférieure à ce qu’ils auraient pu obtenir devant les tribunaux, tandis que d’autres s’opposaient au montant des honoraires d’avocat initialement demandés. Le juge Martínez-Olguín a directement répondu aux préoccupations concernant les honoraires, en ramenant la demande des avocats des plaignants de 187,5 millions de dollars à environ 101 millions de dollars. Cela représente environ 7 % du montant total du fonds de règlement, et ces économies sont réinjectées au profit du groupe.

    Le juge est également resté ferme sur les délais, bloquant les tentatives de dernière minute de certains auteurs de renom visant à se retirer après l’expiration du délai. Au final, seuls 350 auteurs ont réussi à se retirer avant cette date limite, choisissant plutôt d’intenter des actions en justice indépendantes et distinctes contre Anthropic, qui sont toujours en cours.

    L’approbation définitive étant obtenue, Anthropic peut désormais commencer à distribuer les fonds du règlement aux ayants droit, couvrant plus de 500 000 livres à raison d’environ 3 000 dollars par ouvrage. Au-delà de cette compensation financière, Anthropic est également légalement tenue de supprimer définitivement tous les ensembles de données piratés et les fichiers de la « shadow library » (bibliothèque fantôme) encore présents dans ses systèmes.

    Aparna Sridhar, directrice juridique adjointe d’Anthropic, a déclaré que l’entreprise se réjouissait du taux élevé de demandes d’indemnisation et a souligné que le précédent juridique sous-jacent, selon lequel l’entraînement de l’IA en soi relevait de l’usage loyal, restait intact à la suite de ce règlement.

    L’avocat principal des auteurs, Justin Nelson, a qualifié ce résultat de résolution historique qui garantit une responsabilité financière immédiate envers les créateurs. Cette affaire marque le premier règlement à l’amiable d’un grand procès américain concernant les données d’entraînement de l’IA, parmi les dizaines d’affaires similaires toujours en cours devant les tribunaux contre des entreprises telles qu’OpenAI, Microsoft et Meta.


    Cet accord intervient alors que la frontière du droit d'auteur et de l'IA reste encore flou. Le droit d'auteur ne protège que les œuvres créées par un être humain. Le Bureau américain des droits d'auteur l'a confirmé en janvier 2025, et la Cour suprême des États-Unis a refusé d'y revenir en mars 2026 lorsqu'elle a écarté le recours Thaler. Les œuvres générées principalement par une IA sans paternité humaine significative ne sont pas éligibles à la protection du droit d'auteur; cette règle est désormais établie au plus haut niveau judiciaire disponible. Par exemple, cela signifie que le code généré par Claude, Copilot ou Cursor n'appartient pas aux développeurs, sauf si la notion clé « paternité humaine significative » est respecté.

    Source : Araceli Martínez-Olguín, juge fédérale de première instance

    Et vous ?

    Pensez-vous que cette décision est crédible ou pertinente ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    L'industrie de l'IA au bord du précipice ? La plus grande action collective en matière de droits d'auteur contre Anthropic pourrait ruiner l'industrie de l'IA, selon les associations professionnelles

    Un juge suspend l'accord de 1,5 Mds $ conclu par Anthropic pour régler un litige sur les droits d'auteur. Les avocats accusés d'avoir précipité l'accord pour s'octroyer 320 millions de dollars d'honoraires

    Les entreprises d'IA affirment qu'elles ne peuvent pas respecter les droits d'auteur mais ces chercheurs ont essayé, démontrant que former des modèles d'IA puissants sans enfreindre la loi, c'est possible
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  17. #57
    Communiqués de presse

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Avril 2025
    Messages
    866
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : France, Paris (Île de France)

    Informations professionnelles :
    Activité : Rédacteur technique

    Informations forums :
    Inscription : Avril 2025
    Messages : 866
    Par défaut Anthropic et Google achètent en gros des livres publiés avant 2022 pour éviter les « déchets d’IA »
    Les entreprises IA achètent des quantités considérables de livres anciens car ils ne contiennent pas d'AI Slop, Anthropic a embauché un ancien ingénieur de Google Books pour diriger un projet de numérisation

    Anthropic et Google achètent en gros des livres publiés avant 2022 pour éviter les « déchets d’IA ». ISBNdb sert d’intermédiaire pour des commandes en gros de livres imprimés destinées aux laboratoires d’IA, allant de 1 000 à 1 million d’ouvrages par contrat, dans le cadre d’accords de confidentialité stricts. Des documents judiciaires révèlent qu’Anthropic a embauché Tom Harvey, un ancien ingénieur de Google Books, pour diriger un projet de numérisation visant à intégrer des millions de livres. Le juge William Alsup a statué que la destruction des exemplaires papier lors de la numérisation constituait un « usage loyal clairement transformatif », offrant ainsi une protection juridique aux acheteurs.

    La juge fédérale de district Araceli Martínez-Olguín a récemment donné son accord définitif au règlement de 1,5 milliard de dollars conclu par Anthropic avec un groupe d’auteurs, mettant ainsi fin au plus grand recours collectif en matière de droits d’auteur de l’histoire des États-Unis. Cependant, tous les auteurs n’ont pas accepté les conditions, certains estimant que l’indemnité d’environ 3 000 dollars par œuvre était inférieure à ce qu’ils auraient pu obtenir devant les tribunaux, tandis que d’autres s’opposaient au montant des honoraires d’avocat initialement demandés. Au final, seuls 350 auteurs ont réussi à se retirer avant cette date limite, choisissant plutôt d’intenter des actions en justice indépendantes et distinctes contre Anthropic, qui sont toujours en cours.

    Dans le même temps, un rapport a révélé l’étrange facette du marché des données d’entraînement : les entreprises d’IA dépensent de l’argent pour acquérir des livres imprimés d’occasion publiés avant 2022, car il s’agit désormais du plus grand corpus de textes écrits par des humains qui soit encore exempt de contamination. 404 Media rapporte qu’ISBNdb, qui gère une vaste base de données de livres, s’est lancé dans le courtage de commandes groupées de livres imprimés pour des laboratoires d’IA, allant de 1 000 à 1 million d’exemplaires à la fois, dans le cadre d’accords de confidentialité stricts.

    L’argumentaire est sans détour. Les livres imprimés de l’ère pré-LLM sont, selon les propres termes d’ISBNdb, « structurellement garantis d’être exempts de cette contamination » par des textes générés par l’IA, et cela importe car les modèles entraînés sur des sorties de modèles se dégradent. Les données issues du web scraping sont de plus en plus polluées par du contenu généré, et la crainte d’un effondrement des modèles est suffisamment réelle pour que l’achat de livres d’occasion soit devenu une ligne d’approvisionnement à part entière.

    Nom : 1.jpg
Affichages : 5367
Taille : 16,9 Ko

    Anthropic est le nom le plus en vue. Des documents internes issus de son procès pour violation du droit d’auteur ont révélé que l’entreprise prévoyait d’acquérir et de numériser des millions de livres, qu’elle avait embauché Tom Harvey, ancien collaborateur de Google Books, pour diriger ce projet, qu’elle avait acheté des stocks auprès de Better World Books et qu’elle avait fait appel à Datamation pour des numérisations à la fois destructives et non destructives.

    De son côté, Google a été poursuivi par des éditeurs pour avoir entraîné Gemini à partir de livres protégés par le droit d’auteur. Le juge William Alsup a déjà statué que la destruction d’un exemplaire imprimé lors de la numérisation constituait un usage loyal « clairement transformatif », ce qui sert désormais de couverture juridique au reste du secteur. ISBNdb reconnaît ouvertement le problème d’image : « Le problème d’image est réel. “Une entreprise d’IA détruit deux millions de livres” n’est pas un titre qui suscite la sympathie. »

    Il convient toutefois de préciser que les chiffres les plus précis proviennent ici du service marketing d’ISBNdb lui-même et d’un libraire professionnel qui a déclaré à 404 Media qu’il écoulait « des centaines de livres par semaine » depuis avril, contre une vingtaine auparavant. Considérez ces chiffres comme des estimations, et non comme des données définitives. Ce que ce reportage ne précise pas, c’est le montant d’argent échangé par livre, si une partie de cet argent revient aux auteurs d’ouvrages de fond de catalogue à faible tirage, ni dans quelle mesure la décision du juge Alsup s’étend de la configuration de numérisation spécifique d’Anthropic à l’ensemble du circuit de l’occasion.

    Ce qui est prometteur, c’est de savoir qui prend soudainement de l’importance. Les places de marché de livres d’occasion, les éditeurs de fonds obscurs et toute personne détenant des ouvrages antérieurs à 2022 dont la provenance a été vérifiée disposent désormais d’un réel pouvoir de négociation. C’est la sélection, et non l’échelle, qui constitue la ressource rare. Au cœur d’un débat brûlant entre innovation technologique et respect des droits de propriété intellectuelle, nombre d’entreprises d’intelligence artificielle (IA) avancent que « le respect du droit d’auteur est impossible » dans leurs processus de formation. Pourtant, en juin 2025, une équipe de chercheurs a relevé le défi... et semble avoir prouvé le contraire.

    Sources : Anthropic, 404 Media

    Et vous ?

    Pensez-vous que ce rapport est crédible ou pertinent ?
    Quel est votre avis sur le sujet ?

    Voir aussi :

    Anthropic a acheté, découpé et numérisé des millions de livres physiques avant de détruire les originaux, dans le seul but d'entraîner son IA Claude. Il a également téléchargé 7 millions de livres piratés

    ChatGPT, Claude, Gemini : Les IA peuvent générer des copies quasi mot pour mot de romans à partir de données d'entraînement selon une étude qui contredit trois ans de défense juridique des géants de l'IA

    Les modèles d'IA s'effondrent lorsqu'ils sont formés sur des données générées récursivement, si bien qu'il sera plus difficile de former les futurs LLM, car ils seront empoisonnés par le contenu créé par l'IA
    Publication de communiqués de presse en informatique. Contribuez au club : corrections, suggestions, critiques, ... Contactez le service news et Rédigez des actualités

  18. #58
    Membre éprouvé
    Homme Profil pro
    ingénieur qualité
    Inscrit en
    Mars 2015
    Messages
    1 733
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Belgique

    Informations professionnelles :
    Activité : ingénieur qualité
    Secteur : Aéronautique - Marine - Espace - Armement

    Informations forums :
    Inscription : Mars 2015
    Messages : 1 733
    Par défaut
    Bientôt la branche scientifique d'Anthropic, en manque de sources, va scanner les livres pour enfants.
    Ils découvriront ensuite un optimum génétique dans l'anthropomorphisme, essentiellement pour les formes des animaux de compagnies.
    Musk lancera un grand projet pour tous nous transformer un lapins crétins bipèdes.

    Non, l'IA ne pousse pas l'humanité à la médiocrité...
    Imaginez, on essaye de nous vendre l'AGI (à la fois apocalypse et sauveur), pourtant on a mis tout le savoir du monde dans nos IA qui sont toujours bien loin de leur forme ultime.
    Mais bon quoi d'étonnant quand un des leaders du domaine vient d'un pays où la logique a toujours été d'évoluer en augmentant systématiquement la consommation. Et qui ne s'est jamais posé la question de la qualité de ce qu'elle consomme et de sa façon de la consommer.

  19. #59
    Membre extrêmement actif
    Homme Profil pro
    Développeur informatique
    Inscrit en
    Octobre 2017
    Messages
    2 992
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Suisse

    Informations professionnelles :
    Activité : Développeur informatique

    Informations forums :
    Inscription : Octobre 2017
    Messages : 2 992
    Par défaut
    A quand le rachat des grottes de Lascaux et des temples égyptiens?

Discussions similaires

  1. Réponses: 0
    Dernier message: 16/04/2025, 21h30
  2. Réponses: 62
    Dernier message: 15/05/2015, 16h17
  3. [PHP 5.4] Comment ajouter des slash dans un integer pour séparer les digits
    Par Rohan21 dans le forum Langage
    Réponses: 4
    Dernier message: 06/08/2013, 03h09
  4. Parser des phrases dans un tuple pour récuperer les mots?
    Par neo62matrix dans le forum Général Python
    Réponses: 3
    Dernier message: 11/05/2012, 19h16
  5. Réponses: 46
    Dernier message: 12/04/2011, 14h22

Partager

Partager
  • Envoyer la discussion sur Viadeo
  • Envoyer la discussion sur Twitter
  • Envoyer la discussion sur Google
  • Envoyer la discussion sur Facebook
  • Envoyer la discussion sur Digg
  • Envoyer la discussion sur Delicious
  • Envoyer la discussion sur MySpace
  • Envoyer la discussion sur Yahoo