IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)
Navigation

Inscrivez-vous gratuitement
pour pouvoir participer, suivre les réponses en temps réel, voter pour les messages, poser vos propres questions et recevoir la newsletter

Droit Discussion :

« Google et Reddit ne sont pas les propriétaires d'Internet », déclare une société de Web scraping


Sujet :

Droit

  1. #1
    Chroniqueur Actualités

    Homme Profil pro
    Rédacteur technique
    Inscrit en
    Juin 2023
    Messages
    2 022
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Bénin

    Informations professionnelles :
    Activité : Rédacteur technique
    Secteur : High Tech - Éditeur de logiciels

    Informations forums :
    Inscription : Juin 2023
    Messages : 2 022
    Par défaut « Google et Reddit ne sont pas les propriétaires d'Internet », déclare une société de Web scraping
    « Google et Reddit ne sont pas les propriétaires d'Internet », déclare un spécialiste du Web scraping après sa victoire au tribunal. Le recours au DMCA pour lutter contre le scraping est jugé « aberrant »

    Google et Reddit ont été déboutés par le tribunal à l'issue d'une action en justice contre la société de collecte de données SerpApi. Les deux géants d'Internet ont tenté d'utiliser la loi sur le droit d'auteur, le DMCA, pour empêcher l'extraction automatisée d'informations issues de leurs résultats de recherche. Cependant, un tribunal a rejeté la plainte de Google, estimant que la société ne possède pas les droits sur les contenus qu'elle indexe simplement. Cette affaire soulève des inquiétudes majeures concernant la fermeture du Web ouvert au profit d'intérêts commerciaux privés de quelques Big Tech. SerpApi quant à lui défend la légitimité du Web scraping.

    Google et Reddit ont entamé des poursuites judiciaires contre SerpApi, une entreprise d'extraction de données (Web scraping), en l'accusant de contourner leurs technologies anti-scraping. Ces deux géants d'Internet ont déposé chacun une plainte contre SerpApi au titre du DMCA (Digital Millennium Copyright Act), une loi américaine adoptée en 1998. Le but de ce texte est de fournir un dispositif de lutte contre les violations du droit d'auteur.

    Il vise à établir une législation de la propriété intellectuelle adaptée à l'ère numérique. Reddit a été le premier à engager des poursuites en octobre, en accusant SerpApi et la startup Perplexity AI d'extraire le contenu de sa plateforme apparaissant dans les résultats de Google. Google a ensuite déposé sa propre plainte en décembre dernier, en citant explicitement l'action en justice de Reddit lorsqu'il a annoncé sa décision de poursuivre SerpApi.

    Google estime que les actions d'extraction de SerpApi menacent ses accords avec les ayants droit, en particulier ceux qui lui accordent des licences pour le contenu affiché dans ses « panneaux de connaissances ». Cependant, de nombreux experts affirment que « les allégations de Google sont absurdes ».

    Une stratégie juridique surprenante basée sur le droit d'auteur

    Google accusait SerpApi d’avoir enfreint le DMCA en contournant SearchGuard, sa technologie anti-scraping, afin de collecter et de revendre des résultats de recherche. Google a allégué que le contournement mis en place par SerpApi enfreignait ses conditions d’utilisation et l’empêchait de tirer profit de (ou de compenser le coût) « des milliards » de recherches effectuées par des robots. Ces allégations sont toutefois largement controversées.


    Auparavant, Reddit avait affirmé dans sa plainte déposée en octobre que SerpApi contournait deux niveaux de sécurité dans son activité : les contrôles propres à Reddit bloquant le scraping sur sa plateforme et les contrôles de Google bloquant le scraping du contenu de Reddit dans les résultats de recherche.

    Cette stratégie est jugée très inhabituelle par les experts juridiques étant donné que les résultats de recherche de Google ne peuvent pas être protégés par le droit d'auteur. Selon Meredith Rose, experte juridique pour le groupe de défense de l'intérêt public Public Knowledge, « Google et Reddit cherchent en quelque sorte à s'emparer de n'importe quel outil disponible » face à la montée en puissance de l'extraction de données pilotée par l'IA.

    Bien que la manière dont Google et Reddit utilisent le DMCA ne corresponde pas au cas d’utilisation envisagé par la loi, elle précise que cela n’est pas surprenant. Historiquement, le DMCA s’est révélé un outil efficace pour mettre rapidement un terme aux utilisations de contenus jugées indésirables et forcer le dialogue sur les questions de licence ; y avoir recours a donc pu constituer un point de départ évident, compte tenu des objectifs de Google.

    Le géant de la recherche débouté par le juge chargé de l'affaire

    Les arguments inhabituels avancés par Google et Reddit au titre du DMCA ne semblent pas faire mouche. SerpApi a déposé une requête en irrecevabilité en février. La juge en chef du tribunal fédéral de district, Yvonne Gonzalez Rogers, a approuvé cette requête, et ce dès les premières étapes de la procédure engagée par Google. Cela a entraîné le rejet des deux plaintes de Google relatives au contournement des mesures techniques de protection.

    L’arrêt portait sur la question de savoir si SearchGuard protège une œuvre protégée par le droit d’auteur. Les résultats de Google sont principalement constitués d’informations publiques, mais ils incluent souvent un « Knowledge Panel » (encadré d’informations) pouvant contenir des images sous licence.

    Pour les résultats ne comportant pas de contenu protégé par le droit d’auteur, le tribunal a estimé que SearchGuard ne peut pas réguler l’accès, car aucune œuvre protégée n’est en cause. Ces demandes ont été rejetées sans possibilité de modification. Quant aux résultats contenant des images sous licence, le tribunal a estimé que Google n'avait pas prouvé avoir utilisé SearchGuard avec l'autorisation des titulaires de droits, comme l'exige la loi.

    Ces demandes ont été rejetées, mais avec la possibilité de les modifier, ce qui permet à Google d’intenter une nouvelle action. Le tribunal a également rejeté l'argument de SerpApi selon lequel Google n'avait pas le droit d'intenter une action en justice. SerpApi estime que le DMCA ne protège que les titulaires de droits d'auteur et que, Google n'étant pas propriétaire de ses résultats de recherche, l'entreprise ne pouvait pas intenter d'action en justice.

    La juge Gonzalez Rogers n'a toutefois pas suivi cet argument, précisant que la protection offerte par la loi ne se limite pas aux seuls titulaires de droits d'auteur. En somme, SerpApi remporte une victoire d'étape très importante dans cette bataille juridique. « Cela n’arrive pas très souvent. En fin de compte, Google n’a pas suffisamment précisé quels éléments protégés par le droit d’auteur il cherchait à défendre », a fait remarquer Meredith Rose.

    L'arrêt dans l'affaire Google n'augure rien de bon pour Reddit

    Reddit devait comparaître le 23 juillet dans le cadre d’une audience concernant la requête en irrecevabilité déposée par SerpApi. On ignore quelle sera la décision du tribunal dans cette affaire, mais Rose a déclaré que l’arrêt rendu dans l’affaire Google n’augure rien de bon pour Reddit, car ce dernier ne peut prétendre être le titulaire des droits d’auteur ou le titulaire d’une licence exclusive sur les contenus figurant dans les résultats de recherche.

    « Le juge chargé de l’affaire Google a déclaré : “pour avoir qualité pour agir en justice en vertu du DMCA, il faut être soit le titulaire du droit d’auteur, soit le titulaire d’une licence exclusive, soit la personne qui déploie et fabrique la mesure technique de protection en cause” », a expliqué Meredith Rose.

    Reddit n’est rien de tout cela. SerpApi espère que ce conflit prendra bientôt fin, affirmant que cette bataille juridique coûteuse vaut la peine d’être menée jusqu’au bout pour défendre le Web ouvert. « En fin de compte, il semble que Google et Reddit tentent tous deux d’utiliser le DMCA pour cloisonner l'Internet ouvert en revendiquant rétroactivement le contrôle de contenus dont ils ne sont ni les auteurs ni les propriétaires », a déclaré SerpApi.

    Julien Khaleghy, PDG de SerpApi, a qualifié cette décision de victoire pour le libre accès aux données publiques, ajoutant que SerpApi soutiendra les projets qui s'appuient sur les données de recherche publiques. Cette décision précise que, dans ce cas précis, l'extraction de résultats de recherche publics ne contenant pas de contenu protégé par le droit d'auteur ne constitue pas une violation de la loi DMCA, et Google ne peut pas revenir sur ce point.

    Google dispose de 21 jours pour modifier sa plainte. Pour que les allégations relatives au droit d’auteur restent recevables, l’entreprise devra présenter les éléments factuels que le tribunal avait précédemment jugés manquants, à commencer par l’autorisation des titulaires de droits d’auteur à déployer SearchGuard. La juge Gonzalez Rogers a suspendu la procédure de communication des pièces jusqu’à ce que Google apporte les modifications nécessaires.

    Le Web scraping : une pratique controversée, mais légale et encadrée

    Le scraping est une technique consistant à extraire automatiquement des données de sites Web à l'aide de robots ou de scripts. Sur le plan juridique, la jurisprudence tend globalement à confirmer sa légalité lorsqu'il porte sur des données publiquement accessibles : l'affaire hiQ contre LinkedIn avait déjà établi ce principe aux États-Unis, une position récemment renforcée par le rejet, en juillet 2026, des accusations de Google contre SerpApi fondées sur le DMCA.

    Cette pratique reste toutefois encadrée par plusieurs garde-fous : le respect du fichier robots.txt, les conditions d'utilisation des sites Web, et surtout la réglementation sur la protection des données personnelles. En fonction de la position géographique, les règles ne sont pas nécessairement les mêmes. Dans le droit français, le Web scraping est encadré par l’article L. 342-3 du Code de la propriété intellectuelle, qui autorise les pratiques suivantes :

    • l'extraction ou la réutilisation d'une partie non substantielle appréciée de façon qualitative ou quantitative, du contenu de la base, par la personne qui y a licitement accès. Cela signifie que le propriétaire du site Web peut limiter le contenu pouvant être collecté de son site, en le précisant dans ses conditions générales d’utilisation ;
    • l’extraction à des fins privées est autorisée, dans le respect des dispositions législatives et réglementaires en matière de droits d’auteurs et de droits voisins sur les œuvres ou les éléments incorporés dans la base ;
    • l’extraction et la réutilisation d’une partie substantielle, appréciée de façon qualitative ou quantitative, à des fins exclusives d’illustration dans le cadre de l’enseignement et de la recherche et pour un public composé d’élèves, d’étudiants, d’enseignants ou de chercheurs directement concernés. Ainsi, ce cas de figure étant limité à des fins pédagogiques, il est totalement exclu de faire usage des données extraites à titre commercial par exemple.


    Plusieurs sanctions peuvent s’appliquer en cas de violation des règles du Web scraping :

    • l’article 323-3 du Code pénal punit de 150.000 euros d’amende et cinq d’emprisonnement « le fait d'introduire frauduleusement des données dans un système de traitement automatisé, d'extraire, de détenir, de reproduire, de transmettre, de supprimer ou de modifier frauduleusement les données qu'il contient ». Bien entendu, il faut pouvoir prouver l’intention frauduleuse du Web scraping dans ce cas-là ;
    • en droit de la concurrence, le Web scraping peut être qualifié d’un acte de concurrence déloyale ou de parasitisme, si les critères de qualification sont remplis. Dans ce cas, le site Web victime pourra intenter une action en responsabilité délictuelle et l’auteur du Web scraping pourra être condamné au paiement de dommages et intérêts ;
    • l’auteur du Web scraping peut également être sanctionné sur le fondement de la propriété intellectuelle en cas de non-respect de l’article L. 342-3 du Code de la propriété intellectuelle ;
    • enfin, la CNIL (Commission nationale de l'informatique et des libertés), qui a un pouvoir de contrôle et de sanction en matière de RGPD, peut sanctionner des pratiques de Web scraping litigieuses sur le fondement du non-respect de la protection des données personnelles.


    Sources : Google, Knowledge Panels, la plainte déposée par Reddit (PDF)

    Et vous ?

    Quel est votre avis sur le sujet ?
    Que pensez-vous des allégations portées par Google et Reddit contre SerpApi ?
    SerpApi accuse à son tour Google et Reddit de vouloir contrôler Internet. Qu'en pensez-vous ?
    Que pensez-vous des arguments avancés par Google devant le tribunal ? Quid de la décision de la juge ?

    Voir aussi

    Un tiers des nouveaux sites web sont créés par l'IA, selon les mesures de Stanford et l'Internet Archive qui en révèlent l'ampleur, la « théorie de l'Internet mort » reçoit un début de validation empirique

    L'UE a infligé une amende de 890 millions € à Google pour avoir enfreint les règles de concurrence en orientant les utilisateurs de Google Play et de son moteur de recherche vers ses propres services

    Alphabet, maison mère de Google, devient la première société à afficher un bénéfice trimestriel de plus de 100 milliards $, avec un résultat net de 112~?1 milliards, soit près de 4 fois plus qu'il y a un an

  2. #2
    Membre extrêmement actif
    Homme Profil pro
    Développeur informatique
    Inscrit en
    Octobre 2017
    Messages
    3 009
    Détails du profil
    Informations personnelles :
    Sexe : Homme
    Localisation : Suisse

    Informations professionnelles :
    Activité : Développeur informatique

    Informations forums :
    Inscription : Octobre 2017
    Messages : 3 009
    Par défaut
    Amusant, google & autres promoteurs d'IA qui ont construit leur business model sur le principe de la violation du droit d'auteur qui viennent essayer de défendre leur propre *droit d'auteur" sur des données qu'ils ont eux-mêmes volés...

    A quand les cambrioleurs du Louvre venir déposer plainte auprès de la justice pour avoir été victime d'un cambriolage???

Discussions similaires

  1. Réponses: 5
    Dernier message: 24/01/2019, 10h14
  2. Réponses: 11
    Dernier message: 03/07/2014, 18h03
  3. Réponses: 0
    Dernier message: 09/11/2010, 11h01
  4. vb2005 les contrôls ne sont pas les memes
    Par salrouge dans le forum Windows Forms
    Réponses: 5
    Dernier message: 02/05/2007, 11h51
  5. [google map] code n'affiche pas les marqueurs voulus
    Par arnogef dans le forum Général JavaScript
    Réponses: 1
    Dernier message: 08/03/2007, 11h19

Partager

Partager
  • Envoyer la discussion sur Viadeo
  • Envoyer la discussion sur Twitter
  • Envoyer la discussion sur Google
  • Envoyer la discussion sur Facebook
  • Envoyer la discussion sur Digg
  • Envoyer la discussion sur Delicious
  • Envoyer la discussion sur MySpace
  • Envoyer la discussion sur Yahoo