1 points par GN⁺ 3 시간 전 | 1 commentaires | Partager sur WhatsApp
  • Le tribunal a rejeté l’allégation selon laquelle la collecte des résultats de recherche Google par SerpAPI constituait une violation de l’interdiction de contournement prévue à l’article 1201 du DMCA, tout en laissant la possibilité de la reformuler avec un périmètre plus restreint
  • SearchGuard, qui bloque les requêtes automatisées, s’applique à l’ensemble des résultats de recherche, qu’ils soient ou non protégés par le droit d’auteur ; il n’a donc pas été reconnu comme une mesure technique de protection contrôlant l’accès à une œuvre protégée
  • Les résultats de recherche peuvent afficher un Knowledge Panel contenant des images sous licence de tiers, mais tous les résultats ou panels ne contiennent pas de contenus protégés par le droit d’auteur
  • Au regard du DMCA, une mesure technique doit contrôler l’accès à une œuvre sous l’autorité du titulaire des droits ; or Google n’a pas non plus suffisamment établi que SearchGuard avait été mis en œuvre et fonctionnait sous cette autorité du titulaire des droits
  • Google peut réduire le périmètre de sa plainte aux contenus dont il détient les droits, et SerpAPI peut aussi les exclure de sa collecte ; la stratégie visant à contrôler l’ensemble des informations publiques de recherche via le DMCA se trouve donc freinée

Le litige entre Google et SerpAPI

  • En décembre 2025, Google a intenté une action fondée sur l’article 1201 du DMCA contre SerpAPI pour avoir collecté des résultats de recherche Google
  • Le tribunal a rejeté la plainte, mais a laissé à Google la possibilité de la modifier et de la déposer à nouveau
  • SerpAPI collecte les pages de résultats des moteurs de recherche et fournit de fait une API de résultats de recherche non officielle, aidant développeurs, entreprises d’IA, chercheurs et sociétés à accéder aux informations publiques de recherche
  • À l’ère de l’IA, la valeur des données augmente, et les tentatives de dresser des barrières d’accès à certaines parties du web public se multiplient ; dans ce processus, les utilisateurs ordinaires peuvent eux aussi être bloqués

Le lien avec le procès de Reddit

  • À l’automne 2025, Reddit a engagé une action distincte contre SerpAPI, Perplexity et d’autres
    • Reddit affirme que SerpAPI a fourni du contenu Reddit à d’autres entreprises via les résultats de recherche Google, en violation des dispositions anti-contournement du DMCA
    • Les droits d’auteur sur les publications Reddit appartiennent aux utilisateurs, et la cible directement collectée par SerpAPI n’était pas Reddit, mais Google
    • Il existe un contrat d’API entre Reddit et Google, mais les défendeurs ne sont pas parties à ce contrat
  • Dans l’affaire Reddit, les demandes de rejet déposées par les défendeurs sont en cours d’examen ; dans l’affaire Google, le tribunal a d’abord rejeté la plainte

Le champ d’application de l’article 1201 du DMCA

  • L’article 1201 du DMCA a été conçu à l’origine pour engager la responsabilité du seul fait de contourner des mesures techniques de protection comme les DRM
    • Il a été rédigé de manière large afin que le fait de casser un DRM ou de communiquer des méthodes de contournement puisse aussi entraîner une responsabilité pour atteinte au droit d’auteur
    • Des mesures techniques de protection ont aussi été invoquées dans des cas sans lien direct avec le droit d’auteur, par exemple pour limiter l’usage de cartouches d’encre tierces ou d’ouvre-portes de garage
  • Le tribunal a également examiné la jurisprudence relative aux imprimantes Lexmark, mais a estimé qu’elle ne s’appliquait pas à cette affaire
    • Le précédent défavorable à Lexmark provenait du droit des marques, et non du DMCA, et les arguments de Lexmark fondés sur l’article 1201 n’avaient pas abouti

Le fonctionnement de SearchGuard

  • SearchGuard envoie un défi JavaScript lorsqu’il reçoit une requête de recherche depuis une source que Google ne reconnaît pas, afin de déterminer s’il s’agit d’un utilisateur réel ou d’un logiciel automatisé
    • Le navigateur transmet à Google une réponse contenant certaines informations sur l’utilisateur et son environnement
    • Dans le navigateur d’une personne, le JavaScript s’exécute automatiquement et perturbe très peu l’expérience utilisateur
    • Les systèmes de requêtes automatisées à grande échelle ne parviennent généralement pas à résoudre le défi, et l’accès aux résultats de recherche Google leur est refusé
  • Google affirme que la collecte automatisée représente pour lui une perte sèche (deadweight loss), ne générant que des coûts, et que SearchGuard empêche les accès automatisés non autorisés
  • Cependant, SearchGuard ne sélectionne pas uniquement les contenus protégés par le droit d’auteur : il contrôle l’accès automatisé à l’ensemble des résultats de recherche, quel que soit leur statut de protection

Pourquoi l’ensemble des résultats de recherche n’est pas une œuvre protégée

  • Les résultats de recherche Google sont le fruit de l’organisation et de l’affichage, selon leur pertinence, d’informations publiques obtenues sur Internet
  • Google n’a pas soutenu que google.com, ni les résultats de recherche qui y sont affichés, étaient eux-mêmes protégés par le droit d’auteur
  • Les résultats de recherche affichent parfois un Knowledge Panel, qui peut contenir des images protégées sous licence de tiers
    • Un Knowledge Panel n’apparaît pas dans tous les résultats de recherche
    • Même lorsqu’un panel s’affiche, il ne contient pas toujours de contenu protégé par le droit d’auteur
  • Par conséquent, ce que SearchGuard contrôle comprend à la fois des résultats contenant des œuvres protégées et des résultats qui n’en contiennent pas
  • Le DMCA ne s’applique pas lorsque l’objet contrôlé par la mesure technique n’est pas protégé par le droit d’auteur ; les demandes fondées sur §1201(a)(1)(A) et §1201(a)(2) concernant des résultats de recherche sans contenu protégé ne sont donc pas juridiquement recevables

L’exigence d’autorité du titulaire des droits

  • Selon §1201(a)(3)(B), pour qu’une mesure technique contrôle effectivement l’accès à une œuvre, les informations, procédures ou traitements nécessaires à l’accès doivent être appliqués sous l’autorité du titulaire des droits
  • La jurisprudence du Ninth Circuit interprète également cette disposition comme imposant au demandeur d’alléguer et de prouver que la mesure a été mise en œuvre et fonctionne sous l’autorité du titulaire des droits
  • Google a répliqué qu’il fallait examiner qui peut contourner la mesure plutôt que l’entité qui a déployé SearchGuard, mais le tribunal n’a pas retenu cet argument
    • Disney Enterprises v. VidAngel et Universal City Studios v. Corley, cités par Google, sont des décisions interprétant §1201(a)(3)(A), qui définit le « contournement d’une mesure technique »
    • Le point en litige ici relève de §1201(a)(3)(B), qui fixe les conditions dans lesquelles une mesure technique contrôle effectivement l’accès à une œuvre
  • Google a affirmé que les titulaires de droits soutenaient la protection via SearchGuard, mais n’a pas satisfait à l’exigence selon laquelle la mesure devait effectivement être mise en œuvre et fonctionner sous l’autorité de ces titulaires

Le périmètre possible de la plainte après le rejet

  • Tous les arguments de SerpAPI n’ont pas été retenus, mais l’ensemble des demandes DMCA actuelles de Google a été rejeté
  • Google ne peut pas présenter à nouveau la même demande concernant des résultats de recherche sur lesquels il ne détient pas de droits d’auteur
  • Il peut toutefois déposer une plainte plus restreinte, limitée aux contenus dont Google détient les droits, par exemple certains éléments de Knowledge Panel
  • SerpAPI pourrait éviter une plainte ainsi resserrée en modifiant sa collecte pour exclure les contenus produits par Google
  • Dans sa réaction à la décision de rejet, SerpAPI affirme que la tentative de contrôler jusqu’à l’accès aux pages publiques via le DMCA a été rejetée, et qu’elle continuera de soutenir les développeurs, entreprises d’IA, chercheurs et sociétés qui s’appuient sur les informations publiques de recherche
  • Voir Google, dont l’activité s’est construite sur la collecte du web, utiliser le DMCA pour empêcher la collecte de ses propres résultats de recherche revient à retirer derrière soi l’échelle d’accès à l’Internet ouvert

1 commentaires

 
GN⁺ 3 시간 전
Avis sur Hacker News
  • J’aurais été plus réceptif à cette approche si Google fournissait une vraie API pour les résultats de recherche. Mais l’ancienne API a été abandonnée et il n’y a pas d’alternative, donc je compte continuer à utiliser des services tiers qui scrapent les résultats de Google jusqu’à ce que sa politique change

    • Je me demande comment la situation va évoluer maintenant que l’UE oblige Google à partager ses données de recherche
      https://abcnews.com/Technology/wireStory/eu-forces-google-sh...
    • Il faudrait ressusciter l’ancienne API de recherche de Nelson Minar, ou un service similaire. Les réponses fondées sur la recherche dans l’API Gemini sont pratiques, mais manquent de polyvalence
    • J’ai arrêté d’utiliser Google quand ils ont commencé à exiger JavaScript pour la recherche, et ce jour-là m’a donné l’impression que le Web ouvert était vraiment mort
  • C’est le comportement typique d’une grande entreprise disposant d’énormes ressources. Google espérait probablement obtenir un accord, ou pensait que SerpAPI, qui semble beaucoup plus petite qu’elle, ne pourrait pas supporter les frais de justice
    Google a tellement d’argent que même avec le principe du perdant payeur, cela ne la dissuaderait sans doute pas d’intenter des procès

  • Dans l’UE, les producteurs de bases de données sont protégés dès lors qu’il y a eu un investissement substantiel, qualitatif ou quantitatif, pour collecter, vérifier ou présenter le contenu, indépendamment de toute expression créative. Le droit d’auteur américain exige un minimum d’originalité dans la sélection, la coordination ou l’agencement des données
    La frontière est floue si l’on dit que les résultats de recherche de Google ne sont que de simples faits, mais que les cartes sont protégées par le droit d’auteur. Explorer le Web et classer les pages demande un effort immense, et j’estime que PageRank lui-même devrait aussi être protégé par le droit d’auteur

    • Les cartes ne sont pas une bonne comparaison ; les photos sont un meilleur exemple. Une carte ne reproduit pas simplement l’original tel quel ni ne le montre directement sans modification : il faut décider quoi inclure ou exclure, quoi exagérer et quoi déformer, ce qui exige clairement de la créativité. C’est pourquoi des cartes d’une même région peuvent être très différentes
      À l’inverse, les résultats de recherche sont une juxtaposition de plusieurs fragments de texte tirés tels quels des pages, donc le niveau de créativité qu’ils contiennent est probablement comparable à celui d’une photo
    • Google a clairement commencé à franchir cette limite lorsqu’il s’est mis à fournir la réponse du contenu lui-même dans les résultats de recherche
    • L’article sur PageRank date de plus de 20 ans et Google a cessé d’utiliser PageRank il y a environ 15 ans ; à mon avis, cet argument appartient déjà au passé
  • Une raison importante pour laquelle les pages de résultats de recherche doivent pouvoir être scrapées, c’est que Google continue d’afficher des publicités frauduleuses, comme des sites intermédiaires pour l’ETA/ESTA : https://www.bbc.co.uk/news/technology-56886957

    • On peut imaginer à quoi ressemblerait le monde si les géants de la publicité en ligne assumaient une part de responsabilité pour les arnaques et malwares qu’ils ont propagés
    • C’est pareil avec le service britannique du registre foncier. Même en sachant qu’il faut trouver le site .gov, il faut parfois s’y reprendre plusieurs fois ; la dernière fois, je ne me suis rendu compte que j’étais sur un site publicitaire qu’au moment où l’on me demandait de payer pour un service gratuit sur le site gouvernemental
  • Il est ironique que le succès de Google se soit construit en explorant et en indexant le Web ouvert. Je comprends la volonté de protéger ses produits, mais si l’on supprime une API bon marché puis que l’on bloque aussi les tiers qui comblent ce vide, on crée soi-même la demande de scraping que l’on cherchait à freiner

  • Je ne comprends pas bien si cela signifie que n’importe qui peut désormais scraper légalement les résultats de recherche Google

    • Ce qui est légal et le fait que Google ne vous bloque pas par tous les moyens possibles sont deux choses totalement différentes
  • Le billet de blog omet que cette action en justice a été intentée parce qu’OpenAI avait collecté les résultats de recherche Google via SerpApi. Alphabet est aussi investisseur dans Anthropic, et j’attends avec intérêt la plainte amendée qui doit être déposée d’ici le 10 août
    https://searchengineland.com/inside-google-searchguard-46767...

  • Une réforme du DMCA sera nécessaire un jour

    • Ce n’est pas une découverte, mais cet article montre encore une fois à quel point le DMCA est une loi épouvantable. Je ne comprends pas qu’on ne l’ait toujours pas corrigé
    • Il faudrait abolir le système du droit d’auteur lui-même
  • Cette décision peut faire plaisir, mais elle renforce aussi l’idée que le scraping pratiqué par Google lui-même est parfaitement légal. Google a peut-être vu cette action comme une situation gagnante dans les deux cas : soit elle éliminait un concurrent, soit, même en perdant, elle obtenait une jurisprudence protégeant son propre avenir

    • Je n’aime pas Google, mais rendre illégal le scraping de données publiques ouvrirait trop largement la porte aux abus ; ce résultat est donc le meilleur possible
    • À mon avis, Google n’a plus vraiment de douves. Autour de moi, presque plus personne n’utilise Google Search ; les modèles de code permettent un développement bien plus approfondi, et les nombreux ingénieurs licenciés peuvent, avec des outils de codage qui multiplient leur productivité par 10, empiéter sur le territoire des produits Google
      Récemment, quelqu’un a cloné Google G Suite avec un excellent résultat, et Drive comme Search deviendront aussi des produits remplaçables. Il doit y avoir des milliers de personnes qui aimeraient créer leur propre OS mobile, et Chrome semble également remplaçable. Firefox a gagné 1 point de part de marché le mois dernier
      En revanche, les effets de réseau de YouTube seront difficiles à briser, et Google Cloud ne devrait pas disparaître non plus