« Google et Reddit ne sont pas les propriétaires d’Internet », déclare un spécialiste du web scraping après avoir obtenu gain de cause devant les tribunaux

Les développements se succèdent à un rythme impressionnant dans l’IA.

« Google et Reddit ne sont pas les propriétaires d’Internet », déclare un spécialiste du web scraping après avoir obtenu gain de cause devant les tribunaux

Selon un expert, le recours à la loi DMCA par Google et Reddit pour lutter contre les « web scrapers » est étrange.

Après avoir essuyé un lourd revers judiciaire la semaine dernière, Google a confirmé qu’il n’abandonnerait pas son combat visant à empêcher les robots d’IA de « scraper » ses résultats de recherche. Et, curieusement, Reddit s’est rallié à cette cause.

Selon Google, cette technologie anti-scraping avait été mise en place pour protéger les contenus protégés par le droit d’auteur dans les résultats de recherche.

En parallèle, invoquant de manière surprenante la loi DMCA (Digital Millennium Copyright Act), Google a intenté un procès contre SerpApila en décembre. Le géant de la recherche a accusé cette entreprise spécialisée dans le « web scraping » d’avoir contourné sa technologie anti-scraping, puis d’avoir vendu du contenu extrait des résultats de recherche Google via un service logiciel non autorisé utilisant l’« API de recherche Google ».

Fait intéressant, selon Google, cette technologie anti-scraping avait été mise en place pour protéger les contenus protégés par le droit d’auteur dans les résultats de recherche. Il semblerait que le contournement mis en place par SerpApi ait menacé de perturber les relations de Google avec les titulaires de droits, notamment certains d’entre eux qui concèdent à Google des licences pour que leur contenu apparaisse dans ce qu’on appelle les « panneaux de connaissances », affichés dans certains résultats de recherche concernant des personnalités ou des entités connues.

Il s’agissait là d’une application singulière de la loi DMCA, dans la mesure où les résultats de recherche de Google ne peuvent pas être protégés par le droit d’auteur. Mais Google s’est apparemment senti encouragé à explorer cette voie juridique après que Reddit eut intenté en octobre une action en justice très similaire, accusant SerpApi et Perplexity, concurrent de Google, d’avoir « scrapé » du contenu de Reddit apparaissant dans les résultats de Google.

Dans un article de blog, Google a évoqué le recours judiciaire intenté par Reddit pour annoncer sa propre action en justice, qu’il a déclaré avoir engagée en « dernier recours » afin de bloquer le « scraping malveillant » qui porte atteinte au droit des ayants droit de choisir qui peut accéder à leur contenu.

Plus précisément, Google a affirmé que le contournement mis en œuvre par SerpApi enfreignait ses conditions d’utilisation et l’empêchait de tirer profit de — ou de compenser le coût de — « des milliards » de recherches effectuées par des bots. Auparavant, Reddit avait affirmé que SerpApi contournait deux niveaux de sécurité : les contrôles mis en place par Reddit pour empêcher le scraping sur sa plateforme, et les contrôles de Google visant à empêcher le scraping du contenu de Reddit dans les résultats de recherche.

Meredith Rose, conseillère politique senior spécialisée dans la loi DMCA au sein de l’association à but non lucratif d’intérêt public « Public Knowledge », a déclaré à Ars que Google et Reddit semblaient « se raccrocher à n’importe quel outil à leur disposition » face à la montée soudaine et continue du « scraping » par l’IA au cours des trois dernières années. Et bien que la manière dont ils utilisent le DMCA soit « bizarre » — et « ne corresponde pas vraiment à ce que la loi avait en quelque sorte envisagé comme cas d’utilisation » —, elle estime que cela n’est pas « surprenant ». Historiquement, le DMCA s’est révélé être un outil efficace pour mettre rapidement un terme aux utilisations de contenus jugées indésirables et forcer la tenue de discussions sur les licences ; y avoir recours a donc sans doute constitué un point de départ évident, compte tenu des objectifs de Google.

Reste à voir comment l’industrie va réagir à cette annonce.

Dans le même ordre d’idées :


Lire l’article complet sur Ars Technica AI : Ars Technica AI