Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Patreon et Cloudflare bloquent les bots IA prédateurs
Patreon, la plateforme d'adhésion pour les créateurs, intensifie sa lutte contre le scraping par l'IA de son contenu à des fins d'entraînement. Jeudi, la société a annoncé qu'elle collaborait avec le fournisseur d'infrastructure Internet Cloudflare pour bloquer directement l'accès aux bots IA conçus pour entraîner leurs modèles d'IA sur le travail des créateurs sans autorisation.
Les mesures renforcées étaient nécessaires car le scraping par l'IA est devenu plus sophistiqué depuis que Patreon a mis en place des mesures pour dissuader les crawlers IA en 2023. De plus, le paywall de Patreon a longtemps verrouillé une grande partie du contenu des créateurs, le rendant inaccessible aux crawlers. Cependant, plus récemment, la société a introduit de nouveaux outils de découverte, tels qu'un Home Feed repensé et ses Quips similaires à des tweets, qui pourraient exposer davantage de contenu aux crawlers.
Ces changements interviennent alors que de plus en plus d'éditeurs en ligne et de créateurs de contenu prennent conscience de la manière dont l'IA ingère leur travail pour rendre leurs modèles d'IA plus intelligents. Pour lutter contre cela, Cloudflare propose désormais des outils permettant aux éditeurs de sites Web de restreindre l'accès aux bots IA, y compris un marketplace qui permet aux sites de facturer les bots IA pour le scraping, appelé Pay Per Crawl. Plus tôt ce mois-ci, la société a modifié ses politiques pour que les crawlers dits "à usage mixte", c'est-à-dire ceux qui indexent et s'entraînent sur le contenu d'un site, soient bloqués par défaut sur toutes les pages contenant des publicités.
Patreon indique qu'elle étend son travail existant avec Cloudflare pour utiliser la technologie AI Crawl Control de la société afin de mettre à jour ses politiques et outils d'application concernant l'IA. La différence ici est qu'au lieu de simplement demander aux crawlers IA de ne pas scraper le contenu en utilisant les fichiers robots.txt — une méthode standard pour fournir des instructions aux bots sur la manière dont ils peuvent utiliser son site — Patreon bloque désormais activement les bots d'entraînement IA.
« Le consentement ne devrait pas dépendre du comportement d'un scraper », explique un article de blog de Patreon, faisant référence aux mesures plus strictes.
Lors des tests des fonctionnalités, les tentatives hebdomadaires des crawlers d'entraînement IA d'accéder à Patreon sont passées de « milliers de tentatives à zéro », a noté le post. Cela indique que les scrapers IA ignoraient le fichier robots.txt de Patreon et continuaient à scraper le site malgré ses demandes.
Cependant, la société a déclaré qu'elle autoriserait les bots qui indexent les pages et organisent les informations pouvant être utilisées pour renvoyer les utilisateurs vers Patreon.
« À mesure que les agents IA deviennent de plus en plus puissants et populaires, les créateurs méritent d'avoir un mot à dire sur la manière dont leur travail est utilisé par les entreprises d'IA », a déclaré Drew Rowny, responsable produit de Patreon, dans l'annonce. « Sur la plupart d'Internet, les créateurs doivent accepter que leur travail soit utilisé pour l'entraînement de l'IA juste pour atteindre et développer un public. Patreon a une vision différente : les créateurs devraient pouvoir développer leur audience et contrôler comment leur travail est utilisé. »



