Un document de travail de l’Université de Washington estime désormais que les aperçus de l’IA de Google ont réduit d’environ 5 % les références mensuelles de recherche vers Wikipédia en anglais après que la fonctionnalité soit devenue la fonctionnalité par défaut aux États-Unis en 2024. L’article, rédigé par Mehrzad Khosravi et Hema Yoganarasimhan, a été mis à jour pour la dernière fois le 2 septembre et n’a pas été examiné par des pairs.
La nouvelle estimation a remplacé une estimation plus large publiée par les mêmes auteurs en février, et cette révision fait partie de l’histoire. Google se demande si la métrique de référence combinée peut isoler sa fonctionnalité.
Wikimedia affirme que de nombreuses personnes accèdent au travail de ses bénévoles via l’IA et des outils de recherche sans visiter wikipedia.org. L’article révisé en explore un aspect spécifique, en examinant comment la disponibilité par défaut de l’AI Overview a influencé les références provenant des moteurs de recherche externes.
Wikipédia propose un test de trafic rare
Wikimedia publie des données mensuelles sur les flux de clics au niveau des articles pour diverses éditions linguistiques de Wikipédia, telles que l’anglais, l’allemand et le français. Ces fichiers catégorisent les moteurs de recherche externes ensemble et omettent les paires référent-article à faible volume. Les auteurs ont testé plusieurs valeurs pour les décomptes post-traitement supprimés et ont rapporté des estimations presque identiques.
Google a activé par défaut les aperçus de l’IA aux États-Unis en mai 2024. Selon le journal, il ne l’avait pas encore fait en Allemagne ou en France au cours de la période d’échantillonnage. Les auteurs considèrent les éditions linguistiques comme un moyen de représenter différentes régions. Au cours de la période d’échantillonnage, environ 40 % du trafic vers Wikipédia en anglais provenait des États-Unis. Pendant ce temps, le trafic pour les éditions allemandes et françaises provenait principalement de pays sans aperçus IA par défaut. Si, après mai 2024, les références anglaises ont diminué par rapport aux références allemandes et françaises pour les mêmes articles, cette différence n’est qu’une estimation.
Les données couvrent la période de décembre 2023 à décembre 2024. Les auteurs considèrent mai 2024, date de début du déploiement aux États-Unis, comme le premier mois post-traitement. Le panel comprend 499 927 paires d’articles appariés anglais-allemand et 530 873 paires anglais-français. Ils ont utilisé un modèle de différence de différences de pseudo-maximum de vraisemblance de Poisson, qui permet d’estimer les changements en pourcentage dans les décomptes. Les auteurs estiment que la disponibilité par défaut de l’AI Overview a réduit les références mensuelles de recherche externe vers Wikipédia en anglais de 5,45 % par rapport à l’allemand et de 4,82 % par rapport au français.
Pour l’édition anglaise dans son ensemble, l’estimation équivaut à environ 100,27 millions de références de recherche en moins chaque mois, pour un total d’environ 1,20 milliard par an. Le chiffre mensuel est basé sur un modèle et l’estimation annuelle suppose que cet effet reste constant tout au long de l’année. Les deux chiffres ne tiennent compte que des références directes des moteurs de recherche et ne couvrent pas tout le trafic reçu par Wikipédia.
Les versions précédentes utilisaient des pages vues quotidiennement et signalaient une baisse d’environ 15 %. Le journal est ensuite passé à des références de recherche mensuelles et a ajouté des contrôles allemands et français dans la v5 le 26 août, avec davantage de mises à jour dans la v6 le 2 septembre.
Une vérification anglais-japonais dans la version actuelle montre une baisse de 16,53 %, en utilisant une période plus courte et un groupe de comparaison différent. Les auteurs notent que ce résultat est uniquement un support directionnel.
Ce que l’estimation ne prouve pas
Les données publiques de Wikimédia regroupent tous les moteurs de recherche externes, une limitation reconnue par le document. Google a déclaré à UOL Tilt que cela empêche l’analyse d’isoler Google, mais Yoganarasimhan a déclaré que d’autres moteurs ne gèrent qu’une petite partie du trafic et que l’analyse utilise la pause temporelle créée par le déploiement des aperçus de l’IA.
Cette estimation répond à une question précise. Il mesure ce qui est arrivé aux références lorsque les lecteurs anglophones se trouvaient dans un environnement où les aperçus IA étaient activés par défaut. L’expérience précédente dont j’ai parlé en avril a montré une baisse plus importante lorsque les aperçus de l’IA apparaissaient lors des recherches. Ainsi, bien que liées, ce sont des conclusions différentes.
Il compte les références des moteurs de recherche effectuées par des lecteurs humains, donc si quelqu’un arrive de Google et lit ensuite trois articles supplémentaires, cela compte comme une visite. La plupart des visiteurs de Wikipédia en anglais viennent de l’extérieur des États-Unis, ce qui atténue l’effet mesuré. De plus, la conception ne peut pas exclure complètement d’autres événements de 2024 affectant la recherche en anglais, mais pas la recherche en allemand ou en français.
L’estimation des revenus doit être considérée avec prudence. Les auteurs calculent qu’un site Web comparable financé par la publicité pourrait perdre entre 10,82 et 37,08 millions de dollars chaque année aux tarifs publicitaires habituels. Étant donné que Wikipédia lui-même n’affiche pas de publicité, ce chiffre est purement hypothétique et ne représente pas les finances réelles de Wikimédia ni les fonds transférés à Google.
Enfin, le document n’examine pas les effets à long terme, il ne donne donc pas d’informations sur l’activité d’édition, les dons ou si une diminution des visites pourrait avoir un impact sur la création de contenu future.
Wikimédia constate un changement de trafic plus large
Les données de la Fondation Wikimedia offrent une perspective différente. En octobre 2025, le directeur produit Marshall Miller a déclaré que le nombre total de pages vues dans toutes les langues de Wikipédia avait diminué d’environ 8 % par rapport à la même période en 2024. Cette information est intervenue après que Wikimedia ait amélioré sa détection des robots et reclassé le trafic de mars à août 2025. Les visites ont augmenté et semblaient provenir d’utilisateurs réels, principalement du Brésil, mais une grande partie de ce trafic était générée par des robots conçus pour contourner la détection.
Miller a attribué ce déclin à l’IA générative et aux plateformes de médias sociaux. Cependant, il a également souligné que les données réétiquetées doivent être considérées avec une certaine prudence car les méthodes de détection ont changé au fil du temps. Il s’agit ici du nombre total de pages vues par des humains, et non d’une estimation causale des aperçus de l’IA. Elle ne peut donc pas être ajoutée à l’estimation de 5 % du document.
J’ai discuté de cette mise à jour en octobre. En avril, le projet de plan de la Fondation pour l’exercice 2026-27 a souligné que la diminution des pages vues et la diminution des références de Google, ainsi que le trafic de robots que le plan qualifie de sans précédent, devraient se poursuivre plutôt que de constituer des problèmes à court terme. Le plan note également que près de 90 % des visiteurs de Wikipédia proviennent traditionnellement de la recherche Google.
La demande de machines ne cesse de croître
En avril 2025, les ingénieurs de la Fondation Wikimedia ont observé que la bande passante pour le téléchargement d’images et de fichiers multimédias avait augmenté de 50 % depuis janvier 2024. La majeure partie de cette augmentation provenait de robots grattant Wikimedia Commons pour la formation en IA plutôt que de lecteurs réguliers. Ils ont également noté que les robots représentaient au moins 65 % du trafic le plus coûteux, qui atteint les principaux centres de données, et environ 35 % des pages vues.
Un an plus tard, l’équipe a mentionné qu’elle bloquait ou limitait environ 30 % de ces requêtes automatisées provenant de robots d’exploration qui ignorent leurs politiques, et une note du graphique évalue le nombre de requêtes bloquées ou limitées à environ 1,5 milliard par jour. Le rapport explique que certains robots imitent les navigateurs classiques ou utilisent des proxys via les connexions Internet domestiques. L’objectif est d’orienter les réutilisateurs à grande échelle vers des canaux où ils peuvent s’identifier et recevoir des limites plus élevées, plutôt que d’arrêter la réutilisation.
Aucune de ces activités n’apparaît dans le décompte des références. Qu’il s’agisse d’un robot copiant un article à des fins de formation, d’un moteur de recherche le citant dans une réponse d’IA ou d’un lecteur cliquant sur cette réponse, toutes ces actions sont considérées comme des événements distincts. Seuls les clics sont comptabilisés comme références de recherche externe humaine dans les résultats de l’article.
Citation, visites et accès entreprise
L’analyse de Pew a révélé que les gens cliquaient rarement sur les sources contenues dans les résumés de l’IA. Ils ont examiné 68 879 recherches Google effectuées en mars 2025, provenant de l’activité de navigation de 900 adultes américains. Ils ont répété les recherches du 7 au 17 avril pour capturer les pages de résultats, ce qui signifie que la classification du résumé de l’IA est basée sur ces données ultérieures. Lorsque les visites incluaient un résumé IA, les gens cliquaient sur les résultats traditionnels 8 % du temps, contre 15 % lorsqu’il n’y avait aucun résumé. Seulement 1 % des visites de pages contenant un résumé de l’IA ont conduit à un clic sur une source contenue dans celui-ci. Wikipédia, YouTube et Reddit représentaient ensemble 15 % des sources citées, bien que Pew n’ait pas précisé la part exacte de Wikipédia.
Les propres documents de Google indiquent que les aperçus de l’IA guident les utilisateurs vers un plus large éventail de sites Web. Dans l’article de blog d’août 2025 de Liz Reid, il était indiqué que le volume total de clics organiques était resté « relativement stable » par rapport à l’année précédente, même si elle n’a pas fourni de chiffres exacts. Elle l’a également mentionné sur le podcast Odd Lots de Bloomberg en avril.
En novembre 2025, la Fondation a exhorté les développeurs d’IA à créditer correctement Wikipédia dans leurs productions et leur a demandé d’y accéder via Wikimedia Enterprise. Ils estiment que donner du crédit encourage un cycle dans lequel les lecteurs deviennent éditeurs et donateurs, mais ils préviennent également que moins de visites pourraient entraîner une diminution du nombre de bénévoles et de donateurs.
Wikimedia Enterprise est le service payant de la Fondation qui fournit un accès API à un volume élevé, y compris des contrats, des garanties de disponibilité, une assistance et des flux de données structurés. Il facture l’accès, et non le contenu lui-même, qui reste disponible gratuitement sur les chaînes publiques sous licences ouvertes, sous réserve des conditions de sa licence. Lane Becker, qui supervise le programme, a déclaré en juillet que ce modèle était basé sur l’accès plutôt que sur l’octroi de licences. Les revenus d’Enterprise sont plafonnés à 30 % des revenus annuels de la Fondation, a-t-il déclaré, et l’unité a déclaré un chiffre d’affaires de 8,3 millions de dollars pour l’exercice 2024-25.
En janvier, Wikimedia Enterprise a annoncé que Google était un client existant et, pour la première fois, Amazon, Meta, Microsoft, Mistral AI et Perplexity ont été présentés comme partenaires. En juillet, Wikimedia Enterprise a annoncé GNOMI comme autre partenaire. Wikimedia décrit Enterprise comme un service payant conçu pour un accès et une assistance à haut volume, plutôt que pour une compensation liée aux pertes de référencement.
Pourquoi Wikipédia est un test inhabituel
Les caractéristiques qui rendent Wikipédia mesurable limitent également la mesure dans laquelle ses résultats peuvent être utilisés. Wikimedia partage des données sur des articles dans de nombreuses langues et le journal compare les pages correspondantes dans différentes éditions linguistiques. La plupart des sites Web n’ont pas la capacité de faire ce genre de comparaisons.
Le document n’établit pas si les sites d’information, les détaillants ou d’autres types de sites Web subiraient des effets similaires. De plus, les sources ne précisent pas si d’autres organisations pourraient créer un service d’accès payant similaire à Wikimedia Enterprise.
Regarder vers l’avenir
Ce document est toujours un document de travail, reconstruit une fois et révisé à plusieurs reprises depuis février, de sorte que les chiffres sont les dernières estimations et non les chiffres définitifs. Nous mettrons à jour si de nouveaux chiffres des auteurs, de Wikimedia ou de Google changent la donne.
Plus de ressources :