← Tous les articles

La recherche, c'est devenu nul

Sur cette page

L’AI Overview de Google a récemment dit à ses utilisateurs que des astronautes avaient rencontré des chats sur la Lune1. Il a conseillé d’ajouter de la colle sur une pizza pour que le fromage ne glisse pas2. Début 2025, il a prétendu pendant un temps que nous étions encore en 20243. Ce ne sont pas des cas isolés. Ce sont les symptômes d’un problème bien plus large, qui démonte sans bruit les fondations économiques d’internet.

Pendant que les géants de la tech se battent pour coller des résumés générés par des LLM partout, les éditeurs perdent leur trafic et leurs revenus à flots. Les calculs sont brutaux, les hallucinations inquiétantes, et les revenus publicitaires censés faire tenir les éditeurs à flot s’effondrent.

2 Md$ perdus, et ça continue

Les chiffres donnent le vertige. Entre mai 2024 et mai 2025, les 500 éditeurs les plus visités au monde ont perdu plus de 600 millions de visites, passant de 2,3 milliards à 1,7 milliard4. Ça fait 64 millions de visites perdues par mois en moyenne, soit environ 2 milliards de dollars de revenus publicitaires envolés5.

La baisse est régulière et sévère. CNN a perdu 30 %. Business Insider et HuffPost, 40 % chacun.4 Mais le cas le plus frappant, c’est The Planet D, un blog de voyage qui a fermé après avoir perdu 90 % de son trafic à l’arrivée des AI Overviews. La perte de trafic n’explique sans doute pas à elle seule cette fermeture6.

Ce n’est pas une phase d’ajustement passagère, c’est un changement structurel. Les recherches sans clic sont passées de 56 % à 69 % en un an seulement7. Quand Google affiche un AI Overview, les utilisateurs cliquent vers les sites d’éditeurs 8 % du temps au lieu de 15 %, soit une baisse de 46,7 % du taux de clic8.

L’IAB Tech Lab ne tourne pas autour du pot : les éditeurs subissent une « 20-60% traffic reduction (up to 90% for niche sites) »5. Pour la plupart d’entre eux, c’est la différence entre tenir et faire faillite.

La pub ne comblera pas ce que les LLM prennent

C’est là que l’économie devient vraiment perverse. Supposons que ChatGPT tienne ses projets publicitaires. D’après l’analyse d’Incrmntal, « ChatGPT could increase revenues by 16.5x to 24.8x, potentially reaching $26 billion annually » avec un modèle financé par la pub, comparable à celui de Meta ou de Google9.

Ça paraît génial, jusqu’à ce qu’on réalise que les créateurs du contenu d’origine ne touchent strictement rien.

Les chiffres des crawlers racontent l’histoire. D’après l’analyse de Cloudflare, le ratio entre pages crawlées et visites renvoyées d’Anthropic est de 50 000:1. Pour chaque visite que Claude envoie à un éditeur, ClaudeBot l’a crawlé 50 000 fois. OpenAI fait mieux avec 887:1, et Perplexity avec 118:1, mais ce sont toujours des relations d’extraction qui se font passer pour de la symbiose10.

Et ça empire. L’entraînement représente 80 % du crawl des bots d’IA.10 Ces bots ne font même pas semblant de renvoyer du trafic. Ils aspirent le contenu pour construire des modèles qui réduiront encore la raison d’aller voir les sources d’origine.

Même si ChatGPT atteint ses 26 milliards de dollars de revenus, les éditeurs restent face au même problème : leur contenu sert à générer de l’argent ailleurs, pendant que leur propre trafic, et donc leurs revenus publicitaires, continue de s’effondrer. L’ARPU actuel de ChatGPT est de 0,67 $ contre 5,12 $ chez Google et 3,38 $ chez Meta. Sam Altman a dit lui-même que « OpenAI is losing money on the $200-per-month subscription tier. »9

Le modèle, c’est de l’extraction, pas un partenariat.

Tu n’obtiens même pas une information exacte

L’ironie, c’est que les LLM détruisent les revenus des éditeurs sans même fournir une information fiable en échange.

Les meilleurs modèles de 2025 (Gemini-2.0-Flash de Google, GPT-4o, Claude 3.5) affichent des taux d’hallucination de 0,7 % à 2 % dans des benchmarks contrôlés11. Ça semble acceptable, jusqu’à ce qu’on les déploie sur des milliards de recherches.

Et ce sont les bons modèles. Falcon-7B-Instruct tombe à 29,9 % d’hallucinations, soit près d’une réponse sur trois fausse avec aplomb. Selon le domaine, l’écart est énorme : l’information juridique atteint 6,4 % d’hallucinations, contre 0,8 % pour les connaissances générales11.

Les travaux du SEI sur la fidélité des résumés de LLM notent que « Accuracy generally measures how closely hallucinations output by the LLM » s’alignent sur les sources, et que l’écart est souvent important12.

Les AI Overviews de Google sont devenus un cas d’école de l’erreur sûre d’elle. Au-delà des chats lunaires et de la colle sur la pizza, ces résumés apparaissent sur 69 % des recherches et sont souvent la seule chose que les gens lisent. Quand tu te trompes 1 à 2 % du temps sur des milliards de requêtes, tu pollues l’écosystème de l’information, mécaniquement.

La BBC l’a déjà appris à ses dépens quand ses résumés de notifications générés par un LLM se sont mis à produire n’importe quoi. 77 % des entreprises se disent inquiètes des hallucinations de l’IA, selon de récentes enquêtes, et elles ont raison11.

La situation est absurde. Des faits et des hallucinations sont mélangés dans un format qui a l’air d’autorité, servis à des lecteurs incapables de les distinguer, pendant que les journalistes et les vérificateurs d’origine perdent l’argent dont ils ont besoin pour produire une information exacte.

Produire du contenu devient économiquement intenable

Ça crée un cercle vicieux. Des éditeurs qui perdent 25 à 40 % de leur trafic4 ne peuvent pas maintenir le même niveau d’investissement dans un journalisme de qualité. Moins de revenus, c’est moins de vérification rigoureuse, moins de reporters spécialisés, plus de contenu bon marché.

Ce contenu bon marché devient les données d’entraînement de la prochaine génération de LLM, qui produisent encore plus d’hallucinations, ce qui réduit encore la raison de visiter les sites d’éditeurs, ce qui réduit encore leurs revenus. C’est une spirale de la mort pour l’information de qualité.

Le calcul est implacable. 64 millions de visites perdues par mois, multipliées par le revenu publicitaire moyen par visite, ça fait des millions que les éditeurs ne retrouveront pas. Quand Condé Nast, le New York Times, Gannett et Reddit soutiennent tous la nouvelle initiative de Cloudflare sur le contrôle des crawlers, c’est parce qu’ils voient où ça mène13.

Les petits éditeurs ferment déjà. Les moyens licencient. Les gros cherchent désespérément à négocier des accords d’entraînement avec les IA, rien que pour récupérer une fraction de ce qu’ils perdent en trafic. Rien de tout ça n’est tenable.

L’IAB Tech Lab a observé un bond de 117 % du trafic de bots, qui sature l’infrastructure des éditeurs sans rien apporter en retour5. Les éditeurs paient la bande passante et les serveurs pour nourrir des bots qui sapent directement leur modèle économique.

La voie proposée

L’intervention de Cloudflare est un début. Son système Pay Per Crawl, qui bloque par défaut les crawlers d’IA depuis le 1er juillet 2025, a déjà attiré plus d’un million de clients. Le PDG Matthew Prince a été direct : « If the Internet is going to survive the age of AI, we need to give publishers the control they deserve. »13

Roger Lynch, de Condé Nast, a ajouté que « permission-based approach makes way for new business model. »13 C’est exactement ce qu’il faut : une vraie permission, une vraie rémunération, une vraie viabilité.

Le cadre de l’IAB Tech Lab propose plusieurs solutions : une tarification au crawl, une monétisation par API de requêtes et une intégration du Model Context Protocol. Ce sont des points de départ raisonnables, mais ils supposent que les entreprises d’IA jouent le jeu de bonne foi.

Aujourd’hui, les incitations sont toutes à l’envers. Les entreprises d’IA peuvent aspirer librement, entraîner leurs modèles sur le contenu des éditeurs, servir des résumés qui empêchent les gens de cliquer, puis peut-être (peut-être) reverser une toute petite part de leurs revenus publicitaires, loin de compenser ce que les éditeurs ont perdu.

Ça ne diffère pas de l’aspiration du texte d’œuvres littéraires ou de la transcription d’un film. Cela dit, la position de Cloudflare dans cette affaire pourrait aussi se lire comme une façon de protéger ses propres intérêts commerciaux.

Encore un peu d’inconfort

Le modèle économique d’internet n’a jamais été parfait. Les bannières et le jeu SEO ont créé leurs propres problèmes. Mais il y avait au moins un échange de valeur qui fonctionnait : les éditeurs créaient du contenu, les gens visitaient les sites, les annonceurs payaient pour l’attention, et le cycle continuait.

Les LLM ont cassé ce cycle. Ils extraient du contenu à très grande échelle (souviens-toi du ratio de 50 000:1), le synthétisent en résumés plus ou moins exacts, et servent ces résumés à la place des sources d’origine. Les créateurs reçoivent 46,7 % de trafic en moins et la suggestion polie d’être reconnaissants pour les miettes qui restent.

Ce n’est pas tenable. Tu ne peux pas détruire le modèle de revenus qui finance le journalisme de qualité et t’attendre à ce qu’il continue d’exister. Tu ne peux pas entraîner des modèles sur le contenu des éditeurs tout en supprimant le modèle économique qui paie la création de ce contenu.

Regarde The Sun ou le Daily Mail, géants du journalisme britannique d’hier, ombres d’eux-mêmes aujourd’hui… mais probablement pas à cause de l’IA.

Soit les entreprises d’IA rémunèrent vraiment les éditeurs pour les données d’entraînement et l’attribution, soit on finit avec un internet où le seul contenu produit est celui qui survit sans trafic et sans revenus. C’est une course vers le bas qui se termine avec des LLM entraînés sur du contenu de plus en plus médiocre, qui produisent des réponses de moins en moins fiables, pour des utilisateurs qui ne trouvent plus d’information exacte nulle part.

Les 600 millions de visites perdues ne reviendront pas. La question, c’est de savoir si on va bâtir un système qui rémunère vraiment ceux qui créent le contenu, ou si on va regarder tout l’écosystème s’effondrer pendant que les entreprises d’IA fêtent la hausse de leurs revenus publicitaires.

Je sais sur quelle issue je parierais, et ce n’est pas la plus optimiste.

References

Footnotes

  1. WION News, Google’s AI search under fire for falsely claiming Obama is Muslim, astronauts played with cats on Moon, May 2024 ↩

  2. NBC News, Glue on pizza? Google’s AI faces social media mockery, May 2024 ↩

  3. TechCrunch, Google fixes bug that led AI Overviews to say it’s now 2024, May 2025 ↩

  4. Infactory, The Numbers Don’t Lie: Publishers Are Losing 25% of Their Traffic to AI Platforms, 2025 ↩ ↩2 ↩3

  5. IAB Tech Lab, LLM Framework, 2025 ↩ ↩2 ↩3

  6. IAB Tech Lab, Dude, AI ate my traffic, 2025 ↩

  7. StanVentures, Similarweb: Zero-Click Searches Surge to 69% Since Google AI Overviews Launched, 2025 ↩

  8. Pew Research Center, Google users are less likely to click on links when an AI summary appears in the results, July 2025 ↩

  9. Incrmntal, LLM Advertising, 2025 ↩ ↩2

  10. Cloudflare, AI crawler traffic by purpose and industry, 2025 ↩ ↩2

  11. Multiple sources including web search data on LLM hallucination rates, 2025 ↩ ↩2 ↩3

  12. Carnegie Mellon University Software Engineering Institute, Evaluating LLMs for Text Summarisation: Introduction, 2025 ↩

  13. Cloudflare, Cloudflare just changed how AI crawlers scrape the internet at large, 2025 ↩ ↩2 ↩3