Web 4.0 : l'internet pragmatique
Sur cette page
Le web a évolué par vagues, chacune bâtie sur les réussites et les ratés de la précédente. Mais on arrive à un carrefour où les rustines ne règlent plus les problèmes d’architecture de fond. Il est temps de repenser le fonctionnement d’internet avec pragmatisme.
Web n+1.0
Le Web 1.0, c’étaient des pages statiques. Simple, bancal, mais révolutionnaire : tu pouvais chercher et lire une information depuis n’importe où dans le monde. Ce web en lecture seule a fait son boulot de 1989 à 2004, avec du HTML de base et des systèmes de fichiers.
Le Web 2.0 nous a apporté l’interaction sociale, les plateformes et la collaboration. Il a tout centralisé, mais ça a marché : le web est devenu utilisable et participatif. De 2004 à 2010, les contenus créés par les utilisateurs et les réseaux sociaux ont transformé notre façon d’utiliser internet.1 Le secret : la rétrocompatibilité et des promesses claires, qui ont tiré l’adoption.
Le Web 3.0 promettait la décentralisation, des standards de web sémantique et une propriété garantie par la blockchain. Il a échoué lamentablement, et pas pour une seule raison. Deux visions se sont affrontées : le web sémantique de Tim Berners-Lee, avec RDF et OWL, et le web décentralisé fondé sur la blockchain. Le web sémantique n’a réuni que 4 millions de domaines en 2013, malgré plus de 20 ans de développement.2 Il a buté sur ce qu’Aaron Swartz appelait la « formalising mindset of mathematics », qui produit des standards « so abstract that few ever saw widespread adoption » (si abstraits que peu ont réellement été adoptés).3 Pendant ce temps, les projets blockchain affichent 90 % d’échecs,4 avec des limites de passage à l’échelle et des problèmes d’expérience utilisateur de fond.
Nos données ne sont toujours pas organisées
Voilà le rappel à la réalité que les discussions actuelles sur le « Web 4.0 » ratent complètement :
- Le HTML reste le format de base des documents, et il est nul pour porter du sens structuré
- Les sites sont tous différents, à la poursuite des modes du design et de l’identité de marque, ce qui donne souvent de faux signaux sur la qualité et la confiance
- Certains services se parlent entre eux (cartes, avis, paiements), mais c’est surtout du patchwork
- Les utilisateurs sont lassés des interfaces incohérentes, et les agents d’IA ne peuvent pas bosser correctement parce que chaque service expose ses données à sa façon
Les preuves s’accumulent. Plus de 80 % des projets d’IA échouent, soit le double des projets informatiques sans IA,5 en grande partie parce que les LLM ne savent pas interpréter directement les données HTML. Ils sont entraînés sur du texte linéaire, alors que le HTML est une structure en arbre. Akamai compte aujourd’hui plus de 600 millions de requêtes par jour venant du scraping par IA,6 avec de faibles taux de réussite à cause de la qualité des données.
On y était presque. Les balises meta, schema.org et OpenGraph étaient prometteurs. Aujourd’hui, plus de 45 millions de domaines utilisent les données structurées Schema.org,7 et les succès sont impressionnants : Rakuten a vu son trafic grimper de 270 % après avoir ajouté le schéma de recettes,8 et des chaînes de magasins américaines ont obtenu 2 % de clics en plus avec les résultats enrichis pour les produits.8 Mais l’adoption n’est venue que là où le SEO ou le marketing y trouvaient un intérêt clair. Ça n’a jamais remodelé l’architecture du web.
Oui, la BD de XKCD sur « encore un standard » reste drôle. Mais sans un web plus léger, structuré et guidé par l’intention, l’IA ne sera jamais la couche d’interface qu’on voudrait.
Web 4.0 : moins de design, plus d’organisation
Le Web 4.0, ce n’est pas du jargon creux de plus ni des gadgets clinquants. C’est organiser enfin les données du web en structures cohérentes, lisibles par les machines, qui servent les humains, les agents d’IA et les interfaces de demain qu’on n’a pas encore imaginées.
Ça ne veut pas dire adieu au design et à la concurrence. Les entreprises continuent d’exprimer leur marque avec des logos, des couleurs, un ton, des images. Ce qui disparaît, c’est la différenciation lourde et bancale de l’UX qui oblige à réapprendre chaque service.
À la place, le web repose sur sept primitives.
1. Intentions
Ce que fait réellement un service : réserver un taxi, commander à manger, lire un article, comparer des prêts immobiliers. Chaque service déclare ses capacités dans un format lisible par les machines.
2. Contextes
L’information structurée nécessaire pour décider : des menus avec les allergènes, les niveaux de stock, les prix en temps réel, les caractéristiques des produits, les créneaux de disponibilité.
3. Actions
La façon dont tu interagis vraiment : commander, réserver, annuler, s’abonner, comparer. Chaque action a des entrées et des sorties prévisibles.
4. Marque
Des points d’accroche de design maîtrisés pour l’identité et l’expression, sans casser la cohérence. Ton logo, tes couleurs et ta voix restent, mais dans un cadre cohérent.
5. Identité
Des signaux d’identité fédérée qui marchent partout. Tu utilises Apple ID, Google, Microsoft, ou ta propre identité décentralisée. La vérification des entreprises fonctionne de la même façon. Le marché mondial de la gestion des identités et des accès devrait passer de 17,80 milliards de $ (2023) à 61,74 milliards de $ (2032),9 ce qui montre l’ampleur de l’investissement pour résoudre ces problèmes d’identité éclatée.
6. Finance
Un traitement des paiements abstrait. « Payer 20 £ » marche quels que soient les rails sous-jacents : carte, virement, portefeuille numérique ou crypto. Le marché des API de paiement en ligne passe de 200 millions de $ à 306,5 millions de $ d’ici 203210 à mesure que les organisations cherchent des solutions de paiement unifiées.
7. Contrats
Chaque échange laisse une piste d’audit structurée : reçus, factures, conditions, abonnements, garanties. Des contrats numériques avec exécution programmatique.
Un nouveau modèle de confiance
Aujourd’hui, la vérification de l’âge est l’un des plus gros cauchemars d’UX du web. Les gouvernements l’exigent, les sites se débattent avec des solutions pataudes, les utilisateurs perdent leur vie privée. 62 % des consommateurs européens abandonnent une application à cause de la friction de la vérification.11
Avec le Web 4.0, un site demande simplement : « Cet utilisateur a-t-il plus de 18 ans ? » et reçoit un signal de confiance de ton navigateur. Ce signal vient du fournisseur d’identité de ton choix. Le site ne voit ni ta date de naissance, ni ton numéro de passeport, ni ton genre. Juste le minimum requis : oui ou non.
Cette approche qui protège la vie privée devient réalité. La solution open source de preuve à divulgation nulle de connaissance de Google en 202512 et la preuve de concept de la CNIL en France13 montrent que c’est faisable. Les preuves à divulgation nulle de connaissance permettent de vérifier sans révéler les données sous-jacentes, une technologie clé pour un web qui met la vie privée d’abord.
C’est le modèle pour toutes les données sensibles. L’identité devient un système d’échanges de confiance limités à ce qui est nécessaire, pas des formulaires à remplir à l’infini. Tu dois prouver ta tranche de revenus pour un devis de prêt ? Ton fournisseur signale « Palier 3 » sans révéler ton salaire exact. Tu veux du contenu réservé aux adultes ? Tu envoies « 18+ » sans donner ta date de naissance.
Une rémunération juste pour l’entraînement des IA
La publicité ne disparaît pas dans le Web 4.0, mais elle est encadrée. Ce sont les plateformes, et non les sites, qui décident de la façon dont les pubs sont représentées. Les revenus restent, les dark patterns disparaissent.
Pour l’entraînement des IA, le Web 4.0 règle la crise d’équité qui approche. Quand des systèmes d’IA veulent utiliser ton contenu, ils passent par des échanges de contenu structurés, avec une rémunération juste.
Cloudflare a ouvert la voie en juillet 2024 avec son initiative « Content Independence Day »,14 devenant le premier fournisseur d’infrastructure à bloquer par défaut les robots d’IA sans autorisation ni compensation. Son système « Pay Per Crawl »15 permet aux éditeurs de fixer un prix par requête, et de gros éditeurs comme The Atlantic et Associated Press soutiennent le modèle. Ce n’est pas de la théorie, ça se passe maintenant.
La vie privée comme architecture par défaut
La plupart des interactions n’exigent pas de tout dévoiler. Tu n’as pas besoin de donner ton genre pour obtenir un prix de vol. Tu n’as pas besoin de ton adresse personnelle pour consulter le menu d’un restaurant.
Dans le Web 4.0, ton fournisseur d’identité gère l’échange de données. Seule l’information nécessaire circule. Les compagnies aériennes reçoivent le paiement et les détails du passager uniquement au moment de payer. Les restaurants reçoivent l’adresse de livraison uniquement quand tu commandes vraiment.
Ça veut dire moins de données accumulées, moins de fuites, plus de confiance. Le marché du chiffrement homomorphe a atteint 30,51 millions de $ en 2024,16 et 74 % des institutions financières déploient des technologies qui protègent la vie privée et permettent de calculer sans exposer les données sous-jacentes.
Pourquoi c’est important
Pour les utilisateurs : une seule expérience cohérente, que ce soit par assistant vocal, navigateur ou réalité augmentée. Fini de réapprendre chaque service. Les assistants vocaux actuels montrent le problème : la précision de Google Assistant est passée de 98 % (2017) à 88 % (2019)17 malgré les progrès techniques, en grande partie à cause d’une mauvaise intégration des données structurées.
Pour l’IA : enfin une façon structurée et universelle d’interagir avec l’économie réelle. Les approches actuelles échouent parce que chaque service demande son propre scraping et sa propre interprétation.
Pour les entreprises : une intégration plus simple, un développement moins cher, moins de travail en double. Les organisations entretiennent aujourd’hui des équipes dédiées pour chaque combinaison de plateformes, parmi plus de 63 000 variantes possibles de navigateur, de plateforme et d’appareil.18
Pour la concurrence : les services de comparaison et d’agrégation prospèrent parce que les données sont accessibles et cohérentes. Fini l’enfermement dans une plateforme, qui rapporte des milliards aux acteurs dominants et étouffe l’innovation.
Pour la vie privée : tu partages seulement ce qui est nécessaire, quand c’est nécessaire, avec des garanties cryptographiques sur l’usage des données.
Tirer les leçons des échecs
Le web sémantique a échoué parce que l’idéologie a pris le pas sur l’exécution. La vision de Tim Berners-Lee a souffert de standards sur-conçus, qu’Aaron Swartz décrivait comme « uniformly scourges on the planet, offenses against hardworking programmers ».19 Des standards « so abstract that few ever saw widespread adoption ».20
Le Web 4.0 en tire les leçons. Au lieu d’ontologies complexes et de cadres théoriques, on propose sept primitives concrètes qui résolvent de vrais problèmes. Au lieu d’exiger un remplacement complet, les implémentations Schema.org existantes peuvent évoluer pas à pas vers le cadre du Web 4.0.
Les approches actuelles du Web 3.0 fondées sur la blockchain répètent les mêmes erreurs : l’idéologie avant l’usage. Le taux d’échec de 90 % des projets21 montre ce qui arrive quand la technologie mène au lieu de suivre les besoins des utilisateurs.
La voie pragmatique
Cette structure ne tue pas la créativité. Elle la force à s’épanouir dans des contraintes, comme les règles de design d’iOS ont donné une génération d’applis à la fois fonctionnelles et belles. Suivre les principes de design d’iOS fait gagner 30 % d’engagement et baisser de 20 % les interactions ratées.22
Le Web 4.0 n’est pas une refonte radicale qui casse tout. C’est l’évolution pragmatique dont le web a cruellement besoin :
- Bâti sur des fondations éprouvées : l’adoption de Schema.org prouve que les données structurées marchent quand les incitations sont claires
- Il s’attaque à de vrais points de douleur : identité éclatée, complexité des paiements, atteintes à la vie privée, échecs d’intégration de l’IA
- Il ouvre de nouvelles possibilités : interfaces vocales, agents d’IA, réalité augmentée, tous avec des données structurées et cohérentes
- Il préserve ce qui marche : les sites existants continuent de fonctionner tout en gagnant des capacités structurées
Le web doit marcher pour les interfaces qu’on construit aujourd’hui et pour celles qu’on n’a pas encore imaginées. Il faut pour cela sortir du bazar actuel d’API éclatées, de schémas incohérents et de collecte de données hostile à la vie privée, et aller vers des fondations propres, organisées et pragmatiques.
Le fond du sujet
Le Web 3.0 a échoué parce que l’idéologie a primé sur la réalité. Le battage actuel autour du « Web 4.0 » tombe dans le même piège, en se concentrant sur les mots à la mode au lieu de résoudre de vrais problèmes.
Notre vision du Web 4.0 n’est pas du jargon creux de plus. C’est un web de données enfin organisées, structurées en intentions, contextes, actions, identité et contrats. Un web qui marche avec l’interface que tu préfères : assistants vocaux, agents d’IA, navigateurs classiques ou modes d’interaction à venir.
Un web moins lourd, plus centré sur l’information, qui met la vie privée d’abord.
Un web qui marche vraiment.
Footnotes
-
Chohan, Usman W. “Web 3.0: The Future Architecture of the Internet?” SSRN, 2022. https://papers.ssrn.com/sol3/papers.cfm?abstract_id=4037693 ↩
-
Berners-Lee, Tim. “Semantic Web Road map.” W3C Design Issues, 1998. https://www.w3.org/DesignIssues/Semantic.html ↩
-
“Whatever Happened to the Semantic Web?” Two Bit History, May 27, 2018. https://twobithistory.org/2018/05/27/semantic-web.html ↩
-
“Concept and Dimensions of Web 4.0.” ResearchGate, 2017. https://www.researchgate.net/publication/321366810_Concept_and_Dimensions_of_Web_40 ↩
-
“The Root Causes of Failure for Artificial Intelligence Projects and How They Can Succeed.” RAND Corporation, 2024. https://www.rand.org/pubs/research_reports/RRA2680-1.html ↩
-
“The Rise of the LLM AI Scrapers: What It Means for Bot Management.” Akamai, 2024. https://www.akamai.com/blog/security/rise-llm-ai-scrapers-bot-management ↩
-
“Schema Markup Statistics 2025.” Amra & Elma, 2025. https://www.amraandelma.com/top-schema-markup-statistics-2025/ ↩
-
“Schema Success Stories: Using Structured Data to Boost Traffic.” Search Engine Journal, 2020. https://www.searchenginejournal.com/schema-success-stories-structured-data-boost-traffic/372734/ ↩ ↩2
-
“DID and VC: Untangling Decentralized Identifiers and Verifiable Credentials for the Web of Trust.” ACM Digital Library, 2021. https://dl.acm.org/doi/fullHtml/10.1145/3446983.3446992 ↩
-
“Online Payment API Market to Reach $306.5 Million, Globally, by 2032 at 5.2% CAGR.” GlobeNewswire, August 5, 2024. https://www.globenewswire.com/news-release/2024/08/05/2924113/0/en/Online-Payment-API-Market-to-Reach-306-5-Million-Globally-by-2032-at-5-2-CAGR-Allied-Market-Research.html ↩
-
“Age Verification: Methods & Compliance Explained.” Ondato Blog, 2024. https://ondato.com/blog/what-is-age-verification/ ↩
-
“Opening up ‘Zero-Knowledge Proof’ technology to promote privacy in age assurance.” Google Blog, July 2025. https://blog.google/technology/safety-security/opening-up-zero-knowledge-proof-technology-to-promote-privacy-in-age-assurance/ ↩
-
“Exploring Privacy-Preserving Age Verification: A Close Look at Zero-Knowledge Proofs.” New America, 2024. https://www.newamerica.org/oti/briefs/exploring-privacy-preserving-age-verification/ ↩
-
“Content Independence Day: no AI crawl without compensation!” Cloudflare Blog, July 4, 2024. https://blog.cloudflare.com/content-independence-day-no-ai-crawl-without-compensation/ ↩
-
“Introducing pay per crawl: enabling content owners to charge AI crawlers for access.” Cloudflare Blog, January 2025. https://blog.cloudflare.com/introducing-pay-per-crawl/ ↩
-
“Homomorphic Encryption Market Size & Share Trends, 2033.” Global Growth Insights, 2024. https://www.globalgrowthinsights.com/market-reports/homomorphic-encryption-market-110929 ↩
-
“5 major flaws of Voice Assistant technology in 2022.” Fleksy Blog, 2022. https://www.fleksy.com/blog/5-major-flaws-of-voice-assistant-technology-in-2022/ ↩
-
“Understanding Browser and Device Fragmentation.” BrowserStack Blog, 2024. https://www.browserstack.com/blog/understanding-browser-os-and-device-fragmentation/ ↩
-
Cagle, Kurt. “Why the Semantic Web Has Failed.” LinkedIn, 2016. https://www.linkedin.com/pulse/why-semantic-web-has-failed-kurt-cagle ↩
-
“Whatever Happened to the Semantic Web?” Two Bit History, May 27, 2018. https://twobithistory.org/2018/05/27/semantic-web.html ↩
-
“Concept and Dimensions of Web 4.0.” ResearchGate, 2017. https://www.researchgate.net/publication/321366810_Concept_and_Dimensions_of_Web_40 ↩
-
“The Negative Impact of Mobile-First Web Design on Desktop.” Nielsen Norman Group, 2019. https://www.nngroup.com/articles/content-dispersion/ ↩