Pendant que vous lisez ceci, un LLM parcourt votre site Web. Perplexity traite plus de 400 millions de recherches par mois, ChatGPT en traiterait 1,1 milliard, et Google AI Overview représente une part croissante des 255 milliards de recherches mensuelles. Mais obtiennent-ils la bonne information?
Pourquoi vous devriez penser à votre site Web comme à une base de données
Le développement des grands modèles de langage — les LLM — reflète un changement croissant dans la perception et l'utilisation des sites Web : tant pour les humains que pour les robots, incluant les LLM. Cela impose de nouvelles exigences sur notre façon de travailler avec les sites Web, tant sur le plan technique que tactique, si nous voulons suivre l'évolution et surfer sur la vague.
Pendant longtemps, nous avons conçu et développé les sites Web comme une sorte de brochure numérique. Il s'agissait de « pages » plus ou moins statiques, optimisées pour les humains. Mais les systèmes d'IA ne lisent pas les sites Web visuellement, comme le font les humains. Ils cherchent des données pour structurer et comprendre le contenu. Une structure que nous bâtissons normalement à l'aide d'API.
Avec les LLM, il faut repenser tout cela. Les données et la représentation doivent être séparées. Le CMS headless a été un pas important dans cette direction, et il s'est aussi frayé un chemin dans les plus grandes organisations et entreprises. Mais pas seulement parce que c'est une tendance technique. Non, c'est une occasion stratégique pour les entreprises.
Les LLM créent de nouvelles occasions d'affaires et changent les règles du jeu. Cela s'applique autant à la visibilité — lorsque des clients potentiels demandent (« prompt ») des sujets où vous êtes expert, pensez à Google AI Overview, Perplexity et ChatGPT — qu'à la convivialité.
Votre site Web deviendra bien plus qu'une vitrine. C'est du marketing, de la recherche utilisateur et du développement d'affaires — tout en un. En fonction du comportement des utilisateurs, vos données et votre contenu peuvent être optimisés pour la pertinence en utilisant, par exemple, l'intégration vectorielle (vector embedding), de sorte qu'ils soient présentés d'une manière qui correspond au mieux au profil utilisateur présumé. Votre site Web pourra échanger des actions avec d'autres agents d'IA. Des agents qui agiront en votre nom, en comparant par exemple des produits et en complétant potentiellement le processus d'achat, tout comme vous pourrez orchestrer d'énormes quantités de connaissances et de médias, en interne comme en externe, à travers différents modèles.
Le besoin d'une nouvelle norme
Comment gérer la façon dont les LLM demandent des données à votre site Web?
Le Model Context Protocol (MCP) semble être la voie à suivre. L'entreprise américaine Anthropic a développé cette norme ouverte, qui, après seulement huit mois, est déjà adoptée par Google et OpenAI . Mon expérience jusqu'à présent démontre un grand potentiel, et je ne me souviens pas d'avoir vu une norme adoptée aussi rapidement et aussi largement.
Il s'agit d'une manière standardisée pour les systèmes d'IA de communiquer avec vos données. Ainsi, tout comme robots.txt guide les robots d'indexation de Google, MCP.txt, s'il devient une norme, pourra guider les futurs services d'IA pour accéder aux données et aux fonctionnalités des sites Web et les utiliser de façon optimale.
Il existe déjà une autre proposition de norme : llms.txt. Selon moi cependant, cette solution manque de vision, car elle vise un type de modèle spécifique. Vu les développements que nous avons vus en IA, nous devrions rester ouverts à l'idée d'une évolution dans les types de modèles également. MCP a ici un avantage clair, puisqu'il rend les données et les fonctionnalités accessibles à tous les modèles disposant d'un client MCP.
L'avenir appartient à ceux qui sont préparés
Tout comme le design réactif est devenu obligatoire après la révolution mobile, une architecture prête pour l'IA devient maintenant essentielle à la survie. Une voie qui assure une communication optimisée, sécuritaire et efficace entre votre serveur, vos données et les LLM.
J'espère et je crois que MCP deviendra la norme de l'industrie. Il vous faudra donc définir le « contexte » avec MCP. Vous devez contrôler quelles données sont échangées avec les LLM et les autres modèles, et en quelle quantité.
Si vous voulez surfer sur la vague des LLM, il faut prendre le contrôle de vos données, de votre architecture, de votre sécurité, et vous affranchir de décennies de compréhension classique des sites Web. La question n'est pas de savoir si l'IA deviendra votre plus grand utilisateur — elle le deviendra — mais plutôt si vous pourrez gérer et tirer profit de votre visiteur le plus fréquent.



