Un client me transmet le rapport d’une agence. Une ligne en gras : « taux de citation dans les IA : 34 % ». Je demande d’où sort le chiffre. De cinquante questions, écrites par l’agence, posées une fois. Dix-sept réponses mentionnaient la marque.
Ce n’est pas une mesure, c’est un sondage. Et comme tout sondage, il dit surtout quelque chose de celui qui a rédigé les questions.
Une réponse générée ne laisse pas de clic. Elle laisse trois traces, et elles sont toutes chez vous.
Depuis peu, il existe enfin un chiffre de première main côté Google. Pour le reste, tout est déjà dans vos serveurs. Voilà où je vais chercher, et dans quel ordre.
1. Search Console publie les impressions IA, et rien d’autre
C’est une section à part dans Search Console. Le rapport de performances des fonctionnalités d’IA générative compte les impressions de votre site dans les AI Overviews et dans l’AI Mode, ventilées par page, par pays, par appareil et par date.
Ce qu’il ne donne pas : ni clics, ni taux de clic, ni requêtes. Cette absence n’est pas un manque à combler, c’est la description exacte du phénomène. Une réponse générée n’isole pas une requête et ne garantit aucun clic. Le rapport mesure une exposition, pas un trafic. Je ne le mets donc jamais dans la même colonne que les clics organiques, et je ne calcule aucun taux à partir de lui.
Deux pièges de lecture, avant d’en tirer quoi que ce soit. Le premier tient à l’agrégation : comme dans le rapport de performances classique, le graphique agrège par propriété et le tableau par page. Deux de vos URL citées dans la même réponse comptent pour une seule impression sur la courbe, et pour deux dans le tableau. Vos totaux ne tomberont pas juste, et ce n’est pas un bug. Le second est plus bête. Le rapport est déployé par vagues, toutes les propriétés ne l’ont pas encore. Et Search Console porte un réglage qui exclut purement et simplement un site des fonctionnalités d’IA générative.
Ce que j’en fais, concrètement : j’ouvre la dimension Pages, et elle seule. La question n’est pas « combien », elle est « par où ». Quelles pages l’IA emprunte pour répondre à votre place. Sur les dossiers que je suis, ce sont rarement les pages de service : ce sont les pages de fond, un guide, une méthode détaillée, un article un peu technique que personne n’avait mis en avant. Cette liste-là vaut un plan éditorial entier.
L’erreur la plus coûteuse
Lire un zéro et en tirer une conclusion. Trois causes mènent au même écran vide : la propriété n’a pas encore reçu le rapport, le site n’a pas assez d’impressions pour déclencher l’affichage, ou une case d’exclusion est cochée. Une seule des trois relève du contenu. On élimine les deux autres avant de lancer le moindre chantier éditorial.
2. Vos logs disent qui est passé, et pour quoi faire
Google mis à part, aucun assistant ne vous enverra de rapport. Mais tous passent par votre serveur, et tous laissent une ligne dans vos journaux. OpenAI, Anthropic et Perplexity ont convergé vers le même découpage en trois rôles, et c’est exactement ce dont on a besoin pour mesurer.
| Ce que vous voyez dans les logs | À quoi ça sert | Ce que ça vous dit |
|---|---|---|
GPTBot, ClaudeBot |
Collecte pour l’entraînement des modèles | Rien sur votre visibilité d’aujourd’hui. À sortir du comptage. |
OAI-SearchBot, Claude-SearchBot, PerplexityBot |
Index de recherche de l’assistant | Vous êtes candidat. Bloqués, vous sortez des réponses de recherche. |
ChatGPT-User, Claude-User, Perplexity-User |
Récupération déclenchée par une question d’utilisateur | Le signal le plus proche d’une citation en train de se faire. |
OAI-AdsBot |
Contrôle d’une page soumise comme publicité dans ChatGPT | Rien à voir avec l’organique. À ne jamais compter dedans. |
La troisième ligne est la seule qui m’intéresse vraiment. Un passage de ChatGPT-User ou de Perplexity-User sur une de vos URL, ce n’est pas du crawl : c’est quelqu’un, à cet instant, dont la question a mené jusqu’à votre page. C’est ce qui ressemble le plus à une citation, c’est daté à la seconde, et c’est déjà dans vos logs sans rien payer.
Ces robots-là ne jouent pas avec les mêmes règles que les autres, et ça change tout dès qu’on touche à son robots.txt. OpenAI écrit que les règles du robots.txt peuvent ne pas s’appliquer à ChatGPT-User, puisque l’action vient d’un utilisateur. La même page précise que se fermer à OAI-SearchBot fait disparaître le site des réponses de recherche de ChatGPT, même s’il peut encore y figurer en lien de navigation. Perplexity est encore plus net : Perplexity-User ignore généralement le robots.txt, là aussi parce qu’un humain a demandé la page. Côté Anthropic, fermer Claude-User revient à empêcher la récupération de votre contenu en réponse à une question, ce que la documentation qualifie elle-même de perte de visibilité.
Autrement dit : refuser l’entraînement n’empêche pas d’être récupéré à la demande. Les deux décisions sont séparées, chez les trois éditeurs, et c’est la seule raison pour laquelle ce débat reste tenable.
Ne comptez pas un passage sur la seule chaîne d’agent
Une chaîne d’agent se falsifie en trois secondes, et les scrapeurs ne s’en privent pas. Les trois éditeurs publient leurs plages d’adresses IP dans des fichiers ouverts, et un passage qui ne tombe pas dedans n’entre pas dans mon comptage. C’est la différence entre un indicateur et une impression de chiffre.
Le cas que je rencontre le plus souvent n’est d’ailleurs pas un problème de contenu, c’est un pare-feu. Une règle de sécurité, une extension, un pare-feu applicatif qui range ces robots parmi les indésirables. Perplexity va jusqu’à documenter la configuration à poser chez Cloudflare et chez AWS pour qu’on cesse de les bloquer, ce qui en dit long sur la fréquence du problème. Avant de payer un outil pour mesurer une absence, vérifiez que vous ne l’avez pas provoquée. Après correction, comptez environ vingt-quatre heures avant prise en compte.
3. Le peu de trafic qui arrive quand même
Restent les visites. Elles arrivent avec un référent lisible : chatgpt.com, perplexity.ai, claude.ai. Le volume est petit, et il le restera un moment.
Je ne regarde donc pas leur volume, je regarde leur taux de conversion et je le compare au reste du site. Un canal qui amène quarante sessions par mois ne pèse rien en volume. S’il convertit nettement mieux que la recherche classique, il pèse beaucoup en enseignement. La personne arrive déjà décidée : elle a posé sa question, elle a lu la réponse, elle vient vérifier chez vous. Ce n’est pas le même visiteur qu’un clic de position 7.
Ce chiffre est un plancher, pas un total : toutes les visites issues d’un assistant ne portent pas un référent exploitable. Il se pose dans un segment dédié plutôt que noyé dans le direct, par la mécanique décrite dans l’article sur ce que GA4 ne voit plus.
4. Ce qu’un outil de suivi mesure vraiment
Les plateformes qui interrogent les assistants à votre place gardent leur usage : elles servent à lire ce qui se dit de vous, le ton, les concurrents qui sortent à votre place. Elles ne servent pas à mesurer combien. Le taux de citation qu’elles affichent est celui de l’échantillon de questions que vous avez choisi. Changez les questions, le taux change. J’ai détaillé ailleurs la méthode de monitoring et les outils du marché ; ce qui suit ne les remplace pas, ça les remet à leur place.
Google le dit lui-même, dans sa documentation officielle : aucun outil tiers n’a accès à ses systèmes internes de classement ou d’IA. Il invite d’ailleurs à se méfier de ceux qui prétendent utiliser des métriques « internes ». La même page porte deux points qui vont contre ce qu’on lit partout.
Le premier : de son point de vue, optimiser pour la recherche générative, c’est optimiser pour la recherche. Le sigle GEO, pour generative engine optimization, décrit un marché de prestations, pas une technique séparée du travail SEO habituel.
Le second me concerne directement. J’ai publié ici un article sur llms.txt et le contrôle de ce que les IA lisent. Google écrit désormais noir sur blanc que sa recherche ignore ces fichiers : en créer ne nuit ni n’aide au classement. Le fichier garde son sens pour les systèmes tiers qui le lisent, il n’en a aucun pour Google. Le reste de l’article tient, ce point-là est à corriger.
Une dernière chose, vraiment utile : Google décrit comment ses réponses se construisent. Les systèmes vont chercher des pages dans l’index de recherche pour ancrer la réponse, et le modèle génère au passage une série de questions annexes autour de la demande initiale. Sur « comment rattraper une pelouse envahie de mauvaises herbes », il ira aussi chercher « désherbant sélectif gazon » et « désherber sans produit chimique ». Vous n’êtes donc pas cité parce que vous répondez à la question de l’utilisateur, mais parce que vous répondez à l’une de celles que la machine s’est posées à sa place. Ça change la façon d’écrire une page bien plus que n’importe quel fichier à la racine.
Les trois chiffres que je garde
Un par source, relevé une fois par mois, et rien de plus.
- Les impressions IA générative par page, dans Search Console, lues comme un classement plutôt que comme un total : quelles pages Google emprunte pour répondre.
- La part de mes pages à valeur commerciale qui ont reçu au moins un passage d’un robot « utilisateur » dans le mois, IP vérifiée. C’est mon indicateur de citation, et il est de première main.
- Le taux de conversion des sessions référées par un assistant, comparé au taux global du site.
Ce que je ne suis plus : la position moyenne sur des requêtes que plus personne ne tape telles quelles, et le taux de citation d’un panel de questions maison. Le premier mesure un monde qui rétrécit, le second mesure surtout le talent de celui qui a écrit le panel. Le tout se centralise dans le même tableau de bord que le reste, ce que je détaille côté analytics et reporting.
Au creuset : peser une visibilité qui ne laisse pas de clic
Trois traces, donc. Un compteur d’impressions chez Google, une ligne de journal sur votre serveur, une session avec un référent inhabituel. Aucune ne remplace le clic qu’on avait avant, et il ne reviendra pas. Ensemble, elles suffisent à répondre aux deux seules questions qui comptent : est-ce que j’existe dans ces réponses, et par quelles pages.
Le reste, ce sont des sondages. Bons pour écouter ce qui se dit de vous, incapables de dire combien.
Vous ne savez pas si les IA passent chez vous ?
Envoyez-moi un extrait de vos logs serveur sur trente jours et un accès en lecture à votre Search Console. Je vous rends la liste des pages que les assistants sont venus chercher, celles que Google emprunte dans ses réponses, et les robots que votre hébergement bloque sans vous l’avoir dit. Au pire vous confirmez que tout passe, au mieux vous débloquez en une ligne de configuration une visibilité que vous pensiez devoir acheter.