Quelqu'un dans l'équipe ouvre ChatGPT, tape le nom de l'entreprise et obtient un paragraphe amical. La capture d'écran atterrit sur Slack. C'est en général la dernière fois que quelqu'un mesure.
La réponse n'est pas une preuve. Le compte connecté, les chats précédents, les instructions personnalisées et la formulation exacte de ce prompt unique ont tiré la réponse vers vous. Mesurer la visibilité IA, c'est jeter ce test. À la place, il faut une méthode reproductible : un jeu de questions fixe, des sessions qui ne vous connaissent pas, plus d'un moteur, et une règle de scoring écrite avant d'avoir vu les chiffres. Un outil peut exécuter cette boucle. Il ne peut pas inventer les questions. Lisez aussi : recommandation IA pour les fournisseurs : faits pour la shortlist - les lacunes de contenu qui apparaissent en zéros sur les questions à contraintes.
Dans cet article :
- Pourquoi demander à ChatGPT votre propre marque ne prouve rien ?
- Que faut-il réellement mesurer ?
- D'où viennent les questions ?
- Comment l'exécuter, et à quelle fréquence ?
- Tableur, licence SaaS ou self-hosting ?
- Comment lire la ventilation ?
- Comment voir le trafic IA dans Analytics, et que rapporter ?
- Questions fréquentes
Pourquoi demander à ChatGPT votre propre marque ne prouve rien ?
ChatGPT connecté se souvient de vous. Les chats passés, les instructions personnalisées et tout ce que le produit déduit de votre compte tirent la réponse vers les marques dont vous parlez déjà. Vous êtes la dernière personne à faire le test, car le système essaie de vous être utile - pas à un acheteur qui n'a jamais entendu votre nom.
Un seul run reste une anecdote. Posez la même question deux fois dans une session fraîche, et la shortlist bouge souvent. Cela arrive pour trois raisons ordinaires, et aucune n'est une conspiration contre votre marque.
La première est la façon dont le modèle écrit. Il ne consulte pas une liste stockée de fournisseurs approuvés. Il génère la réponse token par token, avec un peu d'aléatoire sur le mot suivant. Deux runs avec le même prompt peuvent donc citer des entreprises différentes, même si rien n'a changé sur le web.
La deuxième est la récupération. Pour beaucoup de questions, l'assistant récupère aussi des pages pendant qu'il répond, et les pages trouvées ne forment pas une bibliothèque fixe. Un classement crawlé hier, le tableau de specs d'un concurrent mis en ligne ce matin, un fil de forum un peu mieux classé aujourd'hui : chacun peut entrer dans la réponse au run suivant et en sortir au suivant.
La troisième est la formulation. « Meilleures pompes de cale pour yachts » et « quelle pompe submersible 12 V convient à un casier de 400 mm en eau salée » semblent proches pour un humain et sont des jobs différents pour un modèle. Ils tirent des sources différentes et renvoient des noms différents. Si vous ne posez que la version brandée, vous paraissez visible et manquez quand même aux prompts qui décident l'achat.
La méthode qui suit est ennuyeuse - c'est pourquoi elle fonctionne. Figez les questions et notez-les. Quand vous changez une formulation, donnez-lui un numéro de version pour que le score du mois dernier garde le même sens. Exécutez le jeu dans un état propre : déconnecté, via une API, ou via un outil sans votre historique. Puis répétez. Plusieurs runs par question, sur plus d'un moteur, avant de traiter une absence comme une absence.
Que faut-il réellement mesurer ?
Il vous faut quatre chiffres. Chacun cache ce que les autres ne montrent pas - une seule headline reste donc incomplète.
Mention rate (taux de mention) est la part de questions où la marque est citée du tout. C'est le chiffre pour la slide, car il répond : « Sommes-nous dans la réponse ? » Ce qu'il cache, c'est où vous êtes apparu. Une mention à la phrase sept d'une longue réponse n'est pas la même chose que le premier nom sur une shortlist à trois.
Citation rate (taux de citation) est la part de réponses qui lient votre domaine. Il ne correspond souvent pas au taux de mention. Les modèles citent des entreprises qu'ils ne peuvent pas pointer, et lient des pages qui ne vous nomment jamais. Le taux de citation est celui qui peut devenir une visite, car un lien est cliquable. Si le taux de citation reste à zéro alors que le taux de mention semble bon, vérifiez si les fetchers atteignent vos pages - voir une IA peut-elle vraiment lire votre site web.
Position est l'endroit dans la réponse où la marque apparaît. Sur une shortlist de trois, le premier nommé est celui que l'acheteur retient. Si vous comptez « mentionné quelque part » comme victoire, vous rapporterez un chiffre que vous ne pourrez plus expliquer à qui lit vraiment les réponses.
Share of voice est vos mentions face à toutes les mentions de fournisseurs dans la catégorie. Les comités l'aiment car cela ressemble à une part de marché. Cela induit vite en erreur. Le dénominateur est qui le modèle a cité cette semaine avec cette formulation - pas le vrai panel concurrentiel. Utilisez-le comme une coupe à observer, pas comme le chiffre à piloter.
Écrivez la règle de scoring avant le premier run. Décidez à l'avance ce qui compte : mention d'une filiale, mention sans lien, page concurrente qui vous cite, liste « marques comme X » où vous passez en passant. Si vous changez la règle après les chiffres, la baseline est déjà inutilisable, car vous ne saurez pas si le score a bougé ou si c'est l'examen qui a changé.
Voici une ligne remplie pour que le tableur ne reste pas abstrait. L'entreprise est fictive. Les réponses sont inventées pour montrer les colonnes - pas tirées d'un run live.
| Date | Moteur | Q | Formulation | Run | Mention | Citation | Position | Ce que la réponse disait vraiment |
|---|---|---|---|---|---|---|---|---|
| 2026-08-26 | ChatGPT | 5 | v1 | 2 | Non | Non | aucune | Deux autres fabricants de pompes cités. Classement « best bilge pumps 2026 » lié. Pas de Northwake. |
Conservez le texte brut de la réponse à côté des coches. C'est dans la formulation que vous voyez pourquoi vous avez manqué : le modèle voulait une taille jamais publiée, a utilisé le prix de l'an dernier, vous a confondu avec un nom proche, ou a fait confiance à un classement qui ne vous a jamais demandé de faits.
D'où viennent les questions ?
Les questions inventées mesurent vos hypothèses. Les vraies viennent des endroits où les acheteurs ont déjà parlé.
Tirez-les de la boîte commerciale et des notes de deals perdus, des documents RFI, des tickets support, des appels enregistrés avec consentement, des requêtes Search Console en forme de question, et des forums que vos acheteurs utilisent vraiment. Gardez les mots de l'acheteur, y compris les approximatifs. Notez la source et la date d'ajout de chaque question, pour voir plus tard quelles sources ont produit les manques qui comptent.
Le jeu doit couvrir plus que « connais-tu notre nom ? » Un acheteur qui a déjà votre marque en tête n'est pas la même personne que celui qui a demandé à un assistant de nommer trois fournisseurs pour un casier.
| Type | À quoi ça sert | Part approximative |
|---|---|---|
| Brandé | Le modèle peut-il parler de vous du tout ? | Petit. Assez pour vérifier la reconnaissance d'entité. |
| Catégorie et « best of » | Apparaissez-vous quand personne ne vous a nommé ? | Grand. C'est la shortlist. |
| Sensible au problème | Survivez-vous à un paragraphe de contraintes ? | Grand. C'est ainsi que les acheteurs demandent vraiment. |
| Comparaison | Que se passe-t-il quand ils ont déjà deux noms ? | Moyen. |
| Coût | Peut-il citer un prix, une fourchette, ou un honnête « non publié » ? | Moyen. |
| Segment | Un autre acheteur, même produit. | Quelques-unes. |
| Géographie et langue | Le même job sur un autre marché. | Séparer le jeu. Ne pas faire la moyenne. |
Un jeu surtout brandé produit un chiffre confortable - et inutile. Vous paraissez présent et restez invisible sur les prompts qui décident le deal. Douze à vingt questions bien sourcées, avec quelques formulations chacune, valent mieux que cinquante écrites en atelier. Vous voulez une lecture stable par type, pas un chiffre rond qui fait sérieux en slide.
Voici un jeu de départ pour une marque fictive de pompes marines, Northwake. Nous ne vendons pas de pompes. La liste montre la forme - remplacez chaque ligne par des questions de votre boîte mail.
- Northwake est-elle une bonne marque de pompes de cale marines ?
- Qui fabrique les pompes Northwake, et où sont-elles produites ?
- Meilleures pompes de cale pour yachts
- Quelles entreprises fabriquent des pompes submersibles 12 V pour l'eau salée ?
- Il me faut une pompe de cale pour un casier de 400 mm, 12 V, entièrement submersible en eau salée avec des impuretés
- Pompe de cale silencieuse pour cabine de yacht, moins de 15 A
- Northwake 400 versus Tidewell 400 pour un yacht de 12 m
- Lequel des deux a des pièces détachées en Europe ?
- Combien coûte une pompe de cale pour yacht ?
- Northwake publie-t-elle des prix catalogue pour la gamme 400 mm ?
- Pompe de cale pour bateau de pêche commerciale, pas yacht de plaisance
- Pompe pour bateau de travail immobilisé des mois au port
- Fournisseurs de pompes de cale marines en Allemagne
- Qui vend des pompes de cale pour yacht avec service en Europe du Nord ?
Les questions 1 et 2 vous flattent si l'entité est connue. Les questions 5, 6, 11 et 13 deviennent des pages, car ce sont celles qu'un acheteur tape vraiment avant d'avoir une shortlist. Si la réponse dit que votre indice IP ou vos dimensions manquent, le correctif est en général du texte lisible sur la page, pas une FAQ brandée de plus - voir texte dans les images et SEO, pourquoi les specs en image seule font échouer search et fetchers.
Figez un noyau et laissez-le tranquille. Quand le marché bouge, ajoutez des questions avec un nouveau numéro de version. Si vous remplacez silencieusement la ligne 5, vous croirez qu'un changement de contenu a déplacé la métrique alors que vous avez changé l'examen.
Pour les splits géographie et langue, traitez chaque marché comme un sous-ensemble propre plutôt que de moyenner les scores - le même schéma qu'un catalogue multilingue où une langue rank et une autre reste invisible.
Comment l'exécuter, et à quelle fréquence ?
Le schéma est simple - et c'est la partie qui doit tenir dans un an : couvrir les endroits où vos acheteurs demandent vraiment, et plus d'un type de récupération, car ces surfaces divergent. Assistant chat, moteur de réponses riche en citations, et ce que Google fait avec des réponses générées en recherche sont des jobs différents. L'une peut vous citer à chaque fois pendant qu'une autre ne le fait jamais. Cette séparation est un premier résultat normal. Ce n'est pas un bug de la méthode.
Les produits dans ces emplacements vont bouger. À la rédaction, un exemple ressemble à ChatGPT, Perplexity, et Google AI Overviews ou AI Mode, plus Copilot, Claude ou Gemini seulement si les conversations commerciales les citent déjà. Ne traitez pas cette liste comme la méthode. Demandez à votre équipe où les deals commencent, mettez ces surfaces dans le tableur, et ignorez celles que personne n'utilise sur votre marché juste parce qu'un classement les a nommées.
Vous n'avez pas besoin de chaque moteur dès le jour un. Deux ou trois de types différents montrent déjà si le manque est « nous sommes inconnus » ou « nous sommes inconnus sur cette surface ». Ajoutez-en un autre seulement si quelqu'ira lire ce split supplémentaire.
Certaines surfaces demandent encore un humain. Produit chat connecté, barre latérale navigateur, réponse seulement après relance : APIs et scrapers ratent cela. Prévoyez quelques runs manuels pour les questions qui décident les deals, et automatisez le reste.
Une baseline complète une fois, puis un sous-ensemble plus léger en rythme. Les questions contraintes centrales toutes les deux semaines ou mensuellement suffisent à la plupart des équipes. Revenez à la longue traîne quand vous avez une raison - nouveau marché, page fraîchement publiée. Des scores quotidiens sur 200 prompts paraissent occupés. Ils changent rarement ce que vous écrirez la semaine prochaine.
Enregistrez les réponses, pas seulement les coches. Un manque qui dit « aucune pompe de cette taille listée avec indice IP » est une tâche contenu : vous n'avez jamais publié l'indice. Un manque qui vous cite mais attribue un modèle arrêté l'an dernier est une tâche correction : le modèle a trouvé une source vieille. Les deux scorent pareil si vous ne stockez que oui/non - et vous envoyez la mauvaise personne corriger la mauvaise chose.
Tableur, licence SaaS ou self-hosting ?
Chaque outil payant de visibilité IA exécute la même boucle que vous venez de lire : jeu de questions, plusieurs moteurs, score. Acheter ne remplace pas la boucle. Cela la scale, pour poser plus de questions plus souvent sans que quelqu'un colle dans un chat tout l'après-midi.
En août 2026 le marché se divise en trois voies. Les noms ci-dessous sont des exemples de catégorie, pas un classement. La liste va bouger.
| Tableur, sessions propres | Plateformes GEO dédiées, ou add-on suite SEO | Self-hosting | |
|---|---|---|---|
| Couverture | Quelques moteurs, autant de runs que vous avez d'heures | Large, planifiée | Ce que vous connectez |
| Qui écrit les questions | Vous | Vous, plus la liste par défaut du vendeur | Vous |
| Réponses brutes | Si vous les collez | Variable. Certaines gardent le texte, d'autres un score | Vous les stockez |
| Benchmarks concurrents | Manuel | Souvent dans le produit | Seulement les noms que vous collectez |
| Coût | Temps | Par seat, par prompt, ou les deux | Temps engineering plus factures API |
| Maintenance | Vous | Le vendeur | Vous |
Les plateformes dédiées dans cette catégorie incluent notamment Profound, Peec et Otterly. Les suites SEO avec tracking ajouté : Semrush AI toolkit, Ahrefs Brand Radar. Nous publions une option self-host, Ansvisor. Licence MIT, vous gardez prompts et réponses, la formule de scoring est dans le dépôt. Il n'invente pas de données concurrentes que vous n'avez jamais collectées, et ne remplace pas un humain sur les surfaces sans API utilisable. Tableur plus navigateur déconnecté reste légitime pour la première semaine.
Acheter gagne quand personne ne maintient de scripts, vous avez besoin de share of voice concurrent que vous ne pouvez pas collecter vous-même, et le comité veut un tableau de bord avant la prochaine réunion.
Le self-hosting gagne quand les questions qui décident les deals doivent rester les vôtres, vous avez besoin des réponses brutes dans six mois, et le prix par seat devient absurde quand le jeu grossit. Vous assumez aussi les changements de format, rate limits, et l'écart entre réponse API et ce que l'utilisateur voit dans le produit. Cet écart est réel. Un pipeline n'est pas la même chose qu'être dans le chat.
La plupart des équipes atterrissent en hybride : outil acheté pour la largeur, petit jeu possédé pour les dix questions qui closent vraiment le travail. Le jeu possédé est celui que vous scorez à la main quand le tableau de bord et la boîte commerciale divergent.
Comment lire la ventilation ?
La moyenne est le chiffre le moins intéressant du tableur.
40 % de taux de mention peut vouloir dire : présent sur chaque question brandée, absent sur toutes les contraintes. Ou : visible en anglais, disparu en allemand. Ou : ChatGPT vous cite, Perplexity jamais. Trois situations, même headline, trois backlogs différents - la headline n'est pas ce sur quoi vous agissez.
Scindez les résultats par moteur, langue et type de question avant de brief quiconque. En général vous ne voyez pas un zéro propre partout. Un taux global correct avec un trou dans une coupe. Ce trou est le travail.
Un manque devient une page quand la question est réelle, les ventes s'y intéressent, et rien sur une URL lisible ne répond. Une liste de manques n'est pas un plan - dix zéros sans lien produiront dix FAQ minces. Regroupez d'abord. Un tableau de specs peut fermer trois questions contraintes. Dix FAQ minces n'en ferment aucune bien. Les pages qui corrigent les manques contraintes sont celles qu'un CMS devrait déjà supporter - champs typés, tableaux, HTML crawlable, décrits dans 10 fonctionnalités SEO qu'un CMS moderne devrait avoir.
Ne traitez pas un mouvement d'une semaine comme preuve qu'une nouvelle page a fonctionné. Les réponses sautent pour les mêmes raisons que le premier test mentait : échantillonnage, récupération, formulation. Il faut un sous-ensemble figé, assez de runs, et du temps avant de revendiquer une cause. Jusque-là, rapportez présence et lacunes. Pas que l'article de blog « a déplacé ChatGPT ».
Comment voir le trafic IA dans Analytics, et que rapporter ?
Certains assistants passent un referrer. Dans GA4, cherchez des hostnames comme chatgpt.com et perplexity.ai et construisez un segment. Beaucoup de chats ne passent rien - la visite atterrit en Direct, mélangée avec ceux qui ont tapé l'URL. First-touch et last-touch mentent dans cette situation, car la recherche s'est faite dans une conversation que vous ne possédez pas.
Les tags UTM sur vos propres liens aident encore pour les campagnes que vous contrôlez. Ils ne taguent pas une citation inside ChatGPT. Si le modèle vous cite et l'acheteur tape votre homepage, Analytics ne saura pas que ChatGPT était impliqué.
Google Search Console est une autre fenêtre - et ne regarde que Google. Le 3 juin 2026 Google a lancé les Search generative AI performance reports. Ils montrent des impressions quand vos URLs sont apparues dans AI Overviews, AI Mode, et fonctionnalités génératives dans Discover. La première version, ce sont des impressions : combien de fois une page a été montrée dans ces fonctionnalités. Pas de clics, pas de requêtes déclencheuses, pas de ChatGPT. Les rapports se déployaient sur un sous-ensemble de sites - si vous ne les voyez pas encore, c'est le déploiement, pas une intégration manquante de votre côté.
Search Console dit donc si les surfaces IA de Google ont montré vos pages. Votre jeu de questions dit si ChatGPT vous a cité. GA4 parle de la tranche de visites qui portent encore un referrer. Aucun des trois n'est l'image entière. Mettez-les côte à côte. Ne les additionnez pas en un chiffre « trafic IA » à piloter. Pour le côté crawl et index qui alimente ces surfaces Google, le SEO technique reste la base.
Ce dont le comité a besoin est plus petit qu'un graphique de sessions. Exposure : sur les questions qui décident les deals, combien de fois vous êtes cités, et sur quels moteurs. Lacunes : quels types de questions ou langues restent à zéro. Corrections : où le modèle se trompe sur vous, et si la source de l'erreur est encore live. Passez la sparkline de trafic Direct. Elle rebondira, et lancera une dispute que personne ne pourra finir.
Questions fréquentes
Pourquoi ChatGPT donne-t-il des réponses différentes à la même question ?
Parce qu'il ne récupère pas une fiche de faits stockée. Chaque fois il génère la réponse avec un peu d'aléatoire - le mot suivant n'est pas entièrement déterminé, deux prompts identiques peuvent produire deux shortlists. Sur beaucoup de questions il récupère aussi des pages pendant la réponse, et les pages trouvées peuvent changer d'heure en heure. Si vous changez même quelques mots du prompt, vous lui donnez un job différent - attendez-vous à des noms différents. Si vous êtes connecté, la mémoire et les chats précédents tirent la réponse vers vous en plus de tout cela. Mesurer à travers le bruit : figer la formulation, session propre, traiter plusieurs runs comme les données. Une réponse est une histoire.
Combien de trafic vient vraiment de l'IA ?
Il n'y a pas une part unique pour chaque site. Une tranche de visites apparaît en referrals des hostnames d'assistants. Une autre se cache en Direct, car le chat n'a pas passé de referrer. Une large part de l'influence ne devient jamais session : l'acheteur a eu trois noms et est allé au gagnant sans toucher vos Analytics. C'est pourquoi le jeu de questions compte plus qu'un pourcentage de trafic. Mesurez combien de fois vous êtes cités et liés. Traitez GA4 comme une vue partielle des visites, pas la taille de l'opportunité.
Puis-je voir les referrals IA dans GA4 ?
Certains. Construisez un segment referral pour les hostnames que vous voyez vraiment dans les rapports. Attendez-vous à une sous-estimation - beaucoup de chats envoient le visiteur sans referrer. N'utilisez pas ce segment comme seul chiffre à rapporter.
Qu'est-ce qu'un bon score de visibilité IA ?
Il n'y a pas de bon score universel - le chiffre est une moyenne sur vos questions. Un jeu chargé de prompts brandés paraîtra fort. Un jeu chargé de prompts contraintes paraîtra plus faible et dira plus. Jugez le mouvement sur les questions qui décident les deals, contre votre propre baseline, pas contre un pourcentage vu sur la capture de quelqu'un d'autre.
Dois-je acheter un outil de visibilité IA ?
Achetez si vous avez besoin de volume, d'un bench concurrent, et que vous ne ferez pas tourner de scripts. Le jeu de questions et la règle de scoring restent les vôtres. Un seat qui ne lance que les prompts par défaut du vendeur rapportera sur un marché qui n'est pas le vôtre. Un tableur pendant une semaine suffit pour voir si vous avez un problème brandé-only ou contraintes. Décidez après, pas avant.
Lancer une baseline cette semaine
Copiez le tableau de scoring de plus haut. Prenez douze questions de la boîte mail, pas d'un brainstorm. Exécutez-les sur deux ou trois surfaces que vos acheteurs utilisent déjà, plusieurs fois chacune, déconnecté. Scorez mention, citation et position, et lisez les zéros par type plutôt qu'en une moyenne.
Si vous avez besoin de volume et de benchmarks concurrents, choisissez un seat dans la catégorie qui correspond à votre façon d'acheter des logiciels. Si vous voulez les questions et réponses brutes sur des machines que vous contrôlez, self-hostez. Nous maintenons Ansvisor pour cette voie.
Si vous avez déjà un site et voulez savoir s'il est en forme pour que les modèles vous trouvent et vous citent, écrivez-nous. Envoyez l'URL. Nous ferons un audit : si les pages sont lisibles, si vous apparaissez sur les questions que les acheteurs posent vraiment, et où sont les trous. Vous aurez le tableur dans tous les cas.