Mesurer la visibilité de sa marque dans ChatGPT
La visibilité IA ne se résume ni à une position ni à une capture d’écran. Elle se mesure avec un échantillon documenté, des catégories distinctes et une comparaison à périmètre constant.
Une réponse de ChatGPT peut changer d’une session à l’autre. La formulation, le contexte conversationnel, la langue, l’accès éventuel au web et l’évolution du produit influencent le résultat. Une mesure utile ne prétend pas éliminer cette variabilité : elle l’encadre afin de détecter des tendances suffisamment stables pour guider une décision.
L’unité de base est un test admissible : un prompt défini, soumis dans des conditions enregistrées, qui produit une réponse exploitable. Un échec technique ou un refus de répondre ne doit pas être silencieusement compté comme une absence de marque. Le rapport doit indiquer les exclusions.
Construire un panel qui représente le parcours client
Une liste composée uniquement de requêtes contenant le nom de votre entreprise surestime la visibilité réelle. Les prompts de marque évaluent surtout la connaissance et l’exactitude. Pour mesurer la découverte, ajoutez des demandes non marquées correspondant aux problèmes, catégories, comparaisons et situations d’achat de vos prospects.
- Découverte : « quels outils permettent de suivre la visibilité dans les moteurs IA ? »
- Problème : « comment savoir si ChatGPT recommande mes concurrents ? »
- Comparaison : « solution A ou solution B pour une agence ? »
- Contrainte : budget, langue, pays, taille d’équipe ou intégration requise.
- Marque : prix, fonctionnalités, réputation ou alternatives à votre produit.
Étiquetez chaque prompt par intention, thème, marché, langue et segment. Faites valider le panel par les équipes ventes, support et produit : elles connaissent les formulations réelles. Gardez un noyau fixe pour suivre la tendance et placez les nouveaux essais dans une cohorte séparée jusqu’à disposer d’un historique comparable.
Séparer les événements au lieu de créer un score opaque
Le taux de présence est la proportion de réponses admissibles qui nomment la marque au moins une fois. Une répétition du nom dans la même réponse ne compte pas plusieurs présences. Documentez les variantes orthographiques et contrôlez manuellement les homonymes.
(réponses avec mention ÷ réponses admissibles) × 100Le taux de recommandation compte uniquement les réponses qui présentent réellement la marque comme un choix adapté. Une apparition dans une liste, une comparaison neutre et une mise en garde ne sont pas équivalentes. Définissez une grille : recommandée en premier, recommandée, simplement citée, déconseillée ou indéterminée.
La couverture de citation mesure les réponses qui affichent explicitement un lien vers un domaine que vous contrôlez. Elle ne doit pas être confondue avec la présence. ChatGPT peut nommer une entreprise en citant un média tiers, ou citer une documentation sans reprendre le nom de la marque.
Ajoutez ensuite le sentiment, la justesse factuelle et la part de voix concurrentielle. Le sentiment décrit le ton, alors que la justesse vérifie les prix, les caractéristiques ou la disponibilité. Une phrase positive mais fausse reste un incident à corriger. La part de voix compare les mentions observées dans un groupe de concurrents fixe ; publiez sa formule et ses dénominateurs.
Organiser une collecte comparable
Enregistrez pour chaque test le prompt exact, la date, la langue, le marché, le moteur ou la surface utilisée, la réponse brute, les marques détectées et les sources visibles. Si une session conserve un historique conversationnel, notez-le : un suivi automatique sans contexte et une conversation personnalisée ne répondent pas à la même question.
Une collecte quotidienne peut révéler un changement rapide, mais elle ne vous oblige pas à décider chaque jour. Une lecture hebdomadaire et un rapport mensuel sont souvent plus rationnels. La cadence dépend du volume, de la volatilité et du coût d’une erreur. Ce qui compte est de comparer des fenêtres homogènes.
Prévoyez une revue humaine des cas incertains. Un classificateur peut confondre une marque et un produit, interpréter une réserve légitime comme négative ou manquer une recommandation implicite. Les réponses sensibles — erreurs de prix, accusations, informations réglementaires — méritent une vérification prioritaire.
Exemple de tableau de bord
Imaginons 40 prompts suivis dans deux configurations de ChatGPT sur deux dates : 160 tests prévus. Six échouent selon les règles établies, donc 154 réponses sont admissibles. La marque apparaît dans 46 réponses, est recommandée dans 19 des 90 réponses à intention commerciale et son domaine est cité dans 12 réponses.
| Indicateur | Calcul | Résultat illustratif |
|---|---|---|
| Présence | 46 ÷ 154 | 29,9 % |
| Recommandation | 19 ÷ 90 | 21,1 % |
| Citation du domaine | 12 ÷ 154 | 7,8 % |
| Réussite de collecte | 154 ÷ 160 | 96,3 % |
Ces nombres sont un exemple de méthode, pas une référence sectorielle. Pour agir, il faut segmenter : les absences se concentrent-elles sur un thème, une langue ou une intention ? Les concurrents occupent-ils les réponses grâce à leurs pages ou grâce à des comparateurs tiers ? Les citations renvoient-elles vers des pages capables de convertir ?
Passer du constat à la décision
Une baisse de présence sur une cohorte stable appelle d’abord une analyse des prompts perdus, pas une refonte générale du site. Une présence stable accompagnée d’une baisse des citations peut signaler que la marque reste connue mais que ses pages servent moins de preuve. Une recommandation faible malgré de nombreuses mentions indique souvent un positionnement indistinct, des réserves récurrentes ou un manque de validation externe.
Reliez les données de réponse aux indicateurs de site sans promettre une attribution parfaite : visites provenant de services IA lorsqu’un référent est disponible, pages d’entrée, conversions et réponses à la question « comment nous avez-vous connus ? ». Une recommandation peut influencer un achat sans clic traçable. Parlez d’association observée, pas de causalité prouvée.
Ce que votre mesure ne peut pas affirmer
- Le panel représente les prompts suivis, pas toutes les conversations possibles.
- Un score propriétaire n’est comparable entre outils que si la méthode, les moteurs et les pondérations le sont.
- Une citation visible prouve qu’une source a été affichée, pas qu’elle a causé toute la réponse.
- Une variation après une publication ne prouve pas que cette publication en est l’unique cause.
- La personnalisation et les changements de produit peuvent rompre la comparabilité.
La meilleure mesure reste modeste dans ses conclusions et précise dans ses preuves. Commencez par le guide comment apparaître sur ChatGPT, puis utilisez la GEO pour organiser les actions qui découlent des lacunes observées.
Suivez un panel de prompts sans perdre les preuves
Bee LLM centralise réponses, mentions, concurrents, sentiment et sources citées afin que votre équipe compare les mêmes conversations dans le temps.
Créer un suivi gratuit