
5 oct. 2026
Ce que mesure réellement votre score de visibilité sur ChatGPT
Par Amine Aziz Alaoui, responsable de la recherche sur les LLM, GetMint Research
Cet article résume un document de recherche rédigé par Amine Aziz Alaoui, docteur en mathématiques appliquées et responsable de la recherche sur les LLM chez GetMint Research : Un modèle de mesure pour la visibilité des marques dans les réponses de ChatGPT.
Une part croissante de la découverte de produits se fait désormais au sein d'assistants d'intelligence artificielle comme ChatGPT. La visibilité dans ces outils devient une priorité pour chaque marque. Pour l'améliorer, il faut d'abord la mesurer. La plupart des outils vous donnent un chiffre quotidien sans marge fiable. Lu de cette manière, ce chiffre peut ne signifier que très peu de choses. Le risque est de dépenser du temps et de l'argent à mesurer et optimiser un chiffre qui ne dit rien sur votre marque. Cet article explique pourquoi, et comment l'éviter.
Document complet : Un modèle de mesure de la visibilité des marques dans les réponses de ChatGPT (prépublication v1.3, 5 octobre 2026).
Votre score de visibilité IA est la part des réponses de ChatGPT à une question qui citent votre marque. Il fluctue chaque jour, même quand rien n'a changé.
ChatGPT a une humeur du jour pour chaque question. C'est ce que nous appelons la météo du jour. Posez la même question 100 fois aujourd'hui et vous obtiendrez un certain score. Reposez-la 100 fois demain et vous obtiendrez un score différent. Votre marque n'a rien fait de différent. ChatGPT se comporte simplement différemment ce jour-là : il choisit d'autres sources et rédige ses réponses d'une autre manière. Sur une question, cette humeur fait varier le score d'environ 14 points d'un jour à l'autre. Elle s'estompe en deux ou trois jours.
Votre score quotidien mélange quatre éléments. Votre visibilité réelle, la météo du jour, les mises à jour de ChatGPT et le hasard. Seule votre visibilité réelle mérite d'être suivie.
Répéter la question le même jour n'élimine pas l'humeur du jour. Toutes les réponses à une même question un jour donné partagent largement la même humeur. Ainsi, le score d'une seule question mesuré sur une journée peut être faussé d'environ ±28 points, même avec 1 000 réponses.
La précision s'obtient en multipliant les questions et les jours. Chaque question et chaque jour ont leur propre humeur, de sorte que les humeurs s'annulent lorsque vous les combinez. Environ 20 questions sémantiquement proches, ciblant toutes le même besoin, posées chacune une fois par jour et analysées sur 14 jours : le score est fiable à environ ±7 ou ±8 points près, en dehors des jours de mise à jour de ChatGPT.
ChatGPT change sans avertissement. De mai à juillet 2026, nous avons identifié 7 jours où les marques que nous suivons ont évolué de concert. Pour 6 d'entre eux, aucune annonce publique n'avait été faite à ces dates.
Ce que cela change pour vous : définissez des groupes d'environ 20 questions sémantiquement proches exprimant le même besoin ou la même intention de recherche, analysez deux semaines de données, ignorez les variations situées dans la marge d'erreur et vérifiez s'il y a eu une mise à jour de ChatGPT avant de réagir à une baisse.
Pourquoi votre score varie chaque jour
Votre score de visibilité IA était de 46 % hier. Aujourd'hui, il affiche 41 %. Personne n'a rien publié. Aucun concurrent n'a lancé d'offensive. Si vous suivez votre marque sur ChatGPT, vous avez déjà vécu cela.
Un score de visibilité est la part des réponses de ChatGPT à une question qui nomment votre marque. ChatGPT ne répond jamais deux fois de la même manière. Posez la même question deux fois et votre marque peut apparaître dans une réponse et pas dans l'autre. Votre score est donc une estimation, comme un sondage. Un sondage indique « 30 %, à 3 points près ». Votre score a lui aussi besoin de cette marge. Peu d'outils l'affichent : un comparatif réalisé en 2026 sur neuf outils de veille n'en a trouvé que deux qui en publiaient une.

Cela est crucial pour vos décisions. Prenons un sujet composé de 20 questions, posées chacune 30 times le même jour. La plupart des outils afficheraient une marge de ±4 points, car ils ne prennent en compte que le hasard. La marge réelle est d'environ ±7 points, car la météo du jour vient s'y ajouter. Une variation qui semble réelle sur leur tableau de bord peut être purement météorologique. Poser chaque question plus de 30 fois ce jour-là n'aide presque pas : avec 100 réponses par question, la marge reste d'environ ±7. Vous payez pour plus de trois fois plus de réponses sans presque rien y gagner. De plus, 6 des 7 changements de ChatGPT que nous avons identifiés n'ont fait l'objet d'aucune annonce publique. Sans la bonne marge d'erreur et un moyen de repérer ces changements, vous réagissez à des fluctuations qui n'ont rien à voir avec votre travail.
GetMint Research a étudié huit mois de suivi quotidien de l'interface web de ChatGPT, de janvier à septembre 2026. Cela représente plus d'un million de réponses à des dizaines de milliers de questions. Voici ce que nous avons découvert, sans jargon mathématique.
Ce que nous avons découvert : quatre facteurs font varier votre score
Pensez à la météo et au climat. La météo change tous les jours. Le climat est l'environnement dans lequel vous vivez, et il évolue progressivement. L'humeur du jour de ChatGPT, c'est la météo. Votre visibilité réelle, c'est le climat. Votre score intègre les deux, ainsi que deux autres sources de variation.
Facteur de variation | Ce que c'est | Taille typique, une question | Ce qui aide |
|---|---|---|---|
Votre visibilité réelle (le climat) | La fréquence à laquelle ChatGPT vous nomme une fois le bruit éliminé. Elle évolue d'elle-même et selon vos actions. | Environ 16 points sur deux semaines | Rien : c'est précisément ce que vous voulez mesurer |
La météo du jour | Ce que fait ChatGPT ce jour-là pour cette question : quelles sources il récupère, comment il rédige | Environ 14 points d'un jour à l'autre. Disparaît en 2 à 3 jours | Plus de jours et plus de questions |
Les mises à jour de ChatGPT | Les jours où ChatGPT modifie quelque chose pour toutes les marques en même temps | Environ une tous les 13 jours de mai à juillet 2026. Un épisode mesuré entre 15 et 18 points | Détecter et signaler ces journées |
Le hasard | Chaque réponse est un tirage aléatoire | Diminue à mesure que les réponses s'accumulent | Plus de réponses |
Les points sont des points de pourcentage de visibilité. Les tailles sont mesurées sur des questions pour lesquelles la marque n'est ni presque toujours ni presque jamais citée.
La surprise réside dans l'importance de la météo. Prenons une question mesurée à deux jours d'intervalle à quelques semaines de distance. Les deux mesures diffèrent généralement de 25 à 33 points. Environ 20 de ces points correspondent à la météo de chaque jour. Une baisse de 5 points d'un jour à l'autre ne vous apprend rien sur votre marque.

La plupart des outils calculent leur marge d'erreur à partir du seul hasard. Cette marge semble précise mais s'avère trop étroite car elle ignore la météo.
Ce que cela implique pour votre méthode de mesure
1. La précision dépend des questions et du nombre de jours
Répéter une question le même jour réduit la part de hasard, jusqu'à un certain point. Cela n'élimine jamais la météo de ce jour-là. Une seule question mesurée sur une seule journée conserve une incertitude d'environ ±28 points, quel que soit le nombre de réponses. En clair : la valeur réelle peut se situer n'importe où entre 28 points en dessous de la mesure et 28 points au-dessus. Une seule question ne descend jamais bien en dessous de ±30 points, même sur plusieurs jours.

Regroupez donc environ 20 questions au sein d'un sujet. Un sujet est un ensemble de questions sémantiquement proches et exprimant le même besoin ou la même intention de recherche, par exemple « meilleures chaussures de course pour débutants », « quelle chaussure de running acheter pour commencer », « bonnes chaussures pour débuter la course ». Chaque question a sa propre météo. En dehors des jours de mise à jour de ChatGPT, leurs variations quotidiennes sont presque indépendantes, de sorte qu'elles s'annulent.

Analysez ensuite les résultats sur plusieurs jours. Pour un sujet de 20 questions, posées chacune une fois par jour :

Deux semaines est la durée idéale. Votre visibilité réelle continue d'évoluer, de sorte que les jours plus anciens décrivent une visibilité que vous n'avez plus. Dans nos simulations, une moyenne sur 30 jours affichée avec une marge uniquement basée sur le hasard ne contenait la visibilité réelle que dans 58 % des jours sans mise à jour de ChatGPT.
Les répétitions restent utiles pour un sujet, dans une certaine mesure. 20 questions avec 30 réponses chacune sur une seule journée (600 réponses) donnent également environ ±7. Au-delà de 30 réponses par question, les réponses supplémentaires n'apportent rien. Quatorze jours à raison d'une réponse par question et par jour permettent d'atteindre à peu près la même précision avec 280 réponses. L'étude combine les deux : de nombreuses réponses en un seul jour pour établir rapidement un point de départ, puis une réponse par jour.
2. Les mises à jour de ChatGPT doivent être signalées
Nous avons développé un outil de vérification quotidienne, le Sentinel, qui détecte les jours où les marques suivies évoluent de concert. Entre mai et juillet 2026, il a identifié 7 jours de ce type. Pour 6 d'entre eux, aucune annonce publique n'a eu lieu à moins de deux jours d'intervalle. L'un d'eux provient peut-être d'un changement dans notre propre outil de mesure. Le 8 août, ChatGPT est passé discrètement à une nouvelle version de son modèle. Ce jour-là a enregistré le plus grand mouvement commun depuis la fin juillet. Le lancement public de GPT-5.6 le 9 juillet n'a eu aucun effet détectable sur les mentions de marques. Les annonces et l'impact réel sont deux choses bien différentes.

Si ces journées restent masquées au sein de la moyenne, la marge d'un sujet de 20 questions sur 14 jours peut passer d'environ ±7 à environ ±13 points. Dès qu'un jour est signalé, le score est recalculé à partir de ce jour.
3. Juger vos actions prend deux semaines et nécessite une comparaison
Une fois la météo et les mises à jour écartées, il reste votre visibilité réelle. C'est là que vos actions se traduisent. Deux précautions s'imposent. Une hausse réelle apparaît tardivement : dans nos simulations, chaque méthode affichait un décalage d'environ une semaine par rapport à la visibilité réelle. De plus, une hausse à elle seule ne prouve rien, car votre visibilité réelle évolue également d'elle-même. L'étude propose de comparer vos questions avec des questions similaires d'autres marques sur la même période, en dehors des jours signalés, et de vérifier que vos propres pages apparaissent bien parmi les sources utilisées par ChatGPT. Leur application aux cas clients fait l'objet d'une étude distincte, non présentée ici.

Pourquoi certains scores semblent stables alors qu'ils ne le sont pas
Si chaque question n'est posée qu'une fois par jour, la méthode standard pour calculer la variation d'un score le fait paraître stable pendant environ deux semaines. Notre propre analyse précédente avait commis cette erreur : les jours comptant plusieurs réponses par question montrent que le score évolue dès le tout premier jour.
Six règles pour analyser votre score
Définissez des sujets : environ 20 questions sémantiquement proches, ciblant le même besoin. Une question isolée génère trop de bruit pour en tirer la moindre conclusion.
Analysez les 14 derniers jours. Le chiffre d'hier relève principalement de la météo.
Ignorez tout changement inférieur à la marge d'erreur.
Avant de réagir à une baisse, vérifiez si ChatGPT a subi une mise à jour ce jour-là.
Laissez environ deux semaines à une action avant d'en juger l'impact, et comparez-le à celui d'autres marques sur la même période.
Arrêtez d'ajouter des réponses le même jour au-delà d'environ 30 par question. Privilégiez plutôt l'ajout de jours et de questions.
Lire l'étude
A Measurement Model for Brand Visibility in ChatGPT Answers, Amine Aziz Alaoui, GetMint Research, prépublication v1.3, 5 octobre 2026. DOI : 10.5281/zenodo.23156371.
Les tableaux agrégés et le code d'analyse sont disponibles auprès de l'auteur. Un package d'étude public sera fourni avec la version archivée. Les réponses brutes restent privées. L'étude présente certaines limites, que vous pouvez consulter dans le document complet. Lisez l'étude, contestez-la et dites-nous là où nous faisons fausse route.
COMMENCER GRATUITEMENT. AUCUNE CARTE DE CRÉDIT REQUISE.
Vos concurrents sont déjà visibles dans l’IA. Et vous ?
Découvrez ce que ChatGPT, Gemini et Perplexity disent de votre marque. Configurez le tout en 5 minutes.

