Tous les articles
SEO & IA

Outil GEO : que vaut un score de visibilité sur les moteurs IA ?

Par Elouan Laurent

Que mesure un outil GEO, et que vaut son score de visibilité IA ?

Un outil GEO mesure la fréquence de votre marque dans les réponses générées par les IA. Il ne donne pas un classement : ces réponses changent presque à chaque exécution. Un score de visibilité IA ne vaut donc que s'il repose sur beaucoup de prompts, posés plusieurs fois.

Avant tout abonnement, deux mesures officielles gratuites existent déjà, chez Bing et dans Search Console.

Le GEO (generative engine optimization, soit l'optimisation pour les moteurs génératifs) travaille un site pour le faire citer par ChatGPT, Perplexity ou Google AI Overviews. Les outils GEO vendent la mesure de ce travail. Ils posent des questions aux moteurs IA, relèvent les marques citées et en tirent un pourcentage.

Le chiffre affiché en haut d'un tableau de bord GEO est donc une moyenne. Tout l'enjeu est de savoir sur quoi elle porte.

Pourquoi les moteurs IA donnent des listes de marques différentes à la même question

Un LLM (le modèle de langage derrière ChatGPT, Gemini ou Claude) ne consulte pas un index figé. Il génère sa réponse mot par mot, avec une part d'aléatoire. Posez-lui deux fois la même question : la liste de marques recommandées ne sera presque jamais la même.

SparkToro l'a mesuré à grande échelle. En novembre et décembre 2025, 600 volontaires ont posé 12 prompts à ChatGPT, Claude et l'IA de Google. Au total, 2 961 exécutions.

Le résultat est net. Sur ChatGPT et l'IA de Google, la probabilité d'obtenir deux fois la même liste de marques est inférieure à 1 sur 100. Obtenir la même liste dans le même ordre est encore bien plus rare.

La longueur des réponses bouge aussi. Une même question renvoie tantôt 2 ou 3 recommandations, tantôt 10 ou plus.

Certaines marques sortent pourtant avec régularité. Sur des catégories étroites, les marques de tête apparaissent dans 55 à 77 % des réponses IA. Sur des secteurs plus larges, ce taux tombe autour de 30 à 40 %.

Ce que j'en retiens pour lire un score de visibilité :

  • une « position » dans une réponse d'IA ne veut rien dire, elle change au tirage suivant ;
  • un pourcentage de présence, calculé sur beaucoup de réponses, porte un vrai signal ;
  • un seul prompt, posé une fois, ne mesure que le hasard.

Un point sur la source. L'étude a été menée avec Gumshoe.ai, et son co-auteur vend un outil de suivi de la visibilité dans les IA.

Ses conclusions vont dans le sens de ce type d'outil. Elles restent utiles, parce qu'elles disent surtout comment ne pas mal mesurer.

Ce qui fait un score : nombre de prompts, avec ou sans recherche web, sources citées

Un score de visibilité dépend de trois réglages que l'éditeur choisit pour vous, avant toute analyse. Changez-en un, et le chiffre change.

Le jeu de prompts. Qui les a écrits ? Des questions génériques sur votre secteur ne donnent pas le même chiffre que celles de vos clients.

Un éditeur peut aussi choisir des prompts où votre marque sort bien. Votre part de voix (la part des réponses qui vous citent, face à vos concurrents) dépend d'abord de ce choix.

Le nombre d'exécutions. SparkToro recommande 60 à 100 exécutions par prompt. Ses auteurs conseillent aussi de suivre un pourcentage de visibilité sur des dizaines, voire des centaines de prompts.

Ils jugent trompeuse l'idée d'une « position de classement dans l'IA ». Un outil qui pose chaque question une seule fois par semaine vous montre surtout du bruit.

Le mode d'interrogation. Un modèle interrogé avec recherche web peut répondre autrement que le même modèle sans recherche. Certains éditeurs affirment aussi que les sources citées diffèrent entre l'interface grand public et l'API (l'accès programmé au modèle).

Je n'ai trouvé aucune méthode publiée qui chiffre cet écart. C'est donc une question à poser, pas un chiffre à croire.

Reste l'objet de l'analyse : ce que l'outil compte. Une mention de marque dans le texte n'est pas une citation avec lien vers votre page. Le taux de citation et le taux de mention ne mesurent pas la même chose, et ne servent pas le même objectif.

Cinq questions à poser à l'éditeur avant de payer

Je ne classe pas ici les meilleurs outils GEO. Je n'ai mené aucun test comparatif, et le marché du GEO est trop jeune : les offres et les prix bougent vite. Un classement serait périmé avant d'être lu.

Les questions à poser pendant la démo, elles, ne se périment pas. Un bon outil GEO y répond sans détour.

  1. Combien de prompts, et lesquels ? Les vôtres, les siens, ou un mélange ? Pouvez-vous importer vos propres questions, tirées de vos échanges commerciaux ?
  2. Combien d'exécutions par prompt, et à quelle fréquence ? Une seule exécution par semaine ne distingue pas une tendance d'un tirage. Demandez le chiffre exact.
  3. Avec ou sans recherche web, par l'interface ou par l'API ? La réponse change la nature de la mesure. Un éditeur qui ne sait pas répondre ne maîtrise pas sa propre collecte.
  4. Quelles plateformes, et chacune à part ? ChatGPT, Gemini, Perplexity, Claude, les AI Overviews : un score agrégé cache des écarts entre moteurs. Exigez le détail par plateforme.
  5. Puis-je exporter les réponses brutes et leurs sources ? Sans les textes générés, impossible de vérifier le score ou de mener votre propre analyse concurrentielle. C'est la question qui départage le plus vite.

Sur le prix, une seule règle : demandez un tarif écrit et daté, avec le nombre de prompts inclus. Un abonnement se compare au coût par prompt réellement exécuté, pas au prix affiché en page d'accueil.

Deux mesures officielles gratuites : Bing AI Performance et Search Console

Avant de payer un abonnement, ouvrez ce que les moteurs donnent déjà. Ces rapports ne simulent rien : ils s'appuient sur les données réelles des moteurs.

Bing a lancé le rapport AI Performance dans Bing Webmaster Tools en préversion publique le 10 février 2026. Il affiche notamment :

  • les citations totales de votre site ;
  • le nombre moyen de pages citées par jour ;
  • les grounding queries (les recherches que l'IA lance pour construire sa réponse) ;
  • l'activité de citation page par page.

Il couvre Microsoft Copilot, les résumés générés par Bing et certaines intégrations partenaires. Depuis le 24 mars 2026, il relie ces requêtes aux pages citées.

Ses limites sont écrites par Bing lui-même. Il n'indique ni la place de votre page dans la réponse, ni son rang. Et les grounding queries ne sont qu'un échantillon.

Côté Google, des rapports de performance pour l'IA générative sont annoncés dans Search Console depuis juin 2026. Ouvrez votre compte pour voir ce qu'ils affichent sur votre site : c'est gratuit, et ce sont les données de Google.

Aucune de ces deux mesures ne dit quel prompt un client a tapé. Elles disent en revanche, sans simulation, si les moteurs de recherche vous montrent dans leurs réponses. C'est la base à confronter au score d'un outil GEO payant, moteur par moteur.

Le GEO ne remplace pas le SEO : le socle à vérifier avant de mesurer

Le SEO vise un classement dans les résultats de Google. Le GEO vise une citation dans une réponse générée. Les deux reposent sur le même socle : un contenu clair, des pages lisibles par les robots, une technique propre.

J'ai détaillé cette articulation dans GEO vs SEO.

Conséquence pratique : une stratégie GEO commence par le SEO. Mesurer sa visibilité IA n'a pas de sens si le site n'est pas déjà bien exploré et indexé.

Un outil de suivi vous dira que vous n'êtes pas cité. Il ne vous dira pas que votre contenu n'est pas dans le HTML servi, ou qu'une page clé est exclue de l'index.

Cette analyse technique se fait avec les outils d'audit SEO classiques, à commencer par Search Console. Elle répond à la question préalable, avant tout abonnement.

L'ordre que je conseille est simple :

  1. le référencement naturel d'abord : indexation, rendu, contenu ;
  2. les deux rapports officiels ensuite, pour une première mesure réelle ;
  3. enfin, si la question reste ouverte, un outil payant, choisi avec les cinq questions ci-dessus.

Un score dépend de son corpus : la règle que j'applique à mes propres mesures

Je n'ai pas testé d'outils GEO. En revanche, je travaille avec un score construit sur le même principe.

Les articles de ce blog passent par une chaîne de production que j'ai développée. Chaque texte reçoit un score de couverture lexicale, issu d'une analyse des pages du top 10 Google.

Le seuil de validation est 80. Il descend à 75 quand le corpus concurrent est trop mince, et il ne se renégocie jamais pour faire passer un article.

La leçon vaut pour un score GEO : un chiffre ne dit rien tant qu'on ignore contre quoi il est calculé. Avant toute analyse de la visibilité IA d'une marque, je lis la liste des prompts qui la produisent.

Si vous voulez savoir par où commencer sur votre site, avant d'engager un budget de suivi, réservez un appel découverte de 30 minutes.

Pré-audit SEO gratuit : donnez l'URL de votre site sur la page audit SEO. J'analyse le site, code source compris, et je vous renvoie vos priorités sous 48 h ouvrées. Gratuit, sans engagement, sans carte bancaire.

À lire ensuite