Outils de visibilité IA comparés : comment mesurer si les LLM vous mentionnent
Ce que mesurent réellement les plateformes de visibilité IA, les trois méthodes qui les sous-tendent, quand la stack gratuite suffit, et une checklist d'achat selon le stade de l'équipe.

Chaque « plateforme de visibilité IA » n'est qu'une enveloppe autour de trois mesures : les panels de prompts (l'assistant vous nomme-t-il ?), le suivi des citations (votre domaine figure-t-il dans les listes de références ?), et la part de réponse dans le temps (est-ce que cela évolue ?). Vous pouvez faire tourner les trois gratuitement pendant un trimestre avant d'acheter quoi que ce soit. Ce guide explique ce qu'apporte la couche payante, où elle déçoit encore, et la checklist que nous utilisons quand une équipe nous demande si elle doit signer.
Les trois méthodes sous le capot
| Méthode | À quoi elle répond | Version gratuite | Le payant ajoute |
|---|---|---|---|
| Panel de prompts | « Cite-moi des outils pour X » → êtes-vous nommé ? | Tableur + sessions déconnectées, hebdomadaire | Échelle (des centaines de prompts), historique |
| Suivi des citations | Votre domaine figure-t-il dans les références des AI Overviews / réponses ? | Vérifications manuelles des SERP ; API SERP | Interrogation automatisée, deltas par requête |
| Part de réponse | Tendance : mentions vs concurrents dans le temps | Comptage manuel depuis le panel | Tableaux de bord, alertes, ensembles de concurrents |
La stack gratuite est d'une simplicité brutale : dix questions, quatre assistants, chaque semaine, déconnecté, résultats dans un tableur. Elle capte les grands mouvements — apparaître, disparaître, être mal décrit — ce qui représente 80 % de la valeur. Ce qu'elle ne peut pas faire, c'est passer à l'échelle (cinquante prompts × quatre moteurs × chaque semaine, c'est un emploi, pas une tâche) ou attribuer (quelle nouvelle mention a coïncidé avec quelle citation qui apparaît).
Ce que les plateformes payantes ajoutent — et où elles déçoivent
Les modules qui valent la dépense : les données historiques de panels de prompts (pour qu'un changement soit une tendance, pas une humeur), les ensembles de mentions des concurrents, et les intégrations qui relient la visibilité au trafic (Search Console, logs de référents). Les déceptions que nous observons systématiquement :
- Le théâtre de l'échantillonnage. Des panels de vingt prompts vendus comme un « score de visibilité IA » — un score que vous ne pouvez pas décomposer est un anneau d'humeur.
- Le biais de session connectée. Les résultats tirés de sessions authentifiées ne correspondent pas à ce que voient vos acheteurs.
- Des listes de citations qui ratent les moteurs qui vous importent. Si un outil ne suit que les AI Overviews de Google et que votre catégorie vit dans ChatGPT et Perplexity, vous mesurez la mauvaise pièce. Demandez quels moteurs et quels modes de récupération (recherche vs conversationnel) chaque métrique couvre.
Une checklist d'acheteur par étape
- Pré-lancement / première année : stack gratuite uniquement. Dépensez le budget sur les actifs qui se font citer à la place (pages de questions, fiches, compilations).
- En croissance, un seul marketeur : payez pour le panel de prompts + l'historique une fois que le tableur gratuit prend plus de deux heures par semaine. Gardez le suivi des citations manuel via une API SERP ou notre méthode de référence pour les AI Overviews.
- Équipe avec un responsable GEO : plateforme complète, mais contractez sur les moteurs couverts et les nombres de prompts, pas sur le « score ».
- Tout le monde : associez tout outil au proxy Search Console pour le trafic généré par l'IA (méthode) — de la visibilité sans trafic, c'est de la vanité.
La métrique qui compte
Pas « sommes-nous mentionnés » mais « sommes-nous mentionnés dans les questions qui précèdent l'achat » — les formulations de comparaison et d'alternative. Suivez-les séparément des questions de notoriété ; elles bougent en premier quand votre travail fonctionne, et ce sont celles qui intéressent réellement un fondateur.
FAQ
Existe-t-il une métrique standard de « classement IA » ? Non. Les positions n'existent pas dans les réponses synthétisées ; tout score unique est une construction de fournisseur. Comparez les méthodologies, pas les scores, entre les outils.
À quelle fréquence dois-je échantillonner ? Chaque semaine pour les questions principales, chaque mois pour la longue traîne. Les ensembles de récupération évoluent sur des cycles de quelques jours à quelques semaines ; un échantillonnage quotidien n'achète que du bruit.
Ces outils m'aident-ils à être cité, ou seulement à mesurer ? Mesurer uniquement. Le gain se fait dans le contenu, les fiches et les mentions — le playbook et votre empreinte de fiches sont là d'où viennent les citations.
La mesure vous dit si le travail de mention a porté. Commencez le travail là où les modèles regardent en premier : soumettez votre produit sur aat.ee et comparez les réseaux et leur DR.