Classe top-3 sur Google mais invisible sur ChatGPT : l’audit en 25 points
Classe top-3 sur Google mais invisible sur ChatGPT : l’audit en 25 points
Le scénario revient dans presque chaque audit que je fais : une marque classée en première position sur Google pour ses termes commerciaux clés, et pourtant complètement absente des réponses de ChatGPT, Perplexity ou Google AI Overviews. Aucune citation. Aucune mention. Comme si le site n’existait pas.
Ce n’est pas un bug. C’est une différence structurelle entre deux machines qui ne fonctionnent pas du tout de la même façon.
Pourquoi Google et les LLMs ne lisent pas la même chose ?
Google suit un pipeline linéaire que l’on connaît bien. Un moteur IA suit un pipeline différent - et c’est la source du problème :
Google rankera la page la plus optimisée parmi celles qu’il peut crawler. Un LLM citera la source qu’il peut extraire, identifier et attribuer avec confiance. Une page parfaitement optimisée pour le SEO classique peut être totalement non-extractible pour un LLM.
Votre section avec le score le plus bas est votre seule priorité - pas la plus forte. C’est une chaîne : une page parfaitement extractible que le crawler ne peut pas atteindre score zéro en pratique. Toujours corriger le maillon faible en premier.
Comment utiliser cet audit ?
25 checkpoints, 5 sections, environ 20 minutes. Chaque point vaut 1 point. Score max : 25/25.
| # | Section | Points |
|---|---|---|
| 1-5 | Empreinte entité | /5 |
| 6-10 | Présence off-site | /5 |
| 11-15 | Extractabilite | /5 |
| 16-20 | Signaux structures | /5 |
| 21-25 | Accès technique | /5 |
Les modèles ne vous trouvent pas ou ne peuvent pas vous citer.
Citations possibles sur les requêtes brand, rarement sur les génériques.
Citable sur les requêtes de catégorie si le contenu est bien positionné.
Cite de façon régulière et factuelle par les principaux moteurs IA.
Section 1 - Empreinte entité (5 pts)
Les moteurs IA construisent leur réponse à partir de sources secondaires fiables avant même de visiter votre site. Si des sources indépendantes ne vous décrivent pas de façon cohérente, vous n’existez pas en tant qu’entité dans leur modèle.
-
01 Présence Wikipedia 1 pt
Article Wikipedia dédié ou mention factuelle dans un article de catégorie pertinente.
# Dans Google :
site:wikipedia.org “[Votre marque]”Fix : Priorité à la couverture presse et aux mentions dans des articles Wikipedia de votre secteur. Un article Wikipedia se justifie uniquement avec une notoriété préexistante. -
02 Google Knowledge Panel 1 pt
Une recherche Google sur votre nom de marque déclenche un Knowledge Panel (encadre à droite) avec description, logo et liens. Une simple fiche Google Business n’est pas un Knowledge Panel.
# Dans Google, navigation privée :
“[Votre marque]”Fix : Déployer schema.org Organization/Person avecsameAspointant vers Wikipedia, Wikidata, LinkedIn, Crunchbase. Le Knowledge Panel suit généralement dans les 3-6 mois. -
03 Entité Wikidata 1 pt
Fiche Wikidata (Q-identifier) existante avec au moins 5 propriétés renseignées (P856 site officiel, P18 image, P112 fondateur, P571 date de création).
https://www.wikidata.org/wiki/Special:Search?search=[Votre+marque]Fix : Créer la fiche Wikidata en suivant les règles de notabilité. Relier depuis Wikipedia si article existant. -
04 Cohérence NAP étendue 1 pt
Nom, localisation/positionnement et description identiques sur LinkedIn, Crunchbase, Google Business, Trustpilot et votre site. Un LLM qui trouve “SaaS B2B” sur LinkedIn et “agence conseil” sur Crunchbase ne sait pas quelle version garder - il omet.
# Comparer manuellement les descriptions sur 5 profilsFix : Corriger les contradictions d’abord, puis remplir les profils manquants. Cohérence requise sur au moins 4 profils sur 5. -
05 Ancres sameAs (min. 3) 1 pt
Votre schema.org Organization/Person déclare au moins 3 URLs de profils d’autorité (DA 50+) via la propriété
sameAs: LinkedIn, Wikipedia, Wikidata, Crunchbase, Google Business.curl -s https://votredomaine.com/ | grep -i “sameAs”
# Ou : https://search.google.com/test/rich-resultsFix : Ajouter dans le JSON-LD :"sameAs": ["https://linkedin.com/company/...", "https://wikidata.org/wiki/Q..."]
Section 2 - Présence off-site (5 pts)
Reddit est de façon constante le domaine le plus cite par ChatGPT dans ses réponses. Wikipedia et YouTube suivent. Si vous n’existez pas dans ces espaces, vous serez peu cite même si votre site est techniquement parfait.
Reddit est le domaine #1 cite par ChatGPT dans ses réponses - devant Wikipedia et YouTube. Si votre marque n’est pas mentionnée dans des threads Reddit pertinents, vous manquez la source que les LLMs privilégient le plus.
-
06 Mentions Reddit organiques 1 pt
Au moins une mention organique positive dans un thread de votre secteur, par un utilisateur sans lien apparent avec vous.
site:reddit.com “[Votre marque]” -“deleted”Fix : Participer honnêtement dans r/[votre secteur], r/entrepreneur. Répondre à des questions sans autopromotion. Les mentions naturelles viennent du service réel. -
07 Listes “best of” tierces 1 pt
Présent dans au moins un article “meilleur [categorie]” ou “top [secteur]” publie par un auteur sans lien avec vous, sur un domaine DA 30+.
“meilleur [categorie]” OR “top [categorie]” “[Votre marque]” -site:votredomaine.comFix : Cibler les roundups existants (classes p.1 Google). Email direct aux auteurs avec pitch “pourquoi vous méritez d’être dans leur liste”. -
08 Présence YouTube 1 pt
Au moins une vidéo YouTube (propre ou tierce) avec votre marque dans le titre ou description, 500+ vues. YouTube est le 2e moteur de recherche mondial et un signal fort pour les LLMs.
site:youtube.com “[Votre marque]”Fix : Une vidéo “what is [Votre marque]” ou une démo produit suffit pour démarrer. -
09 Presse et médias (DA 40+) 1 pt
Au moins une mention factuelle dans une publication DA 40+ : journal, blog pro reconnu, newsletter sectorielle. Un communique de presse sur un site générique ne compte pas.
“[Votre marque]” -site:votredomaine.com -site:reddit.com
# Vérifier le DA via Moz ou AhrefsFix : HARO pour des quotes dans des articles. Guest posts sur publications sectorielles. Étude originale avec données propres = meilleur canal de citation presse. -
10 Avis et reviews tierces 1 pt
10+ avis vérifiés sur G2, Capterra, Trustpilot ou Google Business, note >= 4,0. G2 et Capterra sont massivement indexes dans les LLMs pour les requêtes “[logiciel] avis” et “[service] comparaison”.
# Recherche directe sur G2 / Capterra / Trustpilot pour votre marqueFix : Mettre en place un process de collecte d’avis post-achat/onboarding. L’objectif minimum est 10 avis sur 1 plateforme reconnue.
Section 3 - Extractabilite (5 pts)
Un LLM cite ce qu’il peut extraire sans ambiguïté. Les headings en forme de question sont cites a environ 2x le taux des headings affirmatifs. Une page bien extractible donne au modèle la réponse en une phrase - pas une invitation à creuser.
-
11 Headings en forme de question (>=30%) 1 pt
Au moins 30% de vos H2/H3 sur les 5 pages clés sont formules comme des questions. Les headings affirmatifs (“Notre approche”, “Nos tarifs”) sont invisibles aux LLMs en mode extraction.
# Compter H2/H3 total vs H2/H3 en questions sur vos 5 pages principalesFix : “Notre approche” -> “Comment fonctionne notre approche ?” - “Tarifs” -> “Combien coûte [Service] ?” -
12 Réponses auto-suffisantes (BLUF) 1 pt
Chaque heading-question est suivi d’une réponse complète dans les 2-3 premières phrases, sans renvoi vers une autre page. Un LLM extrait les premières phrases d’une section - pas la section entière. Pattern BLUF : donner la réponse d’abord, développer ensuite.
# Lire les 2 premières phrases après chaque heading-question.
# La réponse a-t-elle du sens sortie de son contexte ?Fix : Retravailler les sections qui commencent par “Il est important de…”, “Dans cet article nous verrons…”, “Pour répondre à cette question…”. -
13 Clarté des entités nommées 1 pt
Le nom exact de votre marque apparaît dans le premier paragraphe de chaque page. Les produits/services sont nommes explicitement - pas “notre solution”, “notre outil”, “nous”. Les LLMs n’ont pas le contexte de navigation : chaque page est un document isole.
# Lire les 100 premiers mots de vos 5 pages clés.
# Compter : nom de marque exact vs pronoms/references vagues.Fix : Remplacer “notre logiciel” par “[Nom produit] de [Marque]” dans les premières phrases. -
14 Page comparative explicite 1 pt
Au moins une page “[Votre marque] vs [Concurrent]” ou “[Votre marque] alternatives” sur votre site ou dans des publications tierces. C’est la requête que les acheteurs posent aux LLMs - elle est très extractible.
“[Votre marque] vs” OR “[Votre marque] alternative” OR “[Votre marque] comparaison”Fix : Créer une page /alternatives ou /comparaison. Inclure un tableau comparatif structure avec votre marque en première colonne. -
15 Données chiffrées mémorables (min. 3) 1 pt
Au moins 3 données chiffrées spécifiques et vérifiables sur vos pages principales. Les LLMs citent les chiffres précis - ils ignorent “leader du marché” et “solution innovante”.
# Scanner vos 5 pages clés pour des chiffres avec contexte explicite
# Exemple valide : “3 200 clients dans 40 pays”, “ROAS moyen de 4.2x”
# Exemple invalide : “des milliers de clients”, “très performant”Fix : Extraire de vos analytics/CRM : volume traite, taux de satisfaction précis, économies client, délai de mise en oeuvre.
Section 4 - Signaux structures (5 pts)
Les schemas JSON-LD sont le langage que les LLMs lisent directement. FAQPage est le schema avec le meilleur ratio effort/impact pour les citations. llms.txt est émergent mais déjà indexe par plusieurs moteurs.
-
16 Schema Organization ou Person valide 1 pt
Homepage avec schema Organization (entreprise) ou Person (consultant/expert) valide, contenant au minimum : name, url, logo, description, sameAs.
https://search.google.com/test/rich-results?url=https://votredomaine.comFix : Ajouter le JSON-LD minimal avec les 5 propriétés requises. Valider sur schema.org/validator après déploiement. -
17 Schema FAQPage (min. 5 Q/R) 1 pt
FAQPage valide avec au moins 5 paires question/réponse sur au moins une page. C’est le schema avec le meilleur ratio effort/impact pour les citations LLM. Les questions doivent correspondre a de vraies requêtes (extraire depuis GSC “Queries” ou Answer The Public).
curl -s https://votredomaine.com/[page-faq] | grep -i “FAQPage”Fix : Déployer en priorité sur homepage et page service principale. Minimum 5 Q/R, maximum 10. -
18 Schema Article sur le blog (80%+) 1 pt
Schema Article ou BlogPosting présent sur 80%+ des articles, avec au minimum : headline, datePublished, author, image. La plupart des CMS configurent ca automatiquement si l’auteur est renseigne (pas “admin”).
https://search.google.com/test/rich-results?url=https://votredomaine.com/[article]Fix : Vérifier que l’auteur est renseigne avec le vrai nom + que datePublished est correct sur chaque article. -
19 llms.txt présent et substantiel 1 pt
Fichier /llms.txt avec contenu significatif : section identité/description ET section services/offre. Un stub vide ou une liste d’URLs auto-générée par un plugin ne compte pas.
curl -s https://votredomaine.com/llms.txt | head -50Fix : Structure minimale : # [Marque] / > [Description en 1 phrase] / ## Identité / ## Services + tarifs si publics / ## FAQ (5-10 Q/R directes). -
20 Open Graph + meta descriptions 1 pt
Meta description unique (150-160 car.) ET og:title + og:description + og:image sur 90%+ des pages indexées. Les meta descriptions sont utilisées par les LLMs pour comprendre de quoi parle une page - c’est une phrase extractible de plus.
curl -s https://votredomaine.com/[page] | grep -E ‘meta name=”description”|og:description|og:title’Fix : Ne pas laisser le CMS générer automatiquement les meta descriptions. Les écrire manuellement en format réponse directe.
Section 5 - Accès technique (5 pts)
Un LLM ne peut citer que ce qu’il a pu crawler. Les blocages silencieux - Cloudflare, robots.txt, noindex accidentel - sont la cause la plus fréquente de l’écart entre “bien indexe Google” et “jamais cite par les IA”.
-
21 GPTBot non bloque 1 pt
GPTBot (OpenAI) autorise dans robots.txt. L’absence de règles pour GPTBot = autorise par défaut. Seulement si
Disallow: /est présent sousUser-agent: GPTBotil est bloqué.curl -s https://votredomaine.com/robots.txt | grep -i -A2 “gptbot”Fix : Retirer la règle de blocage ou ajouter explicitement : User-agent: GPTBot / Allow: / -
22 PerplexityBot non bloque 1 pt
PerplexityBot autorise. Perplexity est le moteur de réponse IA avec la meilleure attribution des sources - être bloque = zéro citation sur Perplexity, quelle que soit la qualité de votre contenu.
curl -s https://votredomaine.com/robots.txt | grep -i -A2 “perplexitybot”Fix : User-agent: PerplexityBot / Allow: / -
23 ClaudeBot / anthropic-ai non bloques 1 pt
ClaudeBot et anthropic-ai (Anthropic) autorises. Deux user-agents distincts à vérifier.
curl -s https://votredomaine.com/robots.txt | grep -i -A2 -E “claudebot|anthropic”Fix : User-agent: ClaudeBot / Allow: / - User-agent: anthropic-ai / Allow: / -
24 CDN/WAF sans blocage silencieux 1 pt
Votre CDN ou WAF (Cloudflare, Fastly, Imperva…) retourne HTTP 200 - et non un 403, captcha ou page d’erreur - pour les user-agents des bots IA. C’est le blocage le plus difficile à détecter car il n’apparaît pas dans robots.txt.
# Tester avec le user-agent GPTBot :
curl -s -o /dev/null -w “%{http_code}”
-H “User-Agent: Mozilla/5.0 (compatible; GPTBot/1.0; +https://openai.com/gptbot)”
https://votredomaine.com/
# Attendre 200 - tout autre code = problèmeFix : Dans Cloudflare : Security > WAF > Custom Rules - vérifier qu’aucune règle ne cible les bots IA. Certains plugins WordPress “Block bad bots” bloquent aussi les crawlers IA. -
25 Pages clés HTTP 200, pas de noindex accidentel 1 pt
Les 5 pages les plus importantes retournent HTTP 200 sans balise
<meta name="robots" content="noindex">. Cas fréquents de noindex accidentel : pages de staging migrees en prod, plugins SEO avec option “noindex” cochee par défaut, pages password-protected.# Vérifier HTTP status + noindex pour chaque page cle :
curl -sI https://votredomaine.com/[page-cle] | grep -i “http/”
curl -s https://votredomaine.com/[page-cle] | grep -i “noindex”
# Résultat vide sur le grep noindex = OKFix : Vérifier dans WP Admin > Rank Math / Yoast que “noindex” n’est pas coche sur les pages clés. Vérifier aussi le fichier robots.txt de staging si le site a été migre.
Que faire de votre score ?
Une fois les 25 points évalues, votre section avec le score le plus bas est votre seule priorité. Pas la plus forte. Voici l’ordre typique de correction pour un site avec des lacunes sur la Section 5 :
| Étape | Action | Temps | Impact |
|---|---|---|---|
| 1 | Débloquer GPTBot/PerplexityBot/ClaudeBot | 30 min | Immédiat |
| 2 | Schema Organization + sameAs (3 sources) | 2h | 3 mois |
| 3 | FAQPage schema sur homepage + page service | 1h | 1-3 mois |
| 4 | Headings en questions + réponses BLUF | 4h | Continu |
| 5 | Présence Reddit + listes “best of” | Long terme | 6-12 mois |
Vous voulez un audit fait pour vous ?
Je parcours les 25 points sur votre site et vous rends un rapport chiffre avec les corrections prioritaires.
Ce qu’il faut retenir
Être bien classe sur Google et être cite par les LLMs sont deux problèmes différents qui demandent des solutions différentes. Google récompense la page la plus optimisée parmi celles qu’il peut crawler. Un LLM récompense l’entité la plus claire, la plus extractible et la plus accessible.
La bonne nouvelle : la plupart des blocages sont techniques et corrigeables en moins d’une journée. Vérifiez votre robots.txt maintenant - vous seriez surpris du nombre de sites qui bloquent GPTBot par inadvertance, avec un plugin ou une règle Cloudflare oubliée depuis des mois.
Pour aller plus loin : contactez-moi ou téléchargez la fiche de scoring complète en PDF. Vous pouvez aussi utiliser directement l’outil interactif d’audit de visibilité IA pour obtenir votre score en quelques minutes.
La visibilité IA ne remplace pas l'acquisition payante. Sur ce volet, voir mon rôle de consultant SEA à Montpellier.