Classe top-3 sur Google mais invisible sur ChatGPT : l’audit en 25 points
Classe top-3 sur Google mais invisible sur ChatGPT : l’audit en 25 points
Le scénario revient dans presque chaque audit que je fais : une marque classee en première position sur Google pour ses termes commerciaux cles, et pourtant completement absente des réponses de ChatGPT, Perplexity ou Google AI Overviews. Aucune citation. Aucune mention. Comme si le site n’existait pas.
Ce n’est pas un bug. C’est une différence structurelle entre deux machines qui ne fonctionnent pas du tout de la même facon.
Pourquoi Google et les LLMs ne lisent pas la même chose ?
Google suit un pipeline linéaire que l’on connait bien. Un moteur IA suit un pipeline différent – et c’est la source du problème :
Google rankera la page la plus optimisee parmi celles qu’il peut crawler. Un LLM citera la source qu’il peut extraire, identifier et attribuer avec confiance. Une page parfaitement optimisee pour le SEO classique peut être totalement non-extractible pour un LLM.
Votre section avec le score le plus bas est votre seule priorité – pas la plus forte. C’est une chaine : une page parfaitement extractible que le crawler ne peut pas atteindre score zéro en pratique. Toujours corriger le maillon faible en premier.
Comment utiliser cet audit ?
25 checkpoints, 5 sections, environ 20 minutes. Chaque point vaut 1 point. Score max : 25/25.
| # | Section | Points |
|---|---|---|
| 1-5 | Empreinte entite | /5 |
| 6-10 | Presence off-site | /5 |
| 11-15 | Extractabilite | /5 |
| 16-20 | Signaux structures | /5 |
| 21-25 | Accès technique | /5 |
Section 1 – Empreinte entite (5 pts)
-
01 Presence Wikipedia 1 pt
Article Wikipedia dédié ou mention factuelle dans un article de categorie pertinente.
# Dans Google :
site:wikipedia.org “[Votre marque]”Fix : Priorité a la couverture presse et aux mentions dans des articles Wikipedia de votre secteur. Un article Wikipedia se justifie uniquement avec une notoriété preexistante. -
02 Google Knowledge Panel 1 pt
Une recherche Google sur votre nom de marque declenche un Knowledge Panel (encadre a droite) avec description, logo et liens. Une simple fiche Google Business n’est pas un Knowledge Panel.
# Dans Google, navigation privee :
“[Votre marque]”Fix : Deployer schema.org Organization/Person avecsameAspointant vers Wikipedia, Wikidata, LinkedIn, Crunchbase. Le Knowledge Panel suit généralement dans les 3-6 mois. -
03 Entite Wikidata 1 pt
Fiche Wikidata (Q-identifier) existante avec au moins 5 proprietes renseignees (P856 site officiel, P18 image, P112 fondateur, P571 date de creation).
https://www.wikidata.org/wiki/Special:Search?search=[Votre+marque]Fix : Créer la fiche Wikidata en suivant les regles de notabilite. Relier depuis Wikipedia si article existant. -
04 Coherence NAP etendue 1 pt
Nom, localisation/positionnement et description identiques sur LinkedIn, Crunchbase, Google Business, Trustpilot et votre site. Un LLM qui trouve “SaaS B2B” sur LinkedIn et “agence conseil” sur Crunchbase ne sait pas quelle version garder – il omet.
# Comparer manuellement les descriptions sur 5 profilsFix : Corriger les contradictions d’abord, puis remplir les profils manquants. Coherence requise sur au moins 4 profils sur 5. -
05 Ancres sameAs (min. 3) 1 pt
Votre schema.org Organization/Person declare au moins 3 URLs de profils d’autorite (DA 50+) via la propriété
sameAs: LinkedIn, Wikipedia, Wikidata, Crunchbase, Google Business.curl -s https://votredomaine.com/ | grep -i “sameAs”
# Ou : https://search.google.com/test/rich-resultsFix : Ajouter dans le JSON-LD :"sameAs": ["https://linkedin.com/company/...", "https://wikidata.org/wiki/Q..."]
Section 2 – Presence off-site (5 pts)
Reddit est le domaine #1 cite par ChatGPT dans ses réponses – devant Wikipedia et YouTube. Si votre marque n’est pas mentionnee dans des threads Reddit pertinents, vous manquez la source que les LLMs privilegient le plus.
-
06 Mentions Reddit organiques 1 pt
Au moins une mention organique positive dans un thread de votre secteur, par un utilisateur sans lien apparent avec vous.
site:reddit.com “[Votre marque]” -“deleted”Fix : Participer honnetement dans r/[votre secteur], r/entrepreneur. Repondre a des questions sans autopromotion. Les mentions naturelles viennent du service réel. -
07 Listes “best of” tierces 1 pt
Present dans au moins un article “meilleur [categorie]” ou “top [secteur]” publie par un auteur sans lien avec vous, sur un domaine DA 30+.
“meilleur [categorie]” OR “top [categorie]” “[Votre marque]” -site:votredomaine.comFix : Cibler les roundups existants (classes p.1 Google). Email direct aux auteurs avec pitch “pourquoi vous meritez d’être dans leur liste”. -
08 Presence YouTube 1 pt
Au moins une vidéo YouTube (propre ou tierce) avec votre marque dans le titre ou description, 500+ vues. YouTube est le 2e moteur de recherche mondial et un signal fort pour les LLMs.
site:youtube.com “[Votre marque]”Fix : Une vidéo “what is [Votre marque]” ou une demo produit suffit pour demarrer. -
09 Presse et médias (DA 40+) 1 pt
Au moins une mention factuelle dans une publication DA 40+ : journal, blog pro reconnu, newsletter sectorielle. Un communique de presse sur un site générique ne compte pas.
“[Votre marque]” -site:votredomaine.com -site:reddit.com
# Vérifier le DA via Moz ou AhrefsFix : HARO pour des quotes dans des articles. Guest posts sur publications sectorielles. Étude originale avec donnees propres = meilleur levier de citation presse. -
10 Avis et reviews tierces 1 pt
10+ avis verifies sur G2, Capterra, Trustpilot ou Google Business, note >= 4,0. G2 et Capterra sont massivement indexes dans les LLMs pour les requêtes “[logiciel] avis” et “[service] comparaison”.
# Recherche directe sur G2 / Capterra / Trustpilot pour votre marqueFix : Mettre en place un process de collecte d’avis post-achat/onboarding. L’objectif minimum est 10 avis sur 1 plateforme reconnue.
Section 3 – Extractabilite (5 pts)
-
11 Headings en forme de question (>=30%) 1 pt
Au moins 30% de vos H2/H3 sur les 5 pages cles sont formules comme des questions. Les headings affirmatifs (“Notre approche”, “Nos tarifs”) sont invisibles aux LLMs en mode extraction.
# Compter H2/H3 total vs H2/H3 en questions sur vos 5 pages principalesFix : “Notre approche” -> “Comment fonctionne notre approche ?” – “Tarifs” -> “Combien coute [Service] ?” -
12 Réponses auto-suffisantes (BLUF) 1 pt
Chaque heading-question est suivi d’une réponse complete dans les 2-3 premières phrases, sans renvoi vers une autre page. Un LLM extrait les premières phrases d’une section – pas la section entiere. Pattern BLUF : donner la réponse d’abord, développer ensuite.
# Lire les 2 premières phrases après chaque heading-question.
# La réponse a-t-elle du sens sortie de son contexte ?Fix : Retravailler les sections qui commencent par “Il est important de…”, “Dans cet article nous verrons…”, “Pour repondre a cette question…”. -
13 Clarte des entites nommees 1 pt
Le nom exact de votre marque apparait dans le premier paragraphe de chaque page. Les produits/services sont nommes explicitement – pas “notre solution”, “notre outil”, “nous”. Les LLMs n’ont pas le contexte de navigation : chaque page est un document isole.
# Lire les 100 premiers mots de vos 5 pages cles.
# Compter : nom de marque exact vs pronoms/references vagues.Fix : Remplacer “notre logiciel” par “[Nom produit] de [Marque]” dans les premières phrases. -
14 Page comparative explicite 1 pt
Au moins une page “[Votre marque] vs [Concurrent]” ou “[Votre marque] alternatives” sur votre site ou dans des publications tierces. C’est la requête que les acheteurs posent aux LLMs – elle est très extractible.
“[Votre marque] vs” OR “[Votre marque] alternative” OR “[Votre marque] comparaison”Fix : Créer une page /alternatives ou /comparaison. Inclure un tableau comparatif structure avec votre marque en première colonne. -
15 Donnees chiffrees memorables (min. 3) 1 pt
Au moins 3 donnees chiffrees specifiques et verifiables sur vos pages principales. Les LLMs citent les chiffres précis – ils ignorent “leader du marché” et “solution innovante”.
# Scanner vos 5 pages cles pour des chiffres avec contexte explicite
# Exemple valide : “3 200 clients dans 40 pays”, “ROAS moyen de 4.2x”
# Exemple invalide : “des milliers de clients”, “très performant”Fix : Extraire de vos analytics/CRM : volume traite, taux de satisfaction précis, economies client, délai de mise en oeuvre.
Section 4 – Signaux structures (5 pts)
-
16 Schema Organization ou Person valide 1 pt
Homepage avec schema Organization (entreprise) ou Person (consultant/expert) valide, contenant au minimum : name, url, logo, description, sameAs.
https://search.google.com/test/rich-results?url=https://votredomaine.comFix : Ajouter le JSON-LD minimal avec les 5 proprietes requises. Valider sur schema.org/validator après déploiement. -
17 Schema FAQPage (min. 5 Q/R) 1 pt
FAQPage valide avec au moins 5 paires question/reponse sur au moins une page. C’est le schema avec le meilleur ratio effort/impact pour les citations LLM. Les questions doivent correspondre a de vraies requêtes (extraire depuis GSC “Queries” ou Answer The Public).
curl -s https://votredomaine.com/[page-faq] | grep -i “FAQPage”Fix : Deployer en priorité sur homepage et page service principale. Minimum 5 Q/R, maximum 10. -
18 Schema Article sur le blog (80%+) 1 pt
Schema Article ou BlogPosting present sur 80%+ des articles, avec au minimum : headline, datePublished, author, image. La plupart des CMS configurent ca automatiquement si l’auteur est renseigne (pas “admin”).
https://search.google.com/test/rich-results?url=https://votredomaine.com/[article]Fix : Vérifier que l’auteur est renseigne avec le vrai nom + que datePublished est correct sur chaque article. -
19 llms.txt present et substantiel 1 pt
Fichier /llms.txt avec contenu significatif : section identite/description ET section services/offre. Un stub vide ou une liste d’URLs auto-générée par un plugin ne compte pas.
curl -s https://votredomaine.com/llms.txt | head -50Fix : Structure minimale : # [Marque] / > [Description en 1 phrase] / ## Identite / ## Services + tarifs si publics / ## FAQ (5-10 Q/R directes). -
20 Open Graph + meta descriptions 1 pt
Meta description unique (150-160 car.) ET og:title + og:description + og:image sur 90%+ des pages indexees. Les meta descriptions sont utilisees par les LLMs pour comprendre de quoi parle une page – c’est une phrase extractible de plus.
curl -s https://votredomaine.com/[page] | grep -E ‘meta name=”description”|og:description|og:title’Fix : Ne pas laisser le CMS générer automatiquement les meta descriptions. Les ecrire manuellement en format réponse directe.
Section 5 – Accès technique (5 pts)
-
21 GPTBot non bloque 1 pt
GPTBot (OpenAI) autorise dans robots.txt. L’absence de regles pour GPTBot = autorise par défaut. Seulement si
Disallow: /est present sousUser-agent: GPTBotil est bloque.curl -s https://votredomaine.com/robots.txt | grep -i -A2 “gptbot”Fix : Retirer la regle de blocage ou ajouter explicitement : User-agent: GPTBot / Allow: / -
22 PerplexityBot non bloque 1 pt
PerplexityBot autorise. Perplexity est le moteur de réponse IA avec la meilleure attribution des sources – être bloque = zéro citation sur Perplexity, quelle que soit la qualité de votre contenu.
curl -s https://votredomaine.com/robots.txt | grep -i -A2 “perplexitybot”Fix : User-agent: PerplexityBot / Allow: / -
23 ClaudeBot / anthropic-ai non bloques 1 pt
ClaudeBot et anthropic-ai (Anthropic) autorises. Deux user-agents distincts à vérifier.
curl -s https://votredomaine.com/robots.txt | grep -i -A2 -E “claudebot|anthropic”Fix : User-agent: ClaudeBot / Allow: / – User-agent: anthropic-ai / Allow: / -
24 CDN/WAF sans blocage silencieux 1 pt
Votre CDN ou WAF (Cloudflare, Fastly, Imperva…) retourne HTTP 200 – et non un 403, captcha ou page d’erreur – pour les user-agents des bots IA. C’est le blocage le plus difficile à detecter car il n’apparait pas dans robots.txt.
# Tester avec le user-agent GPTBot :
curl -s -o /dev/null -w “%{http_code}”
-H “User-Agent: Mozilla/5.0 (compatible; GPTBot/1.0; +https://openai.com/gptbot)”
https://votredomaine.com/
# Attendre 200 – tout autre code = problèmeFix : Dans Cloudflare : Security > WAF > Custom Rules – vérifier qu’aucune regle ne cible les bots IA. Certains plugins WordPress “Block bad bots” bloquent aussi les crawlers IA. -
25 Pages cles HTTP 200, pas de noindex accidentel 1 pt
Les 5 pages les plus importantes retournent HTTP 200 sans balise
<meta name="robots" content="noindex">. Cas frequents de noindex accidentel : pages de staging migrees en prod, plugins SEO avec option “noindex” cochee par défaut, pages password-protected.# Vérifier HTTP status + noindex pour chaque page cle :
curl -sI https://votredomaine.com/[page-cle] | grep -i “http/”
curl -s https://votredomaine.com/[page-cle] | grep -i “noindex”
# Résultat vide sur le grep noindex = OKFix : Vérifier dans WP Admin > Rank Math / Yoast que “noindex” n’est pas coche sur les pages cles. Vérifier aussi le fichier robots.txt de staging si le site a été migre.
Que faire de votre score ?
Une fois les 25 points evalues, votre section avec le score le plus bas est votre seule priorité. Pas la plus forte. Voici l’ordre typique de correction pour un site avec des lacunes sur la Section 5 :
| Étape | Action | Temps | Impact |
|---|---|---|---|
| 1 | Debloquer GPTBot/PerplexityBot/ClaudeBot | 30 min | Immédiat |
| 2 | Schema Organization + sameAs (3 sources) | 2h | 3 mois |
| 3 | FAQPage schema sur homepage + page service | 1h | 1-3 mois |
| 4 | Headings en questions + réponses BLUF | 4h | Continu |
| 5 | Presence Reddit + listes “best of” | Long terme | 6-12 mois |
Vous voulez un audit fait pour vous ?
Je parcours les 25 points sur votre site et vous rends un rapport chiffre avec les corrections prioritaires.
Ce qu’il faut retenir
Être bien classe sur Google et être cite par les LLMs sont deux problèmes différents qui demandent des solutions différentes. Google recompense la page la plus optimisee parmi celles qu’il peut crawler. Un LLM recompense l’entite la plus claire, la plus extractible et la plus accessible.
La bonne nouvelle : la plupart des blocages sont techniques et corrigeables en moins d’une journee. Vérifiez votre robots.txt maintenant – vous seriez surpris du nombre de sites qui bloquent GPTBot par inadvertance, avec un plugin ou une regle Cloudflare oubliee depuis des mois.
Pour aller plus loin : contactez-moi ou telechargez la fiche de scoring complete en PDF. Vous pouvez aussi utiliser directement l’outil interactif d’audit de visibilité IA pour obtenir votre score en quelques minutes.
La visibilité IA ne remplace pas l'acquisition payante. Sur ce volet, voir mon rôle de consultant SEA à Montpellier.
Travaillons ensemble
Une question ? Un projet Google Ads ?
Réponse sous 24h. Audit gratuit offert à l’issue de notre échange.