Visibilité IA

Classe top-3 sur Google mais invisible sur ChatGPT : l’audit en 25 points

TF
Thibault Fayol
10 juin 2026 12 min de lecture

Le scénario revient dans presque chaque audit que je fais : une marque classee en première position sur Google pour ses termes commerciaux cles, et pourtant completement absente des réponses de ChatGPT, Perplexity ou Google AI Overviews. Aucune citation. Aucune mention. Comme si le site n’existait pas.

Ce n’est pas un bug. C’est une différence structurelle entre deux machines qui ne fonctionnent pas du tout de la même facon.

Pourquoi Google et les LLMs ne lisent pas la même chose ?

Google suit un pipeline linéaire que l’on connait bien. Un moteur IA suit un pipeline différent – et c’est la source du problème :

Google
Crawl -> Index -> Rank
Moteur IA (ChatGPT, Perplexity…)
Retrieve -> Synthesise -> Cite

Google rankera la page la plus optimisee parmi celles qu’il peut crawler. Un LLM citera la source qu’il peut extraire, identifier et attribuer avec confiance. Une page parfaitement optimisee pour le SEO classique peut être totalement non-extractible pour un LLM.

La regle de la chaine

Votre section avec le score le plus bas est votre seule priorité – pas la plus forte. C’est une chaine : une page parfaitement extractible que le crawler ne peut pas atteindre score zéro en pratique. Toujours corriger le maillon faible en premier.

Comment utiliser cet audit ?

25 checkpoints, 5 sections, environ 20 minutes. Chaque point vaut 1 point. Score max : 25/25.

# Section Points
1-5Empreinte entite/5
6-10Presence off-site/5
11-15Extractabilite/5
16-20Signaux structures/5
21-25Accès technique/5
0-8
Invisible
Les modèles ne vous trouvent pas ou ne peuvent pas vous citer.
9-15
Partiel
Citations possibles sur les requêtes brand, rarement sur les génériques.
16-20
Bonne base
Citable sur les requêtes de categorie si le contenu est bien positionne.
21-25
Presence forte
Cite de facon régulière et factuelle par les principaux moteurs IA.

Section 1 – Empreinte entite (5 pts)

1
Empreinte entite
Les moteurs IA construisent leur réponse à partir de sources secondaires fiables avant même de visiter votre site. Si des sources independantes ne vous decrivent pas de facon coherente, vous n’existez pas en tant qu’entite dans leur modèle.
  • 01 Presence Wikipedia 1 pt

    Article Wikipedia dédié ou mention factuelle dans un article de categorie pertinente.

    # Dans Google :
    site:wikipedia.org “[Votre marque]”
    Fix : Priorité a la couverture presse et aux mentions dans des articles Wikipedia de votre secteur. Un article Wikipedia se justifie uniquement avec une notoriété preexistante.
  • 02 Google Knowledge Panel 1 pt

    Une recherche Google sur votre nom de marque declenche un Knowledge Panel (encadre a droite) avec description, logo et liens. Une simple fiche Google Business n’est pas un Knowledge Panel.

    # Dans Google, navigation privee :
    “[Votre marque]”
    Fix : Deployer schema.org Organization/Person avec sameAs pointant vers Wikipedia, Wikidata, LinkedIn, Crunchbase. Le Knowledge Panel suit généralement dans les 3-6 mois.
  • 03 Entite Wikidata 1 pt

    Fiche Wikidata (Q-identifier) existante avec au moins 5 proprietes renseignees (P856 site officiel, P18 image, P112 fondateur, P571 date de creation).

    https://www.wikidata.org/wiki/Special:Search?search=[Votre+marque]
    Fix : Créer la fiche Wikidata en suivant les regles de notabilite. Relier depuis Wikipedia si article existant.
  • 04 Coherence NAP etendue 1 pt

    Nom, localisation/positionnement et description identiques sur LinkedIn, Crunchbase, Google Business, Trustpilot et votre site. Un LLM qui trouve “SaaS B2B” sur LinkedIn et “agence conseil” sur Crunchbase ne sait pas quelle version garder – il omet.

    # Comparer manuellement les descriptions sur 5 profils
    Fix : Corriger les contradictions d’abord, puis remplir les profils manquants. Coherence requise sur au moins 4 profils sur 5.
  • 05 Ancres sameAs (min. 3) 1 pt

    Votre schema.org Organization/Person declare au moins 3 URLs de profils d’autorite (DA 50+) via la propriété sameAs : LinkedIn, Wikipedia, Wikidata, Crunchbase, Google Business.

    curl -s https://votredomaine.com/ | grep -i “sameAs”
    # Ou : https://search.google.com/test/rich-results
    Fix : Ajouter dans le JSON-LD : "sameAs": ["https://linkedin.com/company/...", "https://wikidata.org/wiki/Q..."]

Section 2 – Presence off-site (5 pts)

2
Presence off-site
Reddit est de facon constante le domaine le plus cite par ChatGPT dans ses réponses. Wikipedia et YouTube suivent. Si vous n’existez pas dans ces espaces, vous serez peu cite même si votre site est techniquement parfait.
Le fait qui surprend

Reddit est le domaine #1 cite par ChatGPT dans ses réponses – devant Wikipedia et YouTube. Si votre marque n’est pas mentionnee dans des threads Reddit pertinents, vous manquez la source que les LLMs privilegient le plus.

  • 06 Mentions Reddit organiques 1 pt

    Au moins une mention organique positive dans un thread de votre secteur, par un utilisateur sans lien apparent avec vous.

    site:reddit.com “[Votre marque]” -“deleted”
    Fix : Participer honnetement dans r/[votre secteur], r/entrepreneur. Repondre a des questions sans autopromotion. Les mentions naturelles viennent du service réel.
  • 07 Listes “best of” tierces 1 pt

    Present dans au moins un article “meilleur [categorie]” ou “top [secteur]” publie par un auteur sans lien avec vous, sur un domaine DA 30+.

    “meilleur [categorie]” OR “top [categorie]” “[Votre marque]” -site:votredomaine.com
    Fix : Cibler les roundups existants (classes p.1 Google). Email direct aux auteurs avec pitch “pourquoi vous meritez d’être dans leur liste”.
  • 08 Presence YouTube 1 pt

    Au moins une vidéo YouTube (propre ou tierce) avec votre marque dans le titre ou description, 500+ vues. YouTube est le 2e moteur de recherche mondial et un signal fort pour les LLMs.

    site:youtube.com “[Votre marque]”
    Fix : Une vidéo “what is [Votre marque]” ou une demo produit suffit pour demarrer.
  • 09 Presse et médias (DA 40+) 1 pt

    Au moins une mention factuelle dans une publication DA 40+ : journal, blog pro reconnu, newsletter sectorielle. Un communique de presse sur un site générique ne compte pas.

    “[Votre marque]” -site:votredomaine.com -site:reddit.com
    # Vérifier le DA via Moz ou Ahrefs
    Fix : HARO pour des quotes dans des articles. Guest posts sur publications sectorielles. Étude originale avec donnees propres = meilleur levier de citation presse.
  • 10 Avis et reviews tierces 1 pt

    10+ avis verifies sur G2, Capterra, Trustpilot ou Google Business, note >= 4,0. G2 et Capterra sont massivement indexes dans les LLMs pour les requêtes “[logiciel] avis” et “[service] comparaison”.

    # Recherche directe sur G2 / Capterra / Trustpilot pour votre marque
    Fix : Mettre en place un process de collecte d’avis post-achat/onboarding. L’objectif minimum est 10 avis sur 1 plateforme reconnue.

Section 3 – Extractabilite (5 pts)

3
Extractabilite
Un LLM cite ce qu’il peut extraire sans ambiguite. Les headings en forme de question sont cites a environ 2x le taux des headings affirmatifs. Une page bien extractible donne au modèle la réponse en une phrase – pas une invitation à creuser.
  • 11 Headings en forme de question (>=30%) 1 pt

    Au moins 30% de vos H2/H3 sur les 5 pages cles sont formules comme des questions. Les headings affirmatifs (“Notre approche”, “Nos tarifs”) sont invisibles aux LLMs en mode extraction.

    # Compter H2/H3 total vs H2/H3 en questions sur vos 5 pages principales
    Fix : “Notre approche” -> “Comment fonctionne notre approche ?” – “Tarifs” -> “Combien coute [Service] ?”
  • 12 Réponses auto-suffisantes (BLUF) 1 pt

    Chaque heading-question est suivi d’une réponse complete dans les 2-3 premières phrases, sans renvoi vers une autre page. Un LLM extrait les premières phrases d’une section – pas la section entiere. Pattern BLUF : donner la réponse d’abord, développer ensuite.

    # Lire les 2 premières phrases après chaque heading-question.
    # La réponse a-t-elle du sens sortie de son contexte ?
    Fix : Retravailler les sections qui commencent par “Il est important de…”, “Dans cet article nous verrons…”, “Pour repondre a cette question…”.
  • 13 Clarte des entites nommees 1 pt

    Le nom exact de votre marque apparait dans le premier paragraphe de chaque page. Les produits/services sont nommes explicitement – pas “notre solution”, “notre outil”, “nous”. Les LLMs n’ont pas le contexte de navigation : chaque page est un document isole.

    # Lire les 100 premiers mots de vos 5 pages cles.
    # Compter : nom de marque exact vs pronoms/references vagues.
    Fix : Remplacer “notre logiciel” par “[Nom produit] de [Marque]” dans les premières phrases.
  • 14 Page comparative explicite 1 pt

    Au moins une page “[Votre marque] vs [Concurrent]” ou “[Votre marque] alternatives” sur votre site ou dans des publications tierces. C’est la requête que les acheteurs posent aux LLMs – elle est très extractible.

    “[Votre marque] vs” OR “[Votre marque] alternative” OR “[Votre marque] comparaison”
    Fix : Créer une page /alternatives ou /comparaison. Inclure un tableau comparatif structure avec votre marque en première colonne.
  • 15 Donnees chiffrees memorables (min. 3) 1 pt

    Au moins 3 donnees chiffrees specifiques et verifiables sur vos pages principales. Les LLMs citent les chiffres précis – ils ignorent “leader du marché” et “solution innovante”.

    # Scanner vos 5 pages cles pour des chiffres avec contexte explicite
    # Exemple valide : “3 200 clients dans 40 pays”, “ROAS moyen de 4.2x”
    # Exemple invalide : “des milliers de clients”, “très performant”
    Fix : Extraire de vos analytics/CRM : volume traite, taux de satisfaction précis, economies client, délai de mise en oeuvre.

Section 4 – Signaux structures (5 pts)

4
Signaux structures
Les schemas JSON-LD sont le langage que les LLMs lisent directement. FAQPage est le schema avec le meilleur ratio effort/impact pour les citations. llms.txt est emergent mais déjà indexe par plusieurs moteurs.
  • 16 Schema Organization ou Person valide 1 pt

    Homepage avec schema Organization (entreprise) ou Person (consultant/expert) valide, contenant au minimum : name, url, logo, description, sameAs.

    https://search.google.com/test/rich-results?url=https://votredomaine.com
    Fix : Ajouter le JSON-LD minimal avec les 5 proprietes requises. Valider sur schema.org/validator après déploiement.
  • 17 Schema FAQPage (min. 5 Q/R) 1 pt

    FAQPage valide avec au moins 5 paires question/reponse sur au moins une page. C’est le schema avec le meilleur ratio effort/impact pour les citations LLM. Les questions doivent correspondre a de vraies requêtes (extraire depuis GSC “Queries” ou Answer The Public).

    curl -s https://votredomaine.com/[page-faq] | grep -i “FAQPage”
    Fix : Deployer en priorité sur homepage et page service principale. Minimum 5 Q/R, maximum 10.
  • 18 Schema Article sur le blog (80%+) 1 pt

    Schema Article ou BlogPosting present sur 80%+ des articles, avec au minimum : headline, datePublished, author, image. La plupart des CMS configurent ca automatiquement si l’auteur est renseigne (pas “admin”).

    https://search.google.com/test/rich-results?url=https://votredomaine.com/[article]
    Fix : Vérifier que l’auteur est renseigne avec le vrai nom + que datePublished est correct sur chaque article.
  • 19 llms.txt present et substantiel 1 pt

    Fichier /llms.txt avec contenu significatif : section identite/description ET section services/offre. Un stub vide ou une liste d’URLs auto-générée par un plugin ne compte pas.

    curl -s https://votredomaine.com/llms.txt | head -50
    Fix : Structure minimale : # [Marque] / > [Description en 1 phrase] / ## Identite / ## Services + tarifs si publics / ## FAQ (5-10 Q/R directes).
  • 20 Open Graph + meta descriptions 1 pt

    Meta description unique (150-160 car.) ET og:title + og:description + og:image sur 90%+ des pages indexees. Les meta descriptions sont utilisees par les LLMs pour comprendre de quoi parle une page – c’est une phrase extractible de plus.

    curl -s https://votredomaine.com/[page] | grep -E ‘meta name=”description”|og:description|og:title’
    Fix : Ne pas laisser le CMS générer automatiquement les meta descriptions. Les ecrire manuellement en format réponse directe.

Section 5 – Accès technique (5 pts)

5
Accès technique
Un LLM ne peut citer que ce qu’il a pu crawler. Les blocages silencieux – Cloudflare, robots.txt, noindex accidentel – sont la cause la plus frequente de l’écart entre “bien indexe Google” et “jamais cite par les IA”.
  • 21 GPTBot non bloque 1 pt

    GPTBot (OpenAI) autorise dans robots.txt. L’absence de regles pour GPTBot = autorise par défaut. Seulement si Disallow: / est present sous User-agent: GPTBot il est bloque.

    curl -s https://votredomaine.com/robots.txt | grep -i -A2 “gptbot”
    Fix : Retirer la regle de blocage ou ajouter explicitement : User-agent: GPTBot / Allow: /
  • 22 PerplexityBot non bloque 1 pt

    PerplexityBot autorise. Perplexity est le moteur de réponse IA avec la meilleure attribution des sources – être bloque = zéro citation sur Perplexity, quelle que soit la qualité de votre contenu.

    curl -s https://votredomaine.com/robots.txt | grep -i -A2 “perplexitybot”
    Fix : User-agent: PerplexityBot / Allow: /
  • 23 ClaudeBot / anthropic-ai non bloques 1 pt

    ClaudeBot et anthropic-ai (Anthropic) autorises. Deux user-agents distincts à vérifier.

    curl -s https://votredomaine.com/robots.txt | grep -i -A2 -E “claudebot|anthropic”
    Fix : User-agent: ClaudeBot / Allow: / – User-agent: anthropic-ai / Allow: /
  • 24 CDN/WAF sans blocage silencieux 1 pt

    Votre CDN ou WAF (Cloudflare, Fastly, Imperva…) retourne HTTP 200 – et non un 403, captcha ou page d’erreur – pour les user-agents des bots IA. C’est le blocage le plus difficile à detecter car il n’apparait pas dans robots.txt.

    # Tester avec le user-agent GPTBot :
    curl -s -o /dev/null -w “%{http_code}”
    -H “User-Agent: Mozilla/5.0 (compatible; GPTBot/1.0; +https://openai.com/gptbot)”
    https://votredomaine.com/

    # Attendre 200 – tout autre code = problème
    Fix : Dans Cloudflare : Security > WAF > Custom Rules – vérifier qu’aucune regle ne cible les bots IA. Certains plugins WordPress “Block bad bots” bloquent aussi les crawlers IA.
  • 25 Pages cles HTTP 200, pas de noindex accidentel 1 pt

    Les 5 pages les plus importantes retournent HTTP 200 sans balise <meta name="robots" content="noindex">. Cas frequents de noindex accidentel : pages de staging migrees en prod, plugins SEO avec option “noindex” cochee par défaut, pages password-protected.

    # Vérifier HTTP status + noindex pour chaque page cle :
    curl -sI https://votredomaine.com/[page-cle] | grep -i “http/”
    curl -s https://votredomaine.com/[page-cle] | grep -i “noindex”
    # Résultat vide sur le grep noindex = OK
    Fix : Vérifier dans WP Admin > Rank Math / Yoast que “noindex” n’est pas coche sur les pages cles. Vérifier aussi le fichier robots.txt de staging si le site a été migre.

Que faire de votre score ?

Une fois les 25 points evalues, votre section avec le score le plus bas est votre seule priorité. Pas la plus forte. Voici l’ordre typique de correction pour un site avec des lacunes sur la Section 5 :

Étape Action Temps Impact
1 Debloquer GPTBot/PerplexityBot/ClaudeBot 30 min Immédiat
2 Schema Organization + sameAs (3 sources) 2h 3 mois
3 FAQPage schema sur homepage + page service 1h 1-3 mois
4 Headings en questions + réponses BLUF 4h Continu
5 Presence Reddit + listes “best of” Long terme 6-12 mois

Vous voulez un audit fait pour vous ?

Je parcours les 25 points sur votre site et vous rends un rapport chiffre avec les corrections prioritaires.

Demander un audit

Ce qu’il faut retenir

Être bien classe sur Google et être cite par les LLMs sont deux problèmes différents qui demandent des solutions différentes. Google recompense la page la plus optimisee parmi celles qu’il peut crawler. Un LLM recompense l’entite la plus claire, la plus extractible et la plus accessible.

La bonne nouvelle : la plupart des blocages sont techniques et corrigeables en moins d’une journee. Vérifiez votre robots.txt maintenant – vous seriez surpris du nombre de sites qui bloquent GPTBot par inadvertance, avec un plugin ou une regle Cloudflare oubliee depuis des mois.

Pour aller plus loin : contactez-moi ou telechargez la fiche de scoring complete en PDF. Vous pouvez aussi utiliser directement l’outil interactif d’audit de visibilité IA pour obtenir votre score en quelques minutes.

TF
Thibault Fayol
Consultant SEA & Visibilité IA – Montpellier

Ex-comptable tresorier reconverti en consultant marketing digital. J’accompagne les marques qui veulent être citees – pas seulement classees. +7 ans d’expérience, +4MEUR de budget gère, audits visibilité IA depuis 2024.