GEO : comment être cité par ChatGPT, Gemini, Perplexity et Claude
Un guide pour comprendre le GEO et rendre une page claire, structurée et fiable pour les assistants d'IA. Personne ne maîtrise les citations de ces assistants : voici ce qui est documenté, et ce qui relève du bon sens éditorial. Vous pouvez aussi tester votre page tout de suite, gratuitement.
Gratuit, sans compte. Une analyse par jour et par navigateur. Le résultat s'affiche sur la page d'accueil de MicroSEO.
Qu'est-ce que le GEO ?
GEO signifie « Generative Engine Optimization » : l'ensemble des pratiques qui visent à rendre le contenu d'une page facile à comprendre et à reprendre par les assistants d'IA générative (ChatGPT, Gemini, Perplexity, Claude…) lorsqu'ils répondent à une question.
À retenir avant de commencer. Personne ne contrôle ce qu'un assistant d'IA cite. Aucun des éditeurs cités ici ne publie de méthode qui garantisse une citation, et ce guide n'en promet aucune. Le GEO revient à faire de votre page une source claire, exacte et bien structurée : cela n'assure pas d'être cité, mais c'est ce que vous maîtrisez.
GEO et SEO : quelle différence ?
Le SEO vise à faire apparaître une page dans les résultats d'un moteur de recherche, sous forme de liste de liens. Le GEO vise à ce que le contenu de la page soit bien compris et repris lorsqu'un assistant formule lui-même une réponse. Les deux se recoupent largement : une page claire, utile, fiable et accessible aux robots sert les deux.
Un point est confirmé par Google dans sa documentation : pour apparaître dans ses fonctions d'IA (AI Overviews, mode IA), il n'y a pas d'exigence supplémentaire par rapport à Search. La page doit être indexée et éligible à l'affichage avec un extrait, et il n'y a pas de balisage ni de fichier spécial à ajouter. Autrement dit, pour Google, les bases du SEO restent le point de départ.
Les robots des assistants d'IA : ce que disent les éditeurs
Les éditeurs utilisent plusieurs robots, avec des rôles différents : entraîner des modèles, alimenter une recherche, ou aller lire une page parce qu'un utilisateur l'a demandé. Les décrire correctement évite de bloquer le mauvais. Descriptions d'après la documentation officielle de chaque éditeur (voir Sources) :
OAI-SearchBot(OpenAI)Rôle : Fait apparaître des sites dans les résultats des fonctions de recherche de ChatGPT.
robots.txt : Se règle dans robots.txt (délai d'environ 24 h annoncé).
GPTBot(OpenAI)Rôle : Sert à rendre les modèles d'IA générative d'OpenAI plus utiles et plus sûrs (entraînement).
robots.txt : L'interdire signale que le contenu ne doit pas servir à l'entraînement.
ChatGPT-User(OpenAI)Rôle : Visites déclenchées par un utilisateur dans ChatGPT et les GPT personnalisés.
robots.txt : Actions lancées par l'utilisateur : robots.txt peut ne pas s'appliquer.
Google-Extended(Google)Rôle : Jeton pour gérer l'usage du contenu pour l'entraînement de futurs modèles Gemini et l'ancrage dans les applications Gemini.
robots.txt : Via robots.txt ; sans effet sur l'inclusion ni le classement dans Google Search.
PerplexityBot(Perplexity)Rôle : Conçu pour faire apparaître et lier des sites dans les résultats de Perplexity ; non utilisé pour entraîner des modèles de fondation.
robots.txt : Se règle dans robots.txt (jusqu'à 24 h annoncées avant prise en compte).
Perplexity-User(Perplexity)Rôle : Peut visiter une page lorsqu'un utilisateur pose une question.
robots.txt : Ignore généralement robots.txt, car l'utilisateur a demandé la visite.
ClaudeBot(Anthropic)Rôle : Collecte du contenu web pouvant contribuer à l'entraînement des modèles.
robots.txt : Se bloque dans robots.txt.
Claude-User(Anthropic)Rôle : Peut accéder à des sites quand un utilisateur pose une question à Claude.
robots.txt : Se règle dans robots.txt selon Anthropic.
Claude-SearchBot(Anthropic)Rôle : Parcourt le web pour améliorer la qualité des résultats de recherche de Claude.
robots.txt : Se règle dans robots.txt.
Le fichier robots.txt se place à la racine du site (/robots.txt). La norme qui le décrit (RFC 9309) précise que ses règles ne sont pas une forme d'autorisation d'accès : elles servent à indiquer aux robots ce qu'ils peuvent explorer, pas à protéger un contenu confidentiel.
Ces documentations évoluent : vérifiez-les à la source avant de modifier votre fichier. Et autoriser un robot ne garantit rien : cela lui permet seulement de lire votre page.
Checklist actionnable en 8 critères
Ces huit critères sont ceux que l'outil MicroSEO évalue. Ils relèvent de notre méthode éditoriale (structure, clarté, crédibilité), pas d'une règle publiée par les éditeurs d'assistants. Chacun renvoie à une fiche détaillée.
- Critère 1
Structure et hiérarchie
Un seul H1 qui dit le sujet, des H2 et H3 qui découpent la page en parties compréhensibles hors contexte.
Lire la fiche : Structure et hiérarchie - Critère 2
Langage conversationnel
Des phrases naturelles et, pour les questions courantes, une réponse directe dès la première phrase du paragraphe.
Lire la fiche : Langage conversationnel - Critère 3
Listes et tableaux
Les étapes, critères et comparaisons rangés en listes ou en tableaux plutôt que noyés dans un long paragraphe.
Lire la fiche : Listes et tableaux - Critère 4
Autorité (E-E-A-T)
Un auteur identifié, des sources citées, une date, des signes d'expérience réelle : le lecteur sait qui parle et sur quoi il s'appuie.
Lire la fiche : Autorité (E-E-A-T) - Critère 5
Contenu original
Des exemples, des données ou une analyse qui viennent de vous, plutôt qu'une reformulation de ce que disent déjà dix autres pages.
Lire la fiche : Contenu original - Critère 6
FAQ et questions-réponses
Une section de vraies questions que posent vos lecteurs, avec des réponses courtes et complètes.
Lire la fiche : FAQ et questions-réponses - Critère 7
Qualité technique
Une page en HTTPS, dont le contenu est dans le HTML (et pas seulement produit par JavaScript), avec des données structurées JSON-LD cohérentes avec le texte visible.
Lire la fiche : Qualité technique - Critère 8
Clarté sémantique
Une page qui répond précisément à une intention, avec un vocabulaire cohérent avec son sujet, sans digression.
Lire la fiche : Clarté sémantique
Erreurs fréquentes
- Croire qu'une astuce garantit une citation. Aucun des éditeurs cités ici ne publie de règle qui assure d'être cité. Google indique lui-même que remplir les conditions n'implique pas que la page soit explorée, indexée ou servie.
- Bloquer par erreur les robots que l'on veut voir passer. Un fichier robots.txt copié sans relecture peut interdire un robot de recherche d'IA alors qu'on souhaitait seulement refuser l'entraînement. Ce sont des robots distincts (voir la liste ci-dessus).
- Cacher le contenu dans du JavaScript. L'outil MicroSEO lit le HTML de la page ; un texte affiché uniquement après exécution de scripts peut lui échapper. Prudence si vous visez d'autres lecteurs automatiques : rien ne dit qu'ils exécutent tous le JavaScript.
- Ajouter du balisage « pour l'IA » en croyant qu'il est nécessaire. Google précise qu'il n'y a pas de schema.org spécifique ni de fichier particulier à ajouter pour apparaître dans ses fonctions d'IA.
- Remplir une FAQ de questions que personne ne pose. Une FAQ utile reprend des questions réellement reçues (service client, e-mails, recherches). Le texte balisé doit être le texte visible.
- Produire des pages en masse sans valeur propre. Des pages quasi identiques n'apportent rien à un lecteur ni à un assistant. Mieux vaut peu de pages, claires, exactes et à jour.
Comment tester sa page
- Vérifiez l'accès. Ouvrez
votre-site.fr/robots.txtet contrôlez que vous n'interdisez pas, sans le vouloir, un robot de recherche. - Vérifiez le contenu source. Affichez le code source de la page : le texte important y figure-t-il, ou n'apparaît-il qu'après exécution de scripts ?
- Lancez une analyse MicroSEO. Elle note les huit critères et propose trois priorités. C'est une estimation de la structure et de la clarté de la page : l'outil n'interroge aucun assistant et ne mesure pas les citations réelles.
- Corrigez le critère le plus faible, puis recommencez. Comparez avant et après plutôt que de viser un chiffre précis, car deux analyses peuvent différer un peu.
- Posez la question vous-même. Demandez à un assistant une question sur votre sujet et regardez quelles sources il affiche. Les réponses varient d'une fois à l'autre : c'est un test qualitatif, pas une mesure. Notre article sur la mesure de visibilité dans les réponses d'IA détaille ses limites.
Questions fréquentes
Peut-on garantir qu'un assistant d'IA cite sa page ?
Non. Personne ne maîtrise les citations de ChatGPT, Gemini, Perplexity ou Claude. Les éditeurs ne publient pas de règle qui l'assure, et Google précise que même une page qui respecte toutes les conditions n'est pas assurée d'être explorée, indexée ou affichée. Le GEO consiste à rendre une page claire, structurée et fiable, ce qui augmente ses chances d'être comprise, pas à obtenir une citation à coup sûr.
Faut-il un balisage ou un fichier spécial pour apparaître dans les réponses d'IA de Google ?
Selon la documentation de Google Search Central, non : il n'y a pas d'exigence supplémentaire pour apparaître dans les AI Overviews ou le mode IA, ni de fichier, de balisage ou de données structurées schema.org spécifiques. La page doit être indexée et éligible à l'affichage dans Google avec un extrait.
Bloquer GPTBot m'empêche-t-il d'apparaître dans ChatGPT ?
Pas nécessairement. D'après OpenAI, GPTBot sert à l'entraînement de ses modèles, tandis que OAI-SearchBot sert à faire apparaître des sites dans les fonctions de recherche de ChatGPT. Ce sont deux réglages distincts dans le fichier robots.txt. OpenAI indique aussi qu'un changement peut demander environ 24 heures avant d'être pris en compte.
Google-Extended influence-t-il mon classement dans Google ?
Non, d'après Google : Google-Extended ne joue pas sur l'inclusion dans Google Search et n'est pas un signal de classement. C'est un jeton qui permet de gérer l'usage du contenu pour l'entraînement de futurs modèles Gemini et pour l'ancrage dans les applications Gemini.
Le fichier robots.txt suffit-il à protéger une page ?
Non. La norme (RFC 9309) précise que ces règles ne sont pas une forme d'autorisation d'accès : elles s'adressent à des robots qui choisissent de les respecter. Pour des contenus réellement privés, il faut une vraie protection d'accès. Par ailleurs, OpenAI et Perplexity indiquent que leurs robots déclenchés par une demande d'utilisateur (ChatGPT-User, Perplexity-User) ne suivent pas forcément ces règles.
Que mesure MicroSEO, et que ne mesure-t-il pas ?
MicroSEO lit le HTML d'une page et un modèle de langage note huit critères de structure, de contenu et de clarté, de 0 à 100, avec des conseils. L'outil n'interroge aucun assistant d'IA et ne mesure pas les citations réelles, ni votre position dans Google. Le score est une estimation qui peut varier légèrement d'une analyse à l'autre.
Pour aller plus loin
- Comment mesurer sa visibilité dans les réponses des IA générativesCe que l'on peut vraiment mesurer, et ce qui reste hors de portée.
- Storytelling et GEORaconter des cas réels : un levier pour le critère contenu original.
Les huit fiches détaillées :
Sources
Documentations officielles consultées le 9 octobre 2026 :
- OpenAI : documentation des robots (OAI-SearchBot, GPTBot, ChatGPT-User)
- Google Search Central : fonctions d'IA et votre site web (AI Overviews, mode IA)
- Google Search Central : robots d'exploration courants (Google-Extended)
- Perplexity : guide des robots (PerplexityBot, Perplexity-User)
- Anthropic : Anthropic explore-t-il le web, et comment bloquer ses robots ? (ClaudeBot, Claude-User, Claude-SearchBot)
- IETF : RFC 9309, Robots Exclusion Protocol
Les conseils de la checklist sont ceux de MicroSEO : ils ne proviennent pas de ces documentations.
Testez la structure et la clarté de votre page
Collez l'adresse, lancez l'analyse : le résultat s'affiche sur la page d'accueil. L'outil note la structure et la clarté, pas les citations réelles.
Gratuit, sans compte. Une analyse par jour et par navigateur.