·
Aller au contenu principal

Le journal GEO10 min de lecture

Checklist d'audit GEO : 12 vérifications avant de toucher au contenu

Un audit GEO répond à trois questions avant toute modification : les moteurs IA peuvent-ils atteindre vos pages, comprennent-ils votre marque, vous citent-ils déjà. Les douze vérifications ci-dessous couvrent trois groupes — accès, contenu et entité, mesure — et chacune se conclut par une réussite ou un échec consigné avant de toucher à la moindre page.

Ce qu'un audit GEO vérifie qu'un audit SEO ne couvre pas

Un audit GEO couvre cinq domaines : accès des crawlers IA, validité des données structurées, structure extractible du contenu, cohérence d'entité et baseline de citations par prompts. Son livrable est une liste de réussites et d'échecs, pas une liste de tâches : savoir ce qui est cassé avant de décider quoi réécrire.

Trois groupes : les vérifications 1 à 4 couvrent l'accès (robots.txt, rendu, logs serveur, llms.txt) ; les vérifications 5 à 8 couvrent le contenu et l'entité (structure de réponse, schema, cohérence des faits, fraîcheur) ; les vérifications 9 à 12 couvrent la mesure (baseline, part concurrentielle, exactitude, KPI).

Une partie de l'audit SEO se transfère telle quelle : si un crawler ne peut pas récupérer une page, rien en aval ne compte, pour GPTBot comme pour Googlebot. D'autres vérifications n'ont aucun équivalent SEO — aucun suivi de positions ne vous signale que ChatGPT annonce vos anciens tarifs. Position et citation sont deux résultats distincts : dans une analyse de juillet 2025, Ahrefs rapporte que 14,40 % des pages citées dans les AI Overviews ne se positionnent pas dans les SERP, c'est-à-dire au-delà de la position 100. Une page peut se positionner sans être citée, et inversement.

Un audit GEO mesure donc ses propres signaux au-delà du décompte brut de citations : le taux de mention (les moteurs nomment la marque), le taux de citation (ils lient une de vos pages) et l'exactitude (leurs affirmations sont vraies). Ces termes portent les vérifications de mesure en fin d'article.

Audit SEOAudit GEO
Ce qu'il mesurePositions, couverture d'index, clics organiquesTaux de mention, taux de citation, exactitude des réponses
Outillage principalSearch Console, suivi de positions, crawlers de siteLogs serveur, prompts répétés, rapports de performance IA
À quoi ressemble une réussitePage indexée et positionnée sur sa requêtePage accessible, faits cohérents, marque citée dans les réponses

Vérifications 1 à 4 : les moteurs IA peuvent-ils atteindre et lire vos pages

Commencez ici ; rien d'autre ne compte si les crawlers ne peuvent pas récupérer les pages.

Vérification 1 : les règles robots.txt par user agent IA

Lisez le robots.txt ligne par ligne et consignez ce que chaque crawler IA peut faire : GPTBot, OAI-SearchBot, PerplexityBot, ClaudeBot et Google-Extended au minimum. Crawlers d'entraînement et crawlers de recherche sont des agents distincts, aux conséquences distinctes. La documentation des crawlers d'OpenAI, vérifiée le 1er octobre 2026, sépare GPTBot, qui collecte du contenu pour entraîner les modèles, d'OAI-SearchBot, qui fait apparaître les sites dans la recherche ChatGPT ; bloquer l'un ne bloque pas l'autre. Le centre d'aide d'Anthropic indique que ses bots respectent les signaux de non-exploration en honorant les directives standard du robots.txt. Après toute modification, retestez après le délai documenté : OpenAI indique qu'environ 24 heures peuvent s'écouler entre une mise à jour du robots.txt et l'ajustement de ses systèmes de recherche. Réussite : chaque agent que vous comptez autoriser l'est explicitement, et le choix entraînement ou recherche est délibéré, pas un effet de bord d'une règle générique.

Vérification 2 : les pages se rendent sans JavaScript

Récupérez chaque page prioritaire avec une simple requête curl, ou JavaScript désactivé dans le navigateur, et lisez le HTML brut. Plusieurs crawlers IA n'exécutent pas JavaScript : un contenu injecté côté client peut leur rester invisible même quand la page semble complète pour un visiteur. Réussite : le contenu principal — réponse, tableau, faits produit — est présent dans la réponse HTML initiale.

Vérification 3 : des visites de crawlers confirmées dans les logs serveur

Un robots.txt ouvert prouve la permission, pas la présence. Filtrez vos logs d'accès sur les chaînes user-agent autorisées à la vérification 1 et confirmez des passages récents sur les pages qui comptent. Deux réserves : n'importe quel client peut se déclarer GPTBot — la chaîne seule est une preuve faible — et certains fournisseurs publient des plages d'IP officielles pour confirmer qu'un passage vient bien d'eux. Réussite : des visites vérifiées des crawlers de recherche et de réponse sur une fenêtre récente ; aucune visite est un constat à consigner et investiguer, pas une raison de réécrire.

Vérification 4 : llms.txt, noté mais pas déterminant

llms.txt est une proposition de fichier texte listant les contenus clés d'un site pour les modèles de langage. Le guide de Google sur l'optimisation pour les fonctionnalités d'IA générative, vérifié le 1er octobre 2026, est explicite : aucun nouveau fichier lisible par machine, fichier texte pour l'IA, balisage ou Markdown n'est nécessaire pour apparaître dans la recherche Google. Consignez l'existence du fichier si l'équipe y tient, mais ne le pesez jamais comme facteur GEO de réussite ou d'échec. Réussite signifie ici simplement que l'audit note sa présence ou son absence et passe à la suite.

Vérifications 5 à 8 : vos contenus et données d'entité sont-ils prêts pour la citation

Passez ces quatre vérifications sur un échantillon de pages prioritaires ; chacune prend moins d'une heure.

Vérification 5 : la réponse d'abord sur les pages clés

Ouvrez chaque page prioritaire et lisez seulement le premier écran. Il doit énoncer la réponse que la page existe pour donner, sans l'enterrer sous un préambule. Parcourez ensuite le reste : titres descriptifs, listes et tableaux qui portent les faits sous forme extractible, plutôt qu'une longue prose indifférenciée. Réussite : la réponse principale est lisible sans faire défiler, et les faits qui l'appuient tiennent dans des structures qu'un modèle peut citer.

Vérification 6 : un schema conforme au contenu visible

Validez les données structurées sur le même échantillon : Organization pour le site, Article pour les billets, FAQPage quand la page répond à des questions. Le parsing seul n'est pas le critère. Le balisage doit correspondre à ce que la page affiche — mêmes prix, mêmes dates, mêmes affirmations —, car un balisage qui diverge du contenu visible est un problème de confiance, pas un problème technique. Réussite : un balisage valide et zéro divergence entre le schema et la page.

Vérification 7 : des faits d'entité cohérents partout

Listez les faits de marque qu'un moteur pourrait répéter — tarifs, date de création, affirmations produit, implantations — et comparez-les entre votre site, LinkedIn, Crunchbase, G2 et les autres profils tiers qui vous décrivent. Les moteurs répondent depuis la source qu'ils ont récupérée : un seul profil obsolète peut l'emporter sur votre page d'accueil. Sur les sites multilingues, étendez la comparaison aux versions linguistiques : les moteurs répondent aux prompts non anglophones depuis la version récupérée, et une page traduite aux tarifs périmés devient la réponse dans cette langue. Réussite : chaque incohérence est signalée avec son emplacement ; un premier audit sans écart est rare.

Vérification 8 : auteur, dates et signaux de fraîcheur

Vérifiez que les pages prioritaires affichent un auteur nommé, une date de publication visible et une date de mise à jour quand le contenu a changé. Ce sont des signaux de confiance vérifiables, pas de la décoration, et la preuve pour les contenus sourcés est précise : l'étude GEO d'Aggarwal et al., publiée en novembre 2023 et présentée à KDD 2024, rapporte que des méthodes d'optimisation — ajout de statistiques, de citations et de sources — peuvent augmenter la visibilité jusqu'à 40 % dans les réponses des moteurs génératifs. Ce chiffre est un maximum observé dans leur benchmark, pas un gain à attendre sur une page donnée. Réussite : dates et auteur visibles sur chaque page prioritaire, et sources citées quand la page avance des faits.

Vérifications 9 à 12 : ce que les moteurs IA disent actuellement de vous

Vérification 9 : une baseline de citations depuis un jeu de prompts figé

Rédigez un jeu fixe de prompts que vos acheteurs poseraient, figez-le, puis exécutez-le sur ChatGPT, Perplexity, Gemini et Claude. Répétez chaque prompt suffisamment pour lisser la variance entre exécutions, car une exécution unique induit en erreur, et consignez le taux de mention et le taux de citation par moteur. Un résultat proche de zéro reste une baseline ; avant de changer quoi que ce soit, diagnostiquez pourquoi ChatGPT ne mentionne jamais votre marque. Réussite : un tableau de baseline daté existe et peut être reproduit.

Vérification 10 : la part de citations des concurrents sur les mêmes prompts

Relisez les mêmes réponses côté concurrents : quelles marques sont mentionnées à votre place, et vers quels domaines pointent les citations — leurs sites, des fils Reddit, des plateformes d'avis, Wikipédia. La répartition des sources montre où se situe l'influence dans votre catégorie. Pour garder la comparaison stable dans le temps, comparez votre visibilité IA à celle de vos concurrents avec un jeu de prompts figé plutôt qu'avec des requêtes improvisées. Réussite : une vue de part de voix par moteur, avec la liste des domaines cités.

Vérification 11 : l'exactitude de ce que les moteurs affirment sur votre marque

Relisez chaque réponse collectée à la recherche d'erreurs factuelles : tarifs erronés, produits arrêtés, fonctionnalités inventées. Quand un moteur affirme quelque chose de faux, le chemin de correction est concret. Corrigez les pages sources récupérées par le moteur — souvent les profils incohérents de la vérification 7 —, utilisez les mécanismes de signalement de la plateforme, puis relancez le prompt une fois le contenu corrigé recrawlé. Réussite : chaque affirmation fausse est consignée avec sa source présumée et un responsable de la correction.

Vérification 12 : des KPI définis et une source de mesure choisie

Avant de clore l'audit, décidez ce que vous suivrez et d'où viendront les données. Deux sources first-party existent désormais gratuitement. Le rapport de performance sur l'IA générative de Google Search Console montre comment votre site performe dans les fonctionnalités d'IA générative de la recherche Google, selon la documentation d'aide de Google consultée le 1er octobre 2026. Microsoft a annoncé AI Performance dans Bing Webmaster Tools en février 2026 : des indicateurs montrant comment les contenus des éditeurs apparaissent dans Microsoft Copilot, les résumés IA de Bing et certaines intégrations partenaires. Côté objectifs : aucun taux de citation sain universel n'existe, car le chiffre dépend de l'étendue du jeu de prompts et de la densité concurrentielle — un outil B2B de niche et une marque grand public verront des taux incomparables. Fixez une baseline interne depuis la vérification 9 et mesurez le mouvement par rapport à elle plutôt que de courir après un chiffre sectoriel. Réussite : KPI nommés, sources de reporting connectées, baseline consignée.

Par où commencer cette semaine

Priorisez par dépendance, pas par scores effort-impact : un échec d'accès invalide toutes les vérifications en aval et passe donc en premier, quelle que soit la taille du correctif. Ne réécrivez rien tant que les vérifications 1 à 4 ne passent pas — modifier des pages que les crawlers n'atteignent pas ne change rien.

Une première semaine réaliste : jour un, lancez les vérifications robots.txt et rendu sur vos quelques pages les plus importantes ; jour deux, comparez les faits d'entité entre votre site et les profils tiers ; jours trois à cinq, rédigez le jeu de prompts, exécutez-le sur les quatre moteurs et consignez la baseline.

Fixez ensuite une cadence : relancez les vérifications de mesure à intervalle fixe avec le même jeu de prompts, pour des résultats comparables, et les vérifications d'accès après toute migration ou changement de CMS. Une fois la baseline établie, vous pouvez automatiser les vérifications de visibilité au lieu de les relancer à la main.

Lancez un scan Namedrop gratuit pour obtenir les vérifications de mesure — mentions, citations et part concurrentielle — faites pour vous avant d'attaquer la partie manuelle de l'audit.

Sources

Questions fréquentes

Quelle est la différence entre un audit SEO et un audit GEO ?
Un audit SEO mesure la capacité d'un site à se positionner : couverture d'index, positions, trafic organique. Un audit GEO mesure si les moteurs IA comme ChatGPT, Perplexity, Gemini et Claude peuvent atteindre vos pages, comprendre les faits de votre marque et vous citer dans leurs réponses. Certaines vérifications se recoupent, la crawlabilité avant tout, mais la baseline de citations par prompts et la revue d'exactitude de ce que les moteurs disent de vous n'ont aucun équivalent SEO. Les deux audits partagent des pages, pas des critères de réussite.
Quels crawlers IA autoriser dans le robots.txt ?
Auditez le robots.txt agent par agent — GPTBot, OAI-SearchBot, PerplexityBot, ClaudeBot, Google-Extended — et distinguez les crawlers d'entraînement des crawlers de recherche et de réponse, car bloquer l'un ne bloque pas l'autre. OpenAI, par exemple, documente GPTBot pour l'entraînement des modèles et OAI-SearchBot pour la recherche ChatGPT. Si vous voulez des citations, autorisez les crawlers de recherche et de réponse ; autoriser ou non les crawlers d'entraînement est une décision de politique distincte, à prendre délibérément et non par règle générique.
Qu'est-ce qu'un fichier llms.txt et aide-t-il la visibilité IA ?
llms.txt est une proposition de fichier texte listant les contenus clés d'un site pour les modèles de langage. Google indique que vous n'avez pas besoin de créer de nouveaux fichiers lisibles par machine, fichiers texte pour l'IA, balisage ou Markdown pour apparaître dans la recherche Google, et aucune documentation fournisseur citée dans cet article ne mentionne l'usage de ce fichier. En créer un est sans danger : notez son existence, mais ne le traitez jamais comme un facteur de réussite ou d'échec dans un audit GEO.
Comment vérifier que GPTBot ou PerplexityBot a réellement crawlé votre site ?
Filtrez les logs d'accès de votre serveur sur la chaîne user-agent du crawler et cherchez des passages récents sur les pages qui vous importent. Considérez la chaîne seule comme une preuve faible, car n'importe quel client peut se déclarer GPTBot ; certains fournisseurs publient des plages d'IP officielles qui permettent de confirmer qu'un passage vient bien d'eux. Aucune visite vérifiée sur une fenêtre raisonnable, malgré un robots.txt ouvert, pointe généralement vers un problème de découverte ou de rendu à investiguer.
À quelle fréquence lancer un audit GEO ?
Lancez l'audit complet des douze vérifications avant tout chantier de contenu significatif, et relancez les vérifications d'accès après chaque migration, changement de CMS ou modification du robots.txt. Les vérifications de mesure suivent un autre rythme : répétez le même jeu de prompts figé à intervalle fixe, mensuel pour beaucoup d'équipes, afin que les résultats restent comparables entre deux passages. Un monitoring continu peut remplacer les relances manuelles une fois la baseline établie, mais il ne remplace jamais les vérifications structurelles.