La liste de vérification technique AEO : quoi vérifier avant tout le reste

Huit vérifications : des robots d’indexation IA autorisés dans robots.txt; un CDN ou un pare-feu qui ne les bloque pas en silence; un contenu lisible sans JavaScript; des réponses rapides; une structure de titres propre, avec des sections autonomes; des données structurées correctes; les URL inventées par l’IA redirigées plutôt que de renvoyer une erreur 404; et des outils d’analyse capables de réellement voir les visites référées par l’IA. La plupart des entreprises échouent à au moins deux de ces vérifications sans le savoir.

Quelles sont les exigences techniques pour être visible dans la recherche IA?

L’accès des robots : la vérification de cinq minutes qui échoue le plus souvent

Confirmez que robots.txt n’interdit pas GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot ou Google-Extended. Environ 6 % des sites bloquent GPTBot, souvent au moyen d’un fichier robots générique que quelqu’un a copié il y a des années. Testez ensuite avec de vrais agents utilisateurs, pas seulement le fichier : Cloudflare bloque maintenant les robots d’indexation IA par défaut, et une règle de pare-feu peut renvoyer des erreurs aux robots alors que le fichier robots semble permissif. Récupérez vos pages clés en vous présentant comme chaque robot et confirmez une réponse HTTP 200 avec le contenu complet — nous refaisons cette vérification sur notre propre site après chaque changement d’infrastructure.

Le rendu JavaScript : le tueur silencieux

Le robot d’indexation de ChatGPT n’exécute pas JavaScript. Une application monopage qui construit son contenu côté client sert aux robots IA une coquille — un titre, une balise script et aucun des mots. C’est le défaut d’optimisation pour les moteurs de réponse IA (AEO) le plus courant et le plus coûteux, parce que le site paraît parfait dans tous les navigateurs tout en étant pratiquement vide pour les systèmes dont vous voulez les citations. La solution : le rendu côté serveur ou le prérendu à la compilation de chaque route qui porte du contenu. Jugez-en de la seule façon honnête : récupérez le HTML brut avec JavaScript désactivé et comptez les mots de vrai contenu.

La structure, la vitesse et la forme d’une page citable

Les pages lentes sont écartées de la récupération en direct avant même d’être évaluées : le temps de réponse est donc un facteur de visibilité, pas un détail. La structure compte parce que la récupération découpe les pages : un seul H1 clair, des sections H2 qui ont chacune du sens lues seules, la réponse en haut de chaque section plutôt qu’amenée graduellement. Gardez vos données structurées honnêtes et à jour — Organization, Service, FAQ — moins parce que le balisage Schema obtient des citations (les données probantes sont mitigées) que parce qu’il énonce sans ambiguïté les faits sur votre entreprise.

Un seul H1; des sections H2 qui tiennent debout seules quand on les cite hors contexte

La réponse dans les deux premières phrases de la page et de chaque section

Des entités nommées : votre firme, le produit, le chiffre — pas « notre solution »

Une vraie date de dernière mise à jour, visible, que vous respectez réellement

Les erreurs 404 que personne ne surveille, et la mesure

Les assistants IA inventent des URL — des chemins plausibles sur votre domaine qui n’ont jamais existé — et envoient environ 2,9 fois plus de trafic vers des pages 404 que Google. Tirez de vos journaux les erreurs 404 référées par l’IA et redirigez chacune, par une redirection 301, vers la vraie page la plus proche; c’est de la demande récupérée sans aucun coût d’acquisition.

Enfin, rendez le canal visible : un regroupement de canaux personnalisé dans vos outils d’analyse, qui reconnaît les référents chatgpt.com, perplexity.ai, gemini.google.com, copilot.microsoft.com et claude.ai, plus un champ « Comment avez-vous entendu parler de nous? » dans vos formulaires de demande. Les données de référence sous-estiment le trafic — plusieurs plateformes les suppriment —, et c’est exactement pourquoi la question posée dans le formulaire est la source de vérité.

Devrais-je bloquer les robots d’indexation IA pour protéger mon contenu?

Si les assistants IA sont un canal par lequel vous voulez obtenir des clients, bloquer leurs robots, c’est vous rendre invisible vous-même. L’échange, c’est du contenu contre de la présence. Pour un site d’entreprise dont les pages existent pour gagner des clients, autoriser les robots d’indexation IA reconnus est presque toujours la bonne décision.

Et le fichier llms.txt?

C’est une convention proposée pour remettre aux systèmes d’IA une version texte épurée de votre site. Aucun grand fournisseur ne s’engage à le lire aujourd’hui. Le nôtre ne nous coûte rien à générer à partir des mêmes données qui bâtissent nos pages, alors nous le publions — mais voyez-le comme un billet de loterie, pas comme un levier.

Comment vérifier ce qu’un robot d’indexation IA voit sur mon site?

Récupérez votre page avec curl en utilisant l’agent utilisateur du robot et JavaScript désactivé, puis lisez ce qui revient. Si les mots dont vos clients ont besoin ne sont pas dans cette réponse, ils sont invisibles pour le robot d’indexation de ChatGPT. Répétez l’exercice pour vos cinq pages les plus importantes; la page d’accueil est généralement la pire.

La vitesse des pages influence-t-elle vraiment les citations de l’IA?

Oui — la récupération en direct fonctionne avec un budget de temps, et les pages qui répondent lentement sont écartées avant même que la qualité du contenu soit évaluée. La barre n’a rien d’exotique : un serveur qui répond vite et aucune dépendance de rendu de plusieurs secondes.

Dernière révision le 23 août 2026