L’IA peut-elle vraiment lire votre site Web?
Mon site Web empêche-t-il ChatGPT, Claude et Perplexity de le lire?
Les moteurs IA ne peuvent recommander que les entreprises qu’ils arrivent à lire. Une part étonnante des sites Web bloquent les robots d’exploration IA sans le savoir — certains CDN les bloquent par défaut depuis 2025 — et aucun des principaux robots IA n’exécute JavaScript. Une page dont le contenu n’apparaît qu’après l’exécution des scripts leur est donc invisible, même quand ils ont le droit d’entrer.
Entrez votre domaine. La vérification lit votre fichier robots.txt, charge votre page d’accueil comme le font les robots et vous dit clairement quels moteurs peuvent vous voir et ce qu’ils trouvent.
Comment c’est calculé :
Votre fichier robots.txt est lu, et les règles de chaque robot IA sont interprétées comme les robots eux-mêmes les interprètent — l’agent utilisateur (user-agent) le plus précis l’emporte. Les verdicts distinguent le blocage d’un robot d’entraînement, qui relève d’une préférence, du blocage d’un robot de citation, qui vous retire des réponses IA.
Votre page d’accueil est chargée deux fois : une fois comme un navigateur ordinaire, et une fois comme le robot qui produit les citations de ChatGPT. Un site qui répond au premier et refuse le second est filtré par le CDN, peu importe ce que dit son fichier robots.txt.
Le texte statique de la page est compté une fois les scripts et les styles retirés, parce que c’est tout ce que lit un robot qui n’exécute pas JavaScript. Moins de 200 mots veut généralement dire que le vrai contenu se trouve dans le JavaScript.
Chaque verdict est calculé par le code à partir de ce que votre site a renvoyé. Rien n’est conservé, et aucun courriel n’est demandé.
Questions fréquentes sur cet outil :
Quel robot compte le plus?
OAI-SearchBot. C’est lui qui produit les citations de ChatGPT et les clics vers les sites cités. Bloquer GPTBot est une préférence liée aux données d’entraînement; bloquer OAI-SearchBot retire votre site des réponses de ChatGPT.
Mon fichier robots.txt autorise tout le monde. Est-ce suffisant?
Pas nécessairement. La protection contre les robots d’un CDN peut refuser les robots IA avant même que le fichier robots.txt soit consulté. C’est pourquoi la vérification charge votre page comme un robot plutôt que de se fier au fichier. Et un robot autorisé ne lit quand même que votre HTML statique.
Pourquoi JavaScript est-il important?
En 2026, aucun grand robot IA ne l’exécute. Seul Google fait le rendu du JavaScript : une page bâtie par des scripts peut donc se classer dans Google tout en n’existant pas du tout pour ChatGPT, Claude ou Perplexity.
La vérification a trouvé des problèmes. Et maintenant?
Débloquer un robot se résume généralement à un réglage dans le CDN ou à une ligne dans le fichier robots.txt, et votre développeur peut le faire en un après-midi. Faire en sorte que la page lisible dise quelque chose qui mérite d’être cité, c’est le travail plus long, et c’est ce que fait notre programme de visibilité dans les réponses IA.