Accès des robots d'IA dans le robots.txt critique
Nous vérifions si le site bloque GPTBot, ClaudeBot, PerplexityBot et Google-Extended.
ChatGPT, Claude et Perplexity lisent les sites autrement que Google. Nous vérifions le vôtre sur 16 points techniques et montrons ce qui empêche l'IA de vous citer.
L'analyse prend 1 à 3 minutes : nous parcourons la page et tout ce dont elle dépend.
Nous vérifions si le site bloque GPTBot, ClaudeBot, PerplexityBot et Google-Extended.
Nous cherchons du texte dans le HTML brut : les robots d'IA n'exécutent pas les scripts.
Nous demandons la page en tant que navigateur puis en tant que robot d'IA et comparons les réponses.
Nous vérifions la présence de /llms.txt, une carte courte du site que lisent les modèles de langage.
Nous vérifions que la page d'accueil répond 200 et ne se cache pas derrière une chaîne de redirections.
Nous vérifions que HTTPS fonctionne, que le certificat est valide et que http y redirige.
Nous cherchons les données structurées qui indiquent à l'IA le type et l'auteur du contenu.
Nous vérifions title, description, canonical, lang et Open Graph.
Nous vérifions l'unicité du H1, la hiérarchie des titres et les balises main/article/header.
Nous pesons la quantité de texte, la présence d'une date de mise à jour et d'un auteur nommé.
Quelle part de la page est du vrai texte par rapport au balisage — les pages vides sont difficiles à lire pour l’IA.
Si un e-mail, un téléphone ou une adresse est visible — l’IA répond à « comment vous joindre » à partir de la page.
Les liens vers les comptes officiels relient le site à une entité que l’IA connaît déjà.
Nous comptons la part d'images sans attribut alt : sans lui, ni l'IA ni un lecteur d'écran ne sait ce qui est représenté.
Nous vérifions que le plan existe, s'ouvre et est déclaré dans le robots.txt.
Nous mesurons le temps de réponse, la taille du HTML et si la compression est activée.