Acesso dos rastreadores de IA no robots.txt crítico
Verificamos se o site bloqueia GPTBot, ClaudeBot, PerplexityBot e Google-Extended.
ChatGPT, Claude e Perplexity leem os sites de forma diferente do Google. Vamos verificar o seu em 16 pontos técnicos e mostrar o que impede a IA de citar você.
A verificação leva de 1 a 3 minutos: percorremos a página e tudo de que ela depende.
Verificamos se o site bloqueia GPTBot, ClaudeBot, PerplexityBot e Google-Extended.
Procuramos texto no HTML original: os rastreadores de IA não executam scripts.
Pedimos a página como navegador e como rastreador de IA e comparamos as respostas.
Verificamos se existe /llms.txt, um mapa curto do site que os modelos de linguagem leem.
Verificamos se a home responde 200 e não se esconde atrás de uma cadeia de redirecionamentos.
Verificamos se o HTTPS funciona, se o certificado é válido e se o http redireciona para ele.
Procuramos dados estruturados que dizem à IA o tipo e o autor do conteúdo.
Verificamos title, description, canonical, lang e Open Graph.
Verificamos se há um único H1, uma hierarquia de títulos coerente e as tags main/article/header.
Medimos a quantidade de texto, a presença de data de atualização e de um autor identificado.
Quanto da página é texto real frente à marcação — páginas vazias são difíceis para a IA ler.
Se aparece e-mail, telefone ou endereço — a IA responde "como falar com eles" pelo que está na página.
Links para contas oficiais ligam o site a uma entidade que a IA já conhece.
Contamos a proporção de imagens sem o atributo alt: sem ele nem a IA nem um leitor de tela sabe o que está na figura.
Verificamos se o mapa existe, abre e está declarado no robots.txt.
Medimos o tempo de resposta, o tamanho do HTML e se a compressão está ativada.