Acceso de los rastreadores de IA en robots.txt crítico
Comprobamos si el sitio bloquea a GPTBot, ClaudeBot, PerplexityBot y Google-Extended.
ChatGPT, Claude y Perplexity leen los sitios de otra manera que Google. Revisaremos el tuyo en 16 puntos técnicos y te mostraremos qué impide que la IA te cite.
El análisis tarda de 1 a 3 minutos: recorremos la página y todo lo que depende de ella.
Comprobamos si el sitio bloquea a GPTBot, ClaudeBot, PerplexityBot y Google-Extended.
Buscamos texto en el HTML original: los rastreadores de IA no ejecutan scripts.
Pedimos la página como navegador y como rastreador de IA y comparamos las respuestas.
Comprobamos si existe /llms.txt, un mapa breve del sitio que leen los modelos de lenguaje.
Comprobamos que la portada responde 200 y no se esconde tras una cadena de redirecciones.
Comprobamos que HTTPS funciona, que el certificado es válido y que http redirige a él.
Buscamos datos estructurados que le dicen a la IA el tipo y el autor del contenido.
Comprobamos title, description, canonical, lang y Open Graph.
Comprobamos que haya un solo H1, una jerarquía de encabezados sensata y las etiquetas main/article/header.
Medimos la cantidad de texto, la presencia de fecha de actualización y de un autor identificado.
Cuánto de la página es texto real frente al marcado; las páginas vacías son difíciles de leer para la IA.
Si se ve un correo, teléfono o dirección: la IA responde "cómo contactar" con lo que hay en la página.
Los enlaces a cuentas oficiales vinculan el sitio con una entidad que la IA ya conoce.
Contamos la proporción de imágenes sin atributo alt: sin él ni la IA ni un lector de pantalla sabe qué se muestra.
Comprobamos que el mapa existe, se abre y está declarado en robots.txt.
Medimos el tiempo de respuesta, el tamaño del HTML y si la compresión está activada.