- Qué mide
- Los ficheros básicos que un rastreador espera encontrar antes de leerte: robots.txt (con reglas explícitas para GPTBot, ClaudeBot y PerplexityBot), sitemap.xml, HTTPS, etiqueta canonical y atributo lang.
- Por qué importa
- Si el robots.txt bloquea a los bots de IA, o falta el sitemap, o el sitio no va por HTTPS, la máquina se topa con fricción antes siquiera de leer una palabra. Es la portería del edificio: no da puntos por sí sola, pero un fallo aquí te resta visitas de crawler.
- Cómo se comprueba
- Se descargan /robots.txt y /sitemap.xml y se comprueba el esquema de la URL, la etiqueta canonical del HTML y el atributo lang del <html>. Existe o no existe: es binario, no interpretable.