01 / 03 Visibilidad IA · estándar llmstxt.org

Los LLMs leen tu web a ciegas. Dales el mapa.

Rastreamos hasta 30 URLs de tu dominio y construimos tu llms.txt según el estándar de llmstxt.org. Te descargas el fichero y lo subes a la raíz. Sin plugins y sin tocar el tema.

  • Descripciones extraídas de tu propio HTML. Nunca generadas.
  • Secciones en el idioma de tu web, no fijas en inglés.
  • Bloque de robots.txt que respeta tus reglas actuales.
30 URLsRastreo server-side
4 ficherosListos para subir
0Coste del análisis
Server-side

Genera tu llms.txt

Un dominio. Nada más. Ves el diagnóstico y las primeras líneas reales del archivo sin dar el email. La descarga completa la desbloqueas después.

Server-sideHasta 30 URLs0 €

Rastreo server-side. Unos 30 segundos en la mayoría de sitios.

4,9/5 · +80 empresas B2B trabajadas

Comprobando el dominio

02 / 03 Resultado

de 100

Tu archivo

 

Archivo completo · llms-full · robots.txt · PDF

Descarga los 4 ficheros.

Arriba tienes el diagnóstico y las primeras líneas reales. Déjanos tu email y tu teléfono y te damos el archivo entero, la versión larga, el bloque de robots.txt y el PDF con las instrucciones para tu stack. Te llamamos para revisar la instalación antes de que lo publiques.

Cómo funciona

01

Rastreamos

Leemos tu robots.txt, tu sitemap y hasta 30 URLs reales. Priorizamos home, servicios, casos y recursos, en ese orden.

02

Extraemos

Sacamos títulos y descripciones de tu propio HTML: schema.org, meta description, primer párrafo. Descartamos los "Ver más" y los textos de plantilla repetidos.

03

Entregamos

Archivo listo para subir a la raíz, bloque de robots.txt para bots de IA e instrucciones para tu plataforma. Con lo que debes revisar marcado.

01

llms.txt y llms-full.txt

El corto para que los modelos entiendan tu estructura. El largo para que ingieran el contenido en markdown plano, que consume alrededor de un 70% menos de tokens que tu HTML.

02

Bloque de robots.txt por niveles

Los 5 rastreadores que citan en respuestas en vivo, los 5 que entrenan modelos, y Bytespider, que conviene bloquear. Con tus propias reglas Disallow replicadas dentro de cada grupo, porque un grupo con nombre anula el comodín entero.

03

Lo que debemos decirte

La lista de campos donde tu web no nos dio un dato verificable. Los dejamos vacíos a propósito y te explicamos qué escribir. Preferimos un hueco a una mentira.

Ya tienes el fichero. Te faltan cuatro ejes.

El llms.txt pesa un 15% de tu score GEO. La auditoría mide los otros cuatro: acceso de rastreadores, schema JSON-LD, citabilidad del contenido y presencia en AI Overviews. Así trabajamos SEO & GEO, y aquí están los casos de éxito de clientes B2B.

03 / 03 FAQ · llms.txt

Preguntas frecuentes.

08Respuestas claras

  1. ¿Qué es un archivo llms.txt y quién lo lee?
    Es un fichero de texto en la raíz de tu dominio (tudominio.com/llms.txt) que le dice a un modelo de lenguaje qué páginas importan y de qué van. Lo consultan los rastreadores de OpenAI, Anthropic, Perplexity y Google cuando resuelven una pregunta sobre tu sector. No sustituye al sitemap: el sitemap es para robots de índice, el llms.txt es para modelos que leen y resumen. Lo propuso llmstxt.org y en 2026 lo tiene una minoría de los sitios.
  2. ¿Cuántas URLs rastreáis y cómo las elegís?
    Hasta 30. Cruzamos tu sitemap.xml con los enlaces internos de tu portada y priorizamos en este orden: home, servicios y productos, casos, recursos, blog reciente, empresa y contacto. Descartamos paginación, taxonomías finas, login, carrito y boilerplate legal. Si tu sitio tiene más URLs de las que caben, el informe te dice cuántas quedaron fuera. Eso es una cobertura declarada, no un archivo completo.
  3. ¿Las descripciones las escribe una IA?
    No. Se extraen de tu propio HTML en este orden: schema.org, meta description, og:description y primer párrafo real de la página. No generamos texto. Si una página no da ninguna de las cuatro cosas, su entrada se queda sin descripción y te decimos qué URL es para que la arregles en origen. Tampoco reutilizamos una meta description de plantilla repetida en veinte páginas: la descartamos para todas.
  4. ¿Qué hacéis cuando un dato no está en mi web?
    Lo omitimos y lo marcamos. Nunca inventamos un correo tipo contact@tudominio.com, ni una fecha de fundación sacada de un eslogan, ni un "más de 500 clientes" leído de un contador de la home. Si no encontramos al menos dos datos verificables, la sección ## Datos clave no se escribe y se explica por qué. Un hueco es honesto. Un dato inventado en un archivo que la IA va a citar es un problema tuyo dentro de seis meses.
  5. ¿Cómo se calcula el índice de preparación?
    Suma ponderada de cinco componentes de tu sitio: llms.txt actual (25%), acceso de rastreadores de IA por niveles (25%), descubribilidad del sitemap (20%), materia prima citable (20%) e identidad de entidad con schema Organization (10%). Mide tu web, no el archivo que acabamos de escribirte: si midiera el archivo, todo el mundo sacaría 100 y el número no serviría. Si leemos menos de 5 páginas no publicamos índice, decimos cuántas leímos y por qué.
  6. ¿Es gratis de verdad?
    El análisis, el índice y las primeras líneas reales de tu archivo los ves sin dar el email. Para descargar el archivo completo, la versión larga y el bloque de robots.txt dejas tu email y teléfono, y a cambio recibes también el PDF con las instrucciones por stack y una llamada para revisar la instalación antes de que lo publiques. Sin tarjeta y sin coste económico.
  7. ¿Rastreáis mi web de forma agresiva?
    No. Hasta 30 páginas, de una en una, con un user-agent identificable (CronutsLLMsTxtGen/1.0), pausa entre peticiones y tope por dominio y por hora. Cacheamos el resultado 7 días por dominio, así que un segundo intento no vuelve a tocar tu servidor. Respetamos tu robots.txt: si una ruta está bloqueada, no la leemos y tampoco la listamos. Y si tu robots.txt no responde, asumimos que nos prohíbe, que es lo que dice la RFC 9309.
  8. ¿Puedo subirlo en Shopify o en Webflow?
    En la raíz, no. Shopify y Webflow no permiten servir un fichero estático arbitrario en /llms.txt, y la vía limpia es poner el dominio detrás de Cloudflare y servir esa ruta desde un Worker. Te lo decimos en las instrucciones en lugar de venderte un archivo que no vas a poder publicar. En Apache, Nginx, WordPress, Vercel y Cloudflare Pages se sube en dos minutos.