01 / 03 Visibilidad IA · estándar llmstxt.org
Los LLMs leen tu web a ciegas. Dales el mapa.
Rastreamos hasta 30 URLs de tu dominio y construimos tu llms.txt según el estándar de llmstxt.org. Te descargas el fichero y lo subes a la raíz. Sin plugins y sin tocar el tema.
- Descripciones extraídas de tu propio HTML. Nunca generadas.
- Secciones en el idioma de tu web, no fijas en inglés.
- Bloque de
robots.txtque respeta tus reglas actuales.
02 / 03 Resultado
Tu archivo
Archivo completo · llms-full · robots.txt · PDF
Descarga los 4 ficheros.
Arriba tienes el diagnóstico y las primeras líneas reales. Déjanos tu email y tu teléfono y te damos el archivo entero, la versión larga, el bloque de robots.txt y el PDF con las instrucciones para tu stack. Te llamamos para revisar la instalación antes de que lo publiques.
— Cómo funciona
Rastreamos
Leemos tu robots.txt, tu sitemap y hasta 30 URLs reales. Priorizamos home, servicios, casos y recursos, en ese orden.
Extraemos
Sacamos títulos y descripciones de tu propio HTML: schema.org, meta description, primer párrafo. Descartamos los "Ver más" y los textos de plantilla repetidos.
Entregamos
Archivo listo para subir a la raíz, bloque de robots.txt para bots de IA e instrucciones para tu plataforma. Con lo que debes revisar marcado.
01
llms.txt y llms-full.txt
El corto para que los modelos entiendan tu estructura. El largo para que ingieran el contenido en markdown plano, que consume alrededor de un 70% menos de tokens que tu HTML.
02
Bloque de robots.txt por niveles
Los 5 rastreadores que citan en respuestas en vivo, los 5 que entrenan modelos, y Bytespider, que conviene bloquear. Con tus propias reglas Disallow replicadas dentro de cada grupo, porque un grupo con nombre anula el comodín entero.
03
Lo que debemos decirte
La lista de campos donde tu web no nos dio un dato verificable. Los dejamos vacíos a propósito y te explicamos qué escribir. Preferimos un hueco a una mentira.
Ya tienes el fichero. Te faltan cuatro ejes.
El llms.txt pesa un 15% de tu score GEO. La auditoría mide los otros cuatro: acceso de rastreadores, schema JSON-LD, citabilidad del contenido y presencia en AI Overviews. Así trabajamos SEO & GEO, y aquí están los casos de éxito de clientes B2B.
03 / 03 FAQ · llms.txt
Preguntas frecuentes.
08Respuestas claras
¿Qué es un archivo llms.txt y quién lo lee?
Es un fichero de texto en la raíz de tu dominio (tudominio.com/llms.txt) que le dice a un modelo de lenguaje qué páginas importan y de qué van. Lo consultan los rastreadores de OpenAI, Anthropic, Perplexity y Google cuando resuelven una pregunta sobre tu sector. No sustituye al sitemap: el sitemap es para robots de índice, elllms.txtes para modelos que leen y resumen. Lo propuso llmstxt.org y en 2026 lo tiene una minoría de los sitios.¿Cuántas URLs rastreáis y cómo las elegís?
Hasta 30. Cruzamos tusitemap.xmlcon los enlaces internos de tu portada y priorizamos en este orden: home, servicios y productos, casos, recursos, blog reciente, empresa y contacto. Descartamos paginación, taxonomías finas, login, carrito y boilerplate legal. Si tu sitio tiene más URLs de las que caben, el informe te dice cuántas quedaron fuera. Eso es una cobertura declarada, no un archivo completo.¿Las descripciones las escribe una IA?
No. Se extraen de tu propio HTML en este orden:schema.org,meta description,og:descriptiony primer párrafo real de la página. No generamos texto. Si una página no da ninguna de las cuatro cosas, su entrada se queda sin descripción y te decimos qué URL es para que la arregles en origen. Tampoco reutilizamos unameta descriptionde plantilla repetida en veinte páginas: la descartamos para todas.¿Qué hacéis cuando un dato no está en mi web?
Lo omitimos y lo marcamos. Nunca inventamos un correo tipocontact@tudominio.com, ni una fecha de fundación sacada de un eslogan, ni un "más de 500 clientes" leído de un contador de la home. Si no encontramos al menos dos datos verificables, la sección## Datos claveno se escribe y se explica por qué. Un hueco es honesto. Un dato inventado en un archivo que la IA va a citar es un problema tuyo dentro de seis meses.¿Cómo se calcula el índice de preparación?
Suma ponderada de cinco componentes de tu sitio:llms.txtactual (25%), acceso de rastreadores de IA por niveles (25%), descubribilidad del sitemap (20%), materia prima citable (20%) e identidad de entidad con schema Organization (10%). Mide tu web, no el archivo que acabamos de escribirte: si midiera el archivo, todo el mundo sacaría 100 y el número no serviría. Si leemos menos de 5 páginas no publicamos índice, decimos cuántas leímos y por qué.¿Es gratis de verdad?
El análisis, el índice y las primeras líneas reales de tu archivo los ves sin dar el email. Para descargar el archivo completo, la versión larga y el bloque derobots.txtdejas tu email y teléfono, y a cambio recibes también el PDF con las instrucciones por stack y una llamada para revisar la instalación antes de que lo publiques. Sin tarjeta y sin coste económico.¿Rastreáis mi web de forma agresiva?
No. Hasta 30 páginas, de una en una, con un user-agent identificable (CronutsLLMsTxtGen/1.0), pausa entre peticiones y tope por dominio y por hora. Cacheamos el resultado 7 días por dominio, así que un segundo intento no vuelve a tocar tu servidor. Respetamos turobots.txt: si una ruta está bloqueada, no la leemos y tampoco la listamos. Y si turobots.txtno responde, asumimos que nos prohíbe, que es lo que dice la RFC 9309.¿Puedo subirlo en Shopify o en Webflow?
En la raíz, no. Shopify y Webflow no permiten servir un fichero estático arbitrario en/llms.txt, y la vía limpia es poner el dominio detrás de Cloudflare y servir esa ruta desde un Worker. Te lo decimos en las instrucciones en lugar de venderte un archivo que no vas a poder publicar. En Apache, Nginx, WordPress, Vercel y Cloudflare Pages se sube en dos minutos.