Guía de llms.txt: qué hace y qué no hace
El formato llms.txt, cuándo puede ayudar a los agentes de IA, por qué Google Search lo ignora, cómo implementarlo con seguridad y cómo medir el resultado.

La promesa de llms.txt es atractiva: ofrecer a los agentes de IA un punto de entrada limpio y curado, en lugar de pedirles que extraigan el sentido a partir de la navegación, los scripts y el diseño de la página. El riesgo es igual de claro. Quienes hacen marketing pueden confundir una pequeña comodidad técnica con una optimización que garantiza citas.
La postura útil está entre esos extremos. Implementa el archivo cuando los agentes o los flujos de documentación puedan consumirlo, mantenlo preciso y barato de mantener, y mide los resultados por separado.
¿Qué es llms.txt?
La propuesta actual de llms.txt define un archivo Markdown llamado llms.txt que puede vivir en la raíz del sitio o en una subruta. Empieza con un H1, puede incluir un resumen en formato de cita y puede agrupar enlaces curados bajo encabezados H2. La propuesta también recomienda versiones limpias en Markdown de las páginas importantes y relaciones Link estándar para el descubrimiento.
Su función es orientar. Un agente lee un mapa corto, elige la fuente relevante y solo consulta el detalle cuando lo necesita. El archivo debe ser lo bastante pequeño como para procesarse rápido.
Lo que llms.txt no hace
No concede permiso de rastreo. Ese es el papel del acceso al servidor, la autenticación y las directivas para crawlers.
No reemplaza a un sitemap XML. Los sitemaps enumeran URLs canónicas para el descubrimiento en buscadores y las señales de frescura.
No vuelve autoritativo un contenido pobre. Un enlace en el archivo sigue siendo solo un enlace.
No mejora el posicionamiento en Google Search. La guía de Google de 2026 afirma que Search no usa llms.txt y que crearlo ni ayuda ni perjudica la visibilidad en las funciones de búsqueda generativa de Google. Lee la declaración exacta en la guía oficial de Google sobre optimización para IA.
Una estructura de archivo práctica
Usa un resumen factual y una lista corta de destinos de alto valor.
# Example Analytics
> Example Analytics ayuda a los equipos de ecommerce a entender la demanda de productos y el riesgo de inventario.
## Páginas principales
- [Producto](https://example.com/product): Qué mide la plataforma y a quién sirve.
- [Precios](https://example.com/pricing): Planes vigentes, límites y condiciones de facturación.
- [Metodología](https://example.com/methodology): Fuentes de datos, definiciones y limitaciones.
## Guías
- [Guía de pronóstico de demanda](https://example.com/guides/demand-forecasting): Un flujo de trabajo práctico con fórmulas y ejemplos.
- [Glosario de riesgo de inventario](https://example.com/glossary/inventory-risk): Definiciones canónicas usadas en todo el producto.
## Más
- [Sitemap](https://example.com/sitemap.xml)
Las descripciones importan. Ayudan a un agente a elegir un enlace sin abrir todas las páginas. Mantenlas literales y evita afirmaciones promocionales como "la mejor plataforma del mundo".
¿Qué páginas debes incluir?
Elige páginas que respondan preguntas estables y de alto valor sobre la organización, el producto y la experiencia en la materia.
Key takeaways
- Página de inicio y visión general del producto
- Precios y límites de los planes
- Metodología y definiciones
- Guías con autoridad y evidencia original
- Puntos de entrada a la documentación y al soporte
- Políticas que un agente pueda necesitar para responder con exactitud
- El sitemap XML para un descubrimiento más amplio
Excluye archivos de etiquetas, resultados de búsqueda, páginas de campaña pobres, traducciones duplicadas sin etiquetas de idioma claras, rutas privadas y contenido que no quieres que se recupere.
En un sitio multilingüe, indica el idioma en el título del enlace o agrupa cada idioma en una sección aparte. Apunta a la URL canónica de cada versión y conserva las señales hreflang normales en el HTML y en el sitemap.
Genéralo a partir de la fuente de verdad del contenido
Los archivos manuales se desactualizan. Una implementación más segura construye llms.txt desde la misma colección que alimenta el blog, la documentación o las páginas de producto. Así los artículos canónicos nuevos se mantienen sincronizados y los borradores sin publicar desaparecen de forma automática.
El generador debe:
- incluir solo registros publicados y públicos
- usar URLs canónicas absolutas
- escapar los títulos y descripciones mal formados
- agrupar los enlaces por tipo de contenido útil
- mantener un orden determinista
- devolver
text/plain; charset=utf-8 - cachear o generar de forma estática la respuesta
SeoWave sigue este patrón: su adaptador de contenido alimenta el sitemap, el RSS y el llms.txt desde una única colección tipada. Eso reduce la probabilidad de que el índice para IA apunte a páginas desactualizadas o inexistentes.
¿Debes crear variantes de las páginas en Markdown?
La propuesta recomienda alternativas limpias en Markdown cuando los agentes se benefician de ellas, sobre todo en documentación. Puede ser valioso cuando el HTML es muy interactivo o tiene mucho ruido de navegación. Es opcional en un sitio editorial renderizado en el servidor cuyo contenido principal ya es claro en HTML.
Si añades variantes en Markdown, conserva los mismos datos, la misma identidad canónica y el mismo proceso de actualización. No crees una segunda versión contradictoria escrita solo para bots.
Cómo validar llms.txt
Revisa el archivo como cualquier otra superficie pública de producción.
- solicita la URL exacta
/llms.txty confirma el estado 200 - verifica el tipo de contenido y la codificación UTF-8
- sigue cada URL listada y rechaza las redirecciones a páginas de login o 404
- confirma que no haya URLs de borradores, privadas ni con noindex
- compara el archivo con el sitemap canónico y con el inventario de contenido
- mantén la respuesta lo bastante concisa como para escanearla
- añade una prueba de regresión si el archivo se genera
No des por exitosa la implementación solo porque el archivo exista. El éxito significa que un agente compatible puede llegar a páginas precisas y que las menciones o citas medidas de la marca mejoran después del trabajo de contenido más amplio.
Cómo medir el resultado
No existe un informe universal de rendimiento de llms.txt. Usa los logs del servidor para ver si agentes identificados piden el archivo, y luego sigue los resultados de respuesta que importan: tasa de mención, tasa de citas y URLs citadas en un conjunto estable de prompts.
Si nada cambia, lo más probable es que el cuello de botella no sea el archivo. Revisa la calidad del contenido, la claridad de la entidad, la corroboración de terceros y el acceso de los crawlers con la auditoría de visibilidad en IA y la guía de crawlers de IA.
Preguntas frecuentes
- ¿llms.txt mejora el posicionamiento en Google o la visibilidad en AI Overviews?
- No. La guía oficial actual de Google dice que Google Search ignora llms.txt y que el archivo ni ayuda ni perjudica la visibilidad o el posicionamiento en Google Search. Siguen importando el rastreo, la indexación y el contenido útil de siempre.
- ¿llms.txt es un estándar web oficial?
- Es una propuesta abierta con un formato publicado en llmstxt.org, no un reemplazo de robots.txt, de los sitemaps XML ni de los estándares web establecidos. La adopción varía según el agente y la plataforma.
- ¿Qué debe contener un archivo llms.txt?
- Mantenlo conciso: el nombre del sitio, un resumen factual breve y secciones curadas que enlacen a páginas canónicas de alto valor, con descripciones útiles. No vuelques todas las URLs ni repitas el sitio completo.
- ¿Debe llms.txt incluir páginas privadas o con noindex?
- No. El archivo es público y solo debe apuntar a contenido que sea público a propósito, canónico y apropiado para que los agentes lo recuperen. No es un mecanismo de control de acceso.
Fuentes
- llmstxt.org: la propuesta del archivo /llms.txt (llmstxt.org)
- Google Search Central: cómo optimizar tu sitio web para las funciones de IA generativa de Google Search (developers.google.com)
- Google Search Central: qué es un sitemap (developers.google.com)
Sigue leyendo
- SEO para Google AI Overviews: lo que de verdad funcionaMejora tu elegibilidad para Google AI Overviews con páginas rastreables, contenido diferenciado, evidencia clara, buen material multimedia y medición fiable.
- SEO de entidades para búsqueda con IA: marco prácticoAclara la entidad de tu marca para la búsqueda con IA: datos coherentes, páginas canónicas, schema exacto, corroboración externa y prompts de compra medibles.