
Si últimamente te han dicho que sin llms.txt tu web es invisible para la IA, respira: no es verdad.
llms.txt es una propuesta para publicar en la raíz de una web un índice en Markdown con su información más útil. Ayuda a agentes y herramientas compatibles a localizar contexto, pero no es un estándar SEO reconocido ni garantiza citas o visibilidad.
La última parte es la que suele desaparecer en los titulares. El archivo existe, algunas herramientas lo utilizan y puede ser útil. De ahí no se deduce que ChatGPT, Gemini o Google premien a cualquier web que lo añada.
Un archivo de texto en Markdown disponible normalmente en /llms.txt. La propuesta original define un título, un resumen opcional y grupos de enlaces hacia contenidos relevantes.
La especificación se mantiene en llmstxt.org. Su objetivo principal es ofrecer una versión breve y navegable del sitio cuando un sistema necesita contexto durante una consulta. Algo así como la carta resumida del restaurante, en lugar del recetario completo.
Un archivo básico identifica el proyecto y enlaza solo las páginas que aportan contexto útil. Por ejemplo:
# THECOOKIES
> Agencia de desarrollo web, growth e IA aplicada en Zaragoza.
## Servicios
- [Websites](https://thecookies.agency/websites/): desarrollo web a medida.
- [Growth](https://thecookies.agency/growth/): captación y conversión.
- [AI & Automation](https://thecookies.agency/ai-automation/): automatización y consultoría IA.
## Recursos
- [Blog](https://thecookies.agency/blog/): contenidos técnicos y de negocio.
No copies el sitemap completo. Selecciona páginas canónicas, actuales y suficientemente descriptivas.
Redactar el índice, publicarlo como texto accesible y comprobar que devuelve HTTP 200. El proceso mínimo es:
https://dominio.com/llms.txt.En una web pequeña puede mantenerse a mano. En documentación con cientos de páginas conviene generarlo desde el CMS o el proceso de despliegue.
¿No son tres archivos para lo mismo? No. Cada uno tiene su propósito y no se sustituyen entre sí.
| Archivo | Función principal |
|---|---|
| robots.txt | Comunicar reglas de rastreo a crawlers compatibles |
| sitemap.xml | Enumerar URLs canónicas para buscadores |
| llms.txt | Presentar una selección de contexto en Markdown |
robots.txt no garantiza que una URL desaparezca de un índice. sitemap.xml no obliga a indexarla. llms.txt tampoco obliga a un agente a leerla o citarla.
Una variante propuesta que reúne contenido más extenso en un único archivo. Puede tener sentido para documentación técnica preparada específicamente para consumo automatizado.
Nosotros no lo generaríamos sin límites en una web editorial. Duplicar todo el sitio en un archivo enorme crea mantenimiento, contenido obsoleto y costes de procesamiento sin una ventaja demostrada.
No. No existe una exigencia general publicada por estos productos. Google indica que sus funciones de IA usan los fundamentos habituales de Search y no requieren un archivo especial. OpenAI y Perplexity documentan sus crawlers y controles mediante robots.txt.
Algunas plataformas publican su propio llms.txt para facilitar el acceso a documentación. Eso demuestra un caso de uso, no un factor universal de ranking.
Cuando el sitio tiene documentación clara, el coste de mantenerlo es bajo y existe un caso de uso para agentes. Nosotros no lo pondríamos por delante de corregir páginas inaccesibles, canónicos, enlaces rotos, contenido duplicado o falta de fuentes.
En nuestra revisión de GEO y visibilidad en buscadores con IA tratamos llms.txt como una pieza experimental dentro de un sistema mayor. La prioridad sigue siendo publicar información verificable y accesible. Lo aburrido primero. El archivo de moda, después.
También te puede gustar