• fichero LLMs.txt para modelos de lenguaje y visibilidad web

    Si últimamente te han dicho que sin llms.txt tu web es invisible para la IA, respira: no es verdad.

    llms.txt es una propuesta para publicar en la raíz de una web un índice en Markdown con su información más útil. Ayuda a agentes y herramientas compatibles a localizar contexto, pero no es un estándar SEO reconocido ni garantiza citas o visibilidad.

    La última parte es la que suele desaparecer en los titulares. El archivo existe, algunas herramientas lo utilizan y puede ser útil. De ahí no se deduce que ChatGPT, Gemini o Google premien a cualquier web que lo añada.

    Qué es llms.txt

    Un archivo de texto en Markdown disponible normalmente en /llms.txt. La propuesta original define un título, un resumen opcional y grupos de enlaces hacia contenidos relevantes.

    La especificación se mantiene en llmstxt.org. Su objetivo principal es ofrecer una versión breve y navegable del sitio cuando un sistema necesita contexto durante una consulta. Algo así como la carta resumida del restaurante, en lugar del recetario completo.

    Ejemplo de un archivo llms.txt

    Un archivo básico identifica el proyecto y enlaza solo las páginas que aportan contexto útil. Por ejemplo:

    # THECOOKIES
    
    > Agencia de desarrollo web, growth e IA aplicada en Zaragoza.
    
    ## Servicios
    - [Websites](https://thecookies.agency/websites/): desarrollo web a medida.
    - [Growth](https://thecookies.agency/growth/): captación y conversión.
    - [AI & Automation](https://thecookies.agency/ai-automation/): automatización y consultoría IA.
    
    ## Recursos
    - [Blog](https://thecookies.agency/blog/): contenidos técnicos y de negocio.
    

    No copies el sitemap completo. Selecciona páginas canónicas, actuales y suficientemente descriptivas.

    Cómo crear e implementar llms.txt

    Redactar el índice, publicarlo como texto accesible y comprobar que devuelve HTTP 200. El proceso mínimo es:

    1. Definir el nombre y propósito del sitio.
    2. Seleccionar páginas principales y documentación.
    3. Escribir descripciones breves para cada enlace.
    4. Publicar el archivo en https://dominio.com/llms.txt.
    5. Validar contenido, código de estado y enlaces.
    6. Revisarlo cuando cambie la arquitectura.

    En una web pequeña puede mantenerse a mano. En documentación con cientos de páginas conviene generarlo desde el CMS o el proceso de despliegue.

    Diferencias entre llms.txt, robots.txt y sitemap.xml

    ¿No son tres archivos para lo mismo? No. Cada uno tiene su propósito y no se sustituyen entre sí.

    Archivo Función principal
    robots.txt Comunicar reglas de rastreo a crawlers compatibles
    sitemap.xml Enumerar URLs canónicas para buscadores
    llms.txt Presentar una selección de contexto en Markdown

    robots.txt no garantiza que una URL desaparezca de un índice. sitemap.xml no obliga a indexarla. llms.txt tampoco obliga a un agente a leerla o citarla.

    Qué es llms-full.txt

    Una variante propuesta que reúne contenido más extenso en un único archivo. Puede tener sentido para documentación técnica preparada específicamente para consumo automatizado.

    Nosotros no lo generaríamos sin límites en una web editorial. Duplicar todo el sitio en un archivo enorme crea mantenimiento, contenido obsoleto y costes de procesamiento sin una ventaja demostrada.

    ¿Google, OpenAI o Perplexity exigen llms.txt?

    No. No existe una exigencia general publicada por estos productos. Google indica que sus funciones de IA usan los fundamentos habituales de Search y no requieren un archivo especial. OpenAI y Perplexity documentan sus crawlers y controles mediante robots.txt.

    Algunas plataformas publican su propio llms.txt para facilitar el acceso a documentación. Eso demuestra un caso de uso, no un factor universal de ranking.

    Cuándo merece la pena implementarlo

    Cuando el sitio tiene documentación clara, el coste de mantenerlo es bajo y existe un caso de uso para agentes. Nosotros no lo pondríamos por delante de corregir páginas inaccesibles, canónicos, enlaces rotos, contenido duplicado o falta de fuentes.

    En nuestra revisión de GEO y visibilidad en buscadores con IA tratamos llms.txt como una pieza experimental dentro de un sistema mayor. La prioridad sigue siendo publicar información verificable y accesible. Lo aburrido primero. El archivo de moda, después.


    Guillermo Gascón

    (Especialista SEO)

    Soy cofundador de THECOOKIES Agency, empresa de desarrollo web especializada en proyectos de captación de leads, donde doy servicios de consultoría SEO, optimización Web y optimización para motores de búsqueda, liderando el equipo de este área.

    Gestionando clientes desde 2015, me declaro un apasionado del marketing digital y vivo con entusiasmo los proyectos en los que trabajamos.

    Autor de uno de los primeros podcast sobre SEO "Hola SEO" y creador de contenido en diferentes canales como YouTube o Twitter.

    Protección de datos personales. Utilizaremos sus datos para responder consultas, enviar comunicaciones comerciales y realizar análisis estadísticos. Para más información sobre el tratamiento y sus derechos, consulte la política de privacidad.