¿Qué es el archivo llms.txt?

llms.txt es un archivo de texto plano en formato Markdown que se coloca en la raíz de un sitio (por ejemplo, raven3.com.ar/llms.txt) y funciona como un mapa curado para que los modelos de lenguaje —ChatGPT, Claude, Gemini, Perplexity— entiendan rápido qué es tu sitio, qué ofrece y dónde está la información más relevante, sin tener que rastrear ni interpretar todo el HTML.

La propuesta surgió en 2024 y se inspira en dos archivos que ya conocés: robots.txt (le dice a los crawlers qué pueden rastrear) y sitemap.xml (lista todas las URLs). llms.txt hace algo distinto: no lista todo, selecciona lo importante y lo resume en lenguaje natural.

Por qué le importa a un LLM (y a tu negocio)

Los modelos de lenguaje trabajan con una ventana de contexto limitada. Cuando alguien le pregunta a ChatGPT o Perplexity sobre tu rubro, el modelo no puede leer tu sitio entero: necesita fragmentos concisos y confiables. Un HTML cargado de menús, scripts, banners y componentes de UI es ruido para un LLM. Un archivo Markdown limpio con la esencia de tu negocio es señal directa.

Además, muchos sitios corporativos son aplicaciones que renderizan el contenido con JavaScript. Si el bot no ejecuta JS —y varios no lo hacen— ve una página casi vacía. llms.txt resuelve ese problema entregando el contenido clave ya en texto plano, sin depender del render.

La estructura estándar

El formato es simple e intencionalmente austero:

  • Un H1 con el nombre de la marca o el sitio
  • Una cita (blockquote) de una línea que resume qué hace la empresa
  • Un H2 por sección temática (por ejemplo 'Páginas principales', 'Políticas', 'Documentación') con una lista de links, cada uno con una descripción corta

Para sitios muy grandes o con mucha documentación existe además la variante llms-full.txt, que incluye el contenido completo en lugar de solo links y resúmenes.

Cómo lo implementamos en Raven3

En raven3.com.ar/llms.txt seguimos exactamente esa estructura: un H1 con el nombre de la agencia, una cita que resume la propuesta de valor en una línea, y dos secciones —Páginas principales y Políticas— con links directos y una descripción de una frase para cada uno. Nada de relleno, nada de keywords forzadas: solo la información que un modelo necesita para entender de qué se trata el sitio y poder recomendarlo con precisión.

Errores comunes al armar el tuyo

Tratarlo como un archivo de SEO tradicional y llenarlo de keywords: los LLMs no rankean por densidad de palabras clave, priorizan claridad y precisión. Copiar el sitemap completo: si tenés 200 URLs, el archivo pierde utilidad como mapa curado. Dejarlo desactualizado: si agregás o eliminás páginas y no lo mantenés, el modelo puede citar información vieja. Pensar que reemplaza al SEO técnico: llms.txt es un complemento, no un sustituto de HTML semántico, schema markup y contenido de calidad.

Checklist para armar tu llms.txt

  • Creá el archivo en texto plano y subilo a la raíz del dominio (tudominio.com/llms.txt)
  • Empezá con un H1 con el nombre de tu marca y una cita de una línea que resuma qué hacés
  • Agrupá tus páginas más importantes en 2 o 3 secciones con sentido (servicios, sobre la empresa, contacto)
  • Describí cada link en una frase clara, sin jerga interna
  • Verificá que tu robots.txt no bloquee a los crawlers de IA que necesitás que lean el archivo
  • Revisalo cada vez que cambie tu oferta de servicios o tu estructura de páginas