Ir al contenido principal
LathuileCONSULTANCYConcertar una consulta

Guía · GEO

¿Qué es llms.txt y cómo se configura?

llms.txt es un archivo de texto plano en Markdown, situado en la raíz de un sitio web, que indica en pocas líneas a los modelos de lenguaje de IA de qué trata el sitio y qué páginas importan más. Es una convención propuesta, no un estándar: los proveedores de IA no están obligados a leerlo, y no controla a qué pueden acceder sus rastreadores. Añadirlo cuesta poco y merece la pena como una parte de un trabajo más amplio de visibilidad en IA, no como sustituto de ese trabajo.

¿Para qué sirve llms.txt?

Un sitio web está hecho para personas que lo ven en un navegador: menús, banners, scripts, avisos de cookies. Un modelo de lenguaje que lee una página tiene que encontrar el contenido entre todo eso, y solo puede asimilar una cantidad limitada de texto cada vez. La propuesta llms.txt ofrece un atajo: un único archivo breve, en una dirección fija, que dice quién es usted y enlaza a las páginas que merece la pena leer, cada una con una línea de explicación.

¿Qué contiene el archivo?

El archivo se escribe en Markdown y se publica en /llms.txt, junto a robots.txt. La propuesta establece un orden fijo:

  • Un título: el nombre de la empresa o del sitio. Es la única parte obligatoria.
  • Un resumen breve, escrito como bloque de cita, que permite al lector situarle: qué hace, para quién y dónde.
  • Opcionalmente, unos párrafos sencillos con más contexto.
  • Secciones, cada una con su encabezado, que contienen una lista de enlaces. Cada enlace lleva un nombre, la dirección y una nota breve sobre lo que trata la página.
  • Una sección llamada Optional, para los enlaces que pueden omitirse cuando falta espacio.

Que sea breve y se ciña a los hechos. Es un mapa, no un folleto: una lista corta de enlaces bien descritos vale más que una copia del sitemap.

¿Cómo se configura?

  • Haga una lista de las páginas que mejor explican la empresa: los servicios, las guías principales, las páginas «sobre nosotros» y de contacto.
  • Escriba para cada una una frase que diga a qué responde la página.
  • Guarde el archivo como texto plano y publíquelo en la raíz del dominio, de modo que se abra en su dirección seguida de /llms.txt.
  • La propuesta no dice cómo tratar varios idiomas. Una solución viable es un archivo por cada versión de idioma del sitio.
  • Cuando sea posible, haga que el gestor de contenidos genere el archivo, para que no quede desfasado cuando cambian las páginas.
  • Ábralo en un navegador y siga todos los enlaces.

Algunos sitios publican además una versión en Markdown de cada página, o un segundo archivo, llms-full.txt, con el texto completo. Ambas cosas son ampliaciones; empiece por el archivo básico.

¿Qué no hace llms.txt?

  • No es robots.txt. No concede ni deniega nada. Si un rastreador puede o no recuperar sus páginas se sigue decidiendo en robots.txt.
  • No es una señal de posicionamiento. Ningún buscador ha dicho que use el archivo para ordenar páginas, y Google ha dicho que no lo hace.
  • No es ninguna garantía. En el momento de escribir esta guía, ninguno de los grandes proveedores de IA se ha comprometido a leerlo al responder. Algunas herramientas y agentes sí lo recuperan, sobre todo en documentación técnica.

¿Merece la pena?

Sí, con las expectativas adecuadas. El esfuerzo es pequeño, y redactar el archivo obliga a un ejercicio útil: decir en pocas líneas qué hace usted y qué páginas lo demuestran. Pero un archivo no arregla páginas que los rastreadores no pueden leer o que no responden a ninguna pregunta. Nosotros lo añadimos como un paso de nuestro trabajo de GEO, después del acceso y del contenido. En qué consiste ese trabajo más amplio se explica en ¿Qué es el GEO?

Preguntas frecuentes

¿Es llms.txt un estándar oficial?

No. Es una propuesta de la comunidad, no un estándar adoptado por un organismo como el W3C o el IETF. Su formato todavía puede cambiar, y los proveedores de IA son libres de ignorarlo.

¿Impide llms.txt que los rastreadores de IA usen mi contenido?

No. El archivo solo señala páginas; no puede denegar el acceso. Para rechazar a un rastreador hay que nombrarlo en robots.txt, e incluso eso solo funciona con los rastreadores que deciden respetarlo.

¿Dónde se coloca exactamente el archivo?

En la raíz del dominio, de modo que se abra en su dirección seguida de /llms.txt. Una herramienta que busca el archivo lo busca ahí, y no lo encontrará en una subcarpeta ni con otro nombre.

¿Cada cuánto hay que actualizar llms.txt?

Cada vez que se añade, se elimina o se traslada una página que figura en él. Un archivo con enlaces rotos o con la descripción de los servicios del año pasado hace más daño que no tener archivo, y por eso generarlo desde el gestor de contenidos es la vía más segura.

Hablemos de su proyecto.

Cuéntenos dónde está y adónde quiere llegar. Le respondemos en el plazo de un día laborable con una primera valoración. Una persona lee su mensaje y lo responde.