Qué es llms.txt y si sirve para algo
Publicado el 24 de julio de 2026 · Actualizado el 5 de agosto de 2026
Por Rubén Ortega · 12 años en soporte técnico y preventa de empresas de hosting (Abansys, Arsys, Nominalia) · Declaración de vínculos
📌 Datos clave
- Qué es
- Índice del sitio en texto plano (Markdown) para modelos de IA
- Ubicación
/llms.txt, en la raíz del dominio- Estado a julio de 2026
- Propuesta de la comunidad, no estándar adoptado
- Uso confirmado por proveedores de IA
- Ninguno lo ha confirmado públicamente
- Coste de implementarlo
- Bajo
Respuesta rápida
llms.txt es un fichero de texto en la raíz de tu web que resume de qué va el sitio y lista sus contenidos, pensado para que un modelo de IA lo lea de un vistazo. La idea tiene sentido: una versión limpia de tu sitio, sin menús, banners ni JavaScript.
Ahora la parte incómoda: a día de hoy ningún proveedor grande ha confirmado públicamente que lo utilice. No es un estándar aprobado ni tiene detrás a OpenAI, Google o Anthropic. Es una propuesta de la comunidad muy extendida que muchos sitios implementan por si acaso.
Con eso claro: cuesta muy poco montarlo, y si algún día se adopta, ya lo tienes. Pero si alguien te dice que llms.txt te va a traer tráfico, te está vendiendo algo.
Qué contiene
Markdown, con una estructura sencilla: título, descripción del sitio y secciones con enlaces y su resumen.
# HostingCompara
> Comparativas de hosting con datos medidos: precios de renovación,
> uptime y TTFB propios. Actualizado mensualmente.
Idioma: español. Última actualización: 2026-07-24.
## Comparativas
- [Mejor hosting WordPress](https://ejemplo.com/mejor-hosting-wordpress/): comparativa
con precio de renovación y coste a 5 años de 12 proveedores.
## Guías
- [Qué es el TTFB](https://ejemplo.com/ttfb/): qué mide, cuánto debería ser y
mediciones propias de 3 proveedores.
Se sirve en /llms.txt, como text/plain y en UTF-8. El acento mal codificado es el fallo más habitual.
En qué se diferencia de robots.txt
Se confunden mucho, y son cosas distintas:
robots.txt |
llms.txt |
|
|---|---|---|
| Para qué | Decir qué se puede rastrear | Ofrecer un índice del contenido |
| Estado | Estándar veterano y respetado | Propuesta sin adopción confirmada |
| ¿Lo usan? | Sí, los rastreadores serios | Sin confirmación pública |
| Si no lo tienes | Se rastrea todo por defecto | No pasa nada |
Si tienes que elegir uno, robots.txt, sin dudarlo. Ese sí funciona y sí decide si los bots que traen visitas pueden entrar.
Argumentos a favor y en contra
A favor:
- Cuesta muy poco, sobre todo si se genera automáticamente
- Si se adopta, estás listo sin hacer nada
- Obliga a escribir un resumen de cada artículo, que es útil por sí solo
En contra:
- Ningún proveedor ha confirmado que lo lea
- Hay que mantenerlo: un índice desactualizado es peor que ninguno
- Genera falsa sensación de haber hecho algo por el canal de IA
Ese último punto es el riesgo real: es fácil pasar una tarde con llms.txt y sentir que ya has trabajado el GEO, cuando lo que de verdad decide es tener un dato que nadie más publica. El fichero no arregla un contenido sin nada citable.
Si decides ponerlo
Que se genere solo. Un índice escrito a mano queda obsoleto al tercer artículo.
En WordPress, el enfoque que funciona es registrar una regla de reescritura para /llms.txt y construir la salida desde los posts publicados: título, URL y extracto, agrupados por categoría. Así el fichero está siempre al día sin tocarlo nunca.
Dos detalles que dan problemas:
- Codificación. Fuerza
Content-Type: text/plain; charset=UTF-8o los acentos saldrán rotos. - 404 tras el despliegue. Si has añadido una regla de reescritura, hay que refrescar los enlaces permanentes o la ruta no existirá.
Y añade una línea de referencia en robots.txt:
# Contexto para agentes: https://tudominio.com/llms.txt
Lo que sí decide la citación está en cómo conseguir que ChatGPT cite tu web, y los tokens que de verdad importan en robots.txt para bots de IA.
Veredicto
Impleméntalo si te cuesta menos de una hora y puedes automatizarlo. No lo hagas a mano y no esperes tráfico de ahí.
Es una apuesta barata a que se adopte, no una técnica de posicionamiento. La diferencia importa: si tienes una tarde para dedicar al canal de IA, sale mucho más rentable revisar los tokens de robots.txt y añadir una tabla de datos a tu mejor artículo.
Preguntas frecuentes
¿Sirve de algo llms.txt?
A julio de 2026 ningún proveedor de IA importante ha confirmado públicamente que lo use como fuente. Es una propuesta de la comunidad. Cuesta poco montarlo, pero no hay evidencia de que traiga visitas.
¿Es lo mismo que robots.txt?
No. robots.txt dice qué se puede rastrear y sí lo respetan los rastreadores. llms.txt pretende ofrecer un índice del contenido, y su adopción no está confirmada.
¿Dónde se coloca?
En la raíz del dominio: tudominio.com/llms.txt, servido como text/plain en UTF-8.
¿Y llms-full.txt?
Es una variante que incluye el contenido completo en lugar de solo el índice. Mismo estado: sin adopción confirmada, y con el añadido de que expone todo tu contenido en texto plano.
Estado verificado el 24 de julio de 2026. Si lees esto mucho después, comprueba si algún proveedor ha confirmado su uso: es exactamente el dato que cambiaría el veredicto.