Blog · Para profesionales
llms.txt: qué es y si sirve
Si has leído en algún sitio que tu web «debe tener» un archivo llms.txt, la pregunta correcta no es cómo se escribe. Es si sirve. Esta página responde a las dos, y a la segunda responde de forma incómoda.
llms.txt es una propuesta de estándar: un archivo de texto que se coloca en la raíz del sitio, como el robots.txt, y que indica a los modelos de inteligencia artificial qué contenidos importan y dónde encontrarlos. La especificación está en llmstxt.org y lleva poco tiempo abierta.
Qué es, y por qué no es el robots.txt
El robots.txt y llms.txt responden a dos preguntas distintas, y confundirlas es el error más común. El robots.txt dice qué se puede leer: es un permiso, y quien lo ignora está incumpliendo una convención. llms.txt dice qué merece la pena leer: es una sugerencia, y nadie está obligado a seguirla.
La forma es distinta en consecuencia. El robots.txt es una lista de reglas para los rastreadores. llms.txt está escrito en Markdown: el nombre del negocio, una descripción en una línea, y una lista de enlaces a las páginas que importan, cada uno con una frase que explica qué se encuentra allí. Está pensado para ser leído por una máquina que tiene poco espacio y necesita entender rápido.
De 88 webs españolas medidas, 68 no lo tienen
El número procede de nuestras mediciones, no de una estimación: hemos analizado con nuestro motor 88 webs italianas de cinco categorías, entre despachos de abogados, restaurantes, fisioterapeutas, agencias inmobiliarias y centros de estética. De estas, 68 no exponen ningún llms.txt.
De las otras veinte no podemos afirmar con certeza que lo tengan: el control puede no haberse ejecutado, por ejemplo si la web respondió mal en ese momento. Así que el dato honesto es este: al menos el 77% de las webs medidas no tiene llms.txt. La proporción real probablemente sea más alta.
Qué promete, y qué nadie ha demostrado todavía
Aquí hay que decir lo que casi ningún artículo sobre el tema dice. No existen documentaciones oficiales de OpenAI, Google o Anthropic que confirmen que leen llms.txt, ni estudios públicos que midan su efecto sobre las citas. Es una propuesta de la comunidad, no un estándar adoptado por los motores.
Esto no quiere decir que sea inútil, quiere decir que quien te promete un resultado está prometiendo algo que no puede saber. El beneficio plausible es de orientación: si un modelo lee el archivo, encuentra un mapa limpio del sitio en lugar de tener que deducirlo del HTML. El beneficio demostrado, hoy, es cero.
Cómo se escribe, en la práctica
Un llms.txt mínimo tiene un título con el nombre del negocio, un párrafo que dice qué haces y dónde, y una sección de enlaces a las páginas principales, cada uno con una línea de explicación. Los enlaces deben ser direcciones reales y accesibles: un archivo que remite a páginas que no existen es peor que ningún archivo.
Se guarda como llms.txt y se coloca en la raíz, es decir, en la dirección tuweb.es/llms.txt. No hace falta declararlo en ningún sitio, como el robots.txt se encuentra porque está ahí.
Un ejemplo real, el nuestro
Las guías sobre este tema casi siempre muestran un ejemplo inventado. Este es el archivo que servimos realmente en trovavio.com/llms.txt, acortado solo en las líneas finales:
# Trovavio
> Auditoría SEO y GEO para profesionales y agencias italianas: analiza tu web
> en 30 segundos y descubre si es visible en Google y en los motores de IA como ChatGPT.
Trovavio es una herramienta de análisis online pensada para profesionales y agencias
en Italia. En pocos segundos genera una auditoría completa de tu web, explicada
en italiano sencillo y adaptada a tu sector.
## Páginas principales
- [Trovavio, Auditoría SEO y GEO](https://trovavio.com/): la herramienta de análisis,
precios y preguntas frecuentes
- [Blog: guías sobre SEO y GEO](https://trovavio.com/blog): cómo hacerte visible en
Google y ser citado por los asistentes de IA
Tres cosas a notar. El título es el nombre del negocio, no un eslogan. La línea que empieza con el signo mayor que es la descripción en una frase, y es la parte que un modelo lee primero. Cada enlace tiene una explicación después de los dos puntos, porque una lista de direcciones desnudas no le dice a nadie cuál abrir.
Qué no poner ahí
No es un lugar para las palabras clave. Llenarlo de frases repetidas con la esperanza de que un modelo las pondere es la versión 2026 del texto blanco sobre fondo blanco: nunca se ha demostrado que funcione, y es exactamente el tipo de cosa que los motores aprenden a ignorar primero.
Y no pongas páginas que no quieres que se lean. Un archivo que enumera el área privada o una página en borrador la está señalando, no ocultando: para eso está el robots.txt, que es el otro archivo y hace el otro trabajo.
¿Conviene hacerlo? La respuesta honesta
Conviene si lo consideras por lo que es: media hora de trabajo, una vez, en una apuesta de bajo coste. No conviene si alguien te lo vende como la razón por la que no apareces en ChatGPT, porque esa razón, en las webs que hemos medido, casi siempre es otra: contenidos que no responden a ninguna pregunta, ningún dato estructurado, o los bots de las IA bloqueados por el robots.txt sin que el propietario lo sepa.
Dicho de otra forma: llms.txt es el último de los pasos, no el primero. Si tu web tiene problemas más grandes, ese archivo no los compensa.