¿Tienes un llms.txt de verdad?
Escribe un dominio y mira qué recibe de verdad un asistente de IA cuando pide tu llms.txt, más un fichero generado desde tu propia web para copiar.
Qué hace esta herramienta
Un llms.txt es un fichero de texto plano en la raíz de una web que le cuenta a los asistentes de IA qué es el sitio y qué páginas importan. Esta herramienta se lo pide a tu dominio y te dice cuál de estas cosas tienes: una guía de verdad, un fichero escrito por un plugin de SEO, una lista de permisos de bots, un fichero vacío, un soft 200 (tu servidor responde 200 y devuelve la portada, que en un navegador parece correcto y para una máquina no es un fichero), un firewall que nos bloquea, o nada. Después genera un llms.txt desde tu propia web, con cada dato sin verificar marcado como hueco, listo para copiar.
Preguntas frecuentes
Es un fichero de texto plano publicado en la raíz de una web, en /llms.txt, que cuenta en lenguaje llano qué es el sitio, qué ofrece y qué páginas importan. Existe para que un asistente de IA pueda leer los datos importantes sin rastrear y adivinarlos desde tu menú.
Un soft 200 es un servidor que responde 200 OK en /llms.txt y devuelve el HTML de tu portada en vez de un fichero de texto. En un navegador parece que la página cargó, así que nadie se entera, y para una máquina no hay ningún fichero. Es la sorpresa más habitual que encontramos, y el arreglo es de tu hosting o de tus reglas de rutas.
No es un factor de posicionamiento y ningún asistente promete leerlo. Lo que hace es quitar ambigüedad: los datos que quieres que se citen quedan escritos una vez, con tus palabras, en un fichero trivial de parsear. Es barato de publicar y no cuesta nada equivocarse.
En la raíz de tu dominio, para que se abra en tudominio.com/llms.txt, servido como texto plano. Si publicas un segundo idioma, dale su propia ruta como /llms-es.txt en vez de pisar el canónico, porque en /llms.txt solo cabe un fichero.
Porque solo rellenamos lo que hemos podido verificar leyendo tu web. Lo que no hemos podido comprobar queda como hueco marcado y no como una suposición plausible. Un fichero generado lleno de datos inventados sería peor que nada, porque justamente va de ser la fuente en la que un asistente confía.
No, y confundirlos es un error habitual. El robots.txt dice quién puede leer tu web. El llms.txt dice qué es tu web. Si tu llms.txt está lleno de líneas User-agent y Disallow, esas reglas van en el robots.txt y tu llms.txt no está describiendo nada.