llms.txt y sitios franceses: quién ya ha puesto el archivo

El llms.txt es una invitación dirigida a los asistentes de IA: un archivo breve, en la raíz del sitio, que dice quién es usted y dónde mirar. Esta medición cuenta los sitios que lo han puesto, y lee lo que dicen a esos mismos robots en el archivo de al lado.

Publicado el 5 de septiembre de 2026 Panel de 15 000 dominios .fr, medido el 4 de septiembre de 2026

7,9 %de los sitios .fr que responden sirven un llms.txt real
3878bytes, el tamaño mediano del archivo servido
2,8 %de quienes lo publican rechazan además a un robot de IA

Lo que hace el archivo, y por qué aparece ahora

Un llms.txt es un archivo Markdown colocado en /llms.txt. Presenta el sitio en pocas líneas y apunta a las páginas que importan, para que un asistente de IA las lea directamente en lugar de reconstruir un sitio entero. El formato se resume en una exigencia: un título de nivel 1 al principio; el resto es libre.

Responde a una pregunta nueva. Un motor de búsqueda recorre un sitio página por página y clasifica lo que encuentra; un asistente, en cambio, lee rápido, cita poco y necesita que le digan dónde está lo esencial. El 7,9 % de los sitios .fr que responden ya ha tomado posición sobre esta pregunta, dos años después de que se propusiera el formato.

Responder 200 no significa tener el archivo

Es la trampa de esta medición, y lo cambia todo: muchos sitios devuelven su portada ante cualquier dirección desconocida. Pedir /llms.txt a un sitio así devuelve un código 200 y una página HTML, nunca un llms.txt. Un recuento que se detiene en el código HTTP suma por tanto las dos primeras filas de la tabla y publica una adopción cinco veces demasiado alta.

Lo que el sitio responde en /llms.txt Proporción de sitios
Un archivo que empieza con un título Markdown 7,9 %
Un código 200, pero otra cosa (casi siempre la portada) 36,6 %
Una respuesta que dice que el archivo no existe 55,5 %

La medición lee el cuerpo de la respuesta y solo cuenta como llms.txt lo que empieza con un título de nivel 1, el único elemento que exige el formato.

Dos archivos, dos manos, dos respuestas

Un sitio que pone un llms.txt invita a los asistentes de IA a venir a leer. El archivo robots.txt, a tres líneas de distancia, dice a esos mismos robots si tienen derecho a entrar. Ambos se leen la misma mañana, en el mismo dominio.

Entre los sitios que publican un llms.txt, el 2,8 % prohíbe además su raíz a al menos un robot de IA. En el conjunto del parque .fr, esa proporción es del 2,2 %. Dicho de otro modo, poner la invitación no va unido a abrir la puerta: los sitios que invitan rechazan un poco más a menudo que los demás.

Nada de esto es contradictorio en sí: rechazar el entrenamiento de un modelo y querer ser bien leído por un asistente son dos decisiones distintas, y pueden convivir perfectamente. Lo que muestra la cifra es que estos dos archivos rara vez se escriben juntos, aunque respondan al mismo interlocutor.

Un archivo breve, que se mantiene al día

El tamaño mediano es de 3 878 bytes, es decir, unos cuatro kilobytes: una página de plano, no una copia del sitio. Es coherente con lo que pide el formato, y es también lo que lo hace sostenible en el tiempo.

Un llms.txt vale lo que vale su frescura. Nombra páginas, y una página que cambia de dirección deja en el archivo una línea que ya no lleva a ninguna parte. Es un archivo que se retoma en cada rediseño, igual que un mapa del sitio.

Serenity, en claro

Serenity es un sitio web creado, alojado, asegurado y mantenido al día por Simafri, que crea, aloja y mantiene sitios de empresas desde 2012. El nombre de dominio se registra a nombre del cliente, y se incluye una cuenta Simafri Suite.

Ver la oferta y las tarifas

Método

Marco de sorteo: los 4 590 553 dominios .fr activos del archivo de datos abiertos de Afnic Afnic, fichier des domaines .fr actifs. De él se sortea un panel de 15 000 dominios, ordenados por la huella sha256 de cada nombre, lo que permite a cualquiera reconstruir el mismo panel a partir de la semilla publicada. El panel sigue siendo el mismo de una medición a otra, de modo que un movimiento de la serie es una decisión del parque.

Cadena de lectura: el /llms.txt se pide una vez por semana, en la misma pasada que ya abre cada dominio del panel. Las cifras se refieren a los sitios que responden a la pregunta, es decir, el 98 % de los que sirven una página: los que sirven un archivo, los que sirven otra cosa y los que responden que el archivo no existe.

Qué cuenta como llms.txt: un cuerpo que empieza con un título Markdown de nivel 1. El tamaño publicado es la mediana de los archivos servidos, en bytes. El robots.txt se lee en el mismo dominio y la misma mañana, y un robot de IA cuenta como rechazado cuando su propio grupo de instrucciones le prohíbe la raíz.

Qué no se leyó: nada que exija acceso al sitio, a su administración o a su alojamiento. Una petición para la página, una para cada archivo.

Alcance: el panel sortea entre todos los dominios .fr activos, empresas, asociaciones y particulares juntos, sin cualificación por número de empresa. Las cifras describen por tanto el parque francés en su conjunto, y la proporción de sitios que rechazan a un robot de IA procede de la misma medición semanal.

Fuente y reutilización

Las cifras proceden de un índice público que publica su método, su panel fechado y su serie semanal, medición del 4 de septiembre de 2026. La serie se sirve en JSON y se puede rejugar.

Ver el índice y su método (Stileex)

API JSON

El panel se mide cada semana, lo que dirá a qué velocidad el parque pone este archivo, y si quienes lo ponen abren también su puerta.

Poner su llms.txt, y mantenerlo al día

Simafri es el aliado técnico de su empresa desde 2012: creamos su sitio, lo alojamos, lo mantenemos y lo tenemos al día, con su nombre de dominio registrado a su nombre. Su llms.txt y su robots.txt dicen lo que usted ha decidido, y se retoman cuando sus páginas cambian. Escríbanos y miramos su caso juntos.

Contáctenos