llms.txt e siti francesi: chi ha già pubblicato il file

Il llms.txt è un invito rivolto agli assistenti di IA: un file breve, nella radice del sito, che dice chi siete e dove guardare. Questa rilevazione conta i siti che lo hanno pubblicato, e legge cosa dicono agli stessi robot nel file accanto.

Pubblicato il 5 settembre 2026 Paniere di 15 000 domini .fr, rilevato il 4 settembre 2026

7,9 %dei siti .fr che rispondono serve un vero llms.txt
3878byte, la dimensione mediana del file servito
2,8 %di chi lo pubblica rifiuta inoltre un robot di IA

Cosa fa il file, e perché compare adesso

Un llms.txt è un file Markdown collocato in /llms.txt. Presenta il sito in poche righe e rimanda alle pagine che contano, perché un assistente di IA le legga direttamente invece di ricostruire un sito intero. Il formato si riduce a un solo requisito: un titolo di livello 1 in testa, il resto è libero.

Risponde a una domanda nuova. Un motore di ricerca esplora un sito pagina per pagina e classifica ciò che trova; un assistente, invece, legge in fretta, cita poco e ha bisogno che gli si dica dov'è l'essenziale. Il 7,9 % dei siti .fr che rispondono ha già preso posizione su questa domanda, due anni dopo la proposta del formato.

Rispondere 200 non vuol dire avere il file

È la trappola di questa rilevazione, e cambia tutto: molti siti restituiscono la propria home page per qualsiasi indirizzo sconosciuto. Chiedere /llms.txt a un sito del genere restituisce un codice 200 e una pagina HTML, mai un llms.txt. Un conteggio che si ferma al codice HTTP somma quindi le prime due righe della tabella e pubblica un'adozione cinque volte troppo alta.

Cosa risponde il sito su /llms.txt Quota dei siti
Un file che si apre con un titolo Markdown 7,9 %
Un codice 200, ma altro (quasi sempre la home page) 36,6 %
Una risposta che dice che il file non esiste 55,5 %

La rilevazione legge il corpo della risposta e conta come llms.txt solo ciò che si apre con un titolo di livello 1, l'unico elemento che il formato richiede.

Due file, due mani, due risposte

Un sito che pubblica un llms.txt invita gli assistenti di IA a venire a leggere. Il file robots.txt, a tre righe di distanza, dice a quegli stessi robot se hanno il diritto di entrare. I due si leggono la stessa mattina, sullo stesso dominio.

Tra i siti che pubblicano un llms.txt, il 2,8 % vieta inoltre la propria radice ad almeno un robot di IA. Sull'insieme del parco .fr, questa quota è del 2,2 %. In altre parole, pubblicare l'invito non va di pari passo con l'aprire la porta: i siti che invitano rifiutano un po' più spesso degli altri.

Niente di tutto questo è contraddittorio in sé: rifiutare l'addestramento di un modello e voler essere letti bene da un assistente sono due decisioni distinte, e possono convivere perfettamente. Ciò che la cifra mostra è che questi due file vengono scritti raramente insieme, pur rispondendo allo stesso interlocutore.

Un file breve, che si tiene aggiornato

La dimensione mediana è di 3 878 byte, cioè circa quattro kilobyte: una pagina di mappa, non una copia del sito. È coerente con ciò che il formato chiede, ed è anche ciò che lo rende sostenibile nel tempo.

Un llms.txt vale quanto vale la sua freschezza. Nomina delle pagine, e una pagina che cambia indirizzo lascia nel file una riga che non porta più da nessuna parte. È un file da riprendere a ogni rifacimento, esattamente come una mappa del sito.

Serenity, in chiaro

Serenity è un sito web creato, ospitato, messo in sicurezza e tenuto aggiornato da Simafri, che crea, ospita e mantiene siti di imprese dal 2012. Il nome a dominio è registrato a nome del cliente, e un account Simafri Suite è incluso.

Vedere l'offerta e le tariffe

Metodo

Quadro di sorteggio: i 4 590 553 domini .fr attivi del file di dati aperti di Afnic Afnic, fichier des domaines .fr actifs. Da esso viene sorteggiato un paniere di 15 000 domini, ordinati per impronta sha256 di ciascun nome, il che permette a chiunque di ricostruire lo stesso paniere a partire dal seme pubblicato. Il paniere resta lo stesso da una rilevazione all'altra, quindi un movimento della serie è una decisione del parco.

Catena di lettura: il /llms.txt viene chiesto una volta alla settimana, nello stesso passaggio che apre già ogni dominio del paniere. Le cifre riguardano i siti che rispondono alla domanda, cioè il 98 % di quelli che servono una pagina: quelli che servono un file, quelli che servono altro e quelli che rispondono che il file non esiste.

Cosa conta come llms.txt: un corpo che si apre con un titolo Markdown di livello 1. La dimensione pubblicata è la mediana dei file serviti, in byte. Il robots.txt è letto sullo stesso dominio e la stessa mattina, e un robot di IA conta come rifiutato quando il suo proprio gruppo di istruzioni gli vieta la radice.

Cosa non è stato letto: nulla che richieda un accesso al sito, alla sua amministrazione o al suo hosting. Una richiesta per la pagina, una per ciascun file.

Portata: il paniere sorteggia nell'insieme dei domini .fr attivi, imprese, associazioni e privati insieme, senza qualificazione tramite numero d'impresa. Le cifre descrivono quindi il parco francese nel suo insieme, e la quota dei siti che rifiutano un robot di IA viene dalla stessa rilevazione settimanale.

Fonte e riuso

Le cifre vengono da un indice pubblico che pubblica il suo metodo, il suo paniere datato e la sua serie settimanale, rilevazione del 4 settembre 2026. La serie è servita in JSON e si rigioca.

Vedere l'indice e il suo metodo (Stileex)

API JSON

Il paniere è rilevato ogni settimana, il che dirà a quale velocità il parco pubblica questo file, e se chi lo pubblica apre anche la propria porta.

Pubblicare il vostro llms.txt, e tenerlo aggiornato

Simafri è l'alleato tecnico della vostra impresa dal 2012: creiamo il vostro sito, lo ospitiamo, lo manteniamo e lo teniamo aggiornato, con il vostro nome a dominio registrato a vostro nome. Il vostro llms.txt e il vostro robots.txt dicono ciò che avete deciso, e vengono ripresi quando le vostre pagine si spostano. Scriveteci, guardiamo insieme il vostro caso.

Contattaci