Soubor llms.txt je pozvánka pro asistenty AI: krátký soubor v kořeni webu, který říká, kdo jste a kde hledat. Toto měření počítá weby, které jej zveřejnily, a čte, co tytéž weby říkají týmž robotům v souboru hned vedle.
Soubor llms.txt je soubor v Markdownu umístěný na adrese /llms.txt. V několika řádcích představí web a ukáže na stránky, na kterých záleží, aby je asistent AI mohl přečíst přímo, místo aby skládal dohromady celý web. Formát žádá jedinou věc: nadpis první úrovně na začátku, zbytek je volný.
Odpovídá na novou otázku. Vyhledávač prochází web stránku po stránce a řadí, co najde; asistent čte rychle, cituje málo a potřebuje, aby mu někdo řekl, kde je podstata. 7,9 % odpovídajících webů .fr už k této otázce zaujalo postoj, dva roky poté, co byl formát navržen.
Tohle je past tohoto měření a mění všechno: mnoho webů vrací na jakoukoli neznámou adresu svou domovskou stránku. Když se takového webu zeptáte na /llms.txt, dostanete kód 200 a stránku HTML, nikdy llms.txt. Počítání, které se zastaví u stavového kódu HTTP, tak sečte první dva řádky tabulky a zveřejní míru adopce pětkrát vyšší.
| Co web odpovídá na /llms.txt | Podíl webů |
|---|---|
| Soubor začínající nadpisem v Markdownu | 7,9 % |
| Kód 200, ale něco jiného (obvykle domovská stránka) | 36,6 % |
| Odpověď, že soubor neexistuje | 55,5 % |
Měření se dívá na tělo odpovědi a za llms.txt počítá jen to, co začíná nadpisem první úrovně, jediným prvkem, který formát vyžaduje.
Web, který zveřejní llms.txt, zve asistenty AI ke čtení. Soubor robots.txt, o tři řádky dál, týmž robotům říká, zda vůbec smějí vstoupit. Oba se čtou téhož rána, na téže doméně.
Mezi weby, které zveřejňují llms.txt, jich 2,8 % jinde zakazuje svůj kořen alespoň jednomu robotovi AI. V celém parku .fr je tento podíl 2,2 %. Zveřejnit pozvánku tedy neznamená otevřít dveře: weby, které zvou, odmítají roboty o něco častěji než ostatní.
Samo o sobě to není rozporné: nechtít krmit model a chtít, aby vás asistent dobře přečetl, jsou dvě samostatná rozhodnutí, která mohou docela dobře existovat vedle sebe. Číslo ukazuje, že se tyto dva soubory jen zřídka píší společně, přestože odpovídají témuž návštěvníkovi.
Medián velikosti je 3 878 bajtů, zhruba čtyři kilobajty: mapa webu, ne jeho kopie. Odpovídá to tomu, co formát žádá, a právě díky tomu lze soubor udržovat v čase.
Soubor llms.txt má takovou hodnotu, jakou má jeho aktuálnost. Jmenuje stránky, a stránka, která změní adresu, zanechá v souboru řádek, který nikam nevede. Je to soubor, ke kterému se vracet při každém redesignu, přesně jako k mapě stránek.
Serenity je web vytvořený, hostovaný, zabezpečený a udržovaný v aktuálním stavu společností Simafri, která vytváří, hostuje a spravuje firemní weby od roku 2012. Doménové jméno je registrováno na jméno klienta a účet Simafri Suite je součástí.
Výběrový rámec: 4 590 553 aktivních domén .fr z otevřeného datového souboru Afnic Afnic, fichier des domaines .fr actifs. Z něj se losuje panel 15 000 domén, seřazených podle otisku sha256 každého jména, což komukoli umožňuje sestavit tentýž panel ze zveřejněného semínka. Panel zůstává stejný od jednoho čtení k dalšímu, takže pohyb v řadě je rozhodnutím, které učinil park.
Řetěz čtení: na /llms.txt se ptáme jednou týdně, v témže průchodu, který už otevírá každou doménu panelu. Čísla se týkají webů, které na tuto otázku odpovídají, tedy 98 % těch, které podávají stránku: těch, které podávají soubor, těch, které podávají něco jiného, a těch, které odpovídají, že soubor neexistuje.
Co se počítá jako llms.txt: tělo začínající nadpisem první úrovně v Markdownu. Zveřejněná velikost je medián podávaných souborů, v bajtech. Soubor robots.txt se čte na téže doméně téhož rána a robot AI se počítá jako odmítnutý, když mu jeho vlastní skupina pravidel zakazuje kořen.
Co se nečetlo: nic, co by vyžadovalo přístup k webu, k jeho správě nebo k jeho hostingu. Jeden požadavek na stránku, jeden na každý soubor.
Dosah: panel losuje ze všech aktivních domén .fr, firmy, spolky i soukromé osoby dohromady, bez kvalifikace podle firemního čísla. Čísla tedy popisují francouzský park jako celek a podíl webů, které odmítají robota AI, pochází z téhož týdenního čtení.
Čísla pocházejí z veřejného indexu, který zveřejňuje svou metodu, datovaný panel a týdenní řady, přečteno 4. září 2026. Řady se podávají v JSON a dají se přehrát znovu.
Zobrazit index a jeho metodu (Stileex)
Panel se čte každý týden, což ukáže, jak rychle park tento soubor zveřejňuje a zda ti, kdo jej zveřejní, otevírají i dveře.
Simafri je technickým spojencem firem od roku 2012: vytvoříme váš web, hostujeme jej, spravujeme a udržujeme aktuální, s doménovým jménem registrovaným na vás. Váš llms.txt a váš robots.txt říkají to, co jste rozhodli, a upravujeme je, když se vaše stránky přesunou. Napište nám, podíváme se na váš případ společně.
Simafri
Promluvme si o vašem záměru
Řekněte nám v pár slovech, co potřebujete: rychle se vám ozveme.
Děkujeme! Vaše zpráva byla odeslána. Brzy se vám ozveme.
Máte raději e-mail? Napište nám na support@simafri.com.