llms.txt na francuskich stronach: kto opublikował plik

Plik llms.txt to zaproszenie skierowane do asystentów AI: krótki plik w katalogu głównym strony, który mówi, kim Państwo są i gdzie szukać. Ten pomiar liczy strony, które go opublikowały, i czyta, co te same strony mówią tym samym robotom w pliku obok.

Opublikowano 5 września 2026 Panel 15 000 domen .fr, odczytany 4 września 2026

7,9 %odpowiadających stron .fr serwuje prawdziwy llms.txt
3878bajtów, mediana rozmiaru serwowanego pliku
2,8 %publikujących go stron odmawia gdzie indziej robotowi AI

Co robi ten plik i dlaczego pojawia się właśnie teraz

Plik llms.txt to plik Markdown umieszczony pod adresem /llms.txt. Przedstawia stronę w kilku wierszach i wskazuje podstrony, które się liczą, tak aby asystent AI mógł przeczytać je bezpośrednio, zamiast składać w całość cały serwis. Format wymaga jednej rzeczy: nagłówka pierwszego poziomu na początku, reszta jest dowolna.

Odpowiada na nowe pytanie. Wyszukiwarka przegląda serwis podstrona po podstronie i klasyfikuje to, co znajdzie; asystent czyta szybko, cytuje niewiele i trzeba mu wskazać, gdzie jest treść. 7,9 % odpowiadających stron .fr zajęło już stanowisko w tej sprawie, dwa lata po zaproponowaniu formatu.

Odpowiedź 200 to jeszcze nie plik

To jest pułapka tego pomiaru i zmienia ona wszystko: wiele stron zwraca swoją stronę główną pod każdym nieznanym adresem. Zapytana o /llms.txt, taka strona odpowiada kodem 200 i stroną HTML, nigdy plikiem llms.txt. Liczenie, które zatrzymuje się na statusie HTTP, sumuje więc dwa pierwsze wiersze tabeli i publikuje wskaźnik adopcji pięciokrotnie zawyżony.

Co strona odpowiada pod /llms.txt Udział stron
Plik zaczynający się nagłówkiem Markdown 7,9 %
Kod 200, ale coś innego (zwykle strona główna) 36,6 %
Odpowiedź, że plik nie istnieje 55,5 %

Pomiar patrzy na treść odpowiedzi i liczy jako llms.txt tylko to, co zaczyna się nagłówkiem pierwszego poziomu, jedynym elementem, którego wymaga format.

Dwa pliki, dwie ręce, dwie odpowiedzi

Strona, która publikuje llms.txt, zaprasza asystentów AI do czytania. Plik robots.txt, trzy wiersze dalej, mówi tym samym robotom, czy w ogóle mogą wejść. Oba są czytane tego samego ranka, w tej samej domenie.

Wśród stron publikujących llms.txt 2,8 % zabrania gdzie indziej swojego katalogu głównego co najmniej jednemu robotowi AI. W całym zbiorze .fr ten udział wynosi 2,2 %. Opublikowanie zaproszenia nie idzie więc w parze z otwarciem drzwi: strony, które zapraszają, odmawiają robotom nieco częściej niż pozostałe.

Samo w sobie nie jest to sprzeczne: odmowa zasilania modelu i chęć bycia dobrze przeczytanym przez asystenta to dwie odrębne decyzje, które doskonale mogą iść w parze. Liczba pokazuje, że te dwa pliki rzadko pisze się razem, choć odpowiadają temu samemu gościowi.

Krótki plik, utrzymywany na bieżąco

Mediana rozmiaru wynosi 3 878 bajtów, około czterech kilobajtów: mapa strony, a nie jej kopia. To zgodne z tym, czego wymaga format, i właśnie to pozwala utrzymać plik w czasie.

Plik llms.txt jest wart tyle, ile jego aktualność. Wymienia podstrony, a podstrona, która zmienia adres, zostawia w pliku wiersz prowadzący donikąd. To plik do przejrzenia przy każdej przebudowie serwisu, dokładnie jak mapa witryny.

Serenity, bez owijania

Serenity to strona internetowa tworzona, hostowana, zabezpieczana i utrzymywana w aktualności przez Simafri, które tworzy, hostuje i utrzymuje strony firm od 2012 roku. Nazwa domeny jest zarejestrowana na klienta, a konto Simafri Suite jest w cenie.

Zobacz ofertę i cennik

Metoda

Operat losowania: 4 590 553 aktywne domeny .fr z otwartego pliku danych Afnic Afnic, fichier des domaines .fr actifs. Losuje się z niego panel 15 000 domen, uporządkowanych według odcisku sha256 każdej nazwy, co pozwala każdemu odtworzyć ten sam panel na podstawie opublikowanego ziarna. Panel pozostaje ten sam z odczytu na odczyt, więc ruch w serii jest decyzją podjętą przez zbiór.

Łańcuch odczytu: o /llms.txt pytamy raz w tygodniu, w tym samym przebiegu, który już otwiera każdą domenę panelu. Liczby dotyczą stron, które odpowiadają na to pytanie, czyli 98 % tych, które serwują stronę: tych, które serwują plik, tych, które serwują coś innego, i tych, które odpowiadają, że pliku nie ma.

Co liczy się jako llms.txt: treść zaczynająca się nagłówkiem Markdown pierwszego poziomu. Publikowany rozmiar to mediana serwowanych plików, w bajtach. Plik robots.txt jest czytany w tej samej domenie tego samego ranka, a robot AI liczy się jako odrzucony, gdy jego własna grupa reguł zabrania mu katalogu głównego.

Czego nie czytano: niczego, co wymaga dostępu do strony, jej administracji czy hostingu. Jedno zapytanie o stronę, jedno o każdy plik.

Zasięg: panel losuje spośród wszystkich aktywnych domen .fr, firm, stowarzyszeń i osób prywatnych razem, bez kwalifikacji przez numer firmy. Liczby opisują zatem francuski zbiór jako całość, a udział stron odmawiających robotowi AI pochodzi z tego samego cotygodniowego odczytu.

Źródło i ponowne wykorzystanie

Liczby pochodzą z publicznego indeksu, który publikuje swoją metodę, datowany panel i cotygodniowe serie, odczytanego 4 września 2026. Serie są serwowane w JSON i dają się odtworzyć.

Zobacz indeks i jego metodę (Stileex)

API JSON

Panel jest odczytywany co tydzień, co pokaże, jak szybko zbiór publikuje ten plik i czy ci, którzy go publikują, otwierają też drzwi.

Opublikować swój llms.txt i utrzymywać go na bieżąco

Simafri jest technicznym sojusznikiem firm od 2012 roku: tworzymy Państwa stronę, hostujemy ją, utrzymujemy i aktualizujemy, z nazwą domeny zarejestrowaną na Państwa. Państwa llms.txt i robots.txt mówią to, co Państwo zdecydowali, i są przeglądane, gdy Państwa podstrony zmieniają adres. Proszę do nas napisać, przyjrzymy się sprawie razem.

Skontaktuj się z nami