Eine llms.txt ist eine Einladung an KI-Assistenten: eine kurze Datei im Stammverzeichnis der Website, die sagt, wer man ist und wo man nachsehen soll. Diese Erhebung zählt die Websites, die sie bereitgestellt haben, und liest, was sie denselben Crawlern in der Datei nebenan sagen.
Eine llms.txt ist eine Markdown-Datei unter /llms.txt. Sie stellt die Website in wenigen Zeilen vor und verweist auf die Seiten, auf die es ankommt, damit ein KI-Assistent sie direkt liest, statt eine ganze Website zusammenzusetzen. Das Format stellt eine einzige Anforderung: eine Überschrift erster Ebene am Anfang, der Rest ist frei.
Sie beantwortet eine neue Frage. Eine Suchmaschine durchläuft eine Website Seite für Seite und ordnet ein, was sie findet; ein Assistent liest schnell, zitiert wenig und muss gesagt bekommen, wo das Wesentliche steht. 7,9 % der antwortenden .fr-Websites haben zu dieser Frage bereits Stellung bezogen, zwei Jahre nachdem das Format vorgeschlagen wurde.
Das ist der Fallstrick dieser Erhebung, und er ändert alles: viele Websites liefern bei jeder unbekannten Adresse ihre Startseite aus. Fragt man eine solche Website nach /llms.txt, erhält man einen Code 200 und eine HTML-Seite, nie eine llms.txt. Eine Zählung, die beim HTTP-Code stehen bleibt, addiert also die ersten beiden Zeilen der Tabelle und veröffentlicht eine fünfmal zu hohe Verbreitung.
| Was die Website unter /llms.txt antwortet | Anteil der Websites |
|---|---|
| Eine Datei, die mit einer Markdown-Überschrift beginnt | 7,9 % |
| Ein Code 200, aber etwas anderes (meist die Startseite) | 36,6 % |
| Eine Antwort, die besagt, dass die Datei nicht existiert | 55,5 % |
Die Erhebung liest den Inhalt der Antwort und zählt als llms.txt nur, was mit einer Überschrift erster Ebene beginnt, dem einzigen Element, das das Format verlangt.
Eine Website, die eine llms.txt bereitstellt, lädt KI-Assistenten zum Lesen ein. Die robots.txt, drei Zeilen weiter, sagt denselben Crawlern, ob sie überhaupt eintreten dürfen. Beide werden am selben Morgen auf derselben Domain gelesen.
Unter den Websites, die eine llms.txt veröffentlichen, sperren 2,8 % ihre Wurzel an anderer Stelle für mindestens einen KI-Crawler. Im gesamten .fr-Bestand liegt dieser Anteil bei 2,2 %. Die Einladung auszusprechen geht also nicht damit einher, die Tür zu öffnen: die Websites, die einladen, weisen etwas häufiger ab als die übrigen.
Nichts davon ist an sich widersprüchlich: das Training eines Modells abzulehnen und von einem Assistenten gut gelesen werden zu wollen, sind zwei getrennte Entscheidungen, und sie vertragen sich bestens. Die Zahl zeigt, dass diese beiden Dateien selten gemeinsam geschrieben werden, obwohl sie demselben Besucher antworten.
Die Mediangröße beträgt 3 878 Bytes, rund vier Kilobyte: ein Plan der Website, keine Kopie davon. Das entspricht dem, was das Format verlangt, und genau das macht die Datei auf Dauer pflegbar.
Eine llms.txt ist so viel wert wie ihre Aktualität. Sie nennt Seiten, und eine Seite, die ihre Adresse ändert, hinterlässt in der Datei eine Zeile, die ins Leere führt. Diese Datei wird bei jedem Relaunch überarbeitet, genau wie eine Sitemap.
Serenity ist eine Website, erstellt, gehostet, abgesichert und aktuell gehalten von Simafri, das seit 2012 Unternehmenswebsites erstellt, hostet und pflegt. Der Domainname wird auf den Namen der Kundin eingetragen, und ein Simafri-Suite-Konto ist enthalten.
Ziehungsrahmen: die 4 590 553 aktiven .fr-Domains aus der offenen Datendatei von Afnic Afnic, fichier des domaines .fr actifs. Daraus wird ein Panel von 15 000 Domains gezogen, geordnet nach dem sha256-Fingerabdruck jedes Namens, sodass jede und jeder aus dem veröffentlichten Startwert dasselbe Panel neu aufbauen kann. Das Panel bleibt von einer Erhebung zur nächsten dasselbe, eine Bewegung der Reihe ist also eine Entscheidung des Bestands.
Lesekette: /llms.txt wird einmal pro Woche abgefragt, im selben Durchgang, der bereits jede Domain des Panels öffnet. Die Zahlen beziehen sich auf die Websites, die auf die Frage antworten, also 98 % derer, die eine Seite ausliefern: jene, die eine Datei liefern, jene, die etwas anderes liefern, und jene, die antworten, dass die Datei nicht existiert.
Was als llms.txt zählt: ein Inhalt, der mit einer Markdown-Überschrift erster Ebene beginnt. Die veröffentlichte Größe ist der Median der ausgelieferten Dateien, in Bytes. Die robots.txt wird auf derselben Domain am selben Morgen gelesen, und ein KI-Crawler gilt als abgewiesen, wenn seine eigene Regelgruppe ihm die Wurzel verbietet.
Was nicht gelesen wurde: nichts, was Zugang zur Website, zu ihrer Verwaltung oder zu ihrem Hosting verlangt. Eine Anfrage für die Seite, eine für jede Datei.
Reichweite: das Panel zieht aus allen aktiven .fr-Domains, Unternehmen, Vereine und Privatpersonen zusammen, ohne Qualifizierung über die Unternehmensnummer. Die Zahlen beschreiben also den französischen Bestand als Ganzes, und der Anteil der Websites, die einen KI-Crawler abweisen, stammt aus derselben wöchentlichen Erhebung.
Die Zahlen stammen aus einem öffentlichen Index, der seine Methode, sein datiertes Panel und seine wöchentliche Reihe veröffentlicht, gelesen am 4. September 2026. Die Reihe wird als JSON ausgeliefert und lässt sich nachspielen.
Index und Methode ansehen (Stileex)
Das Panel wird jede Woche erhoben, was zeigen wird, wie schnell der Bestand diese Datei einführt und ob jene, die sie einführen, auch ihre Tür öffnen.
Simafri ist seit 2012 der technische Verbündete Ihres Unternehmens: wir erstellen Ihre Website, hosten sie, pflegen sie und halten sie aktuell, mit Ihrem Domainnamen auf Ihren Namen eingetragen. Ihre llms.txt und Ihre robots.txt sagen, was Sie entschieden haben, und werden überarbeitet, wenn sich Ihre Seiten ändern. Schreiben Sie uns, wir sehen uns Ihren Fall gemeinsam an.
Simafri
Sprechen wir über Ihr Vorhaben
Sagen Sie uns in wenigen Worten, was Sie brauchen: Wir melden uns schnell bei Ihnen.
Vielen Dank! Ihre Anfrage wurde gesendet. Wir melden uns in Kürze bei Ihnen.
Sie schreiben lieber eine E-Mail? Schreiben Sie uns an support@simafri.com.