llms.txt Validator
Prüft die llms.txt einer Domain gegen die Spezifikation – und getrennt davon gegen das, was sich in der Praxis bewährt hat.
Was llms.txt ist
Eine Textdatei im Wurzelverzeichnis einer Domain, die Sprachmodellen in kompakter Form beschreibt, worum es auf der Website geht und welche Seiten die wichtigen sind. Gedacht als Gegenstück zur robots.txt – nicht als Zugriffsregel, sondern als Inhaltsverzeichnis.
Es handelt sich um einen Vorschlag der Community, nicht um einen offiziellen Standard einer Suchmaschine. Ob und wie stark Anbieter die Datei auswerten, ist offen. Der Aufwand ist allerdings gering, und die Datei zwingt zu einer Entscheidung, welche Seiten wirklich die wichtigsten sind – das ist auch ohne Maschine nützlich.
Prüfen
Es reicht die Domain – geprüft wird automatisch
https://[domain]/llms.txt. Wer bereits Properties verbunden hat, kann sie
aus der Liste wählen, statt die Adresse einzutippen.
Existiert keine Datei, sagt das Ergebnis genau das – das ist kein Fehler, sondern der häufigste Ausgangszustand.
Was im Ergebnis steht
- Score als Gesamteinschätzung, dazu die Zahl der bestandenen Prüfungen und der Warnungen.
- Erkannte Struktur – Titel, Beschreibung, gefundene Abschnitte und die Zahl der Links je Abschnitt. Hier fällt schnell auf, wenn die Datei zwar existiert, aber leer strukturiert ist.
- Spec-Compliance – Prüfung gegen die Spezifikation von llmstxt.org: Aufbau, Reihenfolge, Formatierung.
- Best Practices – Empfehlungen darüber hinaus, etwa zu Umfang und Verständlichkeit der Beschreibungen.
- Vorschau des Dateiinhalts, um Befunde direkt zuzuordnen.
Was in eine gute llms.txt gehört
- Ein Titel und zwei bis drei Sätze, worum es geht – ohne Marketingsprache, weil die hier nichts nützt
- Abschnitte nach Themen, nicht nach Menüstruktur
- Links mit einer kurzen Beschreibung, wofür die Seite gut ist
- Die wichtigsten zwanzig bis fünfzig Seiten, nicht alle
Der Onpage-Crawler prüft die Datei ebenfalls mit, wenn er über eine Website läuft – siehe Onpage-Crawler.