Was ist llms.txt und wer braucht es?
llms.txt ist eine Markdown-Datei im Stammverzeichnis einer Website (deine-domain.de/llms.txt), die KI-Systemen einen kuratierten Überblick über die wichtigsten Inhalte gibt: was die Site ist, welche Seiten zählen und wo sie liegen. Der Vorschlag stammt von Jeremy Howard (Answer.AI, September 2024). Anders als robots.txt steuert sie keinen Zugriff, sondern hilft Sprachmodellen beim Verstehen.
- Eine Markdown-Datei unter /llms.txt: Kurzbeschreibung plus kuratierte Linkliste.
- robots.txt steuert Zugriff, sitemap.xml listet alles, llms.txt kuratiert das Wichtige.
- Aufwand: unter einer Stunde. Risiko: praktisch keins.
- Ein offizieller Standard ist es (noch) nicht, aber ein wachsendes Ökosystem.
Was steht in einer llms.txt?
Das Format ist bewusst simpel und für Sprachmodelle gemacht: reines Markdown, keine Konfigurationssyntax.
- H1: der Name der Website oder des Produkts.
- Blockquote: ein bis drei Sätze, die das Angebot zusammenfassen.
- H2-Sektionen: kuratierte Linklisten, jeder Link mit einem Satz Kontext (etwa „Pages", „Docs", „Legal").
Ein lebendes Beispiel liest du unter flize.io/llms.txt: genau diese Struktur, gepflegt bei jedem neuen Inhalt.
llms.txt vs. robots.txt vs. sitemap.xml
Die drei Dateien werden oft verwechselt, lösen aber verschiedene Probleme:
- robots.txt steuert Zugriff: Welche Crawler dürfen welche Pfade lesen?
- sitemap.xml listet vollständig: alle URLs, für systematisches Crawling.
- llms.txt kuratiert: die wichtigsten Inhalte mit Kontext, damit ein Sprachmodell die Site schnell und richtig einordnet.
Kurz: robots.txt sagt „dürfen", sitemap.xml sagt „finden", llms.txt sagt „verstehen".
Wer braucht llms.txt (und wer nicht)?
Besonders lohnend ist die Datei für Websites mit erklärungsbedürftigem Angebot: SaaS-Produkte, Dokumentationen, Agenturen, Shops mit klaren Kategorien, Fachpublikationen. Überall dort entscheidet der erste Eindruck der Maschine, ob deine Inhalte als Quelle taugen. Wenig bringt sie reinen Bild-Portfolios oder Sites, deren Inhalte ohnehin aus einer einzigen Seite bestehen.
Wie legst du eine llms.txt an?
Vier Schritte, realistisch unter einer Stunde:
- 1. Kernseiten sammeln: die 10 bis 30 Seiten, die dein Angebot wirklich erklären.
- 2. Je Seite ein Satz: was beantwortet diese Seite, für wen?
- 3. Als Markdown speichern und unter /llms.txt im Root veröffentlichen.
- 4. Aktuell halten: jeder neue relevante Inhalt bekommt eine Zeile.
Wird llms.txt überhaupt gelesen?
Die ehrliche Antwort: Verbindliche Zusagen der großen KI-Anbieter gibt es nicht, llms.txt ist ein offener Community-Vorschlag (llmstxt.org) mit wachsender Verbreitung, unter anderem in Dokumentations-Ökosystemen. Googles John Mueller verglich die Datei im April 2025 sogar mit dem längst bedeutungslosen Keywords-Meta-Tag: Kein KI-Dienst habe bestätigt, sie zu nutzen, und in Server-Logs frage sie praktisch niemand ab (Search Engine Journal, 2025). Die Rechnung bleibt trotzdem eindeutig: Kosten und Risiko liegen nahe null, und jede Maschine, die die Datei nutzt, bekommt sauberen Kontext statt Rätselraten. Als Teil eines GEO-Setups gehört sie zur Grundausstattung.
Ist llms.txt ein offizieller Standard?
+
Nein. Es ist ein offener Vorschlag von Jeremy Howard (Answer.AI) aus dem September 2024, dokumentiert auf llmstxt.org. Die Verbreitung wächst, eine offizielle Standardisierung steht aus.
Ersetzt llms.txt robots.txt oder sitemap.xml?
+
Nein, sie ergänzt beide. Zugriffssteuerung bleibt Aufgabe der robots.txt, die vollständige URL-Liste liefert weiterhin die sitemap.xml.
Was ist llms-full.txt?
+
Eine verbreitete Ergänzung, die statt kuratierter Links die kompletten Inhalte in einer Datei bündelt, für Systeme, die eine Site in einem Rutsch einlesen wollen. Sie stammt nicht aus der Spezifikation von llmstxt.org, dort sind nur die generierten Dateien llms-ctx.txt und llms-ctx-full.txt beschrieben, sondern hat sich über Doku-Plattformen als Konvention etabliert. Für die meisten Websites reicht die normale llms.txt.
Wie prüfe ich meine llms.txt?
+
Rufe die Datei im Browser unter deiner-domain.de/llms.txt auf, prüfe Markdown-Syntax und Links. Ein GEO-Audit wie der flize Score prüft die Datei automatisch mit.