KI-Suche
llms.txt erklärt: was die Datei kann und was nicht.
Was ist eine llms.txt? Aufbau, Beispiel von wemodo.de, Unterschied zu robots.txt und Sitemap, und warum sie kein Standard ist, den alle KI-Anbieter lesen.
- Veröffentlicht
- 7. Oktober 2026
- Lesezeit
- 5 Minuten
- Autor
- Enver Eser
Seit 2024 taucht in Gesprächen über KI-Suche eine Datei auf, die es vorher nicht gab: llms.txt. Manche Anbieter verkaufen sie als Schlüssel, um in ChatGPT genannt zu werden. Das ist sie nicht. Sie ist aber auch nicht nutzlos. Hier steht, was sich belegen lässt.
Was ist eine llms.txt?
Eine llms.txt ist eine Textdatei im Markdown-Format, die unter /llms.txt im Hauptverzeichnis einer Website liegt. Sie fasst zusammen, wer hinter der Seite steht, was dort angeboten wird und welche Seiten für welche Frage die richtigen sind. Gedacht ist sie für Sprachmodelle, die eine Website nicht Seite für Seite durchsuchen wollen, sondern in einem Abruf das Wesentliche brauchen.
Den Vorschlag hat der KI-Entwickler Jeremy Howard veröffentlicht. Die Seite llmstxt.org nennt als Datum den 3. September 2024. Die Begründung dort: Websites sind für Menschen gebaut, mit Navigation, Werbung und Skripten. Für ein Sprachmodell mit begrenztem Kontextfenster ist das viel Ballast um wenig Inhalt.
Ist llms.txt ein offizieller Standard?
Nein. llms.txt ist ein Vorschlag, den jeder umsetzen kann, aber keine Norm, an die sich Anbieter halten müssen. Kein Gremium hat ihn verabschiedet, und welche KI-Anbieter die Datei bei der Antwortsuche lesen, legen die meisten nicht offen.
Eine Aussage gibt es von Google, und die ist eindeutig. In der Doku zu den KI-Funktionen der Suche schreibt Google, dass man keine neuen maschinenlesbaren Dateien, KI-Textdateien oder besonderes Markup braucht, um in den KI-Übersichten oder im KI-Modus zu erscheinen. Wer eine llms.txt für Google anlegt, legt sie umsonst an.
Stand: Oktober 2026. Wer Ihnen eine llms.txt als Garantie für Nennungen in ChatGPT oder Perplexity verkauft, verspricht mehr, als sich belegen lässt.
Wofür lohnt sich eine llms.txt dann?
Für Fälle, in denen ein Werkzeug oder Assistent die Datei gezielt abruft. Eine kurze Zusammenfassung in Markdown ist für ein Modell leichter auszuwerten als eine Startseite mit Navigation, Animationen und Skripten. Verbreitet ist das Format vor allem bei Dokumentation: llmstxt.org nennt etwa die Doku-Plattformen Mintlify und GitBook, die die Datei erzeugen, und das WordPress-Plugin Yoast SEO.
Der Aufwand ist klein, wenn die Datei aus denselben Daten entsteht wie die Website. Dann kann sie nicht veralten, und sie kostet nach dem Einrichten keine Pflege. Eine von Hand geschriebene llms.txt, die nach einem Jahr andere Leistungen nennt als die Website, schadet eher.
Wie ist eine llms.txt aufgebaut?
Laut Vorschlag ist nur eine Überschrift erster Ebene mit dem Namen der Seite Pflicht. Alles andere ist optional, folgt aber einer festen Reihenfolge.
- Überschrift erster Ebene (# Name): der Name des Projekts oder der Website. Pflicht.
- Ein Zitatblock (> …): eine kurze Zusammenfassung mit dem Wichtigsten.
- Beliebig viele Absätze oder Listen ohne Überschriften: weitere Angaben zur Seite.
- Abschnitte mit Überschriften zweiter Ebene (## …), darin Listen von Links im Format [Name](Adresse): Notiz.
- Optional ein Abschnitt „## Optional“ mit Links, die ein Modell überspringen kann, wenn es wenig Platz hat.
Der Vorschlag regt außerdem an, wichtige Seiten zusätzlich als reine Markdown-Fassung unter derselben Adresse mit angehängtem .md bereitzustellen. Für eine Firmenwebsite mit zwanzig Seiten ist das meist mehr Aufwand als Nutzen.
Wie sieht die llms.txt von wemodo.de aus?
Die llms.txt von wemodo.de wird beim Bauen der Seite aus denselben Konfigurationsdateien erzeugt wie die Website. Sie folgt dem Aufbau von llmstxt.org und trägt bewusst mehr Substanz als nur Links, weil sie in einem Abruf die häufigsten Fragen beantworten soll.
| Abschnitt | Inhalt | Warum |
|---|---|---|
| # Wemodo und Zitatblock | Name, Leitsatz, Gründer, Sitz in Burgau, Telefon, E-Mail | Wer, wo, wie erreichbar: die Grundfakten zuerst |
| ## Leistungen | Jede Leistung mit einem Satz und Link zur Detailseite | Beantwortet „Was macht Wemodo?“ |
| ## Eigenes Produkt: Werkerly | Kurzbeschreibung, Store-Adressen, Funktionen, Technik | Beantwortet „Baut Wemodo auch Apps?“ mit prüfbaren Links |
| ## Zwei Wege | Framer und eigener Code im Vergleich, mit Dauer und Grenzen | Die Vergleichsfrage ausgeschrieben statt nur verlinkt |
| ## Projekte | Kundenprojekte mit Jahr, Kurzbeschreibung und Live-Adresse | Belege, die ein Modell selbst aufrufen kann |
| ## Seiten, ## Fallstudien, ## Blog | Jede Seite mit ihrer Beschreibung | Welche Seite welche Frage beantwortet |
| ## Rechtliches | Datenschutz, Impressum erst wenn vollständig | Keine unfertige Rechtsseite als Quelle |
Ein Detail daraus: Das Impressum steht nur in der Datei, wenn es vollständig ist. Solange Pflichtangaben fehlen, trägt die Seite noindex, und dieselbe Bedingung gilt für Sitemap und llms.txt. Wer einen Ratgeber wie diesen ergänzt, muss die llms.txt nicht anfassen. Der neue Beitrag erscheint dort von selbst.
Bei Schrott Ulm steht in der llms.txt ausdrücklich, dass der Betriebssitz in Burgau liegt und in Orten in und um Ulm abgeholt wird. Ein Modell, das nach einem Anbieter in Ulm gefragt wird, kann die Entfernung damit selbst einordnen.
Firmensitz und Zielmarkt: wie Schrott Ulm ohne Ulmer Adresse gefunden wird
Was ist der Unterschied zwischen robots.txt, Sitemap und llms.txt?
Die robots.txt regelt, wer was lesen darf. Die Sitemap listet, welche Seiten es gibt. Die llms.txt erklärt, worum es geht. Die drei Dateien ersetzen einander nicht.
| Merkmal | robots.txt | sitemap.xml | llms.txt |
|---|---|---|---|
| Zweck | Zugriff für Crawler erlauben oder sperren | Alle Seiten mit Änderungsdatum auflisten | Inhalt der Website für Sprachmodelle zusammenfassen |
| Format | Textzeilen nach festem Schema | XML | Markdown |
| Leser | Alle Crawler, die sich daran halten | Suchmaschinen | Sprachmodelle und Werkzeuge, die das Format kennen |
| Status | Standardisiert (RFC 9309) | Etabliertes Protokoll (sitemaps.org) | Vorschlag, kein Standard |
| Für Google nötig? | Nein, aber empfohlen für Steuerung | Nein, aber hilfreich | Nein, laut Google ausdrücklich nicht |
Was sind Content-Signals?
Content-Signals sind eine Zeile in der robots.txt, die sagt, wofür Inhalte verwendet werden dürfen. Cloudflare hat das Format im September 2025 als Content Signals Policy vorgestellt. Es kennt drei Signale: search für Suchindex und Treffer mit Link und Auszug, ai-input für die Verwendung als Quelle in KI-Antworten und ai-train für das Training von Modellen.
Auf wemodo.de steht: search=yes, ai-input=yes, ai-train=no. Als Quelle genannt werden ja, als Trainingsmaterial dienen nein. Die robots.txt regelt damit das Wofür, die llms.txt das Was. Beide sind Angebote an die Crawler. Durchsetzen lässt sich keines davon technisch.
In ChatGPT gefunden werden: welche Crawler Sie zulassen sollten
Brauche ich eine llms.txt?
Wenn Ihre Website aus einer Konfiguration gebaut wird und die Datei dabei von selbst entsteht: ja, es kostet nichts. Wenn Sie sie von Hand pflegen müssten: Kümmern Sie sich zuerst um robots.txt, strukturierte Daten und Inhalte, die Fragen klar beantworten. Das wirkt bei Google und bei jeder KI-Suche, die Ihre Seiten liest. Die llms.txt wirkt nur dort, wo ein Anbieter sie auswertet.
Auf der Seite zur KI-Sichtbarkeit steht, wie ich diese Bausteine bei Kundenseiten einrichte.
Sichtbarkeit in KI-Suchen für Betriebe
Quellen
- llmstxt.org: The /llms.txt file (Jeremy Howard, 2024)
- Google Search Central: KI-Funktionen und Ihre Website
- Cloudflare: Content Signals Policy
- RFC 9309: Robots Exclusion Protocol
- sitemaps.org: Sitemap-Protokoll
Veröffentlicht am von Enver Eser. Themenfeld: KI-Suche.
Wo muss die llms.txt liegen?
Im Hauptverzeichnis der Domain, also unter ihredomain.de/llms.txt, genau wie die robots.txt. Die Datei ist reines Markdown und wird als Text ausgeliefert.
Liest ChatGPT die llms.txt?
Öffentlich bestätigt hat OpenAI das nicht. Belegt ist nur, dass OAI-SearchBot Seiten für die Suche in ChatGPT erfasst. Ob dabei die llms.txt gesondert ausgewertet wird, legt OpenAI nicht offen.
Kann eine llms.txt schaden?
Nur wenn sie etwas anderes sagt als die Website. Eine veraltete Datei mit alten Leistungen oder Preisen liefert einem Modell falsche Fakten. Deshalb sollte sie aus denselben Daten entstehen wie die Seiten selbst.
Ersetzt die llms.txt die Sitemap?
Nein. Die Sitemap listet alle Seiten mit Änderungsdatum für Suchmaschinen. Die llms.txt fasst das Wichtigste für Sprachmodelle zusammen und muss nicht jede Seite enthalten.
Mehr zum Thema.
In ChatGPT gefunden werden: was ein Betrieb dafür tun kann
In ChatGPT, Perplexity und Googles KI-Übersicht gefunden werden: welche Crawler Sie zulassen, was auf die Seite gehört und was niemand versprechen kann.Strukturierte Daten für kleine Betriebe: welches Schema Sie wirklich brauchen
Strukturierte Daten nach schema.org für kleine Betriebe: LocalBusiness, Service mit Einzugsgebiet, BreadcrumbList, @id und was aus FAQPage geworden ist.Website nicht barrierefrei: welche Folgen das BFSG vorsieht
Website nicht barrierefrei trotz BFSG-Pflicht? Wer kontrolliert, wie das Verfahren abläuft, welche Bußgelder drohen und was Sie jetzt tun sollten.
Kontakt
Erzählen Sie mir von Ihrem Projekt.
Website, Relaunch, Software oder App: Füllen Sie die Lücken aus, der Rest ist ein kurzer Brief. Das Erstgespräch ist unverbindlich.
Ich antworte werktags innerhalb von 24 Stunden, selbst und ohne Textbaustein. Im ersten Gespräch sehe ich mir Ihren Auftritt an und sage, was ich zuerst ändern würde, auch wenn Sie danach nicht mit Wemodo arbeiten.
Danach wissen Sie, was das Projekt kostet und wie lange es dauert.
An Enver Eser Wemodo · Burgau
