Seit Anfang 2025 fragen uns Kunden regelmäßig, ob sie eine llms.txt brauchen. Meistens nachdem ein Tool sie als fehlend markiert hat. Die ehrliche Antwort ist unspektakulärer, als die meisten Artikel dazu klingen: Die Datei schadet nicht, kostet wenig und bringt nach heutigem Stand fast nichts für deine Sichtbarkeit in ChatGPT oder Google. Warum das so ist, wie du sie trotzdem richtig anlegst und was stattdessen wirkt, steht hier. Mit eigener Messung an 267 Websites.
Was ist eine llms.txt?
Eine llms.txt ist eine Textdatei im Markdown-Format, die im Stammverzeichnis einer Website liegt, also unter domain.de/llms.txt. Sie fasst für Sprachmodelle und KI-Agenten zusammen, worum es auf der Website geht, und verlinkt die wichtigsten Seiten mit je einem Satz Beschreibung.
Vorgeschlagen hat das Format Jeremy Howard von Answer.AI im September 2024, die Spezifikation steht auf llmstxt.org. Die Idee dahinter ist nachvollziehbar: Eine normale Website besteht aus Navigation, Cookie-Bannern, Skripten und Layout. Ein Sprachmodell, das schnell verstehen soll, worum es geht, muss sich durch all das durcharbeiten. Die llms.txt liefert die Essenz in Markdown, ohne Ballast.
Wichtig für die Einordnung: Es ist ein Vorschlag, kein Standard. Es gibt kein Gremium, keine Pflicht und keine Zusage eines großen KI-Anbieters, die Datei auszuwerten. Genau das unterscheidet sie von der robots.txt, die jeder seriöse Crawler beachtet.
Aufbau und Beispiel: so sieht eine llms.txt aus
Die Spezifikation ist kurz. Pflicht ist nur eine Überschrift erster Ebene mit dem Namen. Alles andere ist empfohlen: ein Zitatblock mit der Zusammenfassung, optional freier Text, dann Abschnitte mit Linklisten. Unten siehst du einen gekürzten Ausschnitt unserer eigenen Datei, die du live unter iceagemedia.com/llms.txt abrufen kannst. Fahr mit der Maus über eine Zeile, dann leuchtet die passende Erklärung darunter auf.
1# Ice Age Media23> Digitalagentur aus Butzbach in der Wetterau. Wir bauen4> Websites, die gefunden werden und Anfragen bringen.56Websites entstehen auf Framer und gehen in rund zwei7Wochen live, Einstieg ab 6.000 €.89## Leistungen10- [Website erstellen lassen](https://www.iceagemedia.com/website-erstellung): Neue11 Unternehmenswebsite auf Framer, ab 6.000 €.12- [GEO Optimierung](https://www.iceagemedia.com/geo-optimierung): Sichtbarkeit13 in ChatGPT, Perplexity und Google AI Overviews.1415## Optional16- [Impressum](https://www.iceagemedia.com/impressum)
- 1Zeile 1
Pflicht. Genau eine H1 mit dem Namen der Firma oder Website. - 2Zeile 3
Zusammenfassung als Zitatblock. Das ist der Satz, den ein Modell am ehesten übernimmt. Konkret statt Werbesprache. - 3Zeile 6
Freier Text für Fakten, die nirgends sonst stehen: Preise, Standort, Arbeitsweise. - 4Zeile 9
H2 gruppiert Links. Halte die Gruppen so, wie ein Kunde denkt, nicht wie dein Menü. - 5Zeile 10
Ein Link pro Zeile, Doppelpunkt, dann ein Satz, wofür die Seite gut ist. - 6Zeile 15
Laut Spezifikation darf ein Modell diesen Abschnitt weglassen, wenn der Platz knapp wird.
Zwei Dinge fallen auf, wenn man viele dieser Dateien liest. Erstens schreiben die meisten ihre Zusammenfassung wie einen Werbeslogan. Ein Modell kann mit "Ihr Partner für digitale Exzellenz" nichts anfangen, mit "Digitalagentur aus Butzbach, Websites ab 6.000 Euro" sehr wohl. Zweitens fehlen fast immer die Fakten, die sonst nirgends maschinenlesbar stehen: Preise, Einzugsgebiet, Lieferzeit. Genau die gehören in den freien Textteil.
llms.txt, robots.txt und sitemap.xml im Vergleich
Die drei Dateien liegen alle im Stammverzeichnis und werden deshalb ständig verwechselt. Sie haben aber völlig unterschiedliche Aufgaben.
| llms.txt | robots.txt | sitemap.xml | |
|---|---|---|---|
| Zweck | Beschreibt, was es gibt | Regelt, wer was abrufen darf | Listet alle Adressen |
| Format | Markdown | eigene Syntax | XML |
| Zielgruppe | Sprachmodelle, Agenten | alle Crawler | Suchmaschinen |
| Von Google genutzt | nein | ja | ja |
| Von KI-Crawlern beachtet | nicht dokumentiert | ja, alle großen | teilweise |
| Pflicht | nein | nein, aber dringend empfohlen | nein, aber empfohlen |
Die Zeile, auf die es ankommt, ist die vorletzte. Wenn du steuern willst, ob ChatGPT, Claude oder Perplexity deine Inhalte sehen, ist die robots.txt der einzige Hebel, den alle Anbieter offiziell beachten. Die llms.txt kommt danach.
llms.txt oder llms-full.txt: welche Variante wofür
Neben der kurzen Datei hat sich eine zweite eingebürgert, die llms-full.txt. Sie steht nicht im Kern der Spezifikation, wird aber von vielen Dokumentationsplattformen automatisch mit ausgeliefert.
| llms.txt | llms-full.txt | |
|---|---|---|
| Inhalt | Inhaltsverzeichnis mit Links | kompletter Text aller Seiten |
| Größe | wenige Kilobyte | oft mehrere Megabyte |
| Sinnvoll für | jede Website | Software-Dokus, Wissensdatenbanken |
| Pflegeaufwand | bei neuen Seiten | bei jeder Textänderung |
Für eine Unternehmenswebsite mit zehn bis fünfzig Seiten ist die Antwort klar: nur die kurze Variante. Eine llms-full.txt, die nicht automatisch aus dem System erzeugt wird, veraltet beim ersten Texttausch und erzählt dann etwas anderes als deine Website. Das ist schlechter als gar keine.
Lesen ChatGPT, Claude, Perplexity und Google die Datei?
Das ist die Frage, an der sich der Nutzen entscheidet, und sie wird in vielen Artikeln großzügig beantwortet. Wir haben die offiziellen Dokumentationen der Anbieter gelesen und die Aussagen ihrer Vertreter gesammelt. Stand: 11. Oktober 2026.
Google sagt, für AI Overviews und den KI-Modus brauchst du keine Sonderdateien. John Mueller hat im Podcast Search Off the Record erklärt, warum: Eine Selbstbeschreibung kann jede Website schreiben, ein Modell kann damit keine Anbieter unterscheiden.
Die Crawler-Dokumentation von OpenAI steuert GPTBot, OAI-SearchBot und ChatGPT-User über die robots.txt. Die llms.txt kommt dort nicht vor. Einzelne Logauswertungen sehen Abrufe der Datei, andere kaum welche. Ein Abruf ist noch keine Auswertung.
Anthropic stellt die eigene Dokumentation als llms.txt bereit. Dass ClaudeBot die Dateien fremder Websites auswertet, steht in keiner Anbieterdokumentation.
PerplexityBot und Perplexity-User werden über die robots.txt gesteuert. Eine Aussage zur llms.txt gibt es von Perplexity nicht.
Coding-Assistenten und KI-Agenten laden Dokumentationen gezielt über llms.txt und llms-full.txt. Für Software-Dokus ist das ein echter Gewinn, für eine Unternehmensseite ein kleiner.
Das Bild ist eindeutig: Kein großer Anbieter einer KI-Suche hat zugesagt, die llms.txt fremder Websites auszuwerten. Google hat sich sogar ausdrücklich dagegen positioniert. Das kann sich ändern, und deshalb datieren wir diesen Abschnitt. Wer dir heute verspricht, eine llms.txt bringe dich in ChatGPT-Antworten, verkauft eine Hoffnung.
Eigene Messung: wer hat schon eine llms.txt?
Weil wir zu Verbreitung nur Schätzungen gefunden haben, haben wir am 11. Oktober 2026 selbst nachgesehen. Zwei Stichproben: 101 Websites kleiner und mittlerer Unternehmen, mit denen wir 2026 zu tun hatten, also Kunden, Anfragen und Audits. Dazu 166 Domains von Agenturen und Fachseiten, die in Google zu Themen wie SEO, Landingpages und KI-Sichtbarkeit ranken. Gezählt hat nur eine echte Textdatei mit Status 200, keine HTML-Fehlerseite unter derselben Adresse.
Aufgeschlüsselt nach System wird das Bild deutlich. Alle acht Wix-Seiten der Stichprobe haben eine llms.txt, weil Wix sie automatisch erzeugt, samt einer KI-generierten Beschreibung, die niemand gegengelesen hat. Bei WordPress sind es sechs von vierzig, und auch dort ist ein Teil von SEO-Plugins erzeugt. Bei Framer sind es drei von acht, und die drei haben wir selbst angelegt. Bewusst geschrieben hat die Datei also kaum ein Mittelständler.
Bei den Agenturen sieht es anders aus: 80 von 166 Domains liefern eine llms.txt aus, das sind 48 Prozent. Zehn davon stammen erkennbar aus WordPress-Plugins (Rank Math acht, Yoast und All in One SEO je eine) und beginnen mit einem Generator-Hinweis statt mit dem Namen. Die Branche, die die Datei verkauft, hat sie also zur Hälfte. Ihre Kunden zu einem Viertel, und dann meist ohne es zu wissen.
Ein Nebenbefund aus derselben Messung, der wichtiger ist als die llms.txt selbst: Von den 91 KMU-Websites mit robots.txt nennen nur acht überhaupt einen KI-Crawler, und keine einzige sperrt einen aus. Die Tür steht bei fast allen offen. Woran es hakt, ist meist das, was die Crawler dahinter vorfinden.
Generator: deine llms.txt in zwei Minuten
Für eine kleine Website brauchst du kein Tool, aber ein Gerüst spart Tippfehler. Trag unten Name, Zusammenfassung und deine wichtigsten Seiten ein. Die Datei entsteht live rechts daneben, du kannst sie kopieren oder direkt herunterladen. Es wird nichts gespeichert und nichts verschickt.
# Malerbetrieb Muster > Meisterbetrieb für Innen- und Fassadenarbeiten in Gießen und Umgebung, seit 1998. Privat- und Gewerbekunden, Angebot innerhalb von 48 Stunden. Einzugsgebiet: 30 km um Gießen Termine meist innerhalb von drei Wochen ## Seiten - [Leistungen](https://www.beispiel.de/leistungen): Innenanstrich, Fassade, Tapezieren - [Fassadensanierung](https://www.beispiel.de/fassade): Ablauf, Förderung und Referenzen - [Referenzen](https://www.beispiel.de/referenzen): Projekte mit Fotos vorher und nachher - [Kontakt](https://www.beispiel.de/kontakt): Telefon, Anfrageformular, Anfahrt ## Optional - [Impressum](https://www.beispiel.de/impressum)
Anleitung: llms.txt in fünf Schritten erstellen
- 01Seiten auswählen
Schreib die zehn bis dreißig Seiten auf, die du einem neuen Kunden zeigen würdest. Leistungen, Preise, Referenzen, Über uns, Kontakt. Kein Blog-Archiv, keine Tag-Seiten.
- 02Zusammenfassung schreiben
Ein bis zwei Sätze: wer du bist, was du anbietest, für wen und wo. Lies sie laut vor. Wenn sie wie ein Slogan klingt, schreib sie um.
- 03Fakten ergänzen
Preise ab, Einzugsgebiet, Lieferzeit, Zertifizierungen. Alles, was ein Interessent fragt und was sonst nur verstreut auf der Website steht.
- 04Datei anlegen
Im Generator oben oder in einem Texteditor. Als llms.txt speichern, Kodierung UTF-8, damit Umlaute stimmen.
- 05Hochladen und prüfen
Ins Stammverzeichnis legen, im Browser aufrufen, mit curl -I den Content-Type prüfen. Dann einen Termin im Kalender, in sechs Monaten wieder reinzuschauen.
llms.txt in Framer, WordPress, Wix und Shopify einrichten
Framer
Framer kann statische Dateien inzwischen selbst ausliefern. Im Dashboard unter Domains den Bereich Files öffnen und die llms.txt hochladen, danach ist sie unter deiner Domain erreichbar. Die Funktion gibt es laut Framer ab dem Pro-Tarif. Wir liefern unsere eigene über eine vorgeschaltete Cloudflare-Schicht aus, weil wir dort ohnehin seitenspezifisches Schema und HTTP-Header setzen. Für die meisten Framer-Seiten reicht der Upload.
WordPress
Rank Math, Yoast und All in One SEO erzeugen die Datei auf Knopfdruck. Bequem, aber prüf das Ergebnis: Die Plugin-Dateien aus unserer Messung beginnen mit einem Hinweis auf das Plugin statt mit deinem Namen und sind teils sehr lang, weil sie einfach alle Beiträge auflisten. Besser ist es, die automatische Erzeugung abzuschalten und eine handgeschriebene Datei per FTP ins Stammverzeichnis zu legen.
Wix
Wix legt die Datei automatisch an. Ruf sie auf und lies sie. In unserer Stichprobe standen dort Sätze wie "Die Website betont die Bedeutung von" über Firmen, die das nie so formulieren würden. Du kannst die Datei bei Wix bearbeiten. Sobald du das tust, stoppen die automatischen Aktualisierungen, du musst sie dann selbst pflegen.
Shopify
Shopify erlaubt keine freie Datei im Stammverzeichnis. Der übliche Weg ist eine App aus dem Shopify App Store oder eine Weiterleitung von /llms.txt auf eine Datei im Dateibereich. Prüf danach mit curl, ob wirklich Text ausgeliefert wird und keine Shop-Seite.
Was für KI-Sichtbarkeit mehr bringt als eine llms.txt
Wenn du eine Stunde Zeit für KI-Sichtbarkeit hast, steck höchstens zehn Minuten in die llms.txt. Der Rest gehört in Dinge, die nachweislich wirken. In der Reihenfolge, in der wir sie bei Kunden prüfen:
- Der Inhalt steht im HTML. Viele moderne Websites liefern Text erst per JavaScript aus oder blenden ihn mit Animationen ein, die beim ersten Laden unsichtbar sind. Mehrere KI-Crawler führen kein JavaScript aus und sehen dann eine leere Seite. Das ist der häufigste und teuerste Fehler, den wir finden.
- Die robots.txt lässt die richtigen Crawler rein. GPTBot und OAI-SearchBot, ClaudeBot, PerplexityBot. Wer einen davon aus Versehen sperrt, ist dort unsichtbar, egal was in der llms.txt steht.
- Bing kennt deine Seite. ChatGPT sucht im Web über den Bing-Index. Bing Webmaster Tools einrichten und neue Seiten dort einreichen kostet eine halbe Stunde und wird fast immer vergessen.
- Klare Antworten im Text. Wer auf eine Frage im ersten Satz antwortet, wird zitiert. Wer drei Absätze Anlauf nimmt, nicht. Tabellen und Definitionen funktionieren besonders gut.
- Erwähnungen auf fremden Seiten. Modelle empfehlen, was andere empfehlen. Branchenverzeichnisse, Bewertungsportale, Fachartikel. Das ist die langsamste Stellschraube und die wirksamste.
Wie das systematisch aussieht und wie man es misst, beschreiben wir auf unserer Seite zur GEO-Optimierung. Wenn du erst einmal wissen willst, wo du stehst, hilft die KI-Sichtbarkeits-Checkliste mit 28 Prüfpunkten.
Typische Fehler bei der llms.txt
- Die Adresse liefert eine HTML-Seite. Viele Systeme zeigen unter jeder unbekannten Adresse eine gestaltete Fehlerseite mit Status 200. Für ein Tool sieht das aus wie eine vorhandene Datei, für ein Modell ist es Müll.
- Werbesprache in der Zusammenfassung. "Innovativ", "ganzheitlich" und "Ihr Partner für" tragen keine Information. Ein Satz mit Branche, Ort und Angebot schon.
- Alle Seiten auf einmal. Eine llms.txt mit vierhundert Links ist keine Übersicht mehr. Nimm die zehn bis dreißig Seiten, die du einem neuen Kunden zeigen würdest.
- Veraltete Preise und Leistungen. Die Datei wird beim Relaunch vergessen und erzählt dann ein Jahr lang Dinge, die nicht mehr stimmen.
- Die Erwartung, dass sie etwas Großes bewirkt. Wer nach dem Hochladen auf mehr Anfragen wartet, wird enttäuscht und investiert danach oft gar nicht mehr in KI-Sichtbarkeit. Das wäre der eigentliche Schaden.
Die llms.txt ist das Schild an der Tür. Ob jemand reinkommt, entscheidet, was hinter der Tür steht.
Häufige Fragen
Was bringt eine llms.txt?
Sie gibt Sprachmodellen und KI-Agenten eine kurze, saubere Übersicht deiner Website mit den wichtigsten Links. Messbar mehr Nennungen in ChatGPT oder Google bringt sie nach heutigem Stand nicht, weil keiner der großen Anbieter dokumentiert, dass er sie auswertet. Sinnvoll ist sie als günstige Ergänzung, nicht als Strategie.
Ist eine llms.txt Pflicht?
Nein. Es ist ein Vorschlag aus dem September 2024, kein Standard und keine gesetzliche oder technische Pflicht. Deine Seite wird ohne die Datei genauso gecrawlt und indexiert.
Wo muss die llms.txt liegen?
Im Stammverzeichnis deiner Domain, also unter deinedomain.de/llms.txt. Sie muss als reine Textdatei ausgeliefert werden, mit Status 200 und ohne Weiterleitung auf eine HTML-Seite.
Schadet eine llms.txt meinem Google-Ranking?
Nein. Google ignoriert die Datei für das Ranking. Sie kann allenfalls selbst in den Suchergebnissen auftauchen, wenn sie indexiert wird. Wer das nicht will, setzt einen X-Robots-Tag noindex auf die Datei.
Was ist der Unterschied zwischen llms.txt und llms-full.txt?
Die llms.txt ist ein Inhaltsverzeichnis mit Links und Kurzbeschreibungen. Die llms-full.txt enthält den vollständigen Text aller verlinkten Seiten in einer Datei. Für eine Unternehmenswebsite reicht die kurze Variante, die lange lohnt sich bei umfangreichen Dokumentationen.
Wie prüfe ich, ob meine llms.txt erreichbar ist?
Ruf deinedomain.de/llms.txt im Browser auf. Du solltest reinen Text sehen, keine gestaltete Seite. Im Terminal zeigt curl -I deinedomain.de/llms.txt den Status und den Content-Type, der mit text/plain oder text/markdown beginnen sollte.
Brauche ich einen llms.txt-Generator?
Nicht zwingend. Für eine Website mit zehn bis dreißig Seiten schreibst du die Datei in einer Viertelstunde von Hand, und sie wird besser, weil du die Beschreibungen selbst formulierst. Generatoren lohnen sich bei großen Seiten mit vielen Unterseiten.
Ersetzt die llms.txt die robots.txt?
Nein. Die robots.txt regelt, welcher Crawler was abrufen darf, und wird von allen großen KI-Anbietern beachtet. Die llms.txt beschreibt nur, was es gibt. Wer KI-Crawler aussperren oder zulassen will, macht das ausschließlich in der robots.txt.
Weiterlesen
Erst gefunden werden, dann zitiert werden.
Wir zeigen dir, ob ChatGPT, Perplexity und Google deine Firma heute nennen, und was als Nächstes den größten Unterschied macht.
Kostenloses Erstgespräch
