KI-Sichtbarkeit

llms.txt: was die Datei ist, wie du sie anlegst und was sie wirklich bringt

Mit annotiertem Beispiel, Generator, Framer-Anleitung und einer eigenen Messung an 267 Websites. Ohne Hype, mit Quellen.

Robin Klose11. Oktober 202612 Minuten Lesezeit
Leuchtturm an einer vereisten Küste, dessen Lichtstrahl durch den Nebel fällt

Seit Anfang 2025 fragen uns Kunden regelmäßig, ob sie eine llms.txt brauchen. Meistens nachdem ein Tool sie als fehlend markiert hat. Die ehrliche Antwort ist unspektakulärer, als die meisten Artikel dazu klingen: Die Datei schadet nicht, kostet wenig und bringt nach heutigem Stand fast nichts für deine Sichtbarkeit in ChatGPT oder Google. Warum das so ist, wie du sie trotzdem richtig anlegst und was stattdessen wirkt, steht hier. Mit eigener Messung an 267 Websites.

Was ist eine llms.txt?

Definition

Eine llms.txt ist eine Textdatei im Markdown-Format, die im Stammverzeichnis einer Website liegt, also unter domain.de/llms.txt. Sie fasst für Sprachmodelle und KI-Agenten zusammen, worum es auf der Website geht, und verlinkt die wichtigsten Seiten mit je einem Satz Beschreibung.

Vorgeschlagen hat das Format Jeremy Howard von Answer.AI im September 2024, die Spezifikation steht auf llmstxt.org. Die Idee dahinter ist nachvollziehbar: Eine normale Website besteht aus Navigation, Cookie-Bannern, Skripten und Layout. Ein Sprachmodell, das schnell verstehen soll, worum es geht, muss sich durch all das durcharbeiten. Die llms.txt liefert die Essenz in Markdown, ohne Ballast.

Wichtig für die Einordnung: Es ist ein Vorschlag, kein Standard. Es gibt kein Gremium, keine Pflicht und keine Zusage eines großen KI-Anbieters, die Datei auszuwerten. Genau das unterscheidet sie von der robots.txt, die jeder seriöse Crawler beachtet.

Aufbau und Beispiel: so sieht eine llms.txt aus

Die Spezifikation ist kurz. Pflicht ist nur eine Überschrift erster Ebene mit dem Namen. Alles andere ist empfohlen: ein Zitatblock mit der Zusammenfassung, optional freier Text, dann Abschnitte mit Linklisten. Unten siehst du einen gekürzten Ausschnitt unserer eigenen Datei, die du live unter iceagemedia.com/llms.txt abrufen kannst. Fahr mit der Maus über eine Zeile, dann leuchtet die passende Erklärung darunter auf.

iceagemedia.com/llms.txt
1# Ice Age Media
2
3> Digitalagentur aus Butzbach in der Wetterau. Wir bauen
4> Websites, die gefunden werden und Anfragen bringen.
5
6Websites entstehen auf Framer und gehen in rund zwei
7Wochen live, Einstieg ab 6.000 €.
8
9## Leistungen
10- [Website erstellen lassen](https://www.iceagemedia.com/website-erstellung): Neue
11 Unternehmenswebsite auf Framer, ab 6.000 €.
12- [GEO Optimierung](https://www.iceagemedia.com/geo-optimierung): Sichtbarkeit
13 in ChatGPT, Perplexity und Google AI Overviews.
14
15## Optional
16- [Impressum](https://www.iceagemedia.com/impressum)
  1. 1Zeile 1
    Pflicht. Genau eine H1 mit dem Namen der Firma oder Website.
  2. 2Zeile 3
    Zusammenfassung als Zitatblock. Das ist der Satz, den ein Modell am ehesten übernimmt. Konkret statt Werbesprache.
  3. 3Zeile 6
    Freier Text für Fakten, die nirgends sonst stehen: Preise, Standort, Arbeitsweise.
  4. 4Zeile 9
    H2 gruppiert Links. Halte die Gruppen so, wie ein Kunde denkt, nicht wie dein Menü.
  5. 5Zeile 10
    Ein Link pro Zeile, Doppelpunkt, dann ein Satz, wofür die Seite gut ist.
  6. 6Zeile 15
    Laut Spezifikation darf ein Modell diesen Abschnitt weglassen, wenn der Platz knapp wird.

Zwei Dinge fallen auf, wenn man viele dieser Dateien liest. Erstens schreiben die meisten ihre Zusammenfassung wie einen Werbeslogan. Ein Modell kann mit "Ihr Partner für digitale Exzellenz" nichts anfangen, mit "Digitalagentur aus Butzbach, Websites ab 6.000 Euro" sehr wohl. Zweitens fehlen fast immer die Fakten, die sonst nirgends maschinenlesbar stehen: Preise, Einzugsgebiet, Lieferzeit. Genau die gehören in den freien Textteil.

llms.txt, robots.txt und sitemap.xml im Vergleich

Die drei Dateien liegen alle im Stammverzeichnis und werden deshalb ständig verwechselt. Sie haben aber völlig unterschiedliche Aufgaben.

llms.txtrobots.txtsitemap.xml
ZweckBeschreibt, was es gibtRegelt, wer was abrufen darfListet alle Adressen
FormatMarkdowneigene SyntaxXML
ZielgruppeSprachmodelle, Agentenalle CrawlerSuchmaschinen
Von Google genutztneinjaja
Von KI-Crawlern beachtetnicht dokumentiertja, alle großenteilweise
Pflichtneinnein, aber dringend empfohlennein, aber empfohlen

Die Zeile, auf die es ankommt, ist die vorletzte. Wenn du steuern willst, ob ChatGPT, Claude oder Perplexity deine Inhalte sehen, ist die robots.txt der einzige Hebel, den alle Anbieter offiziell beachten. Die llms.txt kommt danach.

llms.txt oder llms-full.txt: welche Variante wofür

Neben der kurzen Datei hat sich eine zweite eingebürgert, die llms-full.txt. Sie steht nicht im Kern der Spezifikation, wird aber von vielen Dokumentationsplattformen automatisch mit ausgeliefert.

llms.txtllms-full.txt
InhaltInhaltsverzeichnis mit Linkskompletter Text aller Seiten
Größewenige Kilobyteoft mehrere Megabyte
Sinnvoll fürjede WebsiteSoftware-Dokus, Wissensdatenbanken
Pflegeaufwandbei neuen Seitenbei jeder Textänderung

Für eine Unternehmenswebsite mit zehn bis fünfzig Seiten ist die Antwort klar: nur die kurze Variante. Eine llms-full.txt, die nicht automatisch aus dem System erzeugt wird, veraltet beim ersten Texttausch und erzählt dann etwas anderes als deine Website. Das ist schlechter als gar keine.

Lesen ChatGPT, Claude, Perplexity und Google die Datei?

Das ist die Frage, an der sich der Nutzen entscheidet, und sie wird in vielen Artikeln großzügig beantwortet. Wir haben die offiziellen Dokumentationen der Anbieter gelesen und die Aussagen ihrer Vertreter gesammelt. Stand: 11. Oktober 2026.

Google
Nicht genutzt

Google sagt, für AI Overviews und den KI-Modus brauchst du keine Sonderdateien. John Mueller hat im Podcast Search Off the Record erklärt, warum: Eine Selbstbeschreibung kann jede Website schreiben, ein Modell kann damit keine Anbieter unterscheiden.

OpenAI
Nicht dokumentiert

Die Crawler-Dokumentation von OpenAI steuert GPTBot, OAI-SearchBot und ChatGPT-User über die robots.txt. Die llms.txt kommt dort nicht vor. Einzelne Logauswertungen sehen Abrufe der Datei, andere kaum welche. Ein Abruf ist noch keine Auswertung.

Anthropic
Veröffentlicht eigene

Anthropic stellt die eigene Dokumentation als llms.txt bereit. Dass ClaudeBot die Dateien fremder Websites auswertet, steht in keiner Anbieterdokumentation.

Perplexity
Nicht dokumentiert

PerplexityBot und Perplexity-User werden über die robots.txt gesteuert. Eine Aussage zur llms.txt gibt es von Perplexity nicht.

Agenten und Entwickler-Tools
Hier wirkt sie

Coding-Assistenten und KI-Agenten laden Dokumentationen gezielt über llms.txt und llms-full.txt. Für Software-Dokus ist das ein echter Gewinn, für eine Unternehmensseite ein kleiner.

Das Bild ist eindeutig: Kein großer Anbieter einer KI-Suche hat zugesagt, die llms.txt fremder Websites auszuwerten. Google hat sich sogar ausdrücklich dagegen positioniert. Das kann sich ändern, und deshalb datieren wir diesen Abschnitt. Wer dir heute verspricht, eine llms.txt bringe dich in ChatGPT-Antworten, verkauft eine Hoffnung.

Eigene Messung: wer hat schon eine llms.txt?

Weil wir zu Verbreitung nur Schätzungen gefunden haben, haben wir am 11. Oktober 2026 selbst nachgesehen. Zwei Stichproben: 101 Websites kleiner und mittlerer Unternehmen, mit denen wir 2026 zu tun hatten, also Kunden, Anfragen und Audits. Dazu 166 Domains von Agenturen und Fachseiten, die in Google zu Themen wie SEO, Landingpages und KI-Sichtbarkeit ranken. Gezählt hat nur eine echte Textdatei mit Status 200, keine HTML-Fehlerseite unter derselben Adresse.

26 von 101
KMU-Websites liefern eine llms.txt aus
80 von 166
Agentur- und Fachseiten haben eine
0 von 91
KMU-Websites sperren KI-Crawler in der robots.txt
KMU-Websites mit llms.txt, nach System
Wix
8 von 8 · 100 %
automatisch erzeugt
Shopify
2 von 2 · 100 %
Framer
3 von 8 · 38 %
alle drei von uns angelegt
WordPress
6 von 40 · 15 %
meist per SEO-Plugin
Squarespace
0 von 4 · 0 %
Sonstige
7 von 39 · 18 %
Messung Ice Age Media, 11. Oktober 2026. 101 Websites kleiner und mittlerer Unternehmen aus Kundenprojekten, Anfragen und Audits. Gezählt: echte Textdatei unter /llms.txt mit Status 200. System erkannt über Server-Header und Quelltext.

Aufgeschlüsselt nach System wird das Bild deutlich. Alle acht Wix-Seiten der Stichprobe haben eine llms.txt, weil Wix sie automatisch erzeugt, samt einer KI-generierten Beschreibung, die niemand gegengelesen hat. Bei WordPress sind es sechs von vierzig, und auch dort ist ein Teil von SEO-Plugins erzeugt. Bei Framer sind es drei von acht, und die drei haben wir selbst angelegt. Bewusst geschrieben hat die Datei also kaum ein Mittelständler.

Bei den Agenturen sieht es anders aus: 80 von 166 Domains liefern eine llms.txt aus, das sind 48 Prozent. Zehn davon stammen erkennbar aus WordPress-Plugins (Rank Math acht, Yoast und All in One SEO je eine) und beginnen mit einem Generator-Hinweis statt mit dem Namen. Die Branche, die die Datei verkauft, hat sie also zur Hälfte. Ihre Kunden zu einem Viertel, und dann meist ohne es zu wissen.

Ein Nebenbefund aus derselben Messung, der wichtiger ist als die llms.txt selbst: Von den 91 KMU-Websites mit robots.txt nennen nur acht überhaupt einen KI-Crawler, und keine einzige sperrt einen aus. Die Tür steht bei fast allen offen. Woran es hakt, ist meist das, was die Crawler dahinter vorfinden.

Generator: deine llms.txt in zwei Minuten

Für eine kleine Website brauchst du kein Tool, aber ein Gerüst spart Tippfehler. Trag unten Name, Zusammenfassung und deine wichtigsten Seiten ein. Die Datei entsteht live rechts daneben, du kannst sie kopieren oder direkt herunterladen. Es wird nichts gespeichert und nichts verschickt.

llms.txt
# Malerbetrieb Muster

> Meisterbetrieb für Innen- und Fassadenarbeiten in Gießen und Umgebung, seit 1998. Privat- und Gewerbekunden, Angebot innerhalb von 48 Stunden.

Einzugsgebiet: 30 km um Gießen
Termine meist innerhalb von drei Wochen

## Seiten
- [Leistungen](https://www.beispiel.de/leistungen): Innenanstrich, Fassade, Tapezieren
- [Fassadensanierung](https://www.beispiel.de/fassade): Ablauf, Förderung und Referenzen
- [Referenzen](https://www.beispiel.de/referenzen): Projekte mit Fotos vorher und nachher
- [Kontakt](https://www.beispiel.de/kontakt): Telefon, Anfrageformular, Anfahrt

## Optional
- [Impressum](https://www.beispiel.de/impressum)

Anleitung: llms.txt in fünf Schritten erstellen

  1. 01
    Seiten auswählen

    Schreib die zehn bis dreißig Seiten auf, die du einem neuen Kunden zeigen würdest. Leistungen, Preise, Referenzen, Über uns, Kontakt. Kein Blog-Archiv, keine Tag-Seiten.

  2. 02
    Zusammenfassung schreiben

    Ein bis zwei Sätze: wer du bist, was du anbietest, für wen und wo. Lies sie laut vor. Wenn sie wie ein Slogan klingt, schreib sie um.

  3. 03
    Fakten ergänzen

    Preise ab, Einzugsgebiet, Lieferzeit, Zertifizierungen. Alles, was ein Interessent fragt und was sonst nur verstreut auf der Website steht.

  4. 04
    Datei anlegen

    Im Generator oben oder in einem Texteditor. Als llms.txt speichern, Kodierung UTF-8, damit Umlaute stimmen.

  5. 05
    Hochladen und prüfen

    Ins Stammverzeichnis legen, im Browser aufrufen, mit curl -I den Content-Type prüfen. Dann einen Termin im Kalender, in sechs Monaten wieder reinzuschauen.

llms.txt in Framer, WordPress, Wix und Shopify einrichten

Framer

Framer kann statische Dateien inzwischen selbst ausliefern. Im Dashboard unter Domains den Bereich Files öffnen und die llms.txt hochladen, danach ist sie unter deiner Domain erreichbar. Die Funktion gibt es laut Framer ab dem Pro-Tarif. Wir liefern unsere eigene über eine vorgeschaltete Cloudflare-Schicht aus, weil wir dort ohnehin seitenspezifisches Schema und HTTP-Header setzen. Für die meisten Framer-Seiten reicht der Upload.

WordPress

Rank Math, Yoast und All in One SEO erzeugen die Datei auf Knopfdruck. Bequem, aber prüf das Ergebnis: Die Plugin-Dateien aus unserer Messung beginnen mit einem Hinweis auf das Plugin statt mit deinem Namen und sind teils sehr lang, weil sie einfach alle Beiträge auflisten. Besser ist es, die automatische Erzeugung abzuschalten und eine handgeschriebene Datei per FTP ins Stammverzeichnis zu legen.

Wix

Wix legt die Datei automatisch an. Ruf sie auf und lies sie. In unserer Stichprobe standen dort Sätze wie "Die Website betont die Bedeutung von" über Firmen, die das nie so formulieren würden. Du kannst die Datei bei Wix bearbeiten. Sobald du das tust, stoppen die automatischen Aktualisierungen, du musst sie dann selbst pflegen.

Shopify

Shopify erlaubt keine freie Datei im Stammverzeichnis. Der übliche Weg ist eine App aus dem Shopify App Store oder eine Weiterleitung von /llms.txt auf eine Datei im Dateibereich. Prüf danach mit curl, ob wirklich Text ausgeliefert wird und keine Shop-Seite.

Was für KI-Sichtbarkeit mehr bringt als eine llms.txt

Wenn du eine Stunde Zeit für KI-Sichtbarkeit hast, steck höchstens zehn Minuten in die llms.txt. Der Rest gehört in Dinge, die nachweislich wirken. In der Reihenfolge, in der wir sie bei Kunden prüfen:

  1. Der Inhalt steht im HTML. Viele moderne Websites liefern Text erst per JavaScript aus oder blenden ihn mit Animationen ein, die beim ersten Laden unsichtbar sind. Mehrere KI-Crawler führen kein JavaScript aus und sehen dann eine leere Seite. Das ist der häufigste und teuerste Fehler, den wir finden.
  2. Die robots.txt lässt die richtigen Crawler rein. GPTBot und OAI-SearchBot, ClaudeBot, PerplexityBot. Wer einen davon aus Versehen sperrt, ist dort unsichtbar, egal was in der llms.txt steht.
  3. Bing kennt deine Seite. ChatGPT sucht im Web über den Bing-Index. Bing Webmaster Tools einrichten und neue Seiten dort einreichen kostet eine halbe Stunde und wird fast immer vergessen.
  4. Klare Antworten im Text. Wer auf eine Frage im ersten Satz antwortet, wird zitiert. Wer drei Absätze Anlauf nimmt, nicht. Tabellen und Definitionen funktionieren besonders gut.
  5. Erwähnungen auf fremden Seiten. Modelle empfehlen, was andere empfehlen. Branchenverzeichnisse, Bewertungsportale, Fachartikel. Das ist die langsamste Stellschraube und die wirksamste.

Wie das systematisch aussieht und wie man es misst, beschreiben wir auf unserer Seite zur GEO-Optimierung. Wenn du erst einmal wissen willst, wo du stehst, hilft die KI-Sichtbarkeits-Checkliste mit 28 Prüfpunkten.

Willst du wissen, ob KI-Crawler deine Inhalte überhaupt sehen?

Wir prüfen robots.txt, server-gerenderten Text, Bing-Index und llms.txt deiner Website und zeigen dir die drei Stellen, die am meisten bringen. Dreißig Minuten, ohne Angebot am Ende.

Kostenloses Erstgespräch

Typische Fehler bei der llms.txt

  • Die Adresse liefert eine HTML-Seite. Viele Systeme zeigen unter jeder unbekannten Adresse eine gestaltete Fehlerseite mit Status 200. Für ein Tool sieht das aus wie eine vorhandene Datei, für ein Modell ist es Müll.
  • Werbesprache in der Zusammenfassung. "Innovativ", "ganzheitlich" und "Ihr Partner für" tragen keine Information. Ein Satz mit Branche, Ort und Angebot schon.
  • Alle Seiten auf einmal. Eine llms.txt mit vierhundert Links ist keine Übersicht mehr. Nimm die zehn bis dreißig Seiten, die du einem neuen Kunden zeigen würdest.
  • Veraltete Preise und Leistungen. Die Datei wird beim Relaunch vergessen und erzählt dann ein Jahr lang Dinge, die nicht mehr stimmen.
  • Die Erwartung, dass sie etwas Großes bewirkt. Wer nach dem Hochladen auf mehr Anfragen wartet, wird enttäuscht und investiert danach oft gar nicht mehr in KI-Sichtbarkeit. Das wäre der eigentliche Schaden.
Die llms.txt ist das Schild an der Tür. Ob jemand reinkommt, entscheidet, was hinter der Tür steht.
Unser Fazit nach der Messung

Häufige Fragen

Was bringt eine llms.txt?

Sie gibt Sprachmodellen und KI-Agenten eine kurze, saubere Übersicht deiner Website mit den wichtigsten Links. Messbar mehr Nennungen in ChatGPT oder Google bringt sie nach heutigem Stand nicht, weil keiner der großen Anbieter dokumentiert, dass er sie auswertet. Sinnvoll ist sie als günstige Ergänzung, nicht als Strategie.

Ist eine llms.txt Pflicht?

Nein. Es ist ein Vorschlag aus dem September 2024, kein Standard und keine gesetzliche oder technische Pflicht. Deine Seite wird ohne die Datei genauso gecrawlt und indexiert.

Wo muss die llms.txt liegen?

Im Stammverzeichnis deiner Domain, also unter deinedomain.de/llms.txt. Sie muss als reine Textdatei ausgeliefert werden, mit Status 200 und ohne Weiterleitung auf eine HTML-Seite.

Schadet eine llms.txt meinem Google-Ranking?

Nein. Google ignoriert die Datei für das Ranking. Sie kann allenfalls selbst in den Suchergebnissen auftauchen, wenn sie indexiert wird. Wer das nicht will, setzt einen X-Robots-Tag noindex auf die Datei.

Was ist der Unterschied zwischen llms.txt und llms-full.txt?

Die llms.txt ist ein Inhaltsverzeichnis mit Links und Kurzbeschreibungen. Die llms-full.txt enthält den vollständigen Text aller verlinkten Seiten in einer Datei. Für eine Unternehmenswebsite reicht die kurze Variante, die lange lohnt sich bei umfangreichen Dokumentationen.

Wie prüfe ich, ob meine llms.txt erreichbar ist?

Ruf deinedomain.de/llms.txt im Browser auf. Du solltest reinen Text sehen, keine gestaltete Seite. Im Terminal zeigt curl -I deinedomain.de/llms.txt den Status und den Content-Type, der mit text/plain oder text/markdown beginnen sollte.

Brauche ich einen llms.txt-Generator?

Nicht zwingend. Für eine Website mit zehn bis dreißig Seiten schreibst du die Datei in einer Viertelstunde von Hand, und sie wird besser, weil du die Beschreibungen selbst formulierst. Generatoren lohnen sich bei großen Seiten mit vielen Unterseiten.

Ersetzt die llms.txt die robots.txt?

Nein. Die robots.txt regelt, welcher Crawler was abrufen darf, und wird von allen großen KI-Anbietern beachtet. Die llms.txt beschreibt nur, was es gibt. Wer KI-Crawler aussperren oder zulassen will, macht das ausschließlich in der robots.txt.

Robin Klose
Über den Autor

Robin Klose

Co-Gründer, Ice Age Media

Robin misst für Kunden jeden Monat, ob und wie sie in ChatGPT, Perplexity und Google AI Overviews genannt werden. Die Zahlen in diesem Beitrag hat er selbst erhoben, die Rohdaten liegen bei uns und können auf Nachfrage eingesehen werden.

Mit Robin sprechen

Erst gefunden werden, dann zitiert werden.

Wir zeigen dir, ob ChatGPT, Perplexity und Google deine Firma heute nennen, und was als Nächstes den größten Unterschied macht.

Kostenloses Erstgespräch