Das Wichtigste in 30 Sekunden

  • Eine llms.txt ist eine einfache Markdown-Datei im Stammverzeichnis Ihrer Website, die KI-Systemen zeigt, welche Inhalte zählen und welche nicht.
  • Der Vorschlag stammt von Jeremy Howard (Answer.AI, September 2024) und ist kein offizieller Standard, sondern eine Community-Initiative ohne Normungsgremium.
  • Einige Werkzeuge und Dokumentationsplattformen unterstützen das Format. Ob große KI-Suchsysteme wie ChatGPT oder Google AI es aktiv auswerten, ist unklar und umstritten.
  • Der Aufwand ist gering. Die Datei anlegen dauert eine Stunde, der Nebeneffekt ist eine überfällige Bestandsaufnahme der eigenen Inhalte.

Jeremy Howard hat im September 2024 auf llmstxt.org einen einfachen Vorschlag veröffentlicht: eine kleine Textdatei, die KI-Systemen zeigt, welche Inhalte Ihrer Website es wert sind, gelesen zu werden. Die Idee klingt simpel und ist es auch. Ob sie sich wirklich durchsetzt, ist eine andere Frage, und die beantwortet dieser Artikel so ehrlich wie möglich.

Was ist eine llms.txt, und wozu braucht man sie?

Kurz gesagt: Eine llms.txt ist eine Markdown-Datei unter https://ihre-domain.de/llms.txt, die KI-Systemen in strukturierter Form mitteilt, welche Seiten Ihrer Website den Kerninhalt ausmachen und welche nur Beiwerk sind.

Das Grundproblem, das der Vorschlag lösen will: Eine typische Website besteht nicht nur aus dem, was Sie sagen wollen. Sie besteht auch aus Navigation, Cookie-Bannern, Rechtlichem, veralteten Unterseiten und Textfragmenten, die historisch gewachsen sind. Für ein KI-System, das Ihre Seite liest und verarbeitet, ist nicht ohne Weiteres erkennbar, was davon Ihre Kernaussage ist und was nur technisches Beiwerk.

Das Analogon aus der Suchmaschinen-Welt kennen Sie: Die robots.txt gibt Crawlern vor, welche Bereiche sie betreten dürfen. Die sitemap.xml zeigt ihnen, was indexierbar ist. Die llms.txt geht einen Schritt weiter und erklärt den Inhalt, nicht nur die Zugänge und die Vollständigkeit.

Ein konkretes Bild: Wenn jemand fragt „Welche Agentur hilft mir mit WordPress-Websites in der Region?“, dann durchsucht ein KI-System nicht mehr nur einen Index, sondern liest Seiten direkt und formuliert eine Antwort. Es entscheidet dabei selbst, welche Passagen relevant sind. Mit einer llms.txt haben Sie wenigstens einen Hinweis hinterlegt, was tatsächlich zählt.

llms.txt, robots.txt und sitemap.xml im Vergleich

Datei Zweck Zielgruppe Status
robots.txt Zugang steuern: welche Bereiche darf ein Bot betreten? Alle Crawler (Such- und KI-Crawler) Etablierter Standard seit 1994
sitemap.xml Struktur zeigen: welche URLs sollen indexiert werden? Suchmaschinen-Crawler Etablierter Standard (sitemaps.org)
llms.txt Inhalt erklären: welche Seiten sind die wichtigsten? KI-Sprachmodelle und ihre Crawler Community-Vorschlag, kein Standard

Der Unterschied in einem Satz: robots.txt regelt den Zutritt, sitemap.xml zeigt die Vollständigkeit, llms.txt gibt eine Priorität an. Wer KI-Crawler gezielt steuern will, etwa um GPTBot oder PerplexityBot komplett auszuschließen, macht das weiterhin in der robots.txt. Mehr dazu im Artikel KI-Crawler steuern: GPTBot, PerplexityBot und Co. in der robots.txt.

Aufbau und Syntax der llms.txt

Die Spezifikation ist bewusst minimal gehalten. Das einzige Pflichtfeld ist eine H1-Überschrift mit dem Namen Ihres Unternehmens oder Projekts. Alles andere ist optional.

Element Inhalt Pflicht?
# Name H1-Überschrift mit Ihrem Unternehmensnamen Ja
> Beschreibung Ein Satz, der erklärt, was Sie tun Empfohlen
Freitext-Absatz Hinweise, Einschränkungen, wichtige Kontextinformationen Optional
## Abschnitt Thematische Gruppierung von Links (z. B. „Leistungen“, „Ratgeber“) Optional
- [Titel](url): Hinweis Links zu Ihren wichtigsten Seiten mit kurzem Beschreibungstext Optional
## Optional Seiten, die bei Platzmangel weggelassen werden können Optional

Der Abschnitt ## Optional hat laut Spezifikation eine besondere Bedeutung: Systeme, die auf Kontextlänge achten müssen, dürfen die dort verlinkten Seiten überspringen. Sie schreiben dort also Seiten hin, die nützlich sind, aber kein Kerninhalt sind.

Ein vollständiges Beispiel

Die offizielle Spezifikation zeigt das am FastHTML-Projekt. Hier ein Beispiel für eine mittelständische Webagentur:

Direkt umsetzbar

llms.txt-Vorlage für eine KMU-Website

Diese Vorlage speichern Sie als Datei llms.txt im Wurzelverzeichnis Ihrer Domain, erreichbar unter ihre-domain.de/llms.txt. Passen Sie Kurzbeschreibung, Leistungen und Links an Ihre Seite an. Reine Textdatei in Markdown, Pflicht sind nur Titel und Kurzbeschreibung.

# Musteragentur GmbH

> WordPress- und WooCommerce-Agentur für kleine und mittelständische Unternehmen in Deutschland. Spezialisiert auf DSGVO-konforme Websites, barrierefreie Onlineshops und KI-Sichtbarkeit.

Wichtige Hinweise:
- Wir entwickeln keine Individualsoftware und keinen React-Frontend-Code
- Unsere Leistungen richten sich an Unternehmen, nicht an Privatpersonen

## Leistungen

- [WordPress-Websites erstellen lassen](/leistungen/wordpress-website/): Was wir bauen, wie wir vorgehen, was es kostet
- [WooCommerce-Shop aufsetzen](/leistungen/woocommerce-shop/): Shop-Erstellung, Migration, Barrierefreiheit
- [Website-Check und Audit](/checks-audits/): Technische Prüfung, SEO und KI-Sichtbarkeit

## Ratgeber

- [llms.txt erklärt](/ratgeber/llms-txt/): Diese Seite
- [GEO: Von KI empfohlen werden](/ratgeber/geo/): Wie KI-Systeme Websites bewerten
- [KI-Crawler steuern](/ratgeber/ki-crawler/): robots.txt für GPTBot und Co.

## Optional

- [Blog-Archiv](/ratgeber/): Alle Ratgeber-Artikel nach Thema
- [Über uns](/über-uns/): Team, Geschichte, Referenzen

Vorlage frei nutzbar. Wenn wir Ihre llms.txt mit der richtigen Seitenauswahl aufsetzen und pflegen sollen, übernehmen wir das in der Betreuung.

Welche KI-Systeme unterstützen llms.txt?

Hier ist Ehrlichkeit gefragt, weil die meisten Artikel zu diesem Thema die Lage zu positiv darstellen.

Der Vorschlag existiert seit September 2024. Seitdem haben einige technisch orientierte Plattformen das Format übernommen: Anthropic selbst (die Macher von Claude) hat eine llms.txt für ihre Dokumentation veröffentlicht, ebenso Cloudflare, Vercel, Stripe und Mintlify. Das sind Unternehmen, die sich an Entwickler richten und die strukturierte Dokumentation als sinnvoll einschätzen. Auch Perplexity hat laut eigenen Angaben früh mit dem Format experimentiert.

Was fehlt: Eine öffentliche, verbindliche Aussage der großen Anbieter, dass ihre Systeme llms.txt-Dateien beim Crawlen aktiv auswerten. Google Search Advocate John Mueller hat auf Bluesky erklärt, kein KI-System nutze llms.txt derzeit, und Gary Illyes bestätigte, Google plane keine Unterstützung. OpenAI hat sich nicht offiziell festgelegt; OpenAI-Bots rufen llms.txt-Dateien zwar teils ab, eine verbindliche Aussage zur Auswertung fehlt aber. Auch eine Studie des Analyseanbieters OtterlyAI fand in einem 90-Tage-Zeitraum, dass von über 62.000 KI-Bot-Anfragen auf einer Website exakt 84 auf die llms.txt entfielen, also 0,1 Prozent.

Das heißt nicht, dass der Vorschlag sinnlos ist. Es heißt, dass er in einem frühen Stadium steckt und keine garantierte Wirkung hat.

Ehrliche Einschätzung: Wer eine llms.txt anlegt, sendet ein Signal an Systeme, die es verstehen, und riskiert gar nichts bei denen, die es nicht kennen. Wer sie als Wundermittel für KI-Sichtbarkeit betrachtet, enttäuscht sich selbst.

Die eigentlichen Hebel für KI-Sichtbarkeit liegen woanders: gute Inhalte, klare Struktur, Schema-Markup, und eine Strategie, die versteht, wie Sprachmodelle Empfehlungen bilden. Was dahintersteckt, erklärt der Artikel GEO: Von ChatGPT empfohlen werden.

Was die Daten 2026 sagen. Eine Untersuchung von SE Ranking über rund 300.000 Domains fand eine Verbreitung von gut zehn Prozent und keinen messbaren Zusammenhang zwischen einer vorhandenen llms.txt und der Häufigkeit, mit der eine Seite in KI-Antworten zitiert wird (Search Engine Journal). In Server-Logs holen die großen KI-Crawler wie GPTBot und ClaudeBot die Datei bisher kaum ab; Google steuert die KI-Nutzung ohnehin nur über den robots.txt-Token Google-Extended und ruft keine llms.txt ab. Als Ausnahme gilt Perplexity, das die Datei nach eigenen Angaben abruft, ebenso Entwickler-Werkzeuge wie Cursor. Fazit: heute kein Ranking-Hebel, sondern eine günstige Wette auf morgen und nebenbei ein sauberes Inventar Ihrer wichtigsten Seiten.

Warum es sich trotzdem lohnt

Der Aufwand für eine gut gepflegte llms.txt liegt bei einer Stunde. Das Risiko ist null. Schon das ist ein brauchbares Argument.

Dazu kommt ein Nebeneffekt, der nichts mit KI zu tun hat: Um eine sinnvolle llms.txt zu schreiben, müssen Sie sich fragen, welche Seiten Ihrer Website wirklich tragen. Welche Texte sind aktuell und inhaltlich stark? Welche Leistungsseiten beschreiben Ihr Angebot so präzise, dass ein fremdes System sie verstehen kann? Diese Auseinandersetzung führt oft zu einer Bestandsaufnahme, die längst überfällig war.

Und: Wer früh eine saubere llms.txt betreibt, hat sich positioniert, falls das Format sich doch noch breit durchsetzt. Das ist keine starke Wette, aber eine billige.

Ein wiederkehrendes Muster: Wer vor einem Relaunch eine llms.txt für die bestehende Website schreibt, stellt oft fest, dass ein erheblicher Teil der öffentlichen Seiten keinen Inhalt hat, den man einem KI-System sinnvoll empfehlen würde. Das ist kein Erkenntnisgewinn über KI, sondern über die eigene Website. Solche Klarheit hilft.

Was eine llms.txt nicht leistet

Eine llms.txt ist kein Sperrwerkzeug. KI-Crawler halten sich nicht in jedem Fall an die robots.txt, und die llms.txt ist noch weniger verbindlich. Wer bestimmte Inhalte zuverlässig vor KI-Crawlern schützen will, braucht serverseitige Zugangsbeschränkungen oder Login-Bereiche.

Sie ersetzt keine guten Inhalte. Ein Unternehmen mit dünnen oder veralteten Texten gewinnt wenig, wenn es ausgerechnet diese Texte in der llms.txt besonders hervorhebt. KI-Systeme, die Seiten selbst lesen und bewerten, prüfen den Inhalt, nicht die Datei.

Und sie ist kein SEO-Faktor. Google hat das klar kommuniziert. Die klassischen Ranking-Signale, also Backlinks, Seitenstruktur, Ladezeit, Relevanz, werden davon nicht berührt.

Zwei Dinge sollten Sie zusätzlich bedenken. Erstens legt eine llms.txt die Struktur Ihrer wichtigsten Seiten offen, nehmen Sie dort also keine internen, geschützten oder personenbezogenen URLs auf. Zweitens ist das Format trivial und selbst deklariert, es lässt sich also auch zur Manipulation missbrauchen. Genau das ist einer der Gründe für Googles Skepsis: Eine Angabe, die jeder beliebig setzen kann, taugt schlecht als vertrauenswürdiges Signal.

Die llms.txt ist damit ein Hinweis, kein Schalter. Sie können ihn senden. Ob ihn jemand hört, hängt vom System ab.

Schritt für Schritt: Ihre erste llms.txt erstellen

Schritt 1: Bestandsaufnahme Ihrer wichtigsten Seiten

Öffnen Sie Ihr WordPress-Backend und rufen Sie Seiten und Beiträge auf. Schreiben Sie auf, welche fünf bis acht Seiten Ihr Angebot am besten erklären. Typisch: eine oder zwei Leistungsseiten, die Über-uns-Seite, zwei bis drei Ihrer besten Ratgeber. Seiten, die Sie selbst nicht für gut halten, lassen Sie weg.

Schritt 2: Datei anlegen

Erstellen Sie eine einfache Textdatei mit dem Namen llms.txt. Der Inhalt ist reines Markdown, kein HTML. Die Datei liegt im Stammverzeichnis Ihrer Website, also direkt neben der robots.txt.

Bei WordPress ohne eigene Server-Zugänge: Legen Sie die Datei per FTP oder SFTP im Webroot ab. Wenn Sie WordPress-Zugang haben, können Sie die Datei auch über ein einfaches Plugin ins Stammverzeichnis schreiben. Alternativ gibt es erste Plugins, die die Datei automatisch aus Ihren Inhalten generieren. Eine von Hand gepflegte Version ist in der Regel präziser.

Schritt 3: Inhalt strukturieren

Beginnen Sie mit der Pflichtangabe: # Ihr Unternehmensname. Fügen Sie direkt darunter ein Blockzitat mit einem klaren Satz hinzu, der beschreibt, was Sie tun und für wen. Dann gruppieren Sie Ihre Links in sinnvolle Abschnitte mit ##-Überschriften. Jeder Link bekommt einen kurzen Beschreibungstext, der sagt, was den Besucher oder das KI-System dort erwartet.

Schritt 4: Optional-Abschnitt prüfen

Was gehört in den ## Optional-Bereich? Alles, was nützlich ist, aber nicht Kerninhalt. Typisch: Blog-Archive, ältere Ratgeber, Veranstaltungsseiten. Systeme mit begrenztem Kontextfenster dürfen diese Links überspringen, das ist ausdrücklich so gewollt.

Schritt 5: Erreichbarkeit prüfen

Rufen Sie nach dem Upload https://ihre-domain.de/llms.txt im Browser auf. Sie sollten den Plaintext sehen, kein HTML. Wenn WordPress die URL umschreibt, müssen Sie in der .htaccess eine Ausnahme für llms.txt eintragen oder den korrekten Webroot sicherstellen.

Schritt 6: Aktuell halten

Eine veraltete llms.txt, die auf gelöschte oder umgezogene Seiten zeigt, ist schlechter als keine. Pflegen Sie die Datei, wenn sich Ihre wichtigsten Seiten ändern. Es ist ein manueller Schritt, aber ein kleiner.

Für Entwickler · überspringbar

Für Entwickler: llms-ctx-full.txt und .md-Varianten

Die llms.txt-Spezifikation hat im Umfeld der Answer.AI-Community zwei verwandte Formate hervorgebracht, die nicht Teil des ursprünglichen Vorschlags sind, aber in der Praxis genutzt werden.

llms-ctx.txt und llms-ctx-full.txt: Diese Varianten bündeln nicht nur Links, sondern den vollständigen Textinhalt der referenzierten Seiten in einem einzigen Dokument. Der Hintergedanke ist, dass ein Entwickler-Tool oder ein KI-System den gesamten Kontext in einem einzigen Request laden kann, ohne viele Einzelseiten abzurufen. FastHTML, das Referenzprojekt der Spezifikation, stellt beide Formate bereit. Für eine Unternehmenswebsite mit wenigen Kernseiten ist das kaum nötig. Für Dokumentationsplattformen mit vielen verknüpften Seiten kann es sinnvoll sein.

.md-Varianten: Eine weitere Praxis, die sich in technischen Projekten etabliert hat: Jede wichtige Seite stellt unter derselben URL mit der Endung .md eine saubere Markdown-Version bereit. Statt /ratgeber/llms-txt/ gibt es auch /ratgeber/llms-txt.md. Das funktioniert ohne Plugin, wenn der Webserver oder ein entsprechendes Rewrite-Regelwerk die Weiche stellt. Die Idee dahinter ist dieselbe wie bei der llms.txt: filtern Sie das HTML-Beiwerk heraus und liefern Sie dem Lesenden den Inhalt direkt.

Ob diese Varianten für eine KMU-Website sinnvoll sind, ist fraglich. Der Aufwand steigt, der Nutzen bleibt unsicher. Für eine Agentur oder einen Dienstleister, dessen Kerngeschäft Webentwicklung ist, kann es ein Signal an technisch versierte Besucher sein.

Sofort-Checkliste

  • Ihre fünf bis acht wichtigsten Seiten identifiziert und schriftlich notiert?
  • llms.txt mit H1, Blockzitat und mindestens einem Abschnitt angelegt?
  • Jeder Link hat einen Beschreibungstext, der erklärt, was dort zu finden ist?
  • Datei unter https://ihre-domain.de/llms.txt erreichbar (kein HTML, kein Redirect)?
  • Optional-Abschnitt für Seiten zweiter Priorität genutzt?
  • Keine internen, geschützten oder personenbezogenen URLs in der Datei gelistet?
  • Bestehende robots.txt prüft, welche KI-Crawler Sie zulassen wollen?
  • Datum der letzten Aktualisierung im Kopf behalten, Datei bei Änderungen mitpflegen?
Das Wichtigste zum Mitnehmen

  • Eine llms.txt ist ein offener Vorschlag von Jeremy Howard (Answer.AI, September 2024), kein offizieller Standard. Kein Normungsgremium steckt dahinter.
  • Einige Plattformen und Werkzeuge werten die Datei aus. Ob große KI-Suchsysteme wie ChatGPT oder Google AI das tun, ist nicht bestätigt und von Google aktiv verneint worden.
  • Der Aufwand ist gering, das Risiko null. Die Datei anlegen lohnt sich allein wegen der Klarheit, die der Prozess erzeugt.
  • Echte KI-Sichtbarkeit entsteht durch gute Inhalte, klare Struktur, Schema-Markup und eine Entitätsstrategie, nicht durch eine Textdatei.

Häufige Fragen

Muss ich die llms.txt bei Google oder einem anderen Anbieter anmelden?

Nein. Die Datei liegt im Stammverzeichnis Ihrer Website und wird von Systemen selbst gefunden, sofern sie danach suchen. Es gibt keine zentrale Registrierung und keine Anmeldepflicht.

Was passiert, wenn meine llms.txt Fehler enthält?

Nichts Schlimmes. KI-Systeme, die das Format kennen, ignorieren eine fehlerhafte Datei oder gewichten sie geringer. Klassische Suchmaschinen-Rankings werden davon nicht beeinflusst. Die einzige Ausnahme: tote Links in der Datei sind nutzlos. Prüfen Sie die URLs, bevor Sie die Datei hochladen.

Ist llms.txt ein Ersatz für Schema-Markup?

Nein. Schema-Markup (strukturierte Daten nach schema.org) ist ein etablierter Standard, den Google, Bing und viele andere Systeme aktiv auswerten. Er erzeugt Rich Snippets in Suchergebnissen und hilft KI-Systemen, Entitäten korrekt zu erkennen. Eine llms.txt ist ein ergänzender Hinweis auf einer anderen Ebene. Wer Schema-Markup noch nicht hat, sollte dort zuerst ansetzen. Mehr zum Thema: Ihre Marke als Entität: Wie KI Ihr Unternehmen überhaupt erkennt.

Kann ich llms.txt nutzen, um Inhalte vor KI-Crawlern zu schützen?

Nein. Die Datei gibt Prioritäten an, kein Verbot. Wer Bereiche seiner Website vor KI-Crawlern schützen will, tut das in der robots.txt oder durch Login-Bereiche. Ob KI-Crawler die robots.txt respektieren, ist ebenfalls nicht garantiert, ist aber die deutlich verbindlichere Grundlage als eine llms.txt.

Gibt es WordPress-Plugins für llms.txt?

Inzwischen ja. Erste Plugins erzeugen die Datei automatisch aus Ihren Inhalten. Ob das Ergebnis besser ist als eine handgepflegte Version, hängt vom Plugin ab. Eine manuell geschriebene Datei, die wirklich nur Ihre besten Seiten enthält, ist fast immer präziser als eine automatisch generierte, die alle Seiten auflistet.

Wie passt llms.txt zu GEO und KI-Sichtbarkeit insgesamt?

Die llms.txt ist eine kleine taktische Maßnahme, kein strategischer Hebel. Eine Strategie für KI-Sichtbarkeit umfasst gute Inhalte, klare Struktur, Schema-Markup, Entitätspflege und eine Ausrichtung daran, wie KI-Systeme Empfehlungen bilden. Wie das zusammenhängt, erklärt SEO und GEO kombinieren: eine Website für Google und für KI.