Zum Inhalt springen
Leitfäden

Was ist llms.txt und wie schreibt man sie?

Anleitung · 12 Min. Lesezeit · Aktualisiert 15. September 2026

Kurze Antwort

Wofür ist eine llms.txt-Datei gut?

llms.txt ist eine Klartext-Inhaltskarte im Wurzelverzeichnis einer Website, damit ein generatives Sprachmodell die Site in einer einzigen Anfrage erfassen kann. Jeremy Howard schlug sie im September 2024 auf llmstxt.org vor, Version 2 folgte im August 2026. Das Format ist Markdown: eine H1, ein Blockquote als Zusammenfassung, danach kommentierte Linklisten unter H2-Überschriften. Sie ist kein offizieller Standard und ersetzt robots.txt nicht.

Das Wichtigste

  • llms.txt ist keine Berechtigungsdatei: Den Zugang regelt robots.txt, llms.txt beschreibt nur Inhalte.
  • In der Spezifikation ist die Zusammenfassung ein Blockquote (>), keine Kursivzeile — die meisten kursierenden Beispiele schreiben diese Zeile falsch.
  • Googles eigene Dokumentation sagt, für AI Overviews und AI Mode müsse man „keine neuen maschinenlesbaren Dateien, KI-Textdateien oder Markup erstellen“ — llms.txt ist kein Ranking-Hebel.
  • llms-full.txt kommt in der Spezifikation nicht vor. Es ist verbreitete Praxis, aber kein Standard.
  • Die Datei muss unter /llms.txt mit einer 200-Antwort als text/plain ausgeliefert werden; eine Weiterleitung oder ein Download-Header macht sie unlesbar.
  • Eine nicht gepflegte llms.txt ist schlechter als keine: Eine Karte aus toten Links beschreibt die Site nicht, sie beschreibt sie falsch.

Was ist llms.txt?

llms.txt ist eine Klartextkarte, die einer Maschine in einer Datei sagt, was eine Website ist und worum es auf welcher Seite geht. Jeremy Howard veröffentlichte den Vorschlag im September 2024 auf llmstxt.org; die Spezifikation erreichte im August 2026 ihre zweite Fassung. Die Datei kann im Wurzelverzeichnis liegen oder unter einem Unterpfad — etwa /docs/llms.txt.

Der Name erinnert an robots.txt, weshalb beide oft verwechselt werden, doch die Funktion ist eine völlig andere. robots.txt ist eine Zugangsdatei: Sie sagt, welcher Crawler welchen Pfad abrufen darf. llms.txt ist eine Beschreibungsdatei; sie gewährt niemandem etwas, sie beschreibt nur Inhalte. Keine ersetzt die andere — sie stehen nebeneinander.

Blockiert robots.txt den GPTBot, ändert eine llms.txt daran nichts. Der Crawler kann die Datei nicht abrufen; die Karte bleibt hinter der verschlossenen Tür.

Welches Problem löst llms.txt?

Will ein Sprachmodell eine Website lesen, ist der größte Teil des HTML vor ihm kein Inhalt: Navigation, Cookie-Hinweise, Skripte, Stylesheets. Das Modell muss all das herauslösen und verbraucht dafür einen Teil seines Kontextfensters. Auf einer typischen Unternehmensstartseite macht der lesbare Text wenige Prozent der geladenen Bytes aus.

llms.txt schlägt vor, dass die Autoren der Website dieses Herauslösen vorab erledigen. Eine einzige Klartextdatei im Wurzelverzeichnis sagt in einem Absatz, was die Site ist, und listet darunter die Seiten, auf die es ankommt. Die Aufgabe des Modells sinkt von „Was steckt in diesem HTML-Haufen?“ auf „Welche Seite dieser Liste brauche ich?“.

Wo die Datei sich heute klar bewährt, sind Dokumentationsseiten, nicht Marketingseiten. Kann ein Entwicklerwerkzeug eine Datei von einer bekannten Adresse ziehen, statt die Installationsseite einer Bibliothek zu suchen, wird die Arbeit tatsächlich schneller. Auf einer Unternehmenswebsite ist der Gewinn indirekter — der Abschnitt weiter unten sagt das offen.

Wie schreibt man eine llms.txt-Datei?

Das Format ist Markdown, und die Spezifikation legt die Reihenfolge der Abschnitte fest. Diese Reihenfolge ist keine Geschmacksfrage, sondern die Struktur, die der Parser erwartet.

  1. Eine H1: der Name des Projekts oder der Site

    Das ist der einzige Abschnitt, den die Spezifikation verlangt. Eine Zeile, eine Überschrift, der vollständige Firmenname — kein Slogan.

  2. Eine Zusammenfassung als Blockquote

    Die Zeile beginnt mit >. Sie muss tragen, was zum Verständnis des restlichen Dateiinhalts nötig ist: was verkauft wird, an wen, wo. Die meisten kursierenden Beispiele setzen diese Zeile kursiv; die Spezifikation sagt Blockquote.

  3. Freie Abschnitte ohne Überschriften (optional)

    Nach der Zusammenfassung dürfen Absätze oder Listen ohne Überschriften folgen: keine Preisangaben, Maße in einer bestimmten Einheit, Bestellungen nur über Händler — hier steht so etwas.

  4. Linklisten unter H2-Überschriften

    Jede Zeile ist ein Markdown-Link, danach ein Doppelpunkt und eine kurze Notiz, worum es auf der Seite geht. Die Überschrift „Optional“ ist konventionsgemäß für Sekundäres reserviert: Links, die ein Agent überspringen kann, wenn der Kontext kürzer sein muss.

Ein vollständiges llms.txt-Beispiel
# Kuzey Möbel

> Ein Hersteller von Büro- und Wohnmöbeln mit Sitz in Istanbul. Katalog und
> technische Maße werden auf dieser Website veröffentlicht; der Verkauf läuft
> ausschließlich über Händler.

Es wird keine Preisliste veröffentlicht. Alle Produktmaße in Millimetern.

## Produkte

- [Bürostühle](https://example.com/produkte/buerostuehle): Maße, Stoffe und Garantie für 14 Modelle
- [Besprechungstische](https://example.com/produkte/besprechungstische): Modulare Tischsysteme, Maßtabelle für 6–24 Personen
- [Stauraum](https://example.com/produkte/stauraum): Schrank- und Rollcontainerserien, Schließoptionen

## Unternehmen

- [Über uns](https://example.com/ueber-uns): Gründungsjahr, Produktionsstätte und Kapazität
- [Händler](https://example.com/haendler): Bewerbungsbedingungen und Gebietsliste
- [Kontakt](https://example.com/kontakt): Adresse, Telefon und Öffnungszeiten

## Optional

- [Pressearchiv](https://example.com/presse): Veröffentlichte Mitteilungen
- [Karriere](https://example.com/karriere): Offene Stellen

Die Beschreibungen sind der wertvollste Teil der Datei: Die Linkliste sagt einem Modell, wohin es gehen könnte, die Beschreibung, ob sich die Anfrage lohnt.

Nicht jede Seite gehört auf die Liste. Der Maßstab lautet: die Seiten, die ein Modell braucht, um die Site zu verstehen. Bei einem Katalog mit dreihundert Produkten dreihundert Zeilen zu schreiben, macht aus der Karte eine Sitemap und nimmt der Datei ihren Sinn; nennen Sie die Kategorieseiten und lassen Sie die Produkte darunter.

Was ist der Unterschied zwischen llms.txt und llms-full.txt?

llms.txt ist eine Karte: Sie liefert Links, keinen Text. llms-full.txt fasst den gesamten Text der Site in einer Datei zusammen, damit ein Modell ihn lesen kann, ohne einem einzigen Link zu folgen. Der entscheidende Unterschied: llms-full.txt steht nicht in der Spezifikation. Es ist eine verbreitete Praxis, kein Standard — und so sollte man es behandeln.

In der Praxis entscheidet die Größe. Auf einer zwanzigseitigen Unternehmenssite ist das Zusammenfassen sinnvoll, die Datei bleibt bei einigen hundert Kilobyte. Bei einem Shop mit Tausenden Produkten wächst dieselbe Datei auf Megabyte; niemand lädt sie, und es brächte auch nichts. Dort ist es richtig, llms.txt zu schreiben und llms-full.txt wegzulassen.

Die Spezifikation empfiehlt außerdem einen weniger bekannten Weg: eine saubere Markdown-Fassung jeder Seite zu veröffentlichen — page.html.md oder die Endung durch .md ersetzt. Das ist günstiger als eine riesige Datei und deutlich leichter aktuell zu halten.

Wie muss die Datei ausgeliefert werden, und wie prüfe ich das?

Die Datei zu schreiben ist die leichte Hälfte. Dass der Server sie mit den richtigen Headern ausliefert, wird am häufigsten übersprungen — und eine falsch konfigurierte llms.txt sieht für einen Crawler aus wie gar keine Datei. Ein Befehl prüft das:

Auslieferung prüfen
$ curl -sIL https://example.com/llms.txt

HTTP/2 200
content-type: text/plain; charset=utf-8
content-length: 1483

# Unerwuenschte Antworten:
#   301/302  -> Weiterleitung; die Datei liegt nicht im Wurzelverzeichnis
#   404      -> nicht veroeffentlicht oder falscher Pfad
#   text/html-> der Server liefert sie als Seite aus
#   content-disposition: attachment -> Crawler koennen den Inhalt nicht lesen

Das Flag -L folgt Weiterleitungen; prüfen Sie, dass die Endadresse weiterhin /llms.txt lautet. Leitet ein CDN auf /llms.txt/ um, folgen die meisten Clients nicht.

  • Der Antwortcode muss 200 sein; eine 30x-Weiterleitungskette macht die Datei für manche Clients unsichtbar.
  • Der Content-Type muss text/plain mit charset=utf-8 sein, sonst brechen Nicht-ASCII-Zeichen.
  • Es darf keinen Header content-disposition: attachment geben — er markiert die Datei als Download statt als Lesbares.
  • Die Datei muss UTF-8 sein. Die Spezifikation erlaubt ein Byte-Order-Mark, doch bei unter Windows erzeugten Dateien hängt sich das BOM häufig an die erste Überschrift und zerstört die Zeile „# “.
  • Sie darf nicht hinter Authentifizierung oder Bot-Schutz liegen: Was curl ohne Login nicht lesen kann, kann auch kein Crawler lesen.

Wie fügt man llms.txt in Next.js, WordPress und Shopify ein?

Die Datei von Hand zu schreiben und auf den Server zu legen ist der kürzeste und zugleich brüchigste Weg: Ändert sich die Site, bleibt die Datei stehen und lügt binnen weniger Monate. Auf allen drei Plattformen ist es richtig, sie aus dem Inhalt zu erzeugen.

Next.js — app/llms.txt/route.ts
export const dynamic = "force-static";

export function GET() {
  const pages = [
    { url: "/produkte", name: "Produkte", note: "Katalog und Maßtabellen" },
    { url: "/haendler", name: "Händler", note: "Bewerbungsbedingungen und Gebiete" },
  ];

  const body = [
    "# Kuzey Möbel",
    "",
    "> Hersteller von Büro- und Wohnmöbeln aus Istanbul.",
    "",
    "## Seiten",
    "",
    ...pages.map((p) => `- [${p.name}](https://example.com${p.url}): ${p.note}`),
    "",
  ].join("\n");

  return new Response(body, {
    headers: { "content-type": "text/plain; charset=utf-8" },
  });
}

Da die Liste aus den Seitendaten selbst erzeugt wird, aktualisiert sich die Datei mit dem Inhalt. Die /llms.txt dieser Site entsteht genauso.

WordPress bietet zwei Wege. Eine physische Datei im Wurzelverzeichnis funktioniert, verschwindet aber bei der nächsten Theme- oder Servermigration; dauerhaft ist ein Plugin oder ein Hook in functions.php, der den Pfad /llms.txt abfängt und die Antwort aus veröffentlichten Inhalten baut. Bei einer physischen Datei gilt: Multisite-Installationen brauchen eine pro Domain.

Shopify ist anders, und das sollte man vorher wissen. Shopifys Theme-Templates erlauben nur, robots.txt.liquid zu bearbeiten; eine beliebige Datei im Wurzelverzeichnis gehört nicht zum Theme-Templating. In der Praxis wird llms.txt entweder über eine App bzw. einen Proxy oder über eine Edge-Schicht vor dem Shop (etwa einen Cloudflare Worker) ausgeliefert. Als Seite veröffentlichen und weiterleiten funktioniert nicht: Die Antwort kommt als HTML zurück, nicht als text/plain.

Liest überhaupt jemand llms.txt?

Das ist die meistverkaufte und am wenigsten ehrlich beantwortete Frage zu dieser Datei. Bis heute hat keine große Engine öffentlich erklärt, llms.txt zu lesen. Google schreibt ausdrücklich das Gegenteil: Für AI Overviews und AI Mode müsse man „keine neuen maschinenlesbaren Dateien, KI-Textdateien oder Markup erstellen“, und „es gibt auch keine speziellen schema.org-Daten, die Sie hinzufügen müssten“.

OpenAI und Anthropic dokumentieren ihre Crawler im Detail — welcher User-Agent welche Aufgabe hat, aus welchen IP-Bereichen — und in keiner der beiden Dokumentationen steht eine Zeile zur Unterstützung von llms.txt. Die Datei zu veröffentlichen öffnet also keinen Kanal, den die Engines lesen; es heißt, bereit zu sein, falls sie sich dafür entscheiden.

Trotzdem ist es vernünftig, sie zu veröffentlichen: Sie kostet einen Nachmittag, und ihre Leser sind nicht nur die großen Engines — Agenten, die eine einzige Anfrage an eine bekannte Adresse stellen, Dokumentationswerkzeuge und interne Suchsysteme nutzen die Datei heute. Die ehrliche Einordnung lautet: llms.txt ist ein günstiger, harmloser Schritt ganz unten auf der Prioritätenliste. Sobald er vor Crawler-Zugang und Seitenstruktur rutscht, wird er zur Zeitverschwendung.

Die Reihenfolge steht fest: zuerst Crawler-Zugang, dann die Antwortstruktur auf der Seite, dann Markup, ganz zuletzt llms.txt. Wird sie durchbrochen, entsteht das bekannte Bild — eine makellose llms.txt über einem in der robots.txt blockierten Such-Crawler.

Wie sieht llms.txt auf einer mehrsprachigen Website aus?

Da die Spezifikation die Datei auch unter Unterpfaden erlaubt, sind zwei Muster gültig. Erstens: eine Datei im Wurzelverzeichnis mit je einem H2-Abschnitt pro Sprache. Zweitens: je Sprache eine eigene Datei unter ihrem Pfad — /tr/llms.txt, /en/llms.txt — und die Wurzeldatei verweist darauf.

Auf einer mittelgroßen viersprachigen Site funktioniert das erste besser: eine Anfrage, eine Datei, alles beisammen. Überschreitet die Datei einige hundert Zeilen, wechseln Sie zum zweiten. In beiden Fällen ist ein Fehler fatal: Trennen sich die Sprache der Links und die der Beschreibungen, schickt die Datei das Modell auf die Seite in der falschen Sprache.

Eine Wurzeldatei, Abschnitte je Sprache
# Kuzey Mobilya

> İstanbul merkezli ofis ve ev mobilyası üreticisi. Site Türkçe, İngilizce ve
> Almanca yayımlanır; her sayfanın diğer dillerdeki karşılığı vardır.

## Türkçe

- [Ürünler](https://example.com/tr/urunler): Katalog ve ölçü tabloları
- [Bayilik](https://example.com/tr/bayilik): Başvuru koşulları

## English

- [Products](https://example.com/en/products): Catalogue and dimension tables
- [Dealership](https://example.com/en/dealership): Application terms

## Deutsch

- [Produkte](https://example.com/de/produkte): Katalog und Maßtabellen
- [Händler](https://example.com/de/haendler): Bewerbungsbedingungen

Worin unterscheiden sich llms.txt, robots.txt und sitemap.xml?

Drei Dateien, drei Aufgaben — keine ersetzt die andere

  • robots.txt

    Was sie sagt
    Welcher Crawler welchen Pfad abrufen darf
    Wer sie liest
    Alle Crawler
    Standard?
    Ja — RFC 9309
  • sitemap.xml

    Was sie sagt
    Liste der Adressen und ihrer Änderungsdaten
    Wer sie liest
    Suchmaschinen-Crawler
    Standard?
    Ja — sitemaps.org
  • llms.txt

    Was sie sagt
    Was die Site ist und worum es je Seite geht
    Wer sie liest
    Keine Engine erklärt Unterstützung; Agenten und Doku-Werkzeuge
    Standard?
    Nein — ein Vorschlag

Was sind die fünf häufigsten Fehler?

  • sitemap.xml kopieren und als llms.txt veröffentlichen. Eine Sitemap gibt Adressen; llms.txt soll Bedeutung geben, und eine Linkliste ohne Beschreibungen fügt nichts hinzu.
  • Die Zusammenfassung kursiv setzen. Die Spezifikation sagt Blockquote (>); eine kursive Zeile wird von einem streng parsenden Client nicht als Zusammenfassung erkannt.
  • Die Datei für eine Erlaubnis halten. llms.txt gewährt keinem Crawler etwas; liegt die Sperre in robots.txt oder in der Firewall, wird sie dort gelöst.
  • Die Datei schreiben und die Seiten lassen, wie sie waren. Die Karte führt ein Modell zur Seite; gibt es dort keine zitierfähige Passage, bleibt der Besuch folgenlos.
  • Einmal schreiben und vergessen. Eine llms.txt, deren drei Links nach einem halben Jahr 404 liefern, beschreibt die Site nicht — sie beschreibt sie falsch und zieht die Glaubwürdigkeit der ganzen Datei mit sich.

Häufige Fragen

Ist llms.txt verpflichtend?

Nein. llms.txt ist ein Vorschlag, kein von Suchmaschinen oder Modellanbietern gemeinsam übernommener Standard, und ihre bloße Existenz bringt weder Ranking noch Zitationen. Sie ist günstig genug, um sie zu veröffentlichen, steht in jeder Prioritätenfolge aber hinter Crawler-Zugang und Seitenstruktur.

Nützt llms.txt der SEO?

Auf das klassische Ranking hat sie keinen direkten Einfluss, und Google schreibt das in seiner Dokumentation: Für das Erscheinen in KI-Funktionen braucht es keine neue maschinenlesbare Datei. Der indirekte Nutzen ist jedoch real — die Datei zu schreiben zwingt zur Durchsicht, welche Seiten überhaupt etwas erklären, und diese Durchsicht endet meist damit, die Seiten selbst zu verbessern.

Wie lang sollte llms.txt sein?

Die Spezifikation setzt keine Grenze, doch der Zweck der Datei setzt eine: ein Modell soll die Site in einem Durchgang verstehen. Auf einer Unternehmenswebsite sind das meist 20–60 Links. Eine llms.txt mit Hunderten Zeilen ist keine Karte mehr, sondern ein Verzeichnis — und holt genau das Problem zurück, das die Datei lösen sollte.

Ich habe llms.txt veröffentlicht, erscheine aber weiterhin nicht in ChatGPT — warum?

Weil beides nichts miteinander zu tun hat. Beantwortet ChatGPT eine Frage, sucht es — und zwar mit OAI-SearchBot; ist dieser Crawler in der robots.txt blockiert oder wird er vom Bot-Schutz vor dem Server verworfen, liest er Ihre Site nie. llms.txt ändert kein Glied dieser Kette. Prüfen Sie zuerst den Zugang und stellen Sie dann sicher, dass die Seite eine zitierfähige Antwortpassage trägt.

Wie oft sollte llms.txt aktualisiert werden?

Ist die Datei handgeschrieben, muss sie nach jedem neuen Bereich und jeder entfernten Seite geprüft werden — praktisch monatlich. Wird sie aus dem Inhalt erzeugt, erledigt sich die Frage von selbst, und das ist der vorzuziehende Weg. Die billigste Kontrolle ist ein monatliches Skript, das jeden Link der Datei abruft und die 404er meldet.

Quellen

  1. 01The /llms.txt file proposalllmstxt.org, 2024
  2. 02AI features and your websiteGoogle Search Central, 2026
  3. 03OpenAI crawlers: GPTBot, OAI-SearchBot, ChatGPT-User, OAI-AdsBotOpenAI, 2026
  4. 04GEO: Generative Engine OptimizationAggarwal, Murahari, Rajpurohit, Kalyan — KDD 2024, 2024

Suchanfragen, die diese Seite beantwortet

  • llms.txt
  • llms.txt erstellen
  • llms.txt beispiel
  • was ist llms.txt

Sprechen wir über Ihr Projekt.

Eine neue Marke, eine zu erneuernde Website oder Sichtbarkeit in der Suche — schreiben Sie uns, wo Sie beginnen möchten, und wir entwerfen den Weg gemeinsam.