llms.txt erklärt: Anleitung, Beispiele, Nutzen
Die llms.txt ist eine Markdown-Textdatei im Hauptverzeichnis deiner Website (deine-domain.de/llms.txt), die KI-Systemen zeigt, welche deiner Inhalte wichtig sind. Sie ist kein offizieller Standard, kein Rankingfaktor und wird Stand August 2026 noch selten abgerufen. Sie kostet aber nur zehn Minuten — und ist da, wenn ein KI-Agent sie liest.
Was die llms.txt ist
Die llms.txt ist ein offener Vorschlag von Jeremy Howard, veröffentlicht im September 2024: eine Markdown-Datei unter /llms.txt, die KI-Systemen einen kuratierten Überblick über deine Website gibt — Kurzbeschreibung plus Links zu den wichtigsten Seiten. Die Spezifikation ist öffentlich einsehbar und passt auf eine Bildschirmseite.
Der Gedanke dahinter ist ein praktischer: Sprachmodelle haben ein begrenztes Kontextfenster. Sie können nicht deine kompletten 180 Unterseiten lesen, bevor sie eine Frage über dich beantworten. Eine Navigation aus verschachtelten Menüs, Cookie-Bannern und JavaScript hilft ihnen dabei nicht. Die llms.txt reicht ihnen stattdessen einen Spickzettel: Das hier sind wir, das sind die fünf bis fünfzehn Seiten, auf die es ankommt.
Der Unterschied zu robots.txt und sitemap.xml
Die drei Dateien liegen am selben Ort und werden gern verwechselt. Sie beantworten aber drei verschiedene Fragen: Die robots.txt sagt, was ein Crawler darf. Die sitemap.xml sagt, was es alles gibt. Die llms.txt sagt, was sich lohnt.

Der Unterschied zur Sitemap ist der wichtigste: Eine Sitemap ist vollständig und unsortiert, sie listet auch das Impressum und die Seite „Stellenangebot Aushilfe 2019". Die llms.txt ist redaktionell. Du entscheidest, was drinsteht — und was bewusst nicht.
Wie eine llms.txt aufgebaut ist
Die Spezifikation verlangt genau einen Teil zwingend: eine H1 mit dem Namen. Alles andere ist optional, aber in dieser Reihenfolge vorgesehen.

- 01H1 mit dem Namen deines Unternehmens oder Projekts — der einzige Pflichtteil.
- 02Ein Zitatblock (beginnt mit
>) als Kurzbeschreibung: wer, wo, was. - 03Optional Fließtext mit Details, die kein Link abdeckt.
- 04H2-Abschnitte mit Linklisten im Format
- [Titel](URL): kurze Notiz. - 05Optional ein Abschnitt
## Optional— dieser Name ist in der Spezifikation reserviert und bedeutet: Diese Links darfst du weglassen, wenn der Platz knapp wird.
Ein vollständiges Beispiel für einen lokalen Dienstleister:
# Schnittwerk Hamburg
> Friseursalon in Hamburg-Ottensen: Schnitt, Coloration,
> Balayage. Online-Termine, faire Preise, seit 2015.
## Wichtige Seiten
- [Leistungen & Preise](https://schnittwerk-hamburg.de/preise): Alle Services mit Preisen
- [Online-Termin](https://schnittwerk-hamburg.de/termin): Direkt buchen
- [Über uns](https://schnittwerk-hamburg.de/ueber-uns): Team und Salon
- [FAQ](https://schnittwerk-hamburg.de/faq): Häufige Fragen
## Kontakt
- [Kontakt & Anfahrt](https://schnittwerk-hamburg.de/kontakt): Adresse, Öffnungszeiten
## Optional
- [Blog](https://schnittwerk-hamburg.de/blog): Pflegetipps und Trends
Und dasselbe für einen B2B-Anbieter, bei dem die Leistungsseiten einzeln zählen:
# Ostwald Kältetechnik GmbH
> Planung, Installation und Wartung gewerblicher Kälteanlagen
> in Norddeutschland. Seit 1987, 24-Stunden-Notdienst.
## Leistungen
- [Kälteanlagenbau](https://ostwald-kaelte.de/anlagenbau): Planung und Montage, Gewerbe und Industrie
- [Wartung & Notdienst](https://ostwald-kaelte.de/wartung): Wartungsverträge, Störungsdienst rund um die Uhr
- [Kühlraumbau](https://ostwald-kaelte.de/kuehlraeume): Kühl- und Tiefkühlzellen nach Maß
## Referenzen & Vertrauen
- [Projekte](https://ostwald-kaelte.de/referenzen): Umgesetzte Anlagen mit Kennzahlen
- [Zertifikate](https://ostwald-kaelte.de/zertifikate): Sachkundenachweise nach ChemKlimaschutzV
## Kontakt
- [Standorte](https://ostwald-kaelte.de/standorte): Hamburg, Bremen, Kiel
Beispiel für einen Onlineshop
Shops sind der Fall, in dem die Datei am meisten bringt und am häufigsten falsch gebaut wird. Der Reflex ist, alle Kategorien aufzuführen. Richtig ist das Gegenteil: Sortimentsebene statt Filterebene, plus die Seiten, die eine Kaufentscheidung beantworten.
# Nordlicht Kaffeerösterei
> Kaffeerösterei aus Kiel. Direkt gehandelte Bohnen,
> wöchentlich frisch geröstet, Versand innerhalb Deutschlands.
## Sortiment
- [Espresso](https://nordlicht-kaffee.de/espresso): Dunkle Röstungen für Siebträger und Vollautomat
- [Filterkaffee](https://nordlicht-kaffee.de/filter): Helle Röstungen, Handfilter und Karlsbader Kanne
- [Abo](https://nordlicht-kaffee.de/abo): Feste Lieferung alle zwei oder vier Wochen
## Kaufentscheidung
- [Versand & Lieferzeit](https://nordlicht-kaffee.de/versand): Kosten, Dauer, Länder
- [Rückgabe](https://nordlicht-kaffee.de/rueckgabe): 30 Tage, Ablauf und Bedingungen
- [Röstprofile erklärt](https://nordlicht-kaffee.de/roestung): Welche Bohne zu welcher Zubereitung passt
## Optional
- [Über die Rösterei](https://nordlicht-kaffee.de/ueber-uns): Herkunft, Handel, Team
Was hier bewusst fehlt: einzelne Produktseiten, Filterkombinationen, Seiten wie ?farbe=schwarz&sortierung=preis. Genau die füllen sonst die Datei und machen sie wertlos.
llms.txt erstellen: Anleitung in zehn Minuten
- 01Eine leere Textdatei anlegen und
llms.txtnennen — die Endung.txt, nicht.md. - 02Als UTF-8 speichern, sonst werden Umlaute zu Buchstabensalat.
- 03Inhalt nach dem Muster oben schreiben: H1, Zitatblock, dann die Abschnitte.
- 04Nur die 5–15 wirklich wichtigen Seiten verlinken. Kuratieren, nicht kippen.
- 05Jeden Link mit einem Halbsatz beschreiben — der Text nach dem Doppelpunkt ist das, was das Modell später als Einordnung nutzt.
- 06Per FTP ins Hauptverzeichnis hochladen, dorthin, wo auch die robots.txt liegt.
- 07Testen:
deine-domain.de/llms.txtim Browser aufrufen. Es muss reiner Text erscheinen — kein Layout, keine 404-Seite.
Auf Deutsch oder auf Englisch?
Für eine deutschsprachige Website schreibst du die llms.txt auf Deutsch. Die Datei beschreibt Inhalte, die auf Deutsch vorliegen, und sie wird in dem Moment gelesen, in dem jemand eine deutschsprachige Frage stellt. Eine englische Beschreibung deutscher Seiten erzeugt nur eine Übersetzungsstufe, die niemand braucht.
Zwei Ausnahmen sind sinnvoll. Bei einer mehrsprachigen Website nimmst du die Hauptsprache und führst die anderen Sprachversionen als eigene Abschnitte auf — ## Deutsch, ## English — jeweils mit den Adressen der jeweiligen Sprachfassung. Und wenn du Software oder Dokumentation für ein internationales Publikum anbietest, ist Englisch die naheliegende Wahl, auch bei deutschem Firmensitz.
Ortsangaben und Eigennamen bleiben in jedem Fall unübersetzt: „Kälteanlagenbau in Schleswig-Holstein" ist eine brauchbare Angabe, „refrigeration systems in Northern Germany" ist es für eine Anfrage auf Deutsch nicht.
Implementierung je nach System
Die Datei selbst ist in zehn Minuten geschrieben. Der Aufwand steckt darin, sie an die richtige Stelle zu bekommen — und das unterscheidet sich je nach System erheblich.
| System | Weg | Stolperstein |
|---|---|---|
| WordPress, TYPO3, Shopware | Per FTP oder Dateimanager ins Wurzelverzeichnis, neben robots.txt und index.php | Sicherheits-Plugins blockieren Direktzugriffe auf Dateien im Wurzelverzeichnis → 403 |
| Statische Generatoren (Hugo, Eleventy, Astro) | In den Ordner für unverarbeitete Dateien legen (static/, public/) | Wird sonst vom Build verarbeitet oder gar nicht kopiert |
| Next.js, Nuxt | Nach public/ — landet beim Build unverändert im Wurzelverzeichnis | Kein Stolperstein, funktioniert zuverlässig |
| Shopify | Kein Zugriff auf das Wurzelverzeichnis. Umweg über eine App oder eine Weiterleitung | /llms.txt lässt sich nicht direkt anlegen — vorher prüfen, ob der Umweg den Aufwand wert ist |
| Wix, Jimdo, Squarespace | Je nach Tarif gar nicht möglich | Ohne Dateizugriff bleibt nur, auf eine Funktion des Anbieters zu warten |
Bei WordPress gibt es keinen Menüpunkt dafür, und du brauchst auch kein Plugin: Die Datei kommt per FTP direkt ins Wurzelverzeichnis, dorthin, wo wp-config.php liegt. Wichtig ist nur, dass dein Server sie mit dem Content-Type text/plain ausliefert — was er bei einer .txt-Datei von allein tut.
Wer sie nicht bei jeder Inhaltsänderung von Hand nachziehen will, kann sie erzeugen lassen: Unser eigenes Plugin GEO Copilot Suite baut die Datei aus deinen Inhalten oder aus einer Liste, die du selbst zusammenstellst, und warnt, wenn ein anderes Plugin oder eine echte Datei im Wurzelverzeichnis bereits eine ausliefert. Nötig ist das nicht — bequemer schon.
Zwei Prüfungen nach dem Hochladen lohnen sich, weil sie stille Fehler aufdecken:
- Statuscode und Content-Type. Im Browser genügt der Aufruf; genauer geht es über die Kommandozeile mit
curl -I https://deine-domain.de/llms.txt. Erwartet werden200undtext/plain. Kommt403, blockiert ein Plugin oder eine.htaccess-Regel. - Kein Redirect. Manche Konfigurationen leiten unbekannte Pfade auf die Startseite um. Dann liefert der Aufruf zwar
200, aber die Startseite in HTML — von außen sieht das aus wie eine funktionierende Datei.
llms.txt und llms-full.txt
Neben der llms.txt kursiert eine zweite Datei: llms-full.txt. Der Unterschied ist einfach. Die llms.txt ist ein Verzeichnis mit Links, die llms-full.txt enthält den Text der verlinkten Seiten direkt — ein Modell kann alles in einem Abruf lesen, ohne jedem Link zu folgen.
Sie stammt nicht aus der ursprünglichen Spezifikation, sondern hat sich bei Dokumentations-Plattformen als Gewohnheit etabliert. Für Software-Dokumentation ergibt das Sinn: Der komplette Referenztext in einer Datei ist genau das, was ein Entwicklerwerkzeug braucht.
Für eine normale Firmenwebsite lohnt sie nicht. Sie wird groß, muss bei jeder Textänderung neu erzeugt werden, und ihr Inhalt steht ohnehin schon auf den verlinkten Seiten. Anlegen würden wir sie nur bei umfangreicher, häufig abgefragter Dokumentation.
Für wen sich der Aufwand lohnt
| Website-Typ | Nutzen | Warum |
|---|---|---|
| Shop mit vielen Kategorien | hoch | Ohne Kuratierung landet das Modell in der Filter-Navigation statt bei den Sortimenten |
| Dienstleister mit 5+ Leistungsseiten | hoch | Die einzelnen Leistungen sind das, wonach gefragt wird — sie müssen einzeln benannt sein |
| Dokumentation, Software, SaaS | hoch | Ursprünglicher Anwendungsfall der Spezifikation; Entwickler-Werkzeuge lesen sie aktiv aus |
| Lokaler Betrieb, 5–15 Seiten | mittel | Schadet nicht, ersetzt aber weder Unternehmensprofil noch Verzeichniseinträge |
| Einseitige Website (Onepager) | gering | Es gibt nichts zu kuratieren — hier zählt allein der Seiteninhalt |
Woran du merkst, ob sie gelesen wird
Das lässt sich überprüfen, wird aber selten erwähnt. Jeder Abruf steht im Zugriffsprotokoll deines Servers, und die meisten Hoster legen es unter logs/access.log ab. Über SSH reicht eine Zeile:
grep "llms.txt" ~/logs/access.log | tail -20
Heraus kommen Zeilen wie diese — Datum, abgerufener Pfad, Statuscode und der User-Agent des Abrufers:
54.36.148.11 - - [24/Jul/2026:09:14:02] "GET /llms.txt HTTP/1.1" 200 812
"-" "Mozilla/5.0 (compatible; PerplexityBot/1.0; +https://perplexity.ai/bot)"
Zwei Dinge liest du daraus ab: Der Statuscode muss 200 sein (bei 404 liegt die Datei am falschen Ort, bei 403 blockt ein Plugin), und im User-Agent steht, wer angeklopft hat. Ohne SSH-Zugang findest du dieselben Daten in den Zugriffsstatistiken deines Hosting-Pakets, meist unter „Webalizer" oder „AWStats".
Stell dich darauf ein, dass dort erst einmal nichts steht — und dass die ersten Einträge von SEO-Werkzeugen stammen, nicht von KI-Diensten. Die Zahlen dazu stehen weiter unten unter Was sie 2026 bringt.
Die häufigsten Fehler
- Die komplette Sitemap hineinkopieren. 200 Links ohne Beschreibung sind genau das, was die Datei vermeiden soll. Wer alles betont, betont nichts.
- Relative Pfade benutzen.
/preisefunktioniert nicht zuverlässig, die vollständige URL mithttps://schon. - Marketing statt Beschreibung. „Ihr kompetenter Partner für ganzheitliche Lösungen" sagt einem Modell nichts. „Friseursalon in Hamburg-Ottensen, spezialisiert auf Balayage" sagt ihm Branche, Ort und Schwerpunkt.
- Die Datei im Unterverzeichnis ablegen.
/wp-content/llms.txtoder/de/llms.txtwird nicht gefunden. Gültig ist nur das Wurzelverzeichnis der Domain. - Als HTML ausliefern. Wenn ein Plugin die Datei dynamisch erzeugt und in das Seitenlayout einbettet, steht der Inhalt zwischen Navigation und Cookie-Banner. Dann ist der Zweck verfehlt.
- Einmal anlegen und vergessen. Ändern sich Leistungen oder URLs, zeigt die Datei ins Leere. Zweimal im Jahr draufschauen reicht.
Was sie 2026 bringt
Hier lohnt der nüchterne Blick, weil im Netz beide Extreme kursieren. Anders als vor einem Jahr gibt es inzwischen belastbare Zahlen — und die fallen ernüchternd aus.
Google nutzt sie nicht. In der eigenen Anleitung zu KI-Funktionen schreibt Google Search Central, dass keine zusätzlichen maschinenlesbaren Dateien nötig sind, um in den Suchergebnissen samt KI-Funktionen aufzutauchen (Google Search Central: AI features and your website). Das gilt für Rankings genauso wie für AI Overviews.
Gelesen wird sie kaum. Ahrefs hat im Juni 2026 rund 137.000 Domains ausgewertet: Von den Websites mit gültiger llms.txt bekamen 97 Prozent im Mai 2026 keinen einzigen Abruf dieser Datei (Ahrefs-Studie). Bei den wenigen Abrufen kam der größte Anteil von SEO-Werkzeugen, nicht von KI-Diensten; auf Abrufe durch KI-Systeme entfiel rund ein Prozent.
Verbreitet wird sie trotzdem. Die Zahl der Websites mit llms.txt ist zwischen Juni 2025 und Mai 2026 um das rund Neunfache gestiegen. Und Googles eigenes Prüfwerkzeug Lighthouse hat die llms.txt-Prüfung mit Version 13.3 im Mai 2026 aus dem Experimentierstatus in die reguläre Kategorie „Agentic Browsing" übernommen. Das passt zum eigentlichen Zweck: Die Datei zielt eher auf Agenten, die Websites bedienen, als auf die klassische Suche.
Was folgt daraus? Die Datei ist kein Rankingfaktor und kein Hebel für Sichtbarkeit. Sie kostet zehn Minuten, richtet keinen Schaden an und ist an dem Tag da, an dem ein Agent sie braucht. Ich würd sie deshalb anlegen — aber niemand sollte dafür eine Agentur bezahlen oder ein Projekt danach planen. Wer sie hochlädt und danach nichts an Entität und Erwähnungen tut, wird keinen Unterschied merken.
Unser Check bewertet die llms.txt als eines von mehreren Technik-Signalen — nicht weil sie allein etwas bewirkt, sondern weil ihr Vorhandensein zuverlässig anzeigt, dass eine Website KI-seitig gepflegt wird.
Häufige Fragen
Braucht ein kleines Unternehmen das überhaupt?
Wenn die Website unter zwanzig Seiten hat, ist der Nutzen gering — ein Modell erfasst so eine Seite ohnehin. Ab etwa fünfzig Unterseiten, verschachtelter Navigation oder einem Shop wird der kuratierte Überblick sinnvoll.
Wo genau muss die Datei liegen?
Im Wurzelverzeichnis der Domain, sodass sie unter https://deine-domain.de/llms.txt erreichbar ist — also dort, wo auch robots.txt und die Startseite liegen. Unterverzeichnisse und Sprachordner funktionieren nicht. Bei Subdomains braucht jede Subdomain ihre eigene Datei.
Muss ich zusätzlich Markdown-Versionen meiner Seiten anbieten?
Die Spezifikation schlägt vor, jede Seite zusätzlich unter derselben URL plus .md bereitzustellen. Das ist der aufwendige Teil und für die allermeisten Websites unnötig. Die llms.txt allein bringt den Großteil des Nutzens.
Muss ich die llms.txt in der robots.txt eintragen?
Nein, vorgesehen ist das nicht. Eine Zeile mit dem Verweis in der robots.txt schadet aber nicht und macht die Datei für Werkzeuge auffindbar, die dort nachsehen. Wichtiger ist die umgekehrte Prüfung: dass deine robots.txt die KI-Crawler nicht sperrt.
Schadet sie, wenn niemand sie liest?
Nein. Sie ist eine statische Textdatei ohne Nebenwirkungen auf Ladezeit, Indexierung oder Rankings.
Reicht ein Generator?
Zum Anfangen ja — es gibt kostenlose Werkzeuge, die aus deiner Domain einen Entwurf bauen. Danach solltest du aber von Hand durchgehen und kürzen. Generatoren neigen dazu, zu viel aufzunehmen, und die Beschreibungstexte sind generisch.
Einordnung im Gesamtbild
Die llms.txt ist ein Baustein der technischen Ebene — die unterste Stufe. Darüber liegen Entität, Quellenpräsenz und zitierfähige Inhalte, und dort wird der eigentliche Unterschied gemacht. Wo GEO über klassisches SEO hinausgeht, ordnet GEO vs. SEO ein; welche Hebel für tatsächliche KI-Nennungen sorgen, bündelt der 5-Hebel-Guide. Deutlich mehr Wirkung als die llms.txt haben strukturierte Daten — die werden nachweislich ausgewertet.
Und bevor du die llms.txt anlegst, lohnt ein Blick in die robots.txt: Wenn die KI-Crawler dort gesperrt sind, liest ohnehin niemand mit (Guide zur Freigabe). Wer die technische Seite systematisch abarbeiten will, findet den Ablauf im Audit in vier Schritten.
Ob deine llms.txt (und der Rest der Technik) steht, zeigt dir der Check.
Technik prüfen →