Preis berechnen
Alle Artikel

llms.txt: Ich habe die Datei gebaut. Hier ist, was sie bringt.

Google sagt öffentlich, dass die Datei nichts bewirkt. Die Abrufzahlen bestätigen es. Warum sie auf dieser Website trotzdem liegt, und welche der drei maschinenlesbaren Schichten sich wirklich rechnet.

Unter maikel-szymanski.de/llms.txt liegt eine Datei. Sie listet auf, worum es auf dieser Website geht, welche Leistungen es gibt, welche Artikel wo stehen. Sie wird automatisch erzeugt und ist immer aktuell.

Ich habe sie gebaut, weil ich wissen wollte, ob sie etwas bringt. Die Antwort ist: nach allem, was sich belegen lässt, fast nichts. Trotzdem lasse ich sie liegen. Warum beides stimmt, ist das Thema dieses Artikels – und es ist ein gutes Beispiel dafür, wie man bei KI-Themen zwischen Beleg und Behauptung unterscheidet.

Was llms.txt sein wollte

Die Idee entstand 2024 und ist nachvollziehbar. Ein Sprachmodell, das eine Website lesen soll, muss sich durch Navigation, Cookie-Hinweise, Footer und Werbung wühlen, um an den Inhalt zu kommen. llms.txt sollte diese Arbeit abkürzen: eine Datei in einfacher Textform, die sagt, was wichtig ist und wo es steht. Ein Inhaltsverzeichnis für Maschinen.

Wichtig zur Einordnung, weil es ständig verwechselt wird:

Datei Regelt Verbindlich?
robots.txt wer was abrufen darf freiwillig, aber seit Jahrzehnten etabliert und weithin befolgt
llms.txt was inhaltlich wichtig ist reiner Vorschlag, kein Standard, keine Verpflichtung

llms.txt sperrt nichts und erlaubt nichts. Sie ist eine Selbstbeschreibung – und genau das ist ihr Konstruktionsfehler.

Was die Zahlen sagen

Drei Befunde, alle aus dem Jahr 2026, alle in dieselbe Richtung.

Verbreitung. Eine Untersuchung von rund 300.000 Domains fand die Datei auf etwa 10 % der Websites. Das klingt nach viel, ist aber seit über einem Jahr praktisch unverändert – von einer Durchsetzung kann keine Rede sein.

Abrufe. Die härteste Zahl. In einer Auswertung von über 500 Millionen Zugriffen durch KI-Programme über 90 Tage entfielen ganze 408 auf llms.txt. GPTBot, ClaudeBot, PerplexityBot, OAI-SearchBot und Google-Extended holen sich überwiegend direkt das HTML. Sie fragen die Datei nicht ab, weil sie sie nicht brauchen: Ein Modell, das Text lesen kann, kann auch eine Website lesen.

Googles Position. Die ist seit Sommer 2026 eindeutig. In Googles Anleitung zu generativen KI-Funktionen steht sinngemäß: Man braucht keine neuen maschinenlesbaren Dateien, keine KI-Textdateien, kein zusätzliches Markdown. Die Datei hat weder positiven noch negativen Einfluss auf die Suche oder auf AI Overviews – sie wird schlicht ignoriert. John Mueller hat den Vergleich gezogen, der hängen bleibt: Es erinnert an das Keyword-Meta-Tag, das Google seit Jahren nicht mehr beachtet.

Sein Argument dahinter ist das eigentlich interessante: Eine Datei, in der jede Website selbst behauptet, welche ihrer Seiten die besten sind, kann Websites nicht voneinander unterscheiden. Weil jede dasselbe behaupten wird.

Kurzfassung: Kein großer Anbieter hat öffentlich zugesagt, llms.txt als Signal zu verwenden. Die Datei schadet nicht, aber wer sie als „KI-Optimierung“ verkauft bekommt, zahlt für ein Häkchen.

Warum sie hier trotzdem liegt

Drei Gründe, und keiner davon heißt „weil es SEO bringt“.

Erstens: Sie kostet mich nichts. Die Datei wird bei jeder Inhaltsänderung automatisch neu erzeugt, aus denselben Daten, die ohnehin vorliegen. Kein Pflegeaufwand, kein Veralten. Wer die Datei dagegen von Hand pflegen muss, sollte es lassen – eine veraltete Beschreibung ist schlechter als gar keine.

Zweitens: Ich empfehle nichts, was ich nicht selbst betreibe. Wenn mich ein Kunde fragt, ob er so etwas braucht, möchte ich aus eigener Anschauung antworten können und nicht aus einem Blogartikel.

Drittens: Die Datei ist ein Abfallprodukt von etwas Nützlichem. Und das ist der eigentliche Punkt.

Die Schicht, die sich wirklich rechnet

Beim Bauen der llms.txt fällt zwangsläufig etwas anderes an: eine strukturierte Liste aller Seiten mit Titel, Beschreibung, Volltext und – je nach Seitentyp – Preisspanne, Branche, Ort, Datum. Auf dieser Website liegt das als JSON-Datei.

Diese Datei liest kein fremder KI-Anbieter. Sie wird von den Werkzeugen benutzt, die auf dieser Website für KI-Agenten im Browser bereitstehen: Ein Agent, der in Chrome die Seite geöffnet hat, kann damit Artikel durchsuchen, Leistungen abfragen oder eine Preisspanne berechnen lassen, ohne sich durch Screenshots zu raten. Darüber schreibe ich in dieser Reihe noch ausführlich.

Der Unterschied ist grundsätzlich und lohnt sich zu merken:

Schicht Wer liest sie Nachweisbarer Nutzen
llms.txt fast niemand keiner
strukturierter Index eigene Werkzeuge, eigene Suche mittelbar, aber real
saubere Seiten im HTML jedes Programm, jeder Mensch hoch
Werkzeuge für Agenten im Browser Agenten in Chrome neu, messbar am eigenen Einsatz

Die Reihenfolge der Arbeit ergibt sich daraus von selbst – und sie ist genau umgekehrt zu der Reihenfolge, in der die Themen üblicherweise verkauft werden.

Was das für deine Website heißt

Wenn dir jemand llms.txt als Leistung anbietet, ist das kein Grund zur Empörung. Es ist aber ein guter Anlass für eine Rückfrage: Was steht noch auf der Liste?

  • Kommt danach „strukturierte Daten für KI“ und „Content für KI aufbereiten“, aber nichts über Indexierung, Ladezeit und Inhalt: Vorsicht.
  • Kommt danach „wir prüfen, ob Ihre Seiten überhaupt indexiert sind“: gutes Zeichen.

Und wenn du die Datei selbst anlegen willst, weil es zehn Minuten dauert: Mach es, aber trag sie nicht als erledigten KI-Punkt ab. Die zwölf Punkte, die tatsächlich darüber entscheiden, ob eine Maschine deine Website versteht, stehen im Selbsttest – und keiner davon ist eine Datei.

Was die KI-Programme auf dieser Website tatsächlich abrufen, steht im Serverlog. Was dort steht, schreibe ich auf, wenn genug Tage zusammengekommen sind – mit den echten Zeilen, nicht mit den Zahlen von jemand anderem.

Häufige Fragen

Was ist llms.txt überhaupt?

Eine Textdatei unter /llms.txt, die einer KI in Kurzform sagt, worum es auf der Website geht und welche Seiten wichtig sind – gedacht als Inhaltsverzeichnis für Sprachmodelle. Sie ist kein Standard, sondern ein Vorschlag aus der Community, und sie regelt anders als robots.txt keinen Zugriff. Sie verbietet und erlaubt nichts, sie beschreibt nur.

Schadet llms.txt meiner Website?

Nein. Google hat im Juni 2026 klargestellt, dass die Datei weder hilft noch schadet – die Suche ignoriert sie schlicht. Wer sie hat, verliert nichts außer der Zeit für die Pflege. Riskant wird es nur, wenn die Datei veraltet: Dann beschreibt sie Seiten, die es nicht mehr gibt.

Warum steht llms.txt dann auf jeder SEO-Checkliste?

Weil sie leicht zu verkaufen und leicht zu prüfen ist. Eine Datei, die man anlegen kann und danach abhaken, passt besser in ein Angebot als der Satz „schreiben Sie bessere Seiten“. Das macht sie nicht zum Betrug, aber zu einem Punkt, der auf Checklisten weiter oben steht, als er es verdient.

Was bringt stattdessen etwas?

Dass der Text im ausgelieferten HTML steht, dass Überschriften den Inhalt benennen, dass Fakten als Zahlen und Tabellen dastehen und dass die Seite indexiert ist. Das sind die Punkte, die Google in seiner eigenen Anleitung nennt – und die man nicht in zehn Minuten abhaken kann.

Quellen

  1. Guide to Optimizing for Generative AI Features on Google Search Google Search Central · abgerufen 13.09.2026
  2. llms.txt in Practice: Adoption Data, Evidence, and Setup Digital Applied, 2026 · abgerufen 13.09.2026
  3. llms.txt: What the 2026 Data Actually Shows Geojacker, 2026 · abgerufen 13.09.2026

In zwei Minuten weißt du, was deine Website kostet.