Zum Inhalt springen

Startseite › SEO-Leitfaden › Die Dateien, die KI-Agenten lesen

Die Dateien, die KI-Agenten lesen

Die Dateien, die KI-Agenten lesen, umfassen robots.txt, die seit zwanzig Jahren auf Websites existiert, und llms.txt, die erst seit 2024 vorgeschlagen wird. Robots.txt legt fest, welche Bots Ihre Inhalte lesen dürfen, und laut Googles eigener Dokumentation benötigen Sie keine speziellen KI-Textdateien für die Suche. Der Unterschied zwischen Training und Zitierung wird ebenfalls erläutert.

Die Dateien, die KI-Agenten lesen

Die Frage kommt meist in der Form „Welche Datei muss ich auf die Website legen, um in ChatGPT aufzutauchen?“. Die kurze Antwort lautet: Die am stärksten beworbene Datei bewirkt fast nichts, und die, die wirklich zählt, existiert seit zwanzig Jahren auf Ihrer Website und heißt robots.txt.

Dieses Kapitel ist das vergänglichste im ganzen Leitfaden. Die Angaben unten wurden am 18. August 2026 an der Quelle geprüft, direkt in der Dokumentation jedes Anbieters. Wenn Sie es viel später lesen, prüfen Sie sie erneut.

Wer Ihre Website tatsächlich liest

„Den KI-Bot“ gibt es nicht. Jedes Unternehmen setzt mehrere Bots mit unterschiedlichen Zwecken ein, und die Unterscheidung zwischen ihnen ist die wichtigste Geschäftsentscheidung in diesem Kapitel.

BotWerWas er tut
GPTBotOpenAISammelt Inhalte, die zum Training der Modelle verwendet werden können
OAI-SearchBotOpenAIIndexiert für die Suche in ChatGPT. Dieser kann Ihnen Zitierungen bringen
ChatGPT-UserOpenAIÖffnet eine Seite, weil ein Mensch im Gespräch danach gefragt hat
OAI-AdsBotOpenAIPrüft die Sicherheit von Seiten, die als Anzeigen vorgeschlagen werden
ClaudeBotAnthropicSammelt Inhalte für das Training
Claude-SearchBotAnthropicVerbessert die Qualität der Suchergebnisse
Claude-UserAnthropicÖffnet Seiten auf Anfrage eines Nutzers
Google-ExtendedGoogleSteuert die Verwendung zum Training der Google-Modelle. Beeinflusst die Position in der Suche nicht
PerplexityBotPerplexityIndexiert für die Antworten von Perplexity
CCBotCommon CrawlÖffentliches Archiv, das anschließend von sehr vielen anderen genutzt wird

Die Unterscheidung, die zählt: Das Training zu blockieren ist nicht dasselbe wie das Zitieren zu blockieren.

Wenn Sie GPTBot blockieren, fließen Ihre Inhalte nicht in das Training künftiger Modelle ein, Sie können aber über OAI-SearchBot weiterhin in Antworten zitiert werden. Wenn Sie alles blockieren, verschwinden Sie aus beidem. Es sind zwei getrennte Entscheidungen, und die meisten Firmen treffen sie versehentlich als eine einzige.

robots.txt, die einzige Datei, die wirklich zählt

Sie liegt unter der Adresse ihre-website.ro/robots.txt. Öffnen Sie sie jetzt, sie ist öffentlich. Jeder Block sagt einem Bot, was er lesen darf.

Für eine Firma, die gefunden werden will, erlaubt die vernünftige Konfiguration die Such-Bots und überlässt die Entscheidung über das Training Ihnen. Die Variante „Ich will zitiert werden, das Training ist mir egal“ sieht so aus:

# OpenAI
User-agent: OAI-SearchBot
Allow: /

User-agent: ChatGPT-User
Allow: /

# Anthropic
User-agent: Claude-SearchBot
Allow: /

User-agent: Claude-User
Allow: /

# Perplexity
User-agent: PerplexityBot
Allow: /

Wenn Sie zusätzlich nicht ins Training einfließen wollen, fügen Sie Blöcke mit Disallow: / für GPTBot, ClaudeBot, Google-Extended und CCBot hinzu. Behalten Sie aber eines im Kopf: Google-Extended hat nichts mit Ihrer Position in der Google-Suche zu tun. Ihn zu blockieren nimmt Sie nicht aus den Ergebnissen.

Eine praktische Warnung: Nicht alle Bots halten sich an die Datei. Die großen Unternehmen erklären öffentlich, dass sie sie respektieren. Für den Rest ist robots.txt eine Bitte, kein Zaun.

llms.txt: was die Quellen sagen, nicht was in Artikeln steht

Seit 2024 kursiert der Vorschlag einer Datei llms.txt, einer Zusammenfassung der Website, geschrieben für Sprachmodelle. Die Idee ist auf dem Papier gut. Die Realität, geprüft im August 2026, ist weniger begeisternd.

Google ist in der eigenen Dokumentation deutlich:

Sie müssen keine neuen maschinenlesbaren Dateien, KI-Textdateien, Markup oder Markdown erstellen, um in der Google-Suche zu erscheinen, einschließlich ihrer generativen KI-Funktionen, da die Google-Suche selbst sie nicht verwendet.

Google Search Central, Leitfaden zur Optimierung für generative Funktionen, abgerufen am 18. August 2026

Google fügt hinzu, dass Dateien dieser Art dem Ranking weder helfen noch schaden, weil sie schlicht ignoriert werden, und dass es in Ordnung ist, sie zu behalten, wenn andere Systeme sie nutzen. Auf derselben Seite rät Google ausdrücklich von dem ab, was es AEO- oder GEO-Tricks nennt, darunter das Erstellen von Textdateien für KI.

Keiner der großen Anbieter, weder OpenAI, Anthropic, Google noch Perplexity, dokumentiert, dass sein Produktivsystem llms.txt liest, um zu entscheiden, was es einem Nutzer antwortet.

Wo sie trotzdem nützlich ist: in Werkzeugen für Programmierer. Coding-Assistenten lesen Dokumentation in Echtzeit, und eine gut gemachte llms.txt schickt sie direkt zu den passenden Seiten. Wenn Sie ein technisches Produkt mit Dokumentation verkaufen, hat die Datei Sinn. Wenn Sie eine Pension oder eine Zahnarztpraxis haben, bringt sie Ihnen keinen einzigen Kunden.

Unsere Position, damit sie klar ist: Wir haben llms.txt auf unserer eigenen Website und behalten sie, weil sie nichts kostet und weil wir mit Werkzeugen arbeiten, die sie nutzen. Wir verkaufen sie aber niemandem als Instrument für Sichtbarkeit in KI, weil wir nicht beweisen können, dass sie so funktioniert.

Die Falle der für Maschinen geschriebenen Dateien

Das eigentliche Problem mit Dateien dieser Art ist nicht, dass sie nicht helfen. Es ist, dass niemand sie mehr ansieht, nachdem er sie abgelegt hat.

Auf unserer eigenen Website hat llms.txt monatelang die Daten einer alten Firma veröffentlicht: eine andere Steuernummer, ein anderes Gründungsjahr, eine andere Rechtsform als die tatsächliche. Die Seiten der Website waren korrekt. Die Datei, die kein Besucher öffnet, war seit einer früheren Version der Firma unverändert geblieben.

Ein Mensch hätte es sofort bemerkt. Niemand liest aber eine für Maschinen bestimmte Datei, und so hat sie einem möglichen automatischen Leser weiter genau die Dinge erzählt, die wir überall sonst korrigiert hatten.

Daraus die Regel: Jede Datei, die Sie für Maschinen erstellen, kommt auf die Liste dessen, was bei jeder Änderung der Firmendaten geprüft wird, neben der Fußzeile und den rechtlichen Seiten. Eine Datei für Maschinen, die veraltet geblieben ist, ist schlimmer als eine, die fehlt, weil das Fehlen zu nichts im Widerspruch steht.

Was sich stattdessen wirklich lohnt

Dieselben Quellen, die sagen, dass die Spezialdateien nicht nötig sind, beschreiben auch, was zählt: nützliche Inhalte, eine Struktur, die ein Bot durchlaufen kann, überprüfbare Identifikationsdaten, Seiten, die laden. Also genau das, was die anderen Kapitel des Leitfadens beschreiben.

Eines ist trotzdem eine Ergänzung wert, weil es billig ist und wirklich gelesen wird: in einfacher Form veröffentlichte Preise. Ein Agent, der für einen Menschen Anbieter vergleicht, kann keinen Preis lesen, der hinter einem Kontaktformular versteckt ist. Wenn Ihre Leistungen Festpreise haben, bringt Sie eine klare Seite mit ihnen in den Vergleich. Wenn nicht, sagen Sie deutlich, wovon der Preis abhängt; auch das ist eine Information, die ein Assistent korrekt wiedergeben kann.

Was sich im Juni 2026 geändert hat

Bis jetzt ließ sich die Frage „Erscheine ich in den generierten Antworten?“ nur manuell prüfen. Seit dem 3. Juni 2026 zeigt Google in der Search Console einen Leistungsbericht für generative Funktionen an, getrennt für die Suche und für Discover.

Der Bericht zeigt, wie oft die URLs der Website in generativen Funktionen wie AI Overviews und AI Mode erschienen sind und welche Seiten genau erschienen sind. Er lässt sich nach Gerät und nach Land aufschlüsseln.

Zwei Einschränkungen sind zu beachten. Erstens: Google hat die Einführung bei einem Teil der Websites gestartet, um zu testen, Sie haben ihn also möglicherweise noch nicht. Zweitens: Der Bericht zählt Impressionen, nicht Besuche, und im Kapitel über die Überprüfung haben wir erklärt, warum Impressionen allein wenig aussagen. Es ist trotzdem die erste offizielle Messung, die wir haben, anstelle der manuellen Prüfungen.

Zu tun, in dieser Reihenfolge

  • Öffnen Sie ihre-website.ro/robots.txt und lesen Sie sie. Viele Websites blockieren KI-Bots, ohne dass der Inhaber es weiß, durch Einstellungen eines Themes oder Plugins.
  • Entscheiden Sie die zwei Dinge getrennt: Wollen Sie in Antworten zitiert werden, und wollen Sie ins Training einfließen. Es ist nicht dieselbe Frage.
  • Wenn Sie Zitierungen wollen, prüfen Sie, dass OAI-SearchBot, Claude-SearchBot und PerplexityBot nicht blockiert sind.
  • Veröffentlichen Sie die Preise in einfacher Form, oder erklären Sie deutlich, wovon sie abhängen.
  • Wenn Sie eine llms.txt haben, setzen Sie sie auf die Liste, die bei jeder Änderung der Firmendaten geprüft wird. Wenn Sie keine haben, ist das kein Notfall.
  • Prüfen Sie in der Search Console, ob Sie den Bericht für generative Funktionen schon haben.

Quellen, alle abgerufen am 18. August 2026