llms.txt vs. sitemap.xml vs. robots.txt: Was ist der Unterschied?
Diese drei Dateien befinden sich am selben Ort, Ihrem Domain-Stamm, und bei allen geht es darum, „Maschinen über Ihre Website zu informieren“, sodass sie ständig miteinander verwechselt werden. Sie sind nicht austauschbar. Jedes wurde für ein anderes Publikum und einen anderen Job konzipiert. So vergleichen sie sich tatsächlich.
Die einzeilige Zusammenfassung
robots.txt, sagt Crawlern, was sie crawlen dürfen und was nicht.sitemap.xml, teilt Suchmaschinen mit, welche URLs existieren, damit sie entdeckt und indiziert werden können.llms.txt, bietet LLMs und Agenten eine kuratierte, lesbare Karte dessen, worauf es ankommt, mit Kontext.
Verschiedene Verben: restrict, enumerate, explain. Das ist der ganze Unterschied.
robots.txt: das Regelwerk
robots.txt ist seit Jahrzehnten ein Webstandard. Dabei handelt es sich um eine Nur-Text-Datei mit Anweisungen, die braven Crawlern mitteilt, auf welche Pfade sie zugreifen dürfen:
User-agent: *
Disallow: /admin/
Allow: /
Sitemap: https://example.com/sitemap.xml
Wichtige Fakten:
- Es geht um Erlaubnis und Ausschluss, nicht um die Qualität des Inhalts.
- Es ist beratend, konforme Bots respektieren es; Böswillige ignorieren es.
- Es verweist oft auf Ihre Sitemap.
robots.txt sagt nichts darüber aus, was Ihr Inhalt bedeutet. Es regelt nur den Zugang.
sitemap.xml: der Index der URLs
sitemap.xml ist eine maschinenlesbare Liste der URLs auf Ihrer Website, normalerweise mit Metadaten wie Datum der letzten Änderung und Änderungshäufigkeit:
<url>
<loc>https://example.com/docs/quickstart</loc>
<lastmod>2026-06-01</lastmod>
</url>
Wichtige Fakten:
- Seine Zielgruppe sind Suchmaschinen, die es verwenden, um Seiten für das Crawling und die Indexierung zu entdecken und zu priorisieren.
- Es geht um Vollständigkeit, idealerweise werden alle Seiten aufgelistet, die gefunden werden sollen.
- Es enthält keine Beschreibungen, keine Kuration, keinen Hinweis darauf, welche Seiten am wichtigsten sind.
Eine Sitemap antwortet: „Welche Seiten gibt es?“ Es antwortet nicht: „Worum geht es auf dieser Seite?“ oder „Wo soll ich anfangen?“
llms.txt: die lesbare Karte für Modelle
llms.txt ist eine Markdown-Datei, die auf große Sprachmodelle und die darauf aufbauenden Tools abzielt. Anstatt jede URL aufzulisten, kuratiert es die wichtigen, organisiert sie in Abschnitten und beschreibt jede:
# Example Docs
> A short summary of what this product does.
## Getting Started
- [Quickstart](https://example.com/quickstart): Set up in five minutes
- [Concepts](https://example.com/concepts): Core ideas you need first
Wichtige Fakten:
- Die Zielgruppe sind LLMs, Agenten, RAG-Pipelines und MCP-/Automatisierungstools, und Menschen, die sich schnell zurechtfinden möchten.
- Es geht um Verständnis und Kuratierung, nicht um eine erschöpfende Aufzählung.
- Es ist kein Google-Rankingfaktor und Google hat erklärt, dass es ihn nicht verwendet. (Mehr unter Ist llms.txt ein Google-Ranking-Faktor?.)## Seite an Seite
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| Job | Crawling einschränken | URLs aufzählen | Inhalte erklären und kuratieren |
| Publikum | Crawler/Bots | Suchmaschinen | LLMs, Agenten, Werkzeuge |
| Formatieren | Richtlinien | XML | Abschlag |
| Kuratiert? | Nein | Nein | Ja |
| Beschreibungen? | Nein | Nein | Ja |
| Beeinflusst das Google-Ranking? | Indirekt (Zugriff) | Indirekt (Entdeckung) | Nein |
Ersetzen sie sich gegenseitig? Nein.
Ein häufiger Fehler besteht darin, llms.txt als modernen Ersatz für die beiden anderen zu betrachten. Es ist nicht:
- Es kontrolliert nicht den Crawler-Zugriff, behalten Sie Ihr
robots.txt. - Es stellt nicht sicher, dass Suchmaschinen jede Seite entdecken, behalten Sie Ihr
sitemap.xml. - Die anderen beiden geben den Modellen keinen Überblick, das ist die einzigartige Aufgabe von
llms.txt.
Sie ergänzen sich. Auf einer gut geführten Website können alle drei vorhanden sein, wobei jeder sein eigenes Ding macht.
Was brauchen Sie?
- Jeder profitiert von einem sinnvollen
robots.txtund einemsitemap.xmlfür die herkömmliche Suche. llms.txtist optional und am wertvollsten, wenn Sie über Dokumentation, eine API, ein Entwicklerprodukt oder Inhalte verfügen, die Modelle und Agenten genau verstehen sollen. Wenn Sie das nicht sind, können Sie es auch überspringen. Die vollständige Aufschlüsselung finden Sie unter When llms.txt Makes Sense.
Das Endergebnis
robots.txt schränkt ein, sitemap.xml zählt auf, llms.txt erklärt. Sie lösen drei verschiedene Probleme für drei verschiedene Zielgruppen, und die Übernahme eines Problems bedeutet nicht, dass ein anderes aufgegeben wird.
Wenn Ihre Website gut für llms.txt geeignet ist, generieren Sie einen sauberen Entwurf mit dem llms.txt-Generator und überprüfen Sie ihn mit dem Validator, bevor Sie ihn veröffentlichen.