---
title: "Was ist llms.txt? Die Übersichtsdatei für AI-Systeme erklärt"
description: "llms.txt ist eine Übersichtsdatei für Sprachmodelle. Wie sie aufgebaut ist, wer sie heute nutzt und was in die llms.txt deiner Karriereseite gehört."
canonical: "https://nextplace-jobs.com/partner/llms-txt"
updated: "2026-09-23"
language: "de"
---

# Was ist llms.txt? Die Übersichtsdatei für AI-Systeme erklärt

Die Datei gilt als robots.txt für AI-Systeme. Dabei ist sie etwas anderes, eine kuratierte Landkarte deiner Website, und wer sie heute sauber anlegt, schafft eine Grundlage für eine Nutzung, die gerade erst beginnt.

Die llms.txt ist eine kurze Markdown-Datei im Stammverzeichnis einer Website, die Sprachmodellen eine kuratierte Übersicht der wichtigsten Seiten gibt. Sie ist ein junger Vorschlag, und genutzt wird sie heute vor allem von Werkzeugen, die gezielt auf sie zeigen, etwa bei Entwicklerdokumentation. Keiner der großen AI-Anbieter hat bisher dokumentiert, dass seine Assistenten sie auswerten. Für eine Karriereseite ist sie deshalb ein günstiger Baustein im Fundament, dessen Wirkung sich erst messen lässt, wenn mehr Systeme die Datei lesen.

## Ein Vorschlag, kein Standard

Die Idee stammt von Jeremy Howard, der sie am 3. September 2024 im Blog von Answer.AI veröffentlicht hat. Sein Ausgangspunkt war ein praktisches Problem. Webseiten sind für Menschen gebaut, mit Navigation, Werbung und Skripten rund um den eigentlichen Inhalt. Ein Sprachmodell muss diesen Inhalt erst mühsam herausschälen, und eine ganze Website passt ohnehin nicht in das, was es auf einmal verarbeiten kann.

Howards Antwort darauf ist eine einzige Datei an einem festen Ort, unter /llms.txt. Sie erklärt in wenigen Zeilen, worum es auf der Website geht, und verweist auf die Seiten, in denen die Details stehen. Gedacht ist sie vor allem für den Moment, in dem ein Programm im Auftrag eines Menschen eine Antwort zusammenstellt, weniger für das Training neuer Modelle.

Ein Standard im strengen Sinn ist die llms.txt noch nicht. Kein Normungsgremium hat sie beschlossen, sie ist ein offener Vorschlag, den Howard im August 2026 zu einer zweiten Version überarbeitet hat. Das Format entwickelt sich damit weiter, und eine gepflegte Datei lässt sich leicht an neue Fassungen anpassen.

Oft liest man, sie sei die robots.txt für AI-Systeme. Doch sie erlaubt und verbietet nichts, und anders als eine Sitemap zählt sie nicht alles auf, sondern wählt aus. Sie ist eher ein Inhaltsverzeichnis für einen Leser mit wenig Zeit und wenig Platz.

## Wie eine llms.txt aufgebaut ist

Die Datei ist reiner Text im Format Markdown, also mit ein paar einfachen Zeichen für Überschriften, Zitate und Listen. Das hat einen Grund. Ein Mensch liest sie wie eine Notiz, und ein Programm kann sie trotzdem mit einfachen Mitteln zerlegen.

Ganz oben steht der Name der Website oder des Projekts. Das ist der einzige Pflichtteil. Darunter folgt ein kurzer Absatz als Zusammenfassung, der alles enthält, was man zum Verständnis des Rests braucht. Wer mag, ergänzt danach ein paar Absätze oder Stichpunkte mit Hinweisen zur Einordnung, etwa wie die Adressen aufgebaut sind.

Der eigentliche Kern sind die Abschnitte. Jeder trägt eine Überschrift und darunter eine Liste von Links, hinter denen je eine kurze Notiz stehen darf, die sagt, was dort zu finden ist. Ein Abschnitt mit dem Namen „Optional“ sammelt nach Konvention, was ein Programm auslassen kann, wenn es mit wenig Platz auskommen muss.

## Wer eine llms.txt heute liest

Am selbstverständlichsten nutzen sie Programmierwerkzeuge. OpenAI, Anthropic und Google stellen jeweils eine llms.txt für ihre eigene Entwicklerdokumentation bereit. Ein Werkzeug, das eine solche Dokumentation gezielt lädt, folgt der Übersicht laut dem Vorschlag inzwischen zuverlässig.

Bei den großen AI-Assistenten steht die Nutzung dagegen noch am Anfang. Keiner der großen Anbieter, also OpenAI, Google, Anthropic, Perplexity oder Microsoft, hat bisher dokumentiert, dass seine Crawler die llms.txt fremder Websites gezielt abrufen. Für die klassische Google-Suche braucht es die Datei nicht, dort liest Google die Seiten selbst.

Das spiegeln auch die ersten Messungen. Der SEO-Softwareanbieter Ahrefs hat für eine Studie vom Juni 2026 die Serverprotokolle von 137.210 Domains aus dem Mai 2026 ausgewertet, und AI-Crawler fragten die Dateien dort bisher nur selten an. Für ein Format, das es erst seit 2024 gibt, ist das ein früher Stand. Deshalb lässt sich die Wirkung einer llms.txt heute noch nicht seriös beziffern.

Chromes Prüfwerkzeug Lighthouse kontrolliert inzwischen ebenfalls, ob beim Abruf der Datei ein Serverfehler auftritt. Das Format kommt damit in den Werkzeugen an, mit denen Websites technisch geprüft werden.

## Wann ist eine llms.txt sinnvoll?

Sinnvoll ist sie überall dort, wo jemand ein Werkzeug bewusst auf sie ansetzt, etwa eine Entwicklerin, die ihrem Programmierassistenten die Adresse einer Dokumentation gibt. Dann fragt niemand eine Suchmaschine. Ein Programm liest genau die Datei, die man ihm nennt.

Ein zweiter Nutzen hat mit Maschinen wenig zu tun. Wer eine llms.txt schreibt, muss entscheiden, welche Seiten seine Website wirklich ausmachen und wie man jede davon in einem Satz beschreibt. Diese Übung lohnt sich auch dann, wenn nie ein Crawler vorbeikommt. Sie zeigt schnell, wo ein wichtiger Einstieg fehlt oder zwei Seiten dasselbe versprechen.

Dazu kommt, dass die Datei wenig kostet. Sie ist schnell geschrieben, schadet laut Google nicht, und Systeme wie Yoast SEO für WordPress oder Wix legen sie auf Wunsch selbst an. Ihren Platz hat sie auf einer Website, deren Grundlagen schon stehen, als nächster Baustein darauf.

## llms-full.txt und Markdown-Fassungen einzelner Seiten

Rund um die llms.txt sind zwei Verwandte entstanden. Die erste ist die llms-full.txt, eine Konvention, die nicht im Vorschlag steht und die Dokumentationsplattformen wie Mintlify automatisch anlegen. Sie enthält den vollständigen Text aller Seiten in einer einzigen Datei, damit ein Werkzeug eine ganze Dokumentation auf einmal laden kann. Für ein überschaubares Handbuch ist das praktisch. Bei vielen wechselnden Seiten wird die Datei schnell unhandlich.

Die zweite ist eine Markdown-Fassung jeder einzelnen Seite. Der Vorschlag empfiehlt dafür dieselbe Adresse mit der Endung .md und seit der zweiten Version einen Verweis im Kopf der Seite. Sie enthält denselben Inhalt wie die Seite, nur ohne Navigation, Layout und Skripte.

Einen dritten Weg geht Cloudflare. Seit Februar 2026 wandelt das Netzwerk mit Markdown for Agents eine Seite beim Abruf in Markdown um, sofern die Anfrage das verlangt und der Betreiber die Funktion eingeschaltet hat. Eine zweite Fassung muss die Website dafür nicht pflegen.

Für alle drei gilt dasselbe wie für die llms.txt. Sie sind eine Grundlage für Systeme, die Inhalte ohne Layout verarbeiten wollen, und wie stark die großen Anbieter solche Fassungen nutzen, haben sie bisher nicht offengelegt. Wichtig ist, dass eine Fassung inhaltlich deckungsgleich mit der HTML-Seite bleibt, ohne zusätzliche Aussagen und ohne Lücken.

## Was in die llms.txt einer Karriereseite gehört

Für eine Karriereseite ist die Datei schnell skizziert. Hinein gehören die Einstiege, die sich selten ändern, also die Startseite deines Karrierebereichs, deine Standorte, die Fachbereiche, für die du einstellst, und eine Seite, die den Bewerbungsprozess erklärt. Jeder Link bekommt einen Satz, der sagt, welche Frage die Seite beantwortet, etwa „Wie läuft die Bewerbung ab und wer meldet sich wann?“

Einzelne Stellenanzeigen gehören nicht hinein. Sie kommen und gehen mit jeder Besetzung, und eine Übersicht, die auf eine besetzte Stelle zeigt, schickt ein Programm auf eine leere oder falsche Seite.

Liegt dein Karrierebereich nur in einem Unterordner wie /karriere/, kannst du die Datei auch dort ablegen. Seit der zweiten Version gilt sie dann für alle Seiten darunter. Läuft deine Karriereseite dagegen auf einer Domain deines Bewerbermanagementsystems, hängt es vom Anbieter ab, ob du dort überhaupt eine Datei ablegen kannst.

Wichtiger als die Datei ist allerdings die Reihenfolge. Eine llms.txt hilft keinem Programm, das deine Stellen gar nicht erst lesen kann.

1. Erreichbar für Crawler: Deine Karriereseiten dürfen weder durch die robots.txt noch durch einen Bot-Schutz deines Hosters für Crawler gesperrt sein.
2. Lesbar ohne JavaScript: Der Text jeder Stellenanzeige steht schon in der ersten Antwort des Servers und wird nicht erst im Browser nachgeladen.
3. Strukturierte Stellendaten: Jede einzelne Stellenseite trägt eine JobPosting-Auszeichnung, die Jobtitel, Arbeitgeber, Ort und Anstellungsart maschinenlesbar mitliefert.
4. Die llms.txt als nächster Baustein: Stehen die drei Punkte davor, ergänzt die kleine Übersicht dieses Fundament um eine Landkarte für AI-Systeme.

> Für technisch Interessierte

## Aufbau und Beispiel, Zeile für Zeile

Die Tabelle zeigt die Elemente des Formats der Reihe nach, jeweils mit einer Beispielzeile für den Karrierebereich eines erfundenen Arbeitgebers. Die Datei selbst ist reines Markdown ohne HTML-Hülle und liegt unter /llms.txt oder in einem Unterpfad wie /karriere/llms.txt. Die letzten Zeilen betreffen die Seiten rund um die Datei.

| Element | Schreibweise | Zweck |
| --- | --- | --- |
| Titel | # Muster GmbH Karriere | Name der Website oder des Bereichs. Der einzige Pflichtteil der Datei. |
| Zusammenfassung | > Die Muster GmbH stellt in Oberösterreich ein, vor allem in Technik und Logistik. | Ein Zitatblock mit allem, was zum Verständnis der restlichen Datei nötig ist. |
| Details | Freie Absätze oder Stichpunkte ohne Überschrift, etwa „Alle offenen Stellen stehen unter /karriere/stellen/.“ | Hinweise zur Einordnung, zum Beispiel wie die Adressen aufgebaut sind. |
| Abschnitt | ## Einstieg | Eine Überschrift zweiter Ebene, unter der eine Liste von Links folgt. |
| Link mit Notiz | - [Standorte](Adresse der Seite): Alle Standorte mit Anfahrt und Kontakt | Ein Link pro Zeile. Die Notiz nach dem Doppelpunkt sagt, was hinter dem Link steht, und ist freiwillig. |
| Optionaler Abschnitt | ## Optional | Links, die ein Programm bei wenig Platz überspringen darf, etwa Impressum und Datenschutz. Seit Version 2 eine reine Konvention. |
| Markdown-Fassung | Adresse der Seite mit angehängtem .md | Derselbe Inhalt ohne Navigation und Layout, idealerweise das Ziel der Links in der llms.txt. |
| Verweis auf die Fassung | link rel="alternate" type="text/markdown" im Kopf der Seite | Zeigt, wo die Markdown-Fassung einer Seite liegt. Seit Version 2 empfohlen, auch als HTTP-Header Link möglich. |
| Verweis auf die Übersicht | link rel="describedby" | Zeigt von einer Seite auf die llms.txt, die für sie zuständig ist. Ebenfalls seit Version 2 empfohlen. |
| Inhaltsaushandlung | Anfrage mit dem Header Accept: text/markdown | Kein Teil des Vorschlags. Cloudflare liefert darauf bei eingeschalteter Funktion eine Markdown-Fassung aus. |
| Volltextdatei | /llms-full.txt | Kein Teil des Vorschlags. Eine Konvention von Dokumentationsplattformen für den vollständigen Inhalt aller Seiten in einer Datei. |

Schon der Titel allein ergibt eine gültige llms.txt, nützlich wird sie erst mit Zusammenfassung und Links. Ein Programm liest sie von oben nach unten und folgt nur den Links, die es für seine Frage braucht.

Zum Erstellen reicht ein Texteditor. Prüfe vor dem Veröffentlichen, ob jeder Link auf eine erreichbare, indexierbare Seite führt und die Linktexte zu den Überschriften der Zielseiten passen. Der Vorschlag empfiehlt außerdem einen einfachen Test, bei dem du einem AI-Assistenten nur deine llms.txt gibst und ihm Fragen zu deinen Inhalten stellst.

## Wie wir es selbst halten

Wir veröffentlichen selbst eine llms.txt als Baustein unseres Fundaments. Wie viel sie bewirkt, lässt sich erst beurteilen, wenn mehr Systeme sie auswerten. Sie führt nur zu stabilen Einstiegen, nennt keine einzelnen Stellen und keine Zahlen und zeigt ausschließlich auf Seiten, die gerade erreichbar und indexierbar sind.

Markdown-Fassungen bieten wir nur für Artikel wie diesen an, von der Indexierung ausgenommen und inhaltlich deckungsgleich mit der Seite.

## Liest ChatGPT die llms.txt?

OpenAI hat bisher nicht dokumentiert, dass ChatGPT die llms.txt fremder Websites gezielt abruft, seine Crawler-Dokumentation dreht sich um die robots.txt. Die Nutzung durch AI-Assistenten steht noch am Anfang. Wer die Datei heute sauber anlegt, hat die Grundlage schon gelegt, wenn sich das ändert.

## Braucht Google eine llms.txt?

Für die Google-Suche nicht. Google liest dort die Seiten selbst und zählt die llms.txt in seinem Leitfaden zu den AI-Funktionen der Suche nicht zu den Voraussetzungen. Ihr Einsatzgebiet liegt bei Werkzeugen und Agenten, die gezielt nach einer Übersicht fragen.

## Wie erstelle ich eine llms.txt?

Du schreibst eine Textdatei in Markdown, mit dem Namen deiner Website als Überschrift, einer kurzen Zusammenfassung und Abschnitten mit Links, jeweils mit einer Zeile Beschreibung. Die Datei legst du unter /llms.txt ab. Systeme wie Yoast SEO oder Wix erzeugen sie auch automatisch, prüfen solltest du danach trotzdem, ob jeder Link funktioniert.

## Was ist der Unterschied zwischen llms.txt und llms-full.txt?

Die llms.txt ist eine kurze Übersicht mit Links, die llms-full.txt enthält den vollständigen Text aller Seiten in einer einzigen Datei. Nur die llms.txt ist Teil des Vorschlags. Die Volltextdatei ist eine Konvention von Dokumentationsplattformen und lohnt sich vor allem für überschaubare technische Dokumentation.

## Kann eine llms.txt meiner Website schaden?

Nein, Google sagt ausdrücklich, dass sie der Sichtbarkeit in der Suche nicht schadet. Ein Risiko entsteht erst, wenn die Datei veraltet und auf Seiten zeigt, die es nicht mehr gibt, oder etwas anderes behauptet als deine Seiten. Sie ist außerdem öffentlich, also gehört nichts hinein, was nicht auch auf deiner Website stehen dürfte.

## Braucht meine Karriereseite eine llms.txt?

Sie ist ein sinnvoller Baustein, aber nicht der erste. Zuerst sollten Crawler deine Karriereseiten erreichen, ihren Text ohne JavaScript lesen können und jede Stellenseite strukturierte Stellendaten tragen. Steht dieses Fundament, ergänzt eine kurze llms.txt mit deinen wichtigsten Einstiegen es günstig.

## Quellen
- [Answer.AI: Der ursprüngliche Vorschlag für llms.txt](<https://www.answer.ai/posts/2024-09-03-llmstxt.html>)
- [llmstxt.org: Die llms.txt-Spezifikation, Version 2](<https://llmstxt.org/>)
- [llmstxt.org: Änderungen in Version 2](<https://llmstxt.org/changes.html>)
- [Google Search Central: Websites für generative AI-Funktionen der Google-Suche optimieren](<https://developers.google.com/search/docs/fundamentals/ai-optimization-guide>)
- [Chrome for Developers: Lighthouse-Prüfung llms.txt](<https://developer.chrome.com/docs/lighthouse/agentic-browsing/llms-txt>)
- [Ahrefs: Logstudie zu llms.txt über 137.000 Domains](<https://ahrefs.com/blog/llmstxt-study/>)
- [OpenAI: Übersicht der OpenAI-Crawler](<https://developers.openai.com/api/docs/bots>)
- [Anthropic: Wie Anthropic Daten im Web sammelt](<https://support.claude.com/en/articles/8896518-does-anthropic-crawl-data-from-the-web-and-how-can-site-owners-block-the-crawler>)
- [Perplexity: Die Crawler von Perplexity](<https://docs.perplexity.ai/docs/resources/perplexity-crawlers>)
- [Mintlify: llms.txt und llms-full.txt](<https://www.mintlify.com/docs/ai/llmstxt>)
- [Cloudflare: Markdown for Agents](<https://developers.cloudflare.com/changelog/post/2026-02-12-markdown-for-agents/>)
