LLMs.txt Generator
Geben Sie Ihre Domain ein. Der LLMs.txt Generator crawlt die Website, wählt die Seiten aus, die für KI-Systeme relevant sind, gruppiert sie in Abschnitte und schreibt zu jeder eine Beschreibung. Sie erhalten eine geprüfte llms.txt, die Sie vor der Veröffentlichung bearbeiten können.
Der Unterschied liegt in der Mitte dieses Prozesses. Der Generator übernimmt Ihre Sitemap nicht einfach ungefiltert in eine Textdatei: URLs werden gefiltert, wichtige Seiten priorisiert, und die Beschreibungen entstehen aus dem tatsächlichen Seiteninhalt statt aus dem Meta-Tag.
So funktioniert es
- Website eingeben. Oder eine Sitemap angeben oder eine eigene URL-Liste einfügen.
- Der LLMs.txt Generator crawlt und analysiert. robots.txt, Ihre Sitemaps und den Inhalt jeder Seite.
- Es erstellt und prüft die Datei. Abschnitte, Beschreibungen und eine Konformitätsprüfung.
- Sie prüfen, bearbeiten und veröffentlichen. Ohne Ihre Freigabe geht nichts hinaus.
Mehr als ein Sitemap-zu-llms.txt-Konverter
Ein einfacher Generator macht einen Durchgang: Sitemap rein, URLs mit Meta-Beschreibungen raus. So landen Login-Seiten, Warenkörbe und hundert leere Blogeinträge in einer veröffentlichten Datei.
| Funktion | DiagnoSEO | Andere Generatoren |
|---|---|---|
| Crawlt den tatsächlichen Seiteninhalt | ✅ | Unterschiedlich |
| Filtert URLs ohne Mehrwert | ✅ | Unterschiedlich |
| Priorisiert wichtige Seiten | ✅ | Unterschiedlich |
| Erstellt logische Abschnitte | ✅ | Unterschiedlich |
| Schreibt Beschreibungen aus dem Seiteninhalt | ✅ | Unterschiedlich |
| Schreibt in der Sprache der Website | ✅ | Unterschiedlich |
| Integrierte Validierung | ✅ | Unterschiedlich |
| Bearbeiten vor dem Download | ✅ | Unterschiedlich |
| Zeigt ausgelassene URLs mit Begründung | ✅ | Unterschiedlich |
| Vergleicht die vorhandene llms.txt | ✅ | Unterschiedlich |
| Erzeugt llms-full.txt | ✅ | Unterschiedlich |
Was der LLMs.txt Generator konkret tut
- Sitemap zuerst. Liest robots.txt und verarbeitet Sitemap-Indizes sowie gzip-komprimierte Sitemaps.
- Crawl als Rückfallebene. Keine Sitemap? Seiten werden über interne Links der Startseite gefunden.
- Paralleles Abrufen hält auch größere Crawls zügig.
- Kluge URL-Auswahl. Dokumentation, Produkte, Leistungen, Preise, Über uns und Kontakt zuerst.
- Rauschen raus. Dateien, Login, Warenkorb, Paginierung, Tag- und Datumsarchive, Filterparameter.
- Eigene Ausschlüsse. Ergänzen Sie URL-Fragmente, die übersprungen werden, etwa
/tag/oder?filter=. - Abschnittsbalance verhindert, dass ein großer Blog die Dokumentation verdrängt.
- Titelbereinigung. Aus „Preise | Marke“ wird „Preise“.
- H2-Abschnitte plus ein
Optional-Abschnitt für Nachrangiges. - Zusammenfassung und Seitenbeschreibungen aus dem echten Seiteninhalt, in der Sprache Ihrer Website.
- Rückfall auf Meta-Beschreibungen, falls das Modell nicht erreichbar ist - Sie erhalten immer eine brauchbare Datei.
- Validierung vor dem Download, inklusive der Chrome-Lighthouse-Kriterien.
- Vergleich mit der bereits auf Ihrer Domain veröffentlichten llms.txt.
- Transparente Quellen. Jede einbezogene URL ist gelistet und abwählbar; jede ausgelassene zeigt den Grund.
- llms-full.txt mit dem vollständigen Seiteninhalt, aus demselben Crawl.
Was ist llms.txt
llms.txt ist eine Markdown-Datei, beschrieben im Vorschlag llmstxt.org, veröffentlicht von Jeremy Howard (Answer.AI) im September 2024 und im August 2026 auf v2 aktualisiert. Es ist ein von der Community getragener Vorschlag, kein W3C- oder IETF-Standard.
Der Aufbau ist kurz: eine H1 mit dem Namen der Website (das einzige Pflichtelement), eine Zusammenfassung als Blockzitat, ein optionaler Absatz mit Kontext, danach H2-Abschnitte mit Markdown-Links, bei denen ein Doppelpunkt eine kurze Notiz einleitet. Ein Abschnitt namens Optional kennzeichnet Inhalte, die ein Agent bei knappem Kontext überspringen darf.
Die Datei kann im Stammverzeichnis der Domain oder auf jedem Pfad darin liegen. v2 erlaubt Dateien mit begrenztem Geltungsbereich: /docs/llms.txt deckt alles unter /docs/ ab, und Agenten sollten die spezifischste passende Datei verwenden.
Was ist llms-full.txt
llms-full.txt ist eine von Dokumentationsplattformen verbreitete Konvention, kein Bestandteil der Spezifikation. Statt Links mit Beschreibungen enthält sie den vollständigen Seiteninhalt als Markdown, zusammengeführt in einem Dokument.
Sinnvoll ist sie dort, wo Nutzer KI-Assistenten Detailfragen stellen: Dokumentation, SaaS-Produkte, Wissensdatenbanken. Beide Dateien stammen aus demselben Crawl und bleiben dadurch konsistent.
llms.txt, sitemap.xml und robots.txt
Drei Dateien, drei Aufgaben. Sie ersetzen einander nicht, und eine gepflegte Website liefert alle drei aus.
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| Gedacht für | Crawler | Suchmaschinen | Sprachmodelle und Agenten |
| Beantwortet | Was gecrawlt werden darf | Welche URLs existieren | Worum es auf den Kernseiten geht |
| Format | Direktiven | XML | Markdown |
| Enthält Beschreibungen | Nein | Nein | Ja |
| Steuert Zugriff | Ja | Nein | Nein |
| Geltungsbereich | Domain | Domain | Domain oder Pfad |
Warum Publisher eine llms.txt wollen könnten
- Kontrolle. Sie bestimmen, welche Seiten und Beschreibungen Sie zeigen, statt einem Modell die Deutung von HTML voller Navigation und Skripte zu überlassen.
- Maschinenlesbarkeit. Markdown lässt sich für kompatible Agenten und Werkzeuge leichter verarbeiten als eine gerenderte Seite.
- Kontexteffizienz. Eine knappe Übersicht passt in ein Kontextfenster, in das Ihre gesamte Website nie passen würde.
- Geringe Kosten. Nichts, was Sie im Stack pflegen müssen, kein Einfluss auf die Performance.
Das Format veröffentlichen unter anderem die Dokumentationsteams von OpenAI, Anthropic und Gemini; automatisch erzeugt wird es von Plattformen wie Mintlify, GitBook und Wix sowie von den Plugins Yoast SEO und AIOSEO.
Was llms.txt nicht leistet
- Es blockiert keine Crawler. Zugriffssteuerung gehört in die robots.txt.
- Es ersetzt weder robots.txt noch sitemap.xml.
- Es garantiert keine Zitate in ChatGPT, Perplexity, Gemini oder Claude.
- Es ist kein bestätigter Google-Rankingfaktor.
- Es ist nicht verpflichtend, und die Nutzung unterscheidet sich je nach KI-System.
- Es gleicht weder dünne Inhalte noch eine für Crawler unerreichbare Website aus.
Wer allein durch die Datei mehr Zitate verspricht, verspricht etwas, das derzeit niemand belegen kann. Der Wert liegt in Kontrolle und Lesbarkeit.
Validierung und die Chrome-Lighthouse-Prüfung
Chrome Lighthouse 13.3 hat die experimentelle Kategorie Agentic Browsing eingeführt. Einer ihrer Audits prüft grundlegende Eigenschaften einer veröffentlichten llms.txt: eine H1-Überschrift, mindestens einen echten Markdown-Link in der Form [Titel](URL) und eine Länge über 50 Zeichen.
Der Generator bildet die Prüfungen dieses Audits nach. Es ist eine Strukturprüfung, kein Rankingsignal in der Google-Suche. Für das Audit selbst gilt eine fehlende Datei als nicht zutreffend, während eine veröffentlichte Datei, die es nicht besteht, als Fehler gemeldet werden kann.
Deshalb läuft die Validierung vor dem Download: llmstxt.org-Struktur, die drei Lighthouse-Kriterien, doppelte URLs, Links auf fremde Domains und Dateigröße. Der separate LLMs.txt Checker & Validator prüft eine bereits veröffentlichte Datei, inklusive der Erreichbarkeit ihrer Links.
So veröffentlichen Sie die Datei
Liefern Sie sie als reinen Text unter ihredomain.de/llms.txt aus, neben der robots.txt. Um nur einen Teil der Website zu beschreiben, legen Sie die Datei stattdessen auf diesem Pfad ab, etwa ihredomain.de/docs/llms.txt. Öffnen Sie die Adresse danach und prüfen Sie, ob Markdown erscheint und keine 404-Seite.
| Plattform | Ablageort |
|---|---|
| cPanel oder Shared Hosting | /public_html/llms.txt |
| WordPress | Stammverzeichnis, nicht /wp-content/ |
| Next.js, Nuxt, Astro, React | /public/llms.txt |
| Laravel, Symfony | /public/llms.txt |
| Shopify | Inhalte → Dateien, dann /llms.txt auf die hochgeladene Datei weiterleiten |
| Webflow | Website-Einstellungen, eigener Code oder Datei-Upload |
| Netlify, Vercel, GitHub Pages | Datei in den public-Ordner committen |
Was in die Datei gehört
Eine llms.txt ist eine Auswahl, kein Archiv. Für die vollständige URL-Liste ist Ihre Sitemap da.
- SaaS und Dokumentation: Produktübersicht, Preise, Erste Schritte, API-Referenz, Changelog.
- E-Commerce: Kategorien, Flaggschiffprodukte, Versand, Rückgabe, Größentabellen. Keine Varianten, Filter oder Paginierung.
- Lokale Dienstleistungen: jede Leistung einzeln, Einsatzgebiet, Preise oder Angebotsseite, Über uns und Kontakt.
- Publisher: Themen-Hubs und Evergreen-Beiträge statt der letzten fünfzig Artikel.
Häufige Fragen
-
Eine Markdown-Datei mit dem Namen Ihrer Website, einer kurzen Zusammenfassung und einer Liste wichtiger Seiten mit Beschreibungen. Sie gibt Sprachmodellen und Agenten eine knappe Übersicht Ihrer Inhalte, statt sie aus HTML ableiten zu lassen.
-
Nein. Es ist ein von der Community getragener Vorschlag auf llmstxt.org, aktuell in v2, und wurde weder von W3C noch IETF verabschiedet. „Spezifikationskonform“ meint hier die dort beschriebene Struktur.
-
Nein. Kein System verlangt die Datei. Sie veröffentlichen sie freiwillig, um zu steuern, was Sie kompatiblen KI-Werkzeugen zeigen und wie es beschrieben wird.
-
Dafür gibt es keine Belege, und dieses Tool verspricht es nicht. Die Datei macht Inhalte leichter lesbar und gibt Ihnen Kontrolle über die Beschreibungen, ist aber kein bestätigter Rankingfaktor und keine Garantie für Zitate.
-
Google erklärt, die Datei sei für seine KI-Funktionen in der Suche nicht nötig. Unabhängig davon kann Chrome Lighthouse grundlegende Eigenschaften einer veröffentlichten Datei prüfen. Das ist eine Strukturprüfung, kein Rankingsignal.
-
Liefern Sie sie als reinen Text im Stammverzeichnis aus, neben der robots.txt. v2 erlaubt zusätzlich Dateien auf beliebigen Pfaden:
/docs/llms.txtdeckt die Inhalte unter/docs/ab, und Agenten sollten die spezifischste Datei verwenden. -
llms.txt ist ein kuratierter Index aus Links mit Beschreibungen. llms-full.txt enthält den vollständigen Seiteninhalt als Markdown. Das eine ist die Karte, das andere das Gelände - und nur das erste gehört zur Spezifikation.
-
Eine Sitemap listet alle URLs für Suchmaschinen, ohne Beschreibungen und ohne Gewichtung. robots.txt steuert den Crawler-Zugriff. llms.txt ist eine kurze, kuratierte Übersicht mit Kontext, zugeschnitten auf das Kontextfenster eines Modells.
-
Ja. Ohne Sitemap werden Seiten über interne Links Ihrer Startseite gefunden, mit Vorrang für Dokumentation, Produkte und Leistungen.
-
Ja. Im Rahmen des Tageslimits erhalten Sie die vollständige Datei, ohne Wasserzeichen und ohne gekürzte Vorschau. Kostenpflichtige Tarife erhöhen das Seitenlimit und ergänzen llms-full.txt.
Erstellen Sie Ihre llms.txt
Geben Sie Ihre Domain ein und erhalten Sie eine strukturierte, geprüfte und bearbeitbare llms.txt, bereit zur Veröffentlichung. Kein manuelles Sammeln von URLs nötig. Schon eine Datei vorhanden? Prüfen Sie sie mit dem LLMs.txt Checker & Validator.