LLMs.txt generator
Indtast dit domæne. LLMs.txt generatoren crawler webstedet, udvælger de sider, der er værd at vise AI-systemer, grupperer dem i sektioner og skriver en beskrivelse til hver. Du får en valideret llms.txt, som du kan redigere før udgivelse.
Forskellen ligger midt i processen. Generatoren hælder ikke bare dit sitemap ned i en tekstfil: URL'er bliver filtreret, vigtige sider prioriteret, og beskrivelserne kommer fra sidens faktiske indhold, ikke fra metatagget.
Sådan fungerer det
- Indtast dit websted. Eller peg på et sitemap, eller indsæt din egen liste med URL'er.
- Værktøjet crawler og analyserer. robots.txt, dine sitemaps og indholdet på hver side.
- Det bygger og validerer filen. Sektioner, beskrivelser og en kontrol af overholdelse.
- Du gennemgår, redigerer og udgiver. Intet forlader siden uden din godkendelse.
Mere end en sitemap-til-llms.txt-konverter
En simpel generator laver én gennemgang: sitemap ind, URL'er med metabeskrivelser ud. Sådan ender loginsiden, kurven og hundrede tomme blogindlæg i en udgivet fil.
| Funktion | DiagnoSEO | Andre generatorer |
|---|---|---|
| Crawler sidernes faktiske indhold | ✅ | Varierer |
| Filtrerer URL'er uden værdi fra | ✅ | Varierer |
| Prioriterer vigtige sider | ✅ | Varierer |
| Laver logiske sektioner | ✅ | Varierer |
| Skriver beskrivelser ud fra indholdet | ✅ | Varierer |
| Skriver på webstedets sprog | ✅ | Varierer |
| Indbygget validering | ✅ | Varierer |
| Redigering før download | ✅ | Varierer |
| Viser fravalgte URL'er og årsagen | ✅ | Varierer |
| Sammenligner din eksisterende llms.txt | ✅ | Varierer |
| Genererer llms-full.txt | ✅ | Varierer |
Hvad LLMs.txt generatoren konkret gør
- Sitemap først. Læser robots.txt og håndterer sitemap-indeks og gzip-pakkede sitemaps.
- Crawl som reserve. Intet sitemap? Sider findes via interne links fra din forside.
- Parallel hentning holder også større crawls hurtige.
- Klog URL-udvælgelse. Dokumentation, produkter, ydelser, priser, om os og kontakt kommer først.
- Støj fra. Filer, login, kurv, paginering, tag- og datoarkiver, filterparametre.
- Egne undtagelser. Tilføj URL-fragmenter, der skal springes over, f.eks.
/tag/eller?filter=. - Balancering af sektioner forhindrer, at en stor blog fortrænger din dokumentation.
- Oprydning i titler. „Priser | Brand“ bliver til „Priser“.
- H2-sektioner plus en
Optional-sektion til sekundært indhold. - Resumé og sidebeskrivelser skrevet ud fra det faktiske indhold, på dit websteds sprog.
- Fallback til metabeskrivelsen, hvis modellen ikke er tilgængelig, så du altid får en brugbar fil.
- Validering før download, inklusive Chrome Lighthouse-kriterierne.
- Sammenligning med den llms.txt, der allerede ligger på dit domæne.
- Gennemsigtige kilder. Hver medtaget URL står på listen og kan fravælges; hver fravalgt viser hvorfor.
- llms-full.txt med sidernes fulde indhold, fra samme crawl.
Hvad er llms.txt
llms.txt er en Markdown-fil beskrevet i forslaget llmstxt.org, udgivet af Jeremy Howard (Answer.AI) i september 2024 og opdateret til v2 i august 2026. Det er et forslag drevet af fællesskabet, ikke en W3C- eller IETF-standard.
Strukturen er kort: en H1 med webstedets navn (det eneste obligatoriske element), et resumé i citatblok, et valgfrit afsnit med kontekst og derefter H2-sektioner med Markdown-links, hvor et kolon indleder en kort note. En sektion ved navn Optional markerer indhold, som en agent må springe over, når konteksten er trang.
Filen kan ligge i domænets rod eller på enhver sti inden for det. v2 tillader filer med begrænset rækkevidde: /docs/llms.txt dækker alt under /docs/, og agenter bør bruge den mest specifikke fil, der passer.
Hvad er llms-full.txt
llms-full.txt er en konvention udbredt af dokumentationsplatforme og ikke en del af specifikationen. I stedet for links med beskrivelser indeholder den sidernes fulde indhold som Markdown, samlet i ét dokument.
Den giver mening der, hvor brugere stiller AI-assistenter detaljerede spørgsmål: dokumentation, SaaS-produkter, vidensbaser. Begge filer kommer fra samme crawl og forbliver derfor konsistente.
llms.txt, sitemap.xml og robots.txt
Tre filer, tre opgaver. De erstatter ikke hinanden, og et velholdt websted leverer alle tre.
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| Skrevet til | Crawlere | Søgemaskiner | Sprogmodeller og agenter |
| Besvarer | Hvad der må crawles | Hvilke URL'er der findes | Hvad nøglesiderne handler om |
| Format | Direktiver | XML | Markdown |
| Indeholder beskrivelser | Nej | Nej | Ja |
| Styrer adgang | Ja | Nej | Nej |
| Rækkevidde | Domæne | Domæne | Domæne eller sti |
Hvorfor en udgiver kan ønske sig en
- Kontrol. Du vælger, hvilke sider og beskrivelser du viser, i stedet for at lade en model udlede dem af HTML fyldt med navigation og scripts.
- Maskinlæsbarhed. Markdown er lettere for kompatible agenter og værktøjer at arbejde med end en renderet side.
- Kontekst-effektivitet. Et kortfattet kort passer i et kontektsvindue, hvor hele dit websted aldrig ville kunne være.
- Lave omkostninger. Intet at vedligeholde i din stak og ingen effekt på performance.
Formatet udgives af dokumentationsteamene hos OpenAI, Anthropic og Gemini og genereres automatisk af platforme som Mintlify, GitBook og Wix samt af plugins som Yoast SEO og AIOSEO.
Hvad llms.txt ikke gør
- Den blokerer ikke crawlere. Adgangsstyring hører hjemme i robots.txt.
- Den erstatter hverken robots.txt eller sitemap.xml.
- Den garanterer ikke henvisninger i ChatGPT, Perplexity, Gemini eller Claude.
- Den er ikke en bekræftet rangeringsfaktor hos Google.
- Den er ikke påkrævet, og udbredelsen varierer mellem AI-systemer.
- Den kompenserer hverken for tyndt indhold eller for et websted, crawlere ikke kan nå.
Den, der lover flere henvisninger alene på grund af filen, lover noget, ingen kan påvise i dag. Værdien ligger i kontrol og læsbarhed.
Validering og Chrome Lighthouse-kontrollen
Chrome Lighthouse 13.3 tilføjede den eksperimentelle kategori Agentic Browsing. En af dens audits validerer grundlæggende egenskaber ved en udgivet llms.txt: en H1-overskrift, mindst ét ægte Markdown-link i formen [Titel](URL) og en længde over 50 tegn.
Generatoren efterligner de kontroller, det audit kører. Det er en strukturkontrol, ikke et rangeringssignal i Google-søgning. For selve auditet behandles en manglende fil som ikke relevant, mens en udgivet fil, der ikke består, kan blive rapporteret som en fejl.
Derfor kører valideringen før download: llmstxt.org-struktur, de tre Lighthouse-kriterier, dublerede URL'er, links til fremmede domæner og filstørrelse. Den separate LLMs.txt checker og validator tjekker en fil, der allerede er online, herunder om dens links stadig virker.
Sådan udgiver du filen
Server den som ren tekst på ditdomæne.dk/llms.txt, ved siden af robots.txt. Vil du kun beskrive en del af webstedet, så læg den på den sti i stedet, f.eks. ditdomæne.dk/docs/llms.txt. Åbn adressen efter upload, og bekræft at du ser Markdown og ikke en 404-side.
| Platform | Placering |
|---|---|
| cPanel eller delt hosting | /public_html/llms.txt |
| WordPress | Webstedets rod, ikke /wp-content/ |
| Next.js, Nuxt, Astro, React | /public/llms.txt |
| Laravel, Symfony | /public/llms.txt |
| Shopify | Indhold → Filer, og omdiriger derefter /llms.txt til den uploadede fil |
| Webflow | Webstedsindstillinger, egen kode eller filupload |
| Netlify, Vercel, GitHub Pages | Læg den i din public-mappe i repositoriet |
Hvad hører til i filen
En llms.txt er et udvalg, ikke et arkiv. Til den fulde liste over URL'er har du dit sitemap.
- SaaS og dokumentation: produktoverblik, priser, kom godt i gang, API-reference, changelog.
- E-handel: kategorier, flagskibsprodukter, levering, returnering, størrelsesguider. Ikke varianter, filtre eller paginering.
- Lokale ydelser: hver ydelse for sig, dækningsområde, priser eller tilbud, om os og kontakt.
- Udgivere: emnehubs og tidløse artikler frem for de seneste halvtreds indlæg.
Ofte stillede spørgsmål
-
En Markdown-fil med dit websteds navn, et kort resumé og en liste over nøglesider med beskrivelser. Den giver sprogmodeller og agenter et kortfattet kort over dit indhold i stedet for at lade dem udlede det af HTML.
-
Nej. Det er et forslag drevet af fællesskabet, beskrevet på llmstxt.org, nu i v2, og det er hverken ratificeret af W3C eller IETF. Specifikationsoverholdelse betyder her den struktur, der beskrives der.
-
Nej. Ingen systemer kræver filen. Du udgiver den frivilligt for at styre, hvad du viser kompatible AI-værktøjer, og hvordan det beskrives.
-
Der er ingen dokumentation for det, og dette værktøj lover det ikke. Filen gør dit indhold lettere at læse og giver dig kontrol over beskrivelserne, men den er hverken en bekræftet rangeringsfaktor eller en garanti for henvisninger.
-
Google oplyser, at filen ikke er nødvendig for deres AI-funktioner i søgningen. Derudover kan Chrome Lighthouse validere grundlæggende egenskaber ved en udgivet fil i sine eksperimentelle audits. Det er en strukturkontrol, ikke et rangeringssignal.
-
Server den som ren tekst i domænets rod, ved siden af robots.txt. v2 tillader også filer på enhver sti:
/docs/llms.txtdækker indholdet under/docs/, og agenter bør bruge den mest specifikke fil. -
llms.txt er et udvalgt indeks af links med beskrivelser. llms-full.txt indeholder sidernes fulde indhold som Markdown. Den første er kortet, den anden er terrænet, og kun den første er en del af specifikationen.
-
Et sitemap lister alle URL'er til søgemaskiner, uden beskrivelser og uden rangorden. robots.txt styrer crawleres adgang. llms.txt er et kort, udvalgt kort med kontekst, skåret til en models kontekstvindue.
-
Ja. Uden sitemap findes sider via interne links fra din forside, med prioritet til dokumentation, produkter og ydelser.
-
Ja. Inden for den daglige grænse får du hele filen, uden vandmærke og uden afkortet forhåndsvisning. Betalte planer hæver sidegrænsen og tilføjer llms-full.txt.
Generér din llms.txt
Indtast dit domæne og få en struktureret, valideret og redigerbar llms.txt-fil, klar til udgivelse. Ingen manuel indsamling af URL'er. Har du allerede en fil? Tjek den med LLMs.txt checker og validator.