Generátor LLMs.txt
Zadejte svou doménu. Generátor LLMs.txt projde web, vybere stránky, které stojí za to ukázat systémům AI, seskupí je do sekcí a ke každé napíše popis. Dostanete ověřený llms.txt, který můžete před zveřejněním upravit.
Rozdíl je uprostřed toho procesu. Generátor nesype vaši sitemapu do textového souboru: adresy filtruje, důležité stránky upřednostňuje a popisy vznikají ze skutečného obsahu stránky, ne z meta tagu.
Jak to funguje
- Zadáte web. Nebo určíte sitemapu, případně vložíte vlastní seznam adres.
- Nástroj prochází a analyzuje. robots.txt, vaše sitemapy a obsah každé stránky.
- Sestaví a ověří soubor. Sekce, popisy a kontrola souladu.
- Zkontrolujete, upravíte a zveřejníte. Nic neodejde bez vašeho souhlasu.
Víc než převodník sitemapy na llms.txt
Jednoduchý generátor udělá jeden průchod: dovnitř sitemapa, ven adresy s meta popisky. Tak se do zveřejněného souboru dostane přihlašovací stránka, košík a sto prázdných článků z blogu.
| Funkce | DiagnoSEO | Jiné generátory |
|---|---|---|
| Prochází skutečný obsah stránek | ✅ | Různé |
| Filtruje adresy bez hodnoty | ✅ | Různé |
| Upřednostňuje důležité stránky | ✅ | Různé |
| Vytváří logické sekce | ✅ | Různé |
| Píše popisy z obsahu stránky | ✅ | Různé |
| Píše v jazyce webu | ✅ | Různé |
| Vestavěná validace | ✅ | Různé |
| Úpravy před stažením | ✅ | Různé |
| Ukazuje vynechané adresy i důvod | ✅ | Různé |
| Porovná váš stávající llms.txt | ✅ | Různé |
| Generuje llms-full.txt | ✅ | Různé |
Co přesně dělá Generátor LLMs.txt
- Nejprve sitemapa. Čte robots.txt a zvládá indexy sitemap i sitemapy zabalené gzipem.
- Záložní procházení. Sitemapa chybí? Stránky najdeme přes vnitřní odkazy z úvodní stránky.
- Paralelní stahování udrží tempo i u větších průchodů.
- Chytrý výběr adres. Přednost má dokumentace, produkty, služby, ceník, o nás a kontakt.
- Odstranění balastu. Soubory, přihlášení, košík, stránkování, archivy štítků a dat, parametry filtrů.
- Vlastní vyloučení. Doplňte části adres, které se mají přeskočit, třeba
/tag/nebo?filter=. - Vyvážení sekcí brání tomu, aby rozsáhlý blog vytlačil dokumentaci.
- Čištění titulků. Z „Ceník | Značka“ se stane „Ceník“.
- Sekce H2 plus sekce
Optionalpro druhořadý obsah. - Shrnutí a popisy stránek psané ze skutečného obsahu, v jazyce vašeho webu.
- Náhrada z meta popisku, když model není dostupný, takže vždy dostanete použitelný soubor.
- Validace před stažením, včetně kritérií Chrome Lighthouse.
- Porovnání se souborem llms.txt, který už na doméně máte.
- Průhledné zdroje. Každá zahrnutá adresa je vypsaná a lze ji odškrtnout; u každé vynechané je důvod.
- llms-full.txt s úplným obsahem stránek, ze stejného průchodu.
Co je llms.txt
llms.txt je soubor Markdown popsaný v návrhu llmstxt.org, který v září 2024 zveřejnil Jeremy Howard (Answer.AI) a v srpnu 2026 byl aktualizován na v2. Jde o návrh vedený komunitou, ne o standard W3C ani IETF.
Struktura je krátká: nadpis H1 s názvem webu (jediný povinný prvek), shrnutí v citaci, volitelný odstavec kontextu a poté sekce H2 s odkazy Markdown, kde dvojtečka uvozuje krátkou poznámku. Sekce s názvem Optional označuje obsah, který agent může při nedostatku kontextu přeskočit.
Soubor může ležet v kořeni domény nebo na libovolné cestě uvnitř ní. Verze v2 umožňuje soubory s omezeným rozsahem: /docs/llms.txt pokrývá vše pod /docs/ a agenti mají použít nejkonkrétnější odpovídající soubor.
Co je llms-full.txt
llms-full.txt je zvyklost rozšířená dokumentačními platformami, není součástí specifikace. Místo odkazů s popisy nese úplný obsah stránek v markdownu, spojený do jednoho dokumentu.
Dává smysl tam, kde se uživatelé ptají asistentů AI na detaily: dokumentace, produkty SaaS, znalostní báze. Oba soubory vznikají ze stejného průchodu, takže zůstávají konzistentní.
llms.txt, sitemap.xml a robots.txt
Tři soubory, tři úlohy. Nenahrazují se a dobře udržovaný web servíruje všechny tři.
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| Určeno pro | Crawlery | Vyhledávače | Jazykové modely a agenty |
| Odpovídá na | Co se smí procházet | Jaké adresy existují | O čem jsou klíčové stránky |
| Formát | Direktivy | XML | Markdown |
| Obsahuje popisy | Ne | Ne | Ano |
| Řídí přístup | Ano | Ne | Ne |
| Rozsah | Doména | Doména | Doména nebo cesta |
Proč ho vydavatel může chtít
- Kontrola. Sami volíte, které stránky a popisy vystavíte, místo abyste nechali model odhadovat z HTML plného navigace a skriptů.
- Strojová čitelnost. Markdown se kompatibilním agentům a nástrojům zpracovává snáz než vykreslená stránka.
- Úspora kontextu. Stručná mapa se vejde do kontextového okna, do kterého by se celý web nikdy nevešel.
- Nízké náklady. Nic, co byste udržovali ve stacku, a žádný dopad na výkon.
Formát zveřejňují dokumentační týmy OpenAI, Anthropicu a Gemini a automaticky ho generují platformy jako Mintlify, GitBook a Wix i pluginy Yoast SEO a AIOSEO.
Co llms.txt nedělá
- Neblokuje crawlery. Řízení přístupu patří do robots.txt.
- Nenahrazuje robots.txt ani sitemap.xml.
- Nezaručuje citace v ChatGPT, Perplexity, Gemini ani Claude.
- Není potvrzeným faktorem hodnocení v Googlu.
- Není povinný a míra využití se mezi systémy AI liší.
- Nenahradí slabý obsah ani web, na který se crawlery nedostanou.
Kdo slibuje víc citací jen díky souboru, slibuje něco, co dnes nikdo nedoloží. Hodnota je v kontrole a čitelnosti.
Validace a kontrola Chrome Lighthouse
Chrome Lighthouse 13.3 přidal experimentální kategorii Agentic Browsing. Jeden z jejích auditů ověřuje základní vlastnosti zveřejněného llms.txt: nadpis H1, alespoň jeden skutečný odkaz Markdown ve tvaru [Titulek](URL) a délku nad 50 znaků.
Generátor napodobuje kontroly tohoto auditu. Jde o kontrolu struktury, ne o signál hodnocení ve vyhledávání Google. Pro samotný audit je chybějící soubor brán jako nerelevantní, zatímco zveřejněný soubor, který jím neprojde, může být nahlášen jako chyba.
Proto validace běží před stažením: struktura llmstxt.org, tři kritéria Lighthouse, duplicitní adresy, odkazy na cizí domény a velikost souboru. Samostatný Checker a validátor LLMs.txt zkontroluje soubor, který už je online, včetně dostupnosti jeho odkazů.
Jak soubor zveřejnit
Servírujte ho jako prostý text na adrese vasedomena.cz/llms.txt, vedle robots.txt. Pokud popisujete jen část webu, umístěte ho na tu cestu, například vasedomena.cz/docs/llms.txt. Po nahrání adresu otevřete a ověřte, že vidíte Markdown, a ne stránku 404.
| Platforma | Umístění |
|---|---|
| cPanel nebo sdílený hosting | /public_html/llms.txt |
| WordPress | Kořen webu, ne /wp-content/ |
| Next.js, Nuxt, Astro, React | /public/llms.txt |
| Laravel, Symfony | /public/llms.txt |
| Shopify | Obsah → Soubory, poté přesměrujte /llms.txt na nahraný soubor |
| Webflow | Nastavení webu, vlastní kód nebo nahrání souboru |
| Netlify, Vercel, GitHub Pages | Přidejte ho do složky public v repozitáři |
Co do souboru patří
llms.txt je výběr, ne archiv. Na úplný výpis adres máte sitemapu.
- SaaS a dokumentace: přehled produktu, ceník, první kroky, referenční dokumentace API, changelog.
- E-shopy: kategorie, vlajkové produkty, doprava, vrácení zboží, tabulky velikostí. Žádné varianty, filtry ani stránkování.
- Lokální služby: každá služba zvlášť, oblast působení, ceník nebo poptávka, o nás a kontakt.
- Vydavatelé: tematické rozcestníky a nadčasové texty místo posledních padesáti článků.
Časté dotazy
-
Soubor Markdown s názvem webu, krátkým shrnutím a seznamem klíčových stránek s popisy. Dává jazykovým modelům a agentům stručnou mapu obsahu, místo aby ji museli odvozovat z HTML.
-
Ne. Je to návrh vedený komunitou popsaný na llmstxt.org, nyní ve verzi v2, neschválený W3C ani IETF. Soulad se specifikací zde znamená strukturu popsanou tam.
-
Ne. Žádný systém ho nevyžaduje. Zveřejňujete ho dobrovolně, abyste řídili, co kompatibilním nástrojům AI ukazujete a jak je to popsané.
-
Neexistují pro to důkazy a tento nástroj to neslibuje. Soubor zlepšuje čitelnost obsahu a dává vám kontrolu nad popisy, ale není potvrzeným faktorem hodnocení ani zárukou citací.
-
Google uvádí, že soubor není pro jeho funkce AI ve vyhledávání potřeba. Nezávisle na tom umí Chrome Lighthouse ověřit základní vlastnosti zveřejněného souboru v experimentálních auditech. Jde o kontrolu struktury, ne o signál hodnocení.
-
Servírujte ho jako prostý text v kořeni domény, vedle robots.txt. Verze v2 navíc povoluje soubory na libovolné cestě:
/docs/llms.txtpokrývá obsah pod/docs/a agenti mají použít nejkonkrétnější soubor. -
llms.txt je vybraný rejstřík odkazů s popisy. llms-full.txt obsahuje úplný obsah stránek v markdownu. První je mapa, druhý území, a jen první patří do specifikace.
-
Sitemapa vypisuje všechny adresy pro vyhledávače, bez popisů a bez hierarchie. robots.txt řídí přístup crawlerů. llms.txt je krátká vybraná mapa s kontextem, ušitá na kontextové okno modelu.
-
Ano. Bez sitemapy se stránky hledají přes vnitřní odkazy z úvodní stránky, s přednostní dokumentací, produkty a službami.
-
Ano. V rámci denního limitu dostanete kompletní soubor, bez vodoznaku a bez zkráceného náhledu. Placené tarify zvyšují limit stránek a přidávají llms-full.txt.
Vytvořte si llms.txt
Zadejte doménu a získejte strukturovaný, ověřený a upravitelný soubor llms.txt připravený ke zveřejnění. Žádné ruční sbírání adres. Máte už soubor? Zkontrolujte ho pomocí Checker a validátor LLMs.txt.