Generator LLMs.txt
Podaj domenę. Generator LLMs.txt crawluje stronę, wybiera podstrony warte pokazania systemom AI, grupuje je w sekcje i pisze opis każdej z nich. Dostajesz zwalidowany plik llms.txt, który możesz edytować przed publikacją.
Różnica tkwi w środku tego procesu. Generator nie zrzuca sitemapy do pliku tekstowego: filtruje adresy, stawia ważne podstrony na pierwszym miejscu, a opisy powstają z rzeczywistej treści podstrony, nie z meta tagu.
Jak stworzyć plik llms.txt
- Podajesz adres strony. Domenę, adres sitemapy albo własną listę URL-i.
- Generator LLMs.txt crawluje i analizuje. robots.txt, sitemapy i treść każdej podstrony.
- Buduje i waliduje plik. Sekcje, opisy i kontrola zgodności.
- Sprawdzasz, edytujesz, publikujesz. Nic nie wychodzi na zewnątrz bez Twojej zgody.
Więcej niż konwerter sitemapy na llms.txt
Prosty generator llms.txt robi jedno przejście: sitemapa na wejściu, adresy z opisami meta na wyjściu. Tak właśnie w opublikowanym pliku lądują strona logowania, koszyk i sto pustych wpisów blogowych.
| Funkcja | DiagnoSEO | Inne generatory |
|---|---|---|
| Crawluje rzeczywistą treść stron | ✅ | Różnie |
| Filtruje adresy o niskiej wartości | ✅ | Różnie |
| Stawia ważne podstrony na pierwszym miejscu | ✅ | Różnie |
| Tworzy logiczne sekcje | ✅ | Różnie |
| Pisze opisy z treści podstrony | ✅ | Różnie |
| Pisze w języku witryny | ✅ | Różnie |
| Wbudowana walidacja | ✅ | Różnie |
| Edycja przed pobraniem | ✅ | Różnie |
| Pokazuje pominięte adresy i powody | ✅ | Różnie |
| Porównuje istniejący llms.txt | ✅ | Różnie |
| Generuje llms-full.txt | ✅ | Różnie |
Co dokładnie robi Generator LLMs.txt
- Najpierw sitemapa. Czyta robots.txt, obsługuje indeksy sitemap i sitemapy w gzipie.
- Crawl awaryjny. Brak sitemapy? Podstrony odnajdywane są po linkach wewnętrznych ze strony głównej.
- Równoległe pobieranie utrzymuje tempo przy większych crawlach.
- Inteligentny wybór adresów. Pierwszeństwo: dokumentacja, produkty, usługi, cennik, o nas, kontakt.
- Odsiewanie śmieci. Pliki, logowanie, koszyk, paginacja, archiwa tagów i dat, parametry filtrów.
- Własne wykluczenia. Dodaj fragmenty adresów do pominięcia, np.
/tag/czy?filter=. - Balansowanie sekcji nie pozwala, by duży blog wypchnął dokumentację.
- Czyszczenie tytułów. „Cennik | Marka” staje się „Cennik”.
- Sekcje H2 oraz sekcja
Optionalna treści drugorzędne. - Podsumowanie i opisy podstron pisane z realnej treści, w języku Twojej witryny.
- Awaryjnie opis meta, gdy model jest niedostępny - plik zawsze powstaje.
- Walidacja przed pobraniem, łącznie z kryteriami Chrome Lighthouse.
- Porównanie z plikiem llms.txt już opublikowanym w Twojej domenie.
- Przejrzyste źródła. Każdy użyty adres można odznaczyć, a każdy pominięty ma podany powód.
- llms-full.txt z pełną treścią podstron, z tego samego crawla.
Czym jest llms.txt
llms.txt to plik Markdown opisany w propozycji llmstxt.org, opublikowanej przez Jeremy'ego Howarda (Answer.AI) we wrześniu 2024 i zaktualizowanej do wersji v2 w sierpniu 2026. To propozycja rozwijana przez społeczność, nie standard W3C ani IETF.
Struktura jest krótka: nagłówek H1 z nazwą witryny (jedyny wymagany element), blok cytatu z podsumowaniem, opcjonalny akapit kontekstu, a dalej sekcje H2 z linkami Markdown, gdzie po dwukropku dodaje się krótką notatkę. Sekcja Optional oznacza treści, które agent może pominąć przy ciasnym kontekście.
Plik może leżeć w katalogu głównym domeny albo na dowolnej ścieżce w jej obrębie. Wersja v2 dopuszcza pliki zakresowe, więc /docs/llms.txt opisuje wszystko pod /docs/, a agent powinien użyć najbardziej szczegółowego pasującego pliku.
Czym jest llms-full.txt
llms-full.txt to konwencja spopularyzowana przez platformy dokumentacji, nie element specyfikacji. Zamiast linków z opisami niesie pełną treść podstron w markdownie, połączoną w jeden dokument.
Ma sens tam, gdzie użytkownicy zadają asystentom AI szczegółowe pytania: dokumentacja, produkty SaaS, bazy wiedzy. Generator llms-full.txt korzysta z tego samego crawla co plik indeksowy, więc oba pozostają spójne.
llms.txt, sitemap.xml i robots.txt
Trzy pliki, trzy zadania. Nie zastępują się nawzajem, a dobrze utrzymana strona serwuje wszystkie trzy.
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| Adresat | Crawlery | Wyszukiwarki | Modele językowe i agenci |
| Odpowiada na | Co wolno crawlować | Jakie adresy istnieją | O czym są kluczowe strony |
| Format | Dyrektywy | XML | Markdown |
| Zawiera opisy | Nie | Nie | Tak |
| Kontroluje dostęp | Tak | Nie | Nie |
| Zakres | Domena | Domena | Domena lub ścieżka |
Po co wydawcy ten plik
- Kontrola. Sam wybierasz podstrony i opisy, zamiast zostawiać modelowi wnioskowanie z HTML-a pełnego nawigacji i skryptów.
- Czytelność maszynowa. Markdown jest łatwiejszy w odbiorze dla zgodnych agentów niż renderowana strona.
- Oszczędność kontekstu. Zwięzła mapa mieści się w oknie kontekstu, którego cała witryna nigdy by nie zmieściła.
- Niski koszt. Nic do utrzymywania w stacku, zero wpływu na wydajność.
Format publikują zespoły dokumentacji OpenAI, Anthropic i Gemini, a generują go automatycznie platformy takie jak Mintlify, GitBook i Wix oraz wtyczki Yoast SEO i AIOSEO.
Czego llms.txt nie robi
- Nie blokuje crawlerów. Kontrola dostępu należy do robots.txt.
- Nie zastępuje robots.txt ani sitemap.xml.
- Nie gwarantuje cytowań w ChatGPT, Perplexity, Gemini ani Claude.
- Nie jest potwierdzonym czynnikiem rankingowym w Google.
- Nie jest wymagany, a stopień wykorzystania różni się między systemami AI.
- Nie nadrobi słabej treści ani strony niedostępnej dla crawlerów.
Kto obiecuje wzrost cytowań dzięki samemu plikowi, obiecuje coś, czego dziś nie da się wykazać. Wartością jest kontrola i czytelność.
Walidacja i test Chrome Lighthouse
Chrome Lighthouse 13.3 dodał eksperymentalną kategorię Agentic Browsing. Jeden z jej audytów sprawdza podstawowe właściwości opublikowanego pliku llms.txt: nagłówek H1, co najmniej jeden prawdziwy link Markdown w formie [Tytuł](URL) oraz długość powyżej 50 znaków.
Generator odwzorowuje kryteria tego audytu. To kontrola struktury, a nie sygnał rankingowy w wyszukiwarce Google. W samym audycie brak pliku traktowany jest jako „nie dotyczy”, natomiast opublikowany plik, który go nie przechodzi, może zostać zaraportowany jako błąd.
Dlatego walidacja działa przed pobraniem: struktura llmstxt.org, trzy kryteria Lighthouse, duplikaty adresów, linki do obcych domen i rozmiar pliku. Osobny checker i walidator llms.txt sprawdza plik już opublikowany, razem z osiągalnością linków.
Gdzie umieścić llms.txt i jak go opublikować
Serwuj go jako zwykły tekst pod adresem twojadomena.pl/llms.txt, obok robots.txt. Aby opisać tylko wycinek serwisu, umieść plik na tej ścieżce, np. twojadomena.pl/docs/llms.txt. Po wgraniu otwórz adres i upewnij się, że widzisz Markdown, a nie stronę 404.
| Platforma | Ścieżka |
|---|---|
| cPanel lub hosting współdzielony | /public_html/llms.txt |
| WordPress | Katalog główny, nie /wp-content/ |
| Next.js, Nuxt, Astro, React | /public/llms.txt |
| Laravel, Symfony | /public/llms.txt |
| Shopify | Treść → Pliki, następnie przekierowanie /llms.txt na wgrany plik |
| Webflow | Ustawienia witryny, własny kod lub wgranie pliku |
| Netlify, Vercel, GitHub Pages | Plik w katalogu public w repozytorium |
Co powinno znaleźć się w pliku, według typu strony
llms.txt to lista wybranych stron, a nie archiwum. Od kompletnego zrzutu adresów jest sitemapa. Te same zasady obowiązują, czy strona stoi na WordPressie, Shopify, Webflow, czy na własnym stacku.
- SaaS i dokumentacja: opis produktu, cennik, pierwsze kroki, dokumentacja API, changelog.
- E-commerce: kategorie, flagowe produkty, dostawa, zwroty, tabele rozmiarów. Bez wariantów, filtrów i paginacji.
- Usługi lokalne: każda usługa osobno, obszar działania, cennik lub wycena, o nas i kontakt.
- Wydawcy: huby tematyczne i teksty evergreen zamiast pięćdziesięciu najnowszych wpisów.
Najczęściej zadawane pytania
-
To plik Markdown z nazwą strony, krótkim podsumowaniem i listą kluczowych podstron z opisami. Daje modelom i agentom zwięzłą mapę treści, zamiast zmuszać je do wnioskowania z HTML-a.
-
Nie. To propozycja rozwijana przez społeczność, opisana na llmstxt.org, obecnie w wersji v2, niezatwierdzona przez W3C ani IETF. Zgodność ze specyfikacją oznacza tutaj strukturę opisaną właśnie tam.
-
Nie. Żaden system go nie wymaga. Publikujesz go dobrowolnie, żeby kontrolować, co i jak wystawiasz zgodnym narzędziom AI.
-
Nie ma na to dowodów, a narzędzie tego nie obiecuje. Plik ułatwia odczyt treści i daje kontrolę nad opisami, ale nie jest potwierdzonym czynnikiem rankingowym ani gwarancją cytowań.
-
Google deklaruje, że plik nie jest potrzebny do funkcji AI w wyszukiwarce. Niezależnie od tego Chrome Lighthouse potrafi zwalidować podstawowe właściwości opublikowanego pliku. To kontrola struktury, nie sygnał rankingowy.
-
Serwuj go jako zwykły tekst w katalogu głównym domeny, obok robots.txt. Wersja v2 dopuszcza też pliki na dowolnej ścieżce:
/docs/llms.txtopisuje treści pod/docs/, a agent powinien użyć najbardziej szczegółowego pliku. -
llms.txt to wyselekcjonowany indeks linków z opisami. llms-full.txt zawiera pełną treść podstron w markdownie. Pierwszy jest mapą, drugi terytorium, a tylko pierwszy należy do specyfikacji.
-
Sitemapa wylicza wszystkie adresy dla wyszukiwarek, bez opisów i hierarchii. robots.txt kontroluje dostęp crawlerów. llms.txt to krótka, wyselekcjonowana mapa z kontekstem, dopasowana do okna kontekstu modelu.
-
Tak. Bez sitemapy podstrony są odkrywane po linkach wewnętrznych ze strony głównej, z priorytetem dla dokumentacji, produktów i usług.
-
Tak. W ramach dziennego limitu dostajesz kompletny plik, bez znaku wodnego i bez ucinania wyniku. Płatne plany zwiększają limit stron i dodają llms-full.txt.
Wygeneruj swój plik llms.txt
Podaj domenę i pobierz ustrukturyzowany, zwalidowany i edytowalny plik llms.txt gotowy do publikacji. Za darmo, bez rejestracji, bez ręcznego zbierania adresów. Masz już plik? Sprawdź go checker i walidator llms.txt.