Генератор LLMs.txt
Введіть свій домен. Генератор LLMs.txt обходить сайт, добирає сторінки, які варто показати системам ШІ, групує їх у розділи та пише опис до кожної. Ви отримуєте перевірений файл llms.txt, який можна відредагувати перед публікацією.
Різниця криється на середньому етапі процесу. Генератор не висипає карту сайту в текстовий файл: адреси фільтруються, важливі сторінки мають пріоритет, а описи постають зі справжнього вмісту сторінки, а не з метатегу.
Як це працює
- Введіть свій сайт. Або вкажіть карту сайту, або вставте власний список адрес.
- Генератор LLMs.txt обходить і аналізує. robots.txt, ваші карти сайту та вміст кожної сторінки.
- Будує та перевіряє файл. Розділи, описи та перевірка відповідності.
- Ви переглядаєте, редагуєте й публікуєте. Нічого не виходить назовні без вашого схвалення.
Більше, ніж перетворювач карти сайту на llms.txt
Простий генератор робить один прохід: усередину карта сайту, назовні адреси з метаописами. Так в опублікований файл потрапляють сторінка входу, кошик і сто порожніх дописів блогу.
| Можливість | DiagnoSEO | Інші генератори |
|---|---|---|
| Обходить справжній вміст сторінок | ✅ | По-різному |
| Відсіює адреси без цінності | ✅ | По-різному |
| Надає пріоритет важливим сторінкам | ✅ | По-різному |
| Створює логічні розділи | ✅ | По-різному |
| Пише описи з вмісту сторінки | ✅ | По-різному |
| Пише мовою сайту | ✅ | По-різному |
| Вбудована перевірка | ✅ | По-різному |
| Редагування перед завантаженням | ✅ | По-різному |
| Показує пропущені адреси та причину | ✅ | По-різному |
| Порівнює з наявним llms.txt | ✅ | По-різному |
| Створює llms-full.txt | ✅ | По-різному |
Що саме робить Генератор LLMs.txt
- Спершу карта сайту. Читає robots.txt і дає раду індексам карт сайту та картам, стисненим gzip.
- Резервний обхід. Немає карти сайту? Сторінки знаходимо через внутрішні посилання з головної.
- Паралельне завантаження тримає темп і на більших обходах.
- Розумний добір адрес. Пріоритет мають документація, продукти, послуги, ціни, про нас і контакти.
- Відсіювання шуму. Файли, вхід, кошик, посторінкова навігація, архіви міток і дат, параметри фільтрів.
- Власні виключення. Додайте частини адрес, які слід пропустити, як-от
/tag/чи?filter=. - Балансування розділів не дає великому блогу витіснити документацію.
- Чищення заголовків. «Ціни | Бренд» стає «Ціни».
- Розділи H2 та розділ
Optionalдля другорядного вмісту. - Підсумок та описи сторінок написані зі справжнього вмісту, мовою вашого сайту.
- Запасний варіант із метаопису, коли модель недоступна, тож ви завжди отримуєте придатний файл.
- Перевірка перед завантаженням, разом із критеріями Chrome Lighthouse.
- Порівняння з файлом llms.txt, уже опублікованим на вашому домені.
- Прозорі джерела. Кожна залучена адреса є в списку, і її можна зняти; біля кожної пропущеної вказано причину.
- llms-full.txt з повним вмістом сторінок, із того самого обходу.
Що таке llms.txt
llms.txt - це файл Markdown, описаний у пропозиції llmstxt.org, яку у вересні 2024 року опублікував Jeremy Howard (Answer.AI) і яку в серпні 2026 року оновлено до v2. Це пропозиція, яку веде спільнота, а не стандарт W3C чи IETF.
Будова коротка: заголовок H1 з назвою сайту (єдиний обов'язковий елемент), підсумок у цитаті, необов'язковий абзац контексту, а далі розділи H2 з посиланнями Markdown, де двокрапка вводить коротку примітку. Розділ із назвою Optional позначає вміст, який агент може пропустити за обмеженого контексту.
Файл може лежати в корені домену або на будь-якому шляху всередині нього. Версія v2 дозволяє файли обмеженого обсягу: /docs/llms.txt охоплює все під /docs/, а агенти мають використовувати найточніший відповідний файл.
Що таке llms-full.txt
llms-full.txt - це звичай, поширений платформами документації, і не є частиною специфікації. Замість посилань з описами він несе повний вміст сторінок у Markdown, зведений в один документ.
Він має сенс там, де користувачі ставлять асистентам ШІ докладні запитання: документація, продукти SaaS, бази знань. Обидва файли постають з одного обходу, тож лишаються узгодженими.
llms.txt, sitemap.xml і robots.txt
Три файли, три завдання. Вони не замінюють один одного, а добре доглянутий сайт віддає всі три.
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| Призначено для | Кравлерів | Пошукових систем | Мовних моделей та агентів |
| Відповідає на | Що дозволено обходити | Які адреси існують | Про що ключові сторінки |
| Формат | Директиви | XML | Markdown |
| Містить описи | Ні | Ні | Так |
| Керує доступом | Так | Ні | Ні |
| Обсяг | Домен | Домен | Домен або шлях |
Навіщо він видавцеві
- Контроль. Ви обираєте, які сторінки й описи показуєте, замість дозволяти моделі вгадувати з HTML, повного навігації та скриптів.
- Машинна читність. Markdown сумісним агентам і інструментам обробляти легше, ніж відрендерену сторінку.
- Економія контексту. Стисла карта вміщується у контекстне вікно, куди весь сайт ніколи б не вліз.
- Низька вартість. Нічого підтримувати у вашому стеку і жодного впливу на швидкодію.
Формат публікують команди документації OpenAI, Anthropic і Gemini, а автоматично його створюють платформи на кшталт Mintlify, GitBook і Wix, а також плагіни Yoast SEO та AIOSEO.
Чого llms.txt не робить
- Він не блокує кравлерів. Керування доступом належить robots.txt.
- Він не замінює ні robots.txt, ні sitemap.xml.
- Він не гарантує цитувань у ChatGPT, Perplexity, Gemini чи Claude.
- Він не є підтвердженим фактором ранжування в Google.
- Він не обов'язковий, а використання різниться між системами ШІ.
- Він не надолужить слабкий вміст чи сайт, недоступний для кравлерів.
Хто обіцяє більше цитувань лише завдяки файлу, обіцяє те, чого сьогодні ніхто не може довести. Цінність - у контролі та читності.
Перевірка та тест Chrome Lighthouse
Chrome Lighthouse 13.3 додав експериментальну категорію Agentic Browsing. Один з її аудитів перевіряє базові властивості опублікованого llms.txt: заголовок H1, щонайменше одне справжнє посилання Markdown у вигляді [Заголовок](URL) та довжину понад 50 символів.
Генератор відтворює перевірки цього аудиту. Це перевірка структури, а не сигнал ранжування в пошуку Google. Для самого аудиту відсутній файл вважається незастосовним, тоді як опублікований файл, який його не проходить, може бути позначений як помилка.
Тому перевірка йде перед завантаженням: структура llmstxt.org, три критерії Lighthouse, дублікати адрес, посилання на чужі домени та розмір файлу. Окремий Checker і валідатор LLMs.txt перевіряє файл, уже опублікований, зокрема чи його посилання ще працюють.
Як опублікувати файл
Віддавайте його як звичайний текст за адресою вашдомен.ua/llms.txt, поруч із robots.txt. Якщо описуєте лише частину сайту, покладіть його на той шлях, наприклад вашдомен.ua/docs/llms.txt. Після завантаження відкрийте адресу та переконайтеся, що бачите Markdown, а не сторінку 404.
| Платформа | Розташування |
|---|---|
| cPanel або спільний хостинг | /public_html/llms.txt |
| WordPress | Корінь сайту, не /wp-content/ |
| Next.js, Nuxt, Astro, React | /public/llms.txt |
| Laravel, Symfony | /public/llms.txt |
| Shopify | Вміст → Файли, потім перенаправте /llms.txt на завантажений файл |
| Webflow | Налаштування сайту, власний код або завантаження файлу |
| Netlify, Vercel, GitHub Pages | Додайте його до теки public у репозиторії |
Що має бути у файлі
llms.txt - це добірка, а не архів. Для повного переліку адрес у вас є карта сайту.
- SaaS і документація: огляд продукту, ціни, перші кроки, довідник API, changelog.
- Електронна комерція: категорії, флагманські продукти, доставка, повернення, таблиці розмірів. Без варіантів, фільтрів і посторінкової навігації.
- Локальні послуги: кожна послуга окремо, зона обслуговування, ціни або запит, про нас і контакти.
- Видавці: тематичні хаби та позачасові тексти замість останніх п'ятдесяти дописів.
Часті запитання
-
Файл Markdown із назвою вашого сайту, коротким підсумком і переліком ключових сторінок з описами. Він дає мовним моделям і агентам стислу карту вмісту, замість змушувати їх виводити її з HTML.
-
Ні. Це пропозиція, яку веде спільнота, описана на llmstxt.org, нині у версії v2, і її не затвердили ні W3C, ні IETF. Відповідність специфікації означає тут описану там структуру.
-
Ні. Жодна система його не вимагає. Ви публікуєте його добровільно, щоб керувати тим, що показуєте сумісним інструментам ШІ і як це описано.
-
Доказів цього немає, і цей інструмент цього не обіцяє. Файл робить вміст читнішим і дає вам контроль над описами, але це не підтверджений фактор ранжування і не гарантія цитувань.
-
Google зазначає, що файл не потрібен для його функцій ШІ в пошуку. Окремо Chrome Lighthouse може перевірити базові властивості опублікованого файлу в експериментальних аудитах. Це перевірка структури, а не сигнал ранжування.
-
Віддавайте його як звичайний текст у корені домену, поруч із robots.txt. Версія v2 дозволяє також файли на будь-якому шляху:
/docs/llms.txtохоплює вміст під/docs/, а агенти мають використовувати найточніший файл. -
llms.txt - це дібраний покажчик посилань з описами. llms-full.txt містить повний вміст сторінок у Markdown. Перший - карта, другий - територія, і лише перший належить до специфікації.
-
Карта сайту перелічує всі адреси для пошукових систем, без описів і без ієрархії. robots.txt керує доступом кравлерів. llms.txt - коротка дібрана карта з контекстом, скроєна під контекстне вікно моделі.
-
Так. Без карти сайту сторінки знаходять через внутрішні посилання з головної, з пріоритетом для документації, продуктів і послуг.
-
Так. У межах денного ліміту ви отримуєте повний файл, без водяного знака й без урізаного попереднього перегляду. Платні плани підвищують ліміт сторінок і додають llms-full.txt.
Створіть свій llms.txt
Введіть домен і отримайте структурований, перевірений і редагований файл llms.txt, готовий до публікації. Без ручного збирання адрес. Уже маєте файл? Перевірте його: Checker і валідатор LLMs.txt.