Gerador LLMs.txt

  • Limite mensal 0/10
  • Nome do plano Free

Lemos o robots.txt e o seu sitemap e, na falta deles, seguimos as ligações da página inicial.

Configurações avançadas

Disponível no plano Avançado

Será usado como título H1 do ficheiro. Deixe vazio para deteção automática.

Fragmentos de URL separados por vírgulas a ignorar, ex. /tag/, /categoria/, ?filter=

Custo total em créditos: ...

Introduza o seu domínio. O Gerador LLMs.txt rastreia o site, escolhe as páginas que vale a pena mostrar aos sistemas de IA, agrupa-as em secções e escreve uma descrição para cada uma. Recebe um llms.txt validado que pode editar antes de publicar.

A diferença está no meio do processo. O gerador não despeja o seu sitemap num ficheiro de texto: filtra os URL, dá prioridade às páginas importantes e as descrições nascem do conteúdo real da página, não da meta tag.

Como funciona

  1. Introduza o seu site. Ou indique um sitemap, ou cole a sua própria lista de URL.
  2. O Gerador LLMs.txt rastreia e analisa. robots.txt, os seus sitemaps e o conteúdo de cada página.
  3. Cria e valida o ficheiro. Secções, descrições e uma verificação de conformidade.
  4. Revê, edita e publica. Nada sai sem a sua aprovação.

Mais do que um conversor de sitemap para llms.txt

Um gerador simples faz uma única passagem: entra o sitemap, saem URL com meta descrições. É assim que a página de início de sessão, o carrinho e cem artigos de blogue vazios acabam num ficheiro publicado.

FuncionalidadeDiagnoSEOOutros geradores
Rastreia o conteúdo real das páginasVaria
Filtra URL sem valorVaria
Dá prioridade às páginas importantesVaria
Cria secções lógicasVaria
Escreve descrições a partir do conteúdoVaria
Escreve no idioma do siteVaria
Validação integradaVaria
Edição antes da transferênciaVaria
Mostra os URL excluídos e o motivoVaria
Compara o seu llms.txt existenteVaria
Gera llms-full.txtVaria

O que o Gerador LLMs.txt faz exatamente

  • Descoberta a começar pelo sitemap. Lê o robots.txt e trata índices de sitemaps e sitemaps comprimidos em gzip.
  • Rastreio de recurso. Sem sitemap? As páginas são descobertas pelas ligações internas da página inicial.
  • Transferência em paralelo mantém rápidos mesmo os rastreios maiores.
  • Seleção inteligente de URL. Documentação, produtos, serviços, preços, sobre nós e contactos vêm primeiro.
  • Remoção de ruído. Ficheiros, início de sessão, carrinho, paginação, arquivos de etiquetas e datas, parâmetros de filtro.
  • Exclusões próprias. Acrescente fragmentos de URL a ignorar, como /tag/ ou ?filter=.
  • O equilíbrio de secções impede que um blogue extenso sufoque a documentação.
  • Limpeza de títulos. «Preços | Marca» passa a «Preços».
  • Secções H2 mais uma secção Optional para conteúdos secundários.
  • Resumo e descrições de páginas escritos a partir do conteúdo real, no idioma do seu site.
  • Recurso à meta descrição se o modelo não estiver disponível, para receber sempre um ficheiro utilizável.
  • Validação antes da transferência, incluindo os critérios do Chrome Lighthouse.
  • Comparação com o llms.txt já publicado no seu domínio.
  • Fontes transparentes. Cada URL incluído está listado e pode ser desmarcado; cada URL excluído mostra o motivo.
  • llms-full.txt com o conteúdo completo das páginas, do mesmo rastreio.

O que é o llms.txt

llms.txt é um ficheiro Markdown descrito na proposta llmstxt.org, publicada por Jeremy Howard (Answer.AI) em setembro de 2024 e atualizada para v2 em agosto de 2026. É uma proposta impulsionada pela comunidade, não uma norma do W3C ou do IETF.

A estrutura é curta: um H1 com o nome do site (o único elemento obrigatório), um resumo em citação, um parágrafo de contexto opcional e depois secções H2 com ligações Markdown, onde os dois pontos introduzem uma nota breve. Uma secção chamada Optional assinala o conteúdo que um agente pode ignorar quando o contexto é escasso.

O ficheiro pode estar na raiz do domínio ou em qualquer caminho dentro dele. A v2 permite ficheiros de âmbito restrito: /docs/llms.txt cobre tudo o que existe em /docs/, e os agentes devem usar o ficheiro mais específico aplicável.

O que é o llms-full.txt

llms-full.txt é uma convenção popularizada pelas plataformas de documentação e não faz parte da especificação. Em vez de ligações com descrições, contém o conteúdo completo das páginas em Markdown, reunido num único documento.

Faz sentido onde os utilizadores colocam perguntas detalhadas a assistentes de IA: documentação, produtos SaaS, bases de conhecimento. Ambos os ficheiros vêm do mesmo rastreio, pelo que se mantêm coerentes.

llms.txt, sitemap.xml e robots.txt

Três ficheiros, três funções. Não se substituem e um site bem mantido serve os três.

 robots.txtsitemap.xmlllms.txt
Destinado aRastreadoresMotores de buscaModelos de linguagem e agentes
Responde aO que pode ser rastreadoQue URL existemSobre o que são as páginas principais
FormatoDiretivasXMLMarkdown
Inclui descriçõesNãoNãoSim
Controla o acessoSimNãoNão
ÂmbitoDomínioDomínioDomínio ou caminho

Porque um editor pode querer um

  • Controlo. É o editor que escolhe que páginas e descrições expõe, em vez de deixar um modelo deduzi-las de HTML cheio de navegação e scripts.
  • Legibilidade para máquinas. O Markdown é mais fácil de consumir para agentes e ferramentas compatíveis do que uma página renderizada.
  • Eficiência de contexto. Um mapa conciso cabe numa janela de contexto onde o site inteiro nunca caberia.
  • Custo reduzido. Nada para manter na sua stack e sem impacto no desempenho.

O formato é publicado pelas equipas de documentação da OpenAI, Anthropic e Gemini, e gerado automaticamente por plataformas como Mintlify, GitBook e Wix, além dos plugins Yoast SEO e AIOSEO.

O que o llms.txt não faz

  • Não bloqueia rastreadores. O controlo de acesso pertence ao robots.txt.
  • Não substitui o robots.txt nem o sitemap.xml.
  • Não garante citações no ChatGPT, Perplexity, Gemini ou Claude.
  • Não é um fator de posicionamento confirmado no Google.
  • Não é obrigatório e a adoção varia entre sistemas de IA.
  • Não compensa conteúdo fraco nem um site inacessível aos rastreadores.

Quem promete mais citações só pelo ficheiro promete algo que hoje ninguém consegue demonstrar. O valor está no controlo e na legibilidade.

Validação e a verificação do Chrome Lighthouse

O Chrome Lighthouse 13.3 acrescentou a categoria experimental Agentic Browsing. Uma das suas auditorias valida propriedades básicas de um llms.txt publicado: um cabeçalho H1, pelo menos uma ligação Markdown verdadeira na forma [Título](URL) e um comprimento superior a 50 caracteres.

O gerador reproduz as verificações dessa auditoria. É uma verificação estrutural, não um sinal de posicionamento na Pesquisa Google. Para a própria auditoria, um ficheiro ausente é tratado como não aplicável, enquanto um ficheiro publicado que falhe pode ser reportado como erro.

Por isso a validação corre antes da transferência: estrutura llmstxt.org, os três critérios do Lighthouse, URL duplicados, ligações para domínios externos e tamanho do ficheiro. O Checker e validador LLMs.txt separado verifica um ficheiro já publicado, incluindo se as ligações continuam a funcionar.

Como publicar o ficheiro

Sirva-o como texto simples em oseudominio.pt/llms.txt, junto ao robots.txt. Para descrever apenas parte do site, coloque-o nesse caminho, por exemplo oseudominio.pt/docs/llms.txt. Depois de carregar, abra o endereço e confirme que vê Markdown e não uma página 404.

PlataformaLocal
cPanel ou alojamento partilhado/public_html/llms.txt
WordPressRaiz do site, não /wp-content/
Next.js, Nuxt, Astro, React/public/llms.txt
Laravel, Symfony/public/llms.txt
ShopifyConteúdo → Ficheiros e depois redirecionar /llms.txt para o ficheiro carregado
WebflowDefinições do site, código personalizado ou carregamento de ficheiro
Netlify, Vercel, GitHub PagesColoque-o na pasta public do repositório

O que deve constar do ficheiro

Um llms.txt é uma seleção, não um arquivo. Para a lista completa de URL já existe o sitemap.

  • SaaS e documentação: visão geral do produto, preços, primeiros passos, referência da API, changelog.
  • Comércio eletrónico: categorias, produtos de destaque, envios, devoluções, guias de tamanhos. Sem variantes, filtros ou paginação.
  • Serviços locais: cada serviço em separado, área de atuação, preços ou orçamento, sobre nós e contactos.
  • Editores: centros temáticos e conteúdos intemporais em vez dos últimos cinquenta artigos.

Perguntas frequentes

  • Um ficheiro Markdown com o nome do site, um resumo curto e uma lista de páginas principais com descrições. Dá aos modelos de linguagem e aos agentes um mapa conciso do seu conteúdo, em vez de os obrigar a deduzi-lo do HTML.

  • Não. É uma proposta impulsionada pela comunidade descrita em llmstxt.org, atualmente na v2, e não foi ratificada pelo W3C nem pelo IETF. Conformidade com a especificação significa aqui a estrutura aí descrita.

  • Não. Nenhum sistema o exige. Publica-se voluntariamente, para controlar o que expõe às ferramentas de IA compatíveis e como é descrito.

  • Não há provas disso, e esta ferramenta não o promete. O ficheiro torna o conteúdo mais legível e dá-lhe controlo sobre as descrições, mas não é um fator de posicionamento confirmado nem uma garantia de citações.

  • O Google indica que o ficheiro não é necessário para as suas funcionalidades de IA na Pesquisa. Em separado, o Chrome Lighthouse pode validar propriedades básicas de um ficheiro publicado nas suas auditorias experimentais. É uma verificação estrutural, não um sinal de posicionamento.

  • Sirva-o como texto simples na raiz do domínio, junto ao robots.txt. A v2 permite também ficheiros em qualquer caminho: /docs/llms.txt cobre o conteúdo em /docs/, e os agentes devem usar o ficheiro mais específico.

  • O llms.txt é um índice selecionado de ligações com descrições. O llms-full.txt contém o conteúdo completo das páginas em Markdown. O primeiro é o mapa, o segundo o território, e só o primeiro faz parte da especificação.

  • Um sitemap lista todos os URL para os motores de busca, sem descrições nem hierarquia. O robots.txt controla o acesso dos rastreadores. O llms.txt é um mapa curto e selecionado com contexto, dimensionado para a janela de contexto de um modelo.

  • Sim. Sem sitemap, as páginas são descobertas pelas ligações internas da página inicial, dando prioridade a documentação, produtos e serviços.

  • Sim. Dentro do limite diário recebe o ficheiro completo, sem marca de água e sem pré-visualização cortada. Os planos pagos aumentam o limite de páginas e acrescentam o llms-full.txt.

Gere o seu llms.txt

Introduza o seu domínio e receba um ficheiro llms.txt estruturado, validado e editável, pronto a publicar. Sem recolher URL à mão. Já tem um ficheiro? Verifique-o com o Checker e validador LLMs.txt.

Desbloqueie classificações mais altas e tráfego de qualidade

Faça seu negócio crescer com o software completo #1 com IA para SEO e marketing de conteúdo.

Atualizar para Avançado