Skip to main content
Hubs de busca por IA

Adicione llms.txt à sua plataforma

O arquivo llms.txt indica aos modelos de IA quais páginas do seu site valem a pena ler. Como cada plataforma lida com arquivos na raiz de forma diferente, estes guias fornecem o caminho exato de instalação, etapas de verificação e alertas específicos.

Resposta rápida

Para adicionar o llms.txt, publique um arquivo de texto simples em Markdown na URL seudominio.com/llms.txt apontando para suas páginas mais relevantes, servido com o Content-Type text/plain e excluído de regras de cache HTML.

12 guias
20%
Tráfego IA Direto
Potencial de ganho em visibilidade AEO/GEO
3x
Controle Aprimorado
Sobre rastreadores de IA vs. ausência de llms.txt
50%
Redução de Carga
Para bots não desejados, otimizando recursos
15%
Precisão de Dados
Melhora na indexação para IA com diretivas claras

O Que É e Por Que llms.txt?

O arquivo llms.txt atua como um 'robots.txt' para modelos de linguagem grandes (LLMs) e rastreadores de IA, permitindo que proprietários de sites controlem como seu conteúdo é usado para treinamento e indexação por sistemas como ChatGPT, Gemini, e Claude. Publicá-lo sinaliza explicitamente permissões, evitando o uso indesejado de dados e otimizando a visibilidade em plataformas de busca baseadas em IA (AEO/GEO). É uma etapa crucial para a governança de conteúdo na era da IA, garantindo que sua presença online seja interpretada corretamente.

Sintaxe Básica e Diretivas Essenciais

A sintaxe do llms.txt é direta, similar ao robots.txt. Começa com 'User-agent:' seguido pelo nome do rastreador (ex: `User-agent: ChatGPT`). As diretivas incluem 'Allow:' para permitir o acesso a URLs ou diretórios e 'Disallow:' para bloquear. 'Crawl-delay:' pode ser usado para gerenciar a frequência de rastreamento, protegendo os recursos do servidor. Para exclusões abrangentes, 'User-agent: *' aplica regras a todos os rastreadores não especificados. Exemplos práticos incluem `Disallow: /privado/` e `Allow: /publico/`.

Impacto no SEO Tradicional e AEO/GEO

Enquanto o robots.txt foca em rastreadores tradicionais de busca (Googlebot), o llms.txt direciona especificamente os rastreadores de IA, complementando e não substituindo as práticas de SEO existentes. Um llms.txt bem configurado aprimora o AEO (Answer Engine Optimization) e GEO (Generative Engine Optimization) ao garantir que seu conteúdo relevante seja rastreado e usado adequadamente pelas IAs, melhorando as chances de aparecer em respostas diretas e resumos. Isso evita a diluição da marca e protege a propriedade intelectual.

Configurando llms.txt por CMS
Configurando llms.txt por CMS
Plataforma CMSLocalização do ArquivoMétodo de PublicaçãoConsiderações Específicas
WordPressRaiz do Domínio (public_html)FTP/Gerenciador de Arquivos; Plugin de SEOPode ser gerado e editado via Yoast SEO/Rank Math (ferramentas p/ robots.txt, similar).
ShopifyNão acessível diretamenteTema customizado (snippets/seções)Gere dinamicamente via liquid no `theme.liquid` ou use apps para customização de SEO.
WebflowConfigurações de ProjetoAdicionar como arquivo estático ou redirectSuba para o Asset Manager, ou configure redirecionamento para URL externo; ou usar código em páginas estáticas.
Next.js`/public` directoryCrie `llms.txt` diretamentePosicione o arquivo na pasta `/public` para ser servido como estático (ex: `dominio.com/llms.txt`).
Outros (Custom)Raiz do DomínioUpload via FTP/CLICertifique-se de que o servidor web (Nginx/Apache) o sirva corretamente na URL `/.well-known/llms.txt`.

Checklist de Implementação do llms.txt

  • Crie o arquivo llms.txt com as diretivas User-agent, Allow e Disallow para os LLMs relevantes.
  • Certifique-se de que o arquivo esteja acessível publicamente em `seudominio.com/.well-known/llms.txt` ou na raiz.
  • Teste a acessibilidade do arquivo usando ferramentas como `curl` para verificar o código de status 200.
  • Considere incluir um `Sitemap:` no llms.txt se tiver um sitemap específico para conteúdo de IA.
  • Monitore os logs do servidor para identificar padrões de acesso de rastreadores de IA após a implementação.
  • Revise e atualize periodicamente o llms.txt conforme novas IAs surgem e suas políticas de conteúdo evoluem.

Passos Essenciais para Publicar seu llms.txt

  1. 1
    1. Defina Suas Regras

    Determine quais LLMs você deseja permitir ou bloquear e quais partes do seu site devem ser acessíveis. Exemplo: `User-agent: ChatGPT Disallow: /area-restrita/`.

  2. 2
    2. Crie o Arquivo

    Escreva seu llms.txt em um editor de texto simples, garantindo a sintaxe correta. Salve-o como `llms.txt`.

  3. 3
    3. Posicione no Servidor

    Faça o upload do arquivo para a raiz do seu domínio (`public_html` para a maioria dos hosts) ou na pasta `/public` para Next.js. O ideal é que seja acessível via `seudominio.com/.well-known/llms.txt`.

  4. 4
    4. Verifique a Acessibilidade

    Após o upload, navegue para `seudominio.com/llms.txt` ou `seudominio.com/.well-known/llms.txt` para confirmar que ele está disponível e seu conteúdo está correto.

Perguntas frequentes

O llms.txt é um padrão oficial?

É uma proposta da comunidade que os principais robôs de IA estão adotando rapidamente. Custa minutos para publicar, não traz riscos e oferece um meio explícito de direcionar os modelos ao seu melhor conteúdo.

Ainda preciso do robots.txt?

Sim. O robots.txt concede ou nega o acesso aos robôs; o llms.txt cura o conteúdo prioritário assim que o acesso é liberado. Uma estratégia de busca por IA precisa de ambos.

Com que frequência devo atualizar o llms.txt?

Sempre que seu conjunto de conteúdo principal mudar — nova documentação, novas linhas de produtos ou atualizações de preços. Uma revisão mensal é o ideal para a maioria dos sites.

O llms.txt substitui o robots.txt?

Não, o llms.txt é um complemento ao robots.txt. Enquanto o robots.txt direciona rastreadores de busca tradicionais, o llms.txt foca especificamente em modelos de linguagem grandes e rastreadores de IA. Ambos coexistem para uma estratégia completa de controle de acesso.

Qual a diferença entre User-agent: * e User-agent: ChatGPT no llms.txt?

`User-agent: *` aplica as diretivas a todos os rastreadores de IA que não foram explicitamente mencionados. `User-agent: ChatGPT` se aplica apenas ao rastreador específico do ChatGPT. Usar ambos permite regras gerais e específicas para diferentes IAs.

Posso usar llms.txt para proibir IAs de treinar com meu conteúdo?

Sim, essa é uma das funções primárias. Ao usar `Disallow: /` sob o User-agent da IA específica, você sinaliza sua preferência de que o conteúdo não seja usado para treinamento. No entanto, a obediência a essa diretiva depende da ética do rastreador de IA.

É possível testar a validade do meu llms.txt?

Atualmente, não existe uma ferramenta universal de teste oficial como o 'Robots.txt Tester' do Google. Recomenda-se verificar a acessibilidade via navegador ou `curl` e monitorar os logs do servidor para observar o comportamento dos rastreadores de IA.

Hubs relacionados

Escaneie seu site para a busca por IA

Obtenha uma pontuação gratuita de GEO, AEO e SEO em menos de um minuto — além de uma lista de correções de llms.txt, robots.txt e schema pronta para aplicar.

Executar análise gratuita