llms.txt: como entregar seu conteúdo aos buscadores de IA — guia passo a passo para iniciantes
Sumário do artigo
- Introdução: por que seu site precisa do llms.txt
- Preparação inicial
- Conceitos básicos: o que é llms.txt e como ele funciona
- Etapa 1: auditoria do conteúdo e escolha das páginas para a ia
- Etapa 2: criação do arquivo llms.txt e da sua estrutura básica
- Etapa 3: preenchimento das seções e links
- Etapa 4: criação do llms-full.txt e das versões em texto limpo das páginas
- Etapa 5: upload dos arquivos para o servidor
- Etapa 6: configuração dos cabeçalhos de resposta do servidor
- Verificação do resultado: checklist de prontidão do llms.txt
- Erros típicos ao criar o llms.txt e suas soluções
- Recursos adicionais: trabalho avançado com o llms.txt
- Faq: perguntas frequentes sobre o llms.txt
- Conclusão
Introdução: por que seu site precisa do llms.txt
Até alguns anos atrás, o caminho do usuário até o seu conteúdo era simples: uma busca no Google, uma lista de links, um clique. Em 2026, o cenário é outro. Cada vez mais pessoas fazem perguntas a assistentes de IA e buscadores de IA, e eles mesmos leem os sites, resumem e citam. Se o modelo não entendeu do que se trata o seu site, ele vai ignorá-lo ou resumir errado. O arquivo llms.txt resolve exatamente esse problema: ele explica aos modelos de linguagem o que você tem e onde está o mais importante.
Este guia prático vai te levar do bloco de notas vazio até um arquivo llms.txt funcionando no seu domínio. Nada de teoria pela teoria, só ações concretas com verificação em cada etapa.
O que você vai conseguir no final
- Um arquivo llms.txt pronto, que fica na raiz do seu site e abre no endereço tipo seu-dominio/llms.txt.
- Uma versão estendida llms-full.txt com o texto completo das páginas principais.
- Entendimento de quais páginas vale a pena mostrar para a IA e quais não.
- Uma verificação configurada: você vai saber que o arquivo está sendo lido e que os bots de IA chegam até ele.
- Uma base para continuar trabalhando com otimização generativa, ou seja, com a visibilidade da marca nas respostas de IA.
Para quem é este guia
Para donos de negócio, profissionais de marketing, afiliados e desenvolvedores que querem que seu produto, landing page ou blog apareçam corretamente nas respostas dos assistentes de IA. Se você tem um site e sabe como subir arquivos nele ou conhece quem faça isso, você tem habilidade suficiente. Um bloco separado no final é dedicado a quem quer automatizar o processo e acompanhar o comportamento dos bots de IA pelos logs.
O que é preciso saber de antemão
- Como funciona o seu site: em construtor, em CMS como WordPress ou em código próprio.
- Onde ficam armazenados os arquivos do site e como chegar até eles: painel de hospedagem, FTP, repositório.
- Noção básica de Markdown: títulos com cerquilha, listas com hífen, links entre colchetes e parênteses. Se não conhece, sem problema, vamos explicar com exemplos.
Quanto tempo vai levar
A versão mínima para um site de até 30 páginas leva cerca de uma hora. A versão completa com llms-full.txt, verificação e configuração de cabeçalhos do servidor vai exigir duas a três horas. Para grandes catálogos e documentação, reserve um dia, mas o resultado também será bem mais qualificado.
Preparação inicial
Uma boa preparação economiza mais tempo do que qualquer atalho. Passe pela lista abaixo e confirme que está tudo à mão.
Ferramentas e acessos necessários
- Acesso aos arquivos do site. Pode ser o painel de controle da hospedagem com gerenciador de arquivos, um cliente FTP como o FileZilla, acesso SSH ao servidor ou o repositório do projeto de onde sai o deploy. Verifique se login e senha estão atualizados e se você consegue mesmo criar um arquivo na pasta raiz do site.
- Editor de texto. Serve qualquer um que salve texto puro sem formatação: Visual Studio Code, Sublime Text, Notepad++ no Windows, TextEdit no modo texto simples no Mac. Word e Google Docs não servem: eles adicionam caracteres invisíveis e aspas tipográficas.
- Lista de páginas do site. Baixe do sitemap.xml, do painel do CMS ou de qualquer crawler, como o Screaming Frog. Basta uma tabela com o endereço e o título de cada página.
- Acesso às estatísticas. Google Analytics ou logs do servidor ajudam a entender quais páginas são realmente importantes para os usuários.
- Navegador e o utilitário curl. O curl já vem instalado no Mac e no Linux, e no Windows 10 e 11 está disponível no prompt de comando. Ele vai ser necessário para verificar os cabeçalhos de resposta do servidor.
Requisitos de sistema
Nenhum. O arquivo llms.txt é texto puro. Ele não precisa de PHP, nem de banco de dados, nem de módulo separado no servidor. O único requisito: o servidor deve entregar arquivos estáticos a partir da raiz do domínio, e isso qualquer hospedagem faz.
O que baixar e instalar
- Editor de código, se você ainda não tem. Recomendamos o Visual Studio Code: gratuito, destaca Markdown e mostra caracteres invisíveis.
- Cliente FTP, se o painel de hospedagem não tiver gerenciador de arquivos.
- Opcional: Python 3 e o pacote llms-txt para gerar contexto a partir do arquivo pronto. Ele vai ser útil no bloco avançado, para a configuração básica não é obrigatório.
Backups
Criar o llms.txt não altera os arquivos existentes do site, então o risco é mínimo. Porém, na etapa de configuração de cabeçalhos do servidor você vai editar a configuração, por exemplo o arquivo .htaccess ou o config do Nginx. Antes disso, baixe obrigatoriamente a versão atual do arquivo de configuração para o computador e salve com a data marcada. Se depois da alteração o site parar de abrir, você simplesmente restaura a versão antiga.
Dica: Crie uma pasta separada do projeto no computador, por exemplo site-llms. Guarde nela a tabela de páginas, os rascunhos do arquivo e as cópias dos configs. Daqui a seis meses, quando chegar a hora de atualizar o llms.txt, você vai agradecer a si mesmo.
Conceitos básicos: o que é llms.txt e como ele funciona
Antes de criar o arquivo, vamos destrinchar alguns termos em linguagem simples. Isso leva cinco minutos, mas depois tudo vai ficar claro.
O que é llms.txt
llms.txt é um arquivo de texto em formato Markdown que se coloca na raiz do site. Ele contém uma descrição curta do projeto e uma lista estruturada de links para as páginas principais com explicações. O nome se lê como «éle-éle-ême-ésse-tê-í-éks-tê»: LLMs são Large Language Models, grandes modelos de linguagem.
A proposta do padrão surgiu no outono de 2024, do desenvolvedor Jeremy Howard, da empresa Answer.AI. A ideia era simples: os modelos de linguagem têm uma «janela de atenção» limitada e não lidam bem com páginas HTML pesadas, cheias de menu, anúncios, scripts e pop-ups. O arquivo llms.txt oferece a eles um mapa limpo do conteúdo, sem ruído. Desde então, o formato foi adotado por centenas de empresas, especialmente nas áreas de documentação e desenvolvimento, e em 2025-2026 virou um dos elementos básicos de preparação de sites para trabalhar com IA.
O que o llms.txt não é
É importante entender isso logo de cara, para não confundir as ferramentas.
- Não é um arquivo de proibições. Ele não bloqueia nem libera nada. As regras de acesso para bots ficam em outro arquivo, e sobre isso temos materiais separados no nosso blog. Aqui não tratamos desse tema.
- Não é um sitemap no sentido de sitemap.xml. O sitemap lista todos os endereços para indexação. O arquivo llms.txt, ao contrário, seleciona o essencial e explica o sentido de cada link.
- Não é garantia de aparecer em respostas de IA. O arquivo ajuda os modelos a entender o conteúdo, mas não os obriga a citá-lo.
Dois arquivos: llms.txt e llms-full.txt
O padrão propõe duas entidades:
- llms.txt — navegação resumida. Título, resumo, seções com links. Normalmente de 20 a 200 linhas.
- llms-full.txt — conteúdo completo das páginas principais em um único texto. Um modelo ou ferramenta pode carregá-lo inteiro e não precisar seguir os links.
O primeiro arquivo é obrigatório, o segundo é desejável. Vamos fazer os dois.
Como é a estrutura do arquivo
A especificação define uma ordem rígida de blocos:
- Título de nível um com o nome do projeto. É o único elemento obrigatório.
- Bloco de citação com uma descrição breve: uma a três frases sobre o que é o site e para quem ele serve.
- Parágrafos opcionais com detalhes: características, limitações, contexto.
- Seções de nível dois, cada uma com uma lista de links. Formato da linha: hífen, nome do link entre colchetes, endereço entre parênteses, dois-pontos e uma descrição curta.
- Seção opcional chamada Optional. Os links dela o modelo pode pular se tiver pouco espaço no contexto.
Aqui está um exemplo mínimo, ao qual vamos voltar:
# Название проекта
> Одно-два предложения: что это и для кого.
## Документация
- [Быстрый старт](https://example.com/docs/start): как начать за 10 минут
- [Тарифы](https://example.com/pricing): цены и лимиты
## Optional
- [История изменений](https://example.com/changelog): что обновлялосьAqui o símbolo de quebra de linha é mostrado de forma simbólica; no arquivo real são apenas linhas novas. Parece simples, né? O trabalho principal não está na sintaxe, mas na escolha das páginas e na redação das descrições. É disso que vamos tratar agora.
Quem lê o llms.txt em 2026
Resposta honesta: não todos e não igualmente. O formato é bastante usado por ferramentas de IA para desenvolvedores, editores de código com assistentes de IA, alguns buscadores de IA e agentes que entram no site no momento da pergunta do usuário. As maiores empresas de busca não deram confirmação oficial de suporte. Mesmo assim, o padrão virou uma linguagem comum no setor, o arquivo não custa nada para manter, e a ausência dele com certeza não ajuda. Além disso, tem um benefício paralelo: ao montar o llms.txt, você organiza o seu próprio conteúdo.
Etapa 1: Auditoria do conteúdo e escolha das páginas para a IA
Objetivo da etapa: obter uma tabela com 10-50 páginas que vão entrar no llms.txt, com marcação da seção e um rascunho de descrição para cada uma.
O erro mais comum dos iniciantes é colocar tudo na lista. O modelo recebe mil linhas, não encontra o essencial e trabalha pior do que sem o arquivo. Sua tarefa é selecionar o que realmente explica o produto e responde às perguntas do público.
Instruções
- Abra a tabela com a lista de páginas do site que você preparou antes. Se não tiver, abra o endereço seu-dominio/sitemap.xml no navegador e copie os endereços para uma planilha.
- Adicione as colunas: «Título», «Seção», «Descrição para IA», «Prioridade».
- Passe por cada linha e responda à pergunta: «Se uma pessoa perguntar à IA sobre o meu produto, essa página ajuda a dar uma resposta precisa?» Se sim, marque prioridade 1. Se a página é útil, mas secundária, marque 2. Todo o resto marque como zero.
- Inclua obrigatoriamente com prioridade 1: a página inicial com a descrição do produto, a página de planos ou preços, a página «Sobre a empresa», as seções de documentação ou instruções, a página de contato e os termos de uso. Para uma loja virtual — as páginas de categorias e de entrega. Para um projeto de afiliados ou parceria — a página com as condições do programa e a descrição da oferta.
- Abra as estatísticas. Veja as 20 páginas mais visitadas nos últimos três meses. Se algumas delas não entraram na prioridade 1, reconsidere a decisão: os usuários as consideram importantes.
- Exclua as páginas de serviço: carrinho, área do cliente, resultados de busca, páginas de paginação, duplicadas com parâmetros UTM, promoções antigas.
- Agrupe as páginas de prioridade 1 e 2 em três a seis seções. Nomes típicos: «Produto», «Documentação», «Preços», «Blog», «Suporte», «Cases». Escreva o nome da seção na coluna «Seção».
- Para cada página selecionada, escreva um rascunho de descrição de 8 a 15 palavras. Não copie a meta descrição: ela é escrita para pessoas na busca. Escreva de modo que o modelo entenda quando vale a pena abrir aquela página. Ruim: «Nossos planos». Bom: «Preço de proxies móveis por país, limites de tráfego e condições de troca de IP».
Dica: Imagine que as descrições estão sendo lidas por um novo funcionário do suporte, que precisa entender em um minuto para onde encaminhar o cliente. Se a sua descrição bastar para ele, também vai bastar para o modelo de linguagem.
Resultado esperado
Você tem uma tabela em que estão filtradas as páginas de prioridade 1 e 2, cada uma classificada em uma seção e com um rascunho de descrição. Normalmente são 10 a 50 linhas para um site típico e até 200 para uma documentação grande.
Verificação: Leia só a coluna «Descrição para IA» de cima para baixo, sem olhar os endereços. Se pelas descrições ficar claro o que o site faz e como o produto está organizado, a auditoria foi feita corretamente.
Possíveis problemas
- Páginas demais com prioridade 1. Se forem mais de 60, você não foi rigoroso o suficiente. Pergunte-se mais uma vez: sem qual página o modelo não vai conseguir responder corretamente? O resto vai para prioridade 2 ou para a seção Optional.
- Conteúdo disperso, sem seções claras. Isso é um sinal de problemas na estrutura do site. Para o llms.txt, simplesmente crie grupos lógicos, mesmo que no menu eles não existam. Depois dá para ajustar também a navegação.
- Páginas bloqueadas para indexação ou acessíveis só após login. Não as inclua. O modelo de qualquer forma não vai conseguir lê-las, e você vai dar a ele links falsos.
Etapa 2: Criação do arquivo llms.txt e da sua estrutura básica
Objetivo da etapa: criar o arquivo com o nome e a codificação corretos, preencher o título, o resumo e os parágrafos de contexto.
Instruções
- Abra o editor de texto. Crie um arquivo novo pelo menu «Arquivo» e a opção «Novo arquivo» ou com o atalho Ctrl+N.
- Salve imediatamente: menu «Arquivo», opção «Salvar como». No campo do nome digite exatamente llms.txt com letras minúsculas. Verifique se o editor não adicionou uma segunda extensão tipo llms.txt.txt. No Windows, para isso ative a exibição de extensões no Explorador de Arquivos.
- Confirme que a codificação do arquivo é UTF-8 sem BOM. No Visual Studio Code a codificação aparece no canto inferior direito da janela; clique nela, escolha «Salvar com codificação» e indique UTF-8. No Notepad++ abra o menu «Codificação» e escolha «Codificar em UTF-8» sem a marca BOM.
- Na primeira linha escreva o título de nível um: símbolo de cerquilha, espaço, nome do projeto. Por exemplo: # MobileProxy.space. Use o nome da marca como os clientes a conhecem, sem slogans.
- Deixe uma linha em branco.
- Escreva o bloco de citação: símbolo «maior que», espaço e uma a três frases sobre a essência do projeto. Responda às perguntas «o que é», «para quem», «qual é o diferencial». Exemplo: > Serviço de aluguel de proxies móveis com IP de operadoras de telefonia para profissionais de marketing, afiliados e desenvolvedores. Suporta rotação de endereços por link e API, funciona com navegadores antidetect e ferramentas de scraping.
- Deixe uma linha em branco.
- Adicione um a três parágrafos comuns com contexto que ajudem o modelo a não errar. Cabe bem aqui: geografia de atuação, idiomas suportados pelo site, o que o serviço não faz, data de atualidade das informações. Exemplo: «Os preços são em reais e atualizados mensalmente. O site está disponível em russo e inglês; a versão em inglês fica na subpasta /en/. O serviço fornece infraestrutura e não presta serviços de configuração de campanhas publicitárias».
- Salve o arquivo com o atalho Ctrl+S.
Atenção: No arquivo deve haver exatamente um título de nível um, e ele precisa estar na primeira linha. Se você colocar antes dele um comentário, uma linha em branco com espaços ou um segundo título, ferramentas que seguem a especificação à risca podem se recusar a processar o arquivo.
Como escrever o resumo para que ele funcione
O bloco de citação é o trecho mais lido do arquivo. É justamente ele que o modelo costuma usar quando resume o que é o seu site. Algumas regras:
- Nada de palavras avaliativas. «O melhor», «único», «número um» não trazem informação e reduzem a confiança do modelo no restante do texto.
- Concretude em vez de abstrações. Não «soluções para negócios», mas «aluguel de proxies móveis com IP de operadoras russas e europeias».
- Indique o público-alvo de forma explícita. O modelo compara com a pergunta do usuário.
- Mantenha-se entre 300 e 400 caracteres. Mais longo, o modelo pode cortar.
Dica: Escreva três versões do resumo e cole cada uma em qualquer assistente de IA disponível com a pergunta: «O que essa empresa faz e para quem ela serve? Responda em uma frase». Escolha a versão com a qual o assistente respondeu com mais precisão.
Resultado esperado
O arquivo llms.txt existe no disco, salvo em UTF-8, começa com um único título, contém o resumo no bloco de citação e um a três parágrafos de contexto. As seções com links ainda não existem, esse é o próximo passo.
Verificação: Abra o arquivo no navegador, arrastando-o para a janela. Você deve ver texto limpo, sem caracteres estranhos no lugar do cirílico. Se em vez das letras aparecerem pontos de interrogação ou losangos, a codificação foi escolhida errada — volte ao item 3.
Possíveis problemas
- O editor substituiu automaticamente as aspas por «tipográficas» ou os hífens por travessão. Desative a autocorreção nas configurações ou use um editor de código. Em links Markdown, esses caracteres quebram a marcação.
- O arquivo foi salvo como llms.txt.txt. Renomeie pelo Explorador de Arquivos ou pelo Finder, ativando antes a exibição de extensões.
Etapa 3: Preenchimento das seções e links
Objetivo da etapa: transferir as páginas selecionadas da tabela para o arquivo na sintaxe correta, agrupá-las por seções e adicionar o bloco Optional.
Instruções
- Abra o llms.txt e a tabela da etapa 1 lado a lado.
- Depois dos parágrafos de contexto, deixe uma linha em branco e escreva o título de nível dois da primeira seção: duas cerquilhas, espaço, nome. Por exemplo: ## Produto.
- Deixe uma linha em branco.
- Para cada página dessa seção escreva uma linha de lista seguindo exatamente o modelo: hífen, espaço, colchete de abertura, nome da página, colchete de fechamento, parêntese de abertura, endereço completo com protocolo, parêntese de fechamento, dois-pontos, espaço, descrição. Exemplo: - [Planos de proxies móveis](https://example.com/pricing): preço por país e operadora, limites de tráfego, condições de rotação de IP.
- Use endereços absolutos com https no começo. Caminhos relativos como /pricing muitas ferramentas não vão conseguir resolver, porque leem o arquivo fora do contexto do navegador.
- Pegue o nome do link do título da página, mas reduza para cinco a oito palavras. A descrição vem da coluna «Descrição para IA».
- Repita os itens 2 a 6 para cada seção. A ordem das seções vai da mais importante para a menos importante: primeiro produto e preços, depois documentação, depois blog e cases.
- Dentro da seção, coloque as páginas também por ordem de importância. Os três primeiros links de cada seção são os mais lidos.
- Como última seção adicione ## Optional. Transfira para lá as páginas de prioridade 2: arquivo do blog, histórico de mudanças, cases secundários, página de vagas. O nome da seção precisa estar escrito exatamente em latim: Optional. Essa é uma palavra reservada da especificação.
- Salve o arquivo.
Dica: Se o site tem páginas que já entregam o conteúdo em formato limpo, por exemplo versões em Markdown ou páginas simples de texto da documentação, referencie essas, e não as versões HTML. O modelo vai receber o texto sem menu e sem scripts e vai entender melhor.
Exemplo de seção pronta
## Документация
- [Подключение прокси в антидетект-браузере](https://example.com/docs/antidetect): пошаговая настройка профиля, проверка IP и типичные ошибки
- [API смены IP](https://example.com/docs/api): методы, параметры запросов, лимиты и примеры ответов в JSON
- [Форматы подключения](https://example.com/docs/formats): HTTP, SOCKS5, авторизация по логину и по IPComo escrever as descrições dos links
A descrição depois dos dois-pontos é a dica para o modelo sobre quando vale a pena abrir a página. Quanto mais precisa a dica, melhor o modelo vai escolher a fonte para a resposta. As regras são simples:
- Responda à pergunta «o que tem dentro», não «por que ler». Não «artigo útil sobre proxies», mas «comparação de proxies móveis, residenciais e de servidor por velocidade, custo e risco de bloqueios».
- Use as palavras com que os usuários fazem as perguntas. Se os clientes perguntam «como trocar o ip», na descrição deve estar «troca de IP».
- Não repita o nome do link. O nome diz «o que é», a descrição diz «o que tem lá concretamente».
- Mantenha-se em uma linha só. Quebras de linha dentro do item de lista quebram a interpretação.
Resultado esperado
O arquivo contém de três a seis seções de nível dois, cada uma com 2 a 20 links com descrições, e a seção Optional no final. Volume total: de 20 a 200 linhas.
Verificação: Cole o conteúdo do arquivo em qualquer visualizador de Markdown online ou abra a pré-visualização no editor de código. Todos os links devem ficar clicáveis, os títulos grandes, as listas com marcadores. Se alguma linha aparece como texto comum com parênteses, tem erro de sintaxe.
Possíveis problemas
- O link não ficou clicável. Na maioria das vezes faltou o espaço depois do hífen, faltou um parêntese ou há um espaço entre o colchete e o parêntese. Não deve haver espaço ali.
- O endereço tem espaços ou cirílico. Codifique o endereço: o espaço vira %20, os caracteres cirílicos viram suas representações percentuais. Mais fácil é copiar o endereço da barra do navegador, ele já está codificado.
- A descrição contém dois-pontos. O primeiro dois-pontos depois do parêntese de fechamento é considerado separador; os seguintes dentro da descrição são permitidos, mas é melhor reformular para evitar confusão.
Etapa 4: Criação do llms-full.txt e das versões em texto limpo das páginas
Objetivo da etapa: montar o arquivo estendido com o texto completo das páginas principais, para que as ferramentas possam carregar todo o conteúdo em uma única requisição.
Esta etapa é opcional, mas é justamente ela que traz o maior ganho para documentação, instruções e descrições detalhadas de produto. Se o llms.txt é o sumário, o llms-full.txt é o livro inteiro.
Instruções
- Crie um arquivo novo e salve como llms-full.txt na mesma codificação UTF-8.
- Copie para o início o título de nível um e o bloco de citação do llms.txt. Os arquivos devem começar igual.
- Para cada página de prioridade 1, abra-a no navegador e copie o texto principal: títulos, parágrafos, listas, tabelas. Não copie menu, rodapé, formulários de inscrição, comentários e blocos de anúncio.
- Cole o texto no arquivo sob um título de nível dois com o nome da página. Rebaixe os títulos internos da página em um ou dois níveis: o que no site era título de nível dois, no arquivo fica terceiro. Assim a hierarquia se mantém.
- Depois de cada bloco adicione uma linha com o endereço da fonte, por exemplo: Fonte: https://example.com/docs/api. Isso ajuda o modelo a referenciar a página específica.
- Separe os blocos de páginas com uma linha em branco e uma linha de três hífens, o separador horizontal padrão do Markdown.
- Transfira as tabelas para o formato Markdown com barras verticais ou transforme em listas, se a estrutura for simples.
- Remova frases de serviço tipo «clique aqui», «leia mais», «compartilhe». Em um texto sem interface, elas não fazem sentido.
- Salve o arquivo.
Atenção: Não inclua no llms-full.txt dados pessoais de clientes, documentos internos, cupons e qualquer informação que você não esteja pronto para ver na resposta de um assistente de IA na tela de um estranho. Tudo o que entra nesse arquivo, na prática, está publicado.
Quanto texto deve ter
Um parâmetro razoável é de 20 a 300 mil caracteres. Menos que isso, o arquivo não justifica sua existência, basta o llms.txt. Mais que isso, muitas ferramentas não vão carregá-lo inteiro. Se o conteúdo é muito, faça vários arquivos temáticos, por exemplo llms-full-docs.txt e llms-full-blog.txt, e referencie-os no llms.txt em uma seção separada.
Dica: Para sites em WordPress e na maioria dos CMS existem plugins e módulos que geram llms.txt e llms-full.txt automaticamente a partir dos posts publicados. Procure no catálogo de extensões pela busca «llms txt». A geração automática economiza horas, mas confira o resultado manualmente: os plugins costumam arrastar tudo para o arquivo, incluindo páginas de tags e rascunhos.
Resultado esperado
O arquivo llms-full.txt contém o mesmo título e resumo do llms.txt, e em seguida o texto completo e limpo das páginas principais com indicação das fontes.
Verificação: Abra o arquivo e leia um trecho aleatório do meio. Se ficar claro de qual página se trata e o texto for lido sem lixo de interface, está tudo certo. Se aparecerem fragmentos tipo «Menu Início Planos Contato», limpe-os.
Possíveis problemas
- Ao copiar do navegador, a estrutura dos títulos se perde. Copie por partes e coloque as cerquilhas manualmente, ou use uma extensão do navegador para salvar a página em Markdown.
- O arquivo ficou com vários megabytes. Divida em partes temáticas ou deixe apenas as páginas de prioridade 1.
Etapa 5: Upload dos arquivos para o servidor
Objetivo da etapa: colocar o llms.txt e o llms-full.txt na raiz do site, de modo que abram no endereço seu-dominio/llms.txt.
O método depende de como o seu site está feito. Abaixo quatro cenários típicos. Escolha o seu.
Opção A: painel de hospedagem com gerenciador de arquivos
- Entre no painel de controle da hospedagem com login e senha do e-mail do provedor.
- Encontre a seção chamada «Gerenciador de Arquivos», «Arquivos» ou «Gerenciador de arquivos».
- Vá para a pasta raiz do site. Normalmente ela se chama public_html, www, htdocs ou tem o nome do domínio. Ponto de referência: nela está o arquivo index.html ou index.php e um sitemap.xml já existente.
- Clique no botão «Enviar» ou «Upload». Vai abrir a janela de seleção de arquivos.
- Selecione llms.txt e llms-full.txt do computador, confirme o envio. Espere o indicador de conclusão.
- Confirme que os arquivos apareceram na lista ao lado do arquivo index e que as permissões são 644, ou seja, leitura para todos, escrita apenas para o dono. Normalmente o painel já coloca essas permissões sozinho.
Opção B: cliente FTP
- Abra o FileZilla ou cliente similar.
- No painel de cima digite host, usuário, senha e porta do e-mail do provedor. Clique em «Conexão rápida».
- No lado direito da janela encontre a pasta raiz do site pelos mesmos sinais de antes.
- No lado esquerdo encontre a pasta com os seus arquivos no computador.
- Arraste llms.txt e llms-full.txt da esquerda para a direita. Na parte de baixo da janela vai aparecer a fila de transferência; espere ela esvaziar.
- Clique com o botão direito no arquivo enviado, escolha «Permissões de arquivo» e confirme o valor 644.
Opção C: site de repositório com deploy automático
- Defina a pasta de onde os arquivos estáticos são publicados. Na maioria dos frameworks ela se chama public ou static e fica na raiz do projeto.
- Coloque llms.txt e llms-full.txt nessa pasta, ao lado do favicon e do arquivo robots.
- Faça o commit das alterações e envie para a branch de onde sai o deploy.
- Espere a conclusão do build. O tempo depende do projeto, normalmente de um a dez minutos.
Opção D: construtores de site
Aqui é mais complicado: nem todo construtor permite adicionar um arquivo arbitrário na raiz do domínio. A ordem das ações:
- Abra as configurações do site e encontre uma seção tipo «Arquivos», «Upload de arquivos», «SEO» ou «Avançado».
- Se houver a possibilidade de enviar um arquivo com indicação de caminho, informe o caminho /llms.txt.
- Se não houver, mas existir configuração de redirecionamentos ou regras, crie uma regra: a requisição a /llms.txt redireciona com código 200 ou 301 para o arquivo enviado. Algumas plataformas chamam isso de «redirecionamento» ou «regras de roteamento».
- Se nem isso estiver disponível, fale com o suporte do construtor pedindo para colocar um arquivo de texto na raiz. Formulação: «Preciso colocar um arquivo estático llms.txt no endereço dominio/llms.txt com o tipo text/plain».
Atenção: O arquivo precisa estar exatamente na raiz do domínio, não em uma subpasta. O endereço tipo dominio/arquivos/llms.txt as ferramentas não vão encontrar, porque procuram o arquivo em um caminho fixo, como o favicon ou o sitemap.
Dica: Se o site funciona em vários domínios ou subdomínios, por exemplo o domínio principal e um subdomínio separado para a documentação, coloque o llms.txt em cada um. O arquivo de cada domínio descreve apenas o próprio conteúdo, mas na seção de links pode apontar para o domínio vizinho.
Resultado esperado
Ao digitar na barra de endereços do navegador o endereço seu-dominio/llms.txt, o seu texto abre. O mesmo para llms-full.txt.
Verificação: Abra os dois endereços no modo anônimo, para excluir o cache do navegador. Você deve ver o texto do arquivo como ele é: título com cerquilha, citação com o sinal «maior que», lista com hífens. Se o navegador oferecer para baixar o arquivo em vez de mostrá-lo, não é crítico, mas a gente corrige na próxima etapa.
Possíveis problemas
- Erro 404. O arquivo não está na raiz ou o nome está errado. Verifique o uso de maiúsculas: LLMS.txt e llms.txt em servidores Linux são arquivos diferentes.
- Erro 403. Permissões incorretas. Defina 644 pelo gerenciador de arquivos ou pelo FTP.
- Abre a versão antiga depois da atualização. Está funcionando o cache da hospedagem ou do CDN. Limpe o cache no painel ou espere o tempo de vida do cache.
- O cirílico aparece errado. O servidor não informa a codificação. Isso se resolve no próximo passo.
Etapa 6: Configuração dos cabeçalhos de resposta do servidor
Objetivo da etapa: fazer com que o servidor entregue o arquivo com o tipo de conteúdo e a codificação corretos, permita o acesso de agentes de IA de ferramentas de navegador e não faça cache do arquivo por muito tempo.
Esta etapa não é para todo mundo. Se a verificação da etapa 5 mostrou o texto correto com as letras, dá para se limitar ao item de verificação abaixo. Mas cabeçalhos corretos aumentam a chance de as ferramentas processarem o arquivo sem surpresas.
Quais cabeçalhos são necessários
- Content-Type: text/plain; charset=utf-8 ou text/markdown; charset=utf-8. A primeira opção é mais universal.
- Cache-Control: max-age=3600 — cache de uma hora. É suficiente para tirar a carga, mas as atualizações entram rápido.
- Access-Control-Allow-Origin: * — permissão para ler o arquivo de aplicações web em outros domínios. Algumas ferramentas de IA funcionam direto no navegador e sem esse cabeçalho não conseguem carregar o arquivo.
Instruções para Apache via .htaccess
- Baixe o arquivo .htaccess atual da raiz do site para o computador e salve a cópia. Se o arquivo não existir, crie um novo vazio.
- Abra o arquivo no editor e adicione no final o bloco:
<Files "llms.txt">
Header set Content-Type "text/plain; charset=utf-8"
Header set Cache-Control "max-age=3600"
Header set Access-Control-Allow-Origin "*"
</Files>
<Files "llms-full.txt">
Header set Content-Type "text/plain; charset=utf-8"
Header set Cache-Control "max-age=3600"
Header set Access-Control-Allow-Origin "*"
</Files>- Salve e envie o arquivo de volta para a raiz do site, substituindo o antigo.
- Abra imediatamente a página inicial do site. Se ela abrir, está tudo bem. Se você vir o erro 500, restaure imediatamente a cópia salva: a hospedagem provavelmente não tem o módulo de cabeçalhos ativado. Nesse caso, fale com o suporte da hospedagem pedindo para ativar o mod_headers.
Instruções para Nginx
- Conecte-se ao servidor por SSH.
- Faça uma cópia do arquivo de configuração do site, normalmente ele fica na pasta /etc/nginx/sites-available/.
- Dentro do bloco server adicione:
location = /llms.txt {
default_type text/plain;
charset utf-8;
add_header Cache-Control "max-age=3600";
add_header Access-Control-Allow-Origin "*";
}
location = /llms-full.txt {
default_type text/plain;
charset utf-8;
add_header Cache-Control "max-age=3600";
add_header Access-Control-Allow-Origin "*";
}- Verifique a configuração com o comando nginx -t. Deve aparecer uma mensagem de verificação bem-sucedida.
- Recarregue a configuração com o comando systemctl reload nginx.
Instruções para construtores e plataformas em nuvem
Procure nas configurações uma seção «Cabeçalhos» ou «Headers». Muitas plataformas suportam um arquivo com regras de cabeçalho na raiz do projeto; a sintaxe de cada uma é própria, mas o sentido é o mesmo: para o caminho /llms.txt definir Content-Type e Cache-Control. Se não houver essa possibilidade, não se preocupe: a maioria dos servidores entrega .txt como text/plain por padrão, e isso já é aceitável.
Resultado esperado
O servidor entrega o arquivo com código 200 e os cabeçalhos necessários.
Verificação: Abra o prompt de comando ou terminal e execute o comando curl -I https://seu-dominio/llms.txt. Na resposta você deve ver a linha HTTP/2 200 ou HTTP/1.1 200 OK, a linha content-type: text/plain; charset=utf-8 e a linha cache-control: max-age=3600. Se quiser ver também o conteúdo, tire a chave -I.
Possíveis problemas
- Erro 500 depois de editar o .htaccess. Restaure a cópia, verifique se não sobraram caracteres extras e confirme com o provedor se o módulo de cabeçalhos está ativo.
- Os cabeçalhos não mudaram. Na frente do servidor tem um CDN ou cache de proxy que entrega a versão antiga. Limpe o cache do CDN no painel dele.
- Content-Type ainda é text/html. Alguma regra está reescrevendo todas as requisições para index.php. Confirme que a regra exclui arquivos existentes, normalmente com a condição «se o arquivo não existe».
Verificação do resultado: checklist de prontidão do llms.txt
Você passou por todas as etapas. Agora vamos confirmar que o resultado é realmente funcional, e não apenas «um arquivo parado lá». Passe pelo checklist item por item e marque o que já fez.
Checklist
- O endereço dominio/llms.txt abre no navegador em modo anônimo e mostra o texto.
- A primeira linha do arquivo é o único título de nível um com o nome do projeto.
- Logo depois do título vem o bloco de citação com o resumo de até 400 caracteres.
- Todos os links são absolutos, começam com https e abrem sem redirecionamentos e erros.
- Cada link tem uma descrição depois dos dois-pontos.
- As seções estão ordenadas por importância, o secundário foi para o Optional.
- O cirílico aparece corretamente, codificação UTF-8.
- O comando curl -I mostra código 200 e tipo text/plain ou text/markdown.
- Se o llms-full.txt foi criado, ele abre no seu endereço e começa igual ao llms.txt.
- Nos arquivos não há dados pessoais nem informação interna.
Como testar de verdade
- Verificação de links. Copie todos os endereços do arquivo para qualquer verificador de links em massa ou para uma ferramenta de verificação de resposta do servidor. Todos devem retornar 200. Um link quebrado não vai quebrar o arquivo, mas reduz a confiança do modelo.
- Verificação de validade. Cole o conteúdo em um validador de llms.txt online; em 2026 existem vários desses serviços, procure pelo nome do padrão. O validador vai mostrar se reconheceu o título, o resumo e as seções.
- Verificação com um modelo real. Abra qualquer assistente de IA que saiba ler links. Dê a ele o endereço do seu arquivo e peça: «Estude esse arquivo e me diga o que a empresa faz, quanto custa o serviço e onde encontrar a instrução de conexão». Se a resposta for precisa e o assistente citar as páginas certas, você conseguiu. Se ele se confundir, veja quais descrições o atrapalharam e ajuste.
- Verificação de redes diferentes. Se você tem acesso a proxies móveis em regiões diferentes, abra o arquivo por eles. Isso mostra se o servidor não entrega conteúdo diferente para países diferentes e se a proteção contra bots não bloqueia o acesso ao arquivo para faixas de IP específicas. Agentes de IA vêm dos endereços mais variados, e o arquivo precisa estar acessível a todos.
Indicadores de sucesso
- Os dez itens do checklist estão cumpridos.
- O assistente de IA resumiu a essência do site sem erros factuais.
- Depois de duas a quatro semanas, aparecem nos logs do servidor requisições a /llms.txt de agentes de empresas de IA. Como encontrá-los, contamos no bloco avançado.
Erros típicos ao criar o llms.txt e suas soluções
Abaixo estão reunidos os problemas que quase todo mundo encontra ao fazer o arquivo pela primeira vez. Formato: problema, causa, solução.
1. O arquivo abre, mas a ferramenta de IA diz que não o encontrou
Causa: proteção contra bots no nível da hospedagem ou do CDN mostra captcha ou verificação JavaScript para todos que parecem requisição automática. O navegador passa pela verificação sem perceber, o agente não.
Solução: nas configurações da proteção, adicione uma exceção para o caminho /llms.txt e /llms-full.txt. Confira o resultado com o comando curl sem cabeçalhos de navegador: se o curl recebe o texto, e não uma página HTML de verificação, está tudo corrigido.
2. O modelo resume o site errado, mesmo com o arquivo presente
Causa: o resumo está vago ou as descrições dos links repetem os nomes e não trazem informação.
Solução: reescreva o resumo pelas regras da etapa 2 e as descrições pelas regras da etapa 3. Rode o teste com o assistente de novo.
3. O arquivo tem centenas de links e ficou inútil
Causa: geração automática por plugin ou perfeccionismo: «que fique tudo».
Solução: volte à auditoria da etapa 1. Deixe nas seções principais no máximo 50 links, o resto vai para o Optional ou sai. A completude é garantida pelo llms-full.txt, não pelo tamanho do sumário.
4. As letras viraram pontos de interrogação
Causa: o arquivo foi salvo em codificação Windows-1251 ou o servidor não transmite o charset.
Solução: salve o arquivo de novo em UTF-8 sem BOM e adicione charset=utf-8 no cabeçalho Content-Type conforme as instruções da etapa 6.
5. O arquivo foi atualizado, mas a IA vê a versão antiga
Causa: cache longo no CDN ou na própria ferramenta.
Solução: defina Cache-Control com max-age de no máximo uma hora, limpe o cache do CDN. As ferramentas atualizam as próprias cópias em intervalos diferentes, dê alguns dias a elas.
6. Os links levam a páginas com redirecionamento
Causa: no arquivo estão endereços sem barra no final ou com http em vez de https, e o servidor redireciona.
Solução: abra cada link e copie o endereço final da barra do navegador. Substitua no arquivo. Os agentes nem sempre seguem redirecionamentos.
7. O título de nível um não é o primeiro do arquivo
Causa: antes dele ficou uma linha em branco com espaços, um caractere BOM invisível ou um comentário.
Solução: no editor de código ative a exibição de caracteres invisíveis, remova tudo antes da primeira cerquilha, salve sem BOM.
8. O arquivo descreve vários sites de uma vez
Causa: vontade de economizar e referenciar todos os projetos da empresa a partir de um único arquivo.
Solução: um domínio, um arquivo sobre esse domínio. Para outros projetos dá para referenciar em uma seção separada, mas o resumo e as seções principais devem ser sobre o site atual.
Recursos adicionais: trabalho avançado com o llms.txt
A configuração básica está pronta. Esta seção é para quem quer tirar o máximo do arquivo: automatizar atualizações, acompanhar os bots de IA e usar o llms.txt como parte da estratégia de divulgação.
Geração automática a partir do CMS ou do build
Para sites em que o conteúdo muda com frequência, atualizar o arquivo manualmente cansa rápido. Opções de automação:
- Plugin de CMS. Para WordPress, Joomla e outros sistemas existem módulos que montam o llms.txt a partir de tipos de post selecionados. Configure-os para incluir apenas as categorias necessárias e para pegar as descrições de um campo especial, e não das primeiras linhas do texto.
- Script na etapa de build. Para sites estáticos e frameworks, escreva um pequeno script que lê os metadados das páginas, por exemplo os campos title e llm_description no cabeçalho dos arquivos Markdown, e monta o llms.txt a partir deles. Rode-o antes do deploy.
- Versões Markdown separadas das páginas. Alguns sites entregam cada página em HTML e também em Markdown no endereço com sufixo .md. Aí no llms.txt dá para referenciar as versões limpas e montar o llms-full.txt com uma simples concatenação. Esse é o formato mais prático para os modelos.
Verificação do arquivo com ferramentas de linha de comando
Existe um pacote oficial para Python chamado llms-txt. Ele transforma o arquivo em contexto para o modelo e, de quebra, verifica a estrutura. Instalação e execução:
pip install llms-txt
llms_txt2ctx https://seu-dominio/llms.txtSe o comando exibiu texto estruturado com seções, o arquivo foi interpretado corretamente. Se deu erro, veja em qual linha ele tropeçou: normalmente é sintaxe de link incorreta.
Monitoramento de bots de IA nos logs
A forma mais honesta de saber se o seu arquivo está sendo lido é olhar os logs do servidor web. A ordem das ações:
- Encontre o arquivo de logs de acesso. No Nginx normalmente é /var/log/nginx/access.log, no Apache é access.log na pasta de logs do site. Em hospedagem virtual, os logs ficam disponíveis no painel, na seção «Estatísticas» ou «Logs».
- Filtre as linhas que contêm llms.txt. No terminal: grep llms.txt access.log.
- Olhe o campo User-Agent nas linhas encontradas. Os agentes das empresas de IA geralmente se identificam com nomes reconhecíveis, contendo o nome da empresa ou palavras como Bot, Agent, User.
- Monte uma tabela simples: data, agente, arquivo. Uma vez por mês, confira quem vem e com que frequência. O crescimento do número de requisições é um bom sinal.
Dica: Se você quiser ver o site «pelos olhos» do agente que vem de outro país, use um proxy móvel da região desejada e faça a requisição por ele: curl -x endereco-do-proxy https://seu-dominio/llms.txt. Assim você verifica que as configurações geográficas do CDN, os redirecionamentos regionais e a proteção contra bots não impedem receber o arquivo do exterior. Isso é especialmente relevante para projetos que atuam em vários países.
llms.txt para landing pages e projetos de afiliados
Afiliados e donos de landing pages pequenas costumam achar que não precisam do arquivo: são poucas páginas. Na prática, mesmo para uma página única o llms.txt é útil: ele dá ao modelo a formulação exata da oferta, as condições, a geografia e o link para as regras. Quando o usuário perguntar ao assistente sobre o produto, ele vai pegar os fatos do seu arquivo, em vez de inventar. Para uma rede de landing pages, faça um template comum e substitua nome, resumo e links automaticamente.
Relação com a otimização generativa
O arquivo llms.txt é um dos elementos da área que em 2026 se chama otimização generativa: o trabalho para que a marca apareça corretamente e com frequência nas respostas de IA. Outros elementos são dados estruturados nas páginas, respostas claras às perguntas no início dos artigos, autoria e data de atualização, uniformidade dos fatos sobre a empresa em todas as fontes. O arquivo amarra tudo isso em um único mapa. Atualize-o a cada mudança relevante no produto ou nos preços, e os modelos vão receber o quadro atual.
Versionamento e data de atualidade
Adicione no parágrafo de contexto uma linha com a data da última atualização, por exemplo: «As informações estão atualizadas em março de 2026». Isso ajuda o modelo a avaliar a atualidade dos dados. Guarde o arquivo em um sistema de controle de versão junto com o código do site, para ver o histórico de alterações.
FAQ: perguntas frequentes sobre o llms.txt
É obrigatório fazer o llms-full.txt?
Não. Apenas o llms.txt é obrigatório. Mas se você tem documentação, instruções ou descrições detalhadas, a versão completa melhora bastante a qualidade das respostas das ferramentas que a usam. Para uma landing page com cinco páginas, dá para ficar só com um arquivo.
Dá para escrever o arquivo em português?
Sim. Use o idioma do conteúdo principal do site. Se o site for bilíngue, indique no parágrafo de contexto onde fica a segunda versão e, se quiser, crie um arquivo separado no subdomínio ou na pasta de idioma, referenciando-o a partir do principal. Os nomes das seções também podem ser em português, exceto a palavra reservada Optional.
Com que frequência atualizar o llms.txt?
A cada mudança de preços, lançamento de nova seção, mudança de condições ou remoção de páginas. Se nada de relevante acontece, basta uma revisão por trimestre: verificar os links, atualizar as descrições, atualizar a data.
É preciso indicar o llms.txt no sitemap ou registrar em algum lugar?
Não. As ferramentas procuram o arquivo no caminho padrão na raiz do domínio, como o favicon. Não existe registro especial. Alguns diretórios públicos reúnem sites com llms.txt; adicionar a eles não é obrigatório, mas não faz mal.
O arquivo vai influenciar as posições na busca comum?
Influência direta não há: o arquivo não é indexado como página e não é fator de ranqueamento. Indiretamente, ele ajuda: organiza a estrutura, e menções corretas em respostas de IA trazem tráfego de marca.
O que fazer se o site no construtor não deixa colocar o arquivo na raiz?
Primeiro procure uma configuração de upload de arquivos com caminho livre ou regras de redirecionamento. Se não houver nada, escreva para o suporte do construtor: em 2026, o pedido de colocar um llms.txt já não é novidade para eles. A última alternativa é colocar o arquivo em um subdomínio separado e referenciá-lo a partir da página «Sobre a empresa», embora o caminho padrão ainda seja preferível.
Vale a pena incluir páginas do blog no arquivo?
Inclua os artigos que respondem a perguntas frequentes dos clientes e continuam atuais: instruções, comparações, análises. Notícias e anúncios de promoções é melhor não incluir, ou mandar para o Optional. Para um blog grande, faça uma seção separada com os 10-20 materiais mais úteis.
Dá para usar um único arquivo para vários domínios da empresa?
Não. Cada domínio é descrito pelo seu próprio arquivo. Links cruzados entre projetos são permitidos em uma seção separada, mas o resumo e as seções principais devem se referir ao domínio atual.
Como saber se a IA realmente usa o arquivo?
Olhe os logs conforme as instruções do bloco avançado e pergunte periodicamente aos assistentes sobre o seu produto. Se as formulações nas respostas batem com o seu resumo e o assistente nomeia as páginas certas, o arquivo está funcionando. Mantenha uma tabela de verificações uma vez por mês, para acompanhar a evolução.
O que fazer se, depois de editar a configuração do servidor, o site parar de abrir?
Restaure imediatamente a cópia salva do arquivo de configuração e confirme que o site voltou a funcionar. Depois fale com o suporte da hospedagem sobre a ativação dos módulos necessários. O arquivo llms.txt nesse meio tempo continua funcionando sem cabeçalhos adicionais: o servidor entrega .txt como texto comum por padrão.
Conclusão
Vamos resumir o trabalho feito. Você fez a auditoria do conteúdo e selecionou as páginas que realmente explicam o seu produto. Criou o arquivo llms.txt com título claro, resumo honesto e seções de links estruturadas. Montou a versão estendida llms-full.txt com o texto completo das páginas principais. Fez o upload dos arquivos para a raiz do site, configurou os cabeçalhos do servidor e verificou o resultado com o comando curl, com um validador e com um assistente de IA de verdade. Agora os modelos de linguagem recebem do seu site não um caos de páginas HTML, mas um mapa claro com explicações.
O que fazer em seguida
- Coloque um lembrete para revisar o arquivo em três meses. Verifique os links, atualize preços e a data de atualidade.
- Uma vez por mês, dê uma olhada nos logs e registre quais agentes leem o llms.txt. É uma análise gratuita do interesse da IA no seu projeto.
- Faça várias perguntas sobre o seu produto a diferentes assistentes e compare as respostas com os fatos. Divergências são sinal para ajustar as descrições no arquivo ou nas próprias páginas.
Para onde evoluir
O arquivo llms.txt é o primeiro passo no trabalho com visibilidade em IA. Os próximos: dados estruturados nas páginas, respostas claras às perguntas no início de cada artigo, versões Markdown dos materiais principais, fatos uniformes sobre a empresa em todos os diretórios e catálogos. Se você atua em várias regiões, adicione verificações regulares de disponibilidade do conteúdo através de proxies móveis dos países necessários: os agentes vêm de endereços diferentes, e o arquivo precisa estar acessível para cada um deles. Quanto mais transparente e estruturado for o seu conteúdo, mais preciso a IA vai falar sobre você para os usuários. E, portanto, mais gente vai chegar até você já preparada e com as expectativas certas.