Arquivos de descoberta para agentes
Arquivos de descoberta para agentes são os arquivos que um site publica num endereço fixo para dizer aos agentes de IA o que ele é e o que se pode fazer com ele, e só alguns têm atrás algo que mereça a palavra padrão.
É o canto mais confuso desta área. Várias propostas compartilham nomes parecidos, pelo menos um produto se diz padrão do setor, e a diferença não se vê de fora. Aqui está o que cada um realmente é.
Quais destes estão assentados?
Dois, e só dois, se apoiam numa especificação concluída. A RFC 8615 é o que faz de `/.well-known/` um lugar legítimo para publicar uma declaração, e tudo o que vem depois ou a segue ou a ignora.
- `/.well-known/agent-card.json` — definido pela especificação do A2A, hoje sob a Agentic AI Foundation. Assentado.
- `/.well-known/tdmrep.json` — definido por um relatório final de um Community Group do W3C, que declara não ser padrão do W3C. Concluído, mas com menos autoridade do que costuma receber.
- `/llms.txt` — uma convenção proposta sem nenhum motor publicamente comprometido a lê-la. Muito publicada, não ratificada.
Quais destes não são o que parecem?
Há um Internet-Draft do IETF propondo `/.well-known/ai.txt`, assinado por um particular. Todo Internet-Draft carrega o mesmo aviso, e aqui ele se aplica: «Não é apropriado usar Internet-Drafts como material de referência nem citá-los senão como trabalho em andamento».
Há também sites e fornecedores publicando o próprio `ai.txt` ou endpoint de descoberta e descrevendo-o como padrão universal ou padrão do setor. Chamar-se padrão não é um processo, e em pelo menos um caso a proposta vem empacotada com o produto que a implementa.
Um detalhe resolve: todo Internet-Draft expira em 6 meses a menos que alguém o renove. Essa é a validade do documento que em alguns lugares é citado como se fosse uma especificação para construir em cima.
Então o que um site deveria publicar?
Publique aqueles cujo propósito você consegue dizer numa frase. Um robots.txt com regras explícitas por agente, porque a permissão é real. Um tdmrep.json se você tem posição sobre mineração. Um agent card só se opera um agente. Um llms.txt porque custa uma hora e obriga a um exercício útil.
Deixe o resto até que algo mude. Um arquivo publicado num endereço well-known que nenhum motor lê não é neutro: é uma afirmação sobre o seu site que nada sustenta, e dessas esta área já tem de sobra.
De onde isso vem?
A norma que governa o endereço, o draft que mostra a cara de um draft, e a proposta séria mais recente. Lidos juntos, o degradê fica visível.
- RFC 8615, Well-Known Uniform Resource Identifiers
A norma que reserva `/.well-known/`. É a linha entre uma declaração pensada e um arquivo inventado na raiz de um domínio.
- Um Internet-Draft do IETF propondo ai.txt
Datado de 12 de junho de 2026, assinado por um particular. Citado acima pelo aviso que todo Internet-Draft carrega sobre não citá-lo como material de referência.
- Agentic Resource Discovery, Google
A proposta mais recente e mais bem respaldada desta zona, anunciada em 2026 e baseada em `/.well-known/ai-catalog.json`. Nova o bastante para que sua adoção ainda não seja um fato.
- A convenção llms.txt
A proposta de onde saiu boa parte disso. Uma convenção de fato e não uma especificação ratificada, e ela mesma diz isso.
Perguntas frequentes sobre Arquivos de descoberta para agentes
Existe um arquivo ai.txt padrão?
- Não. Pelo menos três propostas sem relação entre si usam esse nome ou um parecido, incluindo um draft individual no IETF e um fornecedor que descreve o próprio produto como padrão do setor. Nenhuma tem atrás uma especificação ratificada, então publicar um é uma aposta e não um passo de conformidade.
Devo publicar todo arquivo de descoberta que encontrar?
- Não. Um arquivo num endereço well-known afirma algo sobre o seu site, e um que ninguém lê afirma algo que nada sustenta. Publique os cujo propósito você sabe dizer numa frase e deixe o resto até mudar quem os respeita.