
O programador Jeremy Howard, da Answer.AI e criador do llms.txt, publicou uma atualização para a versão 2 da especificação a 10 de agosto. Esta é a primeira revisão desde o lançamento do formato, introduzindo formas padronizadas para os agentes de inteligência artificial descobrirem as versões em Markdown das páginas web.
A proposta original de 2024 incluía o ficheiro llms.txt e versões em Markdown das páginas individuais, publicadas no mesmo endereço com a adição de ".md" ao nome do ficheiro. A V2 mantém esta estrutura, mas introduz um segundo padrão de endereço para as páginas em Markdown e meios formais para os agentes as localizarem. Para as plataformas que já utilizam o ficheiro, a atualização exige apenas uma pequena alteração.
Novos padrões e relações de hiperligação
A nova versão suporta agora dois padrões de endereço para as páginas em Markdown. Os sites podem adicionar ".md" ao nome completo do ficheiro (o único padrão suportado anteriormente, transformando "/docs/tutorial.html" em "/docs/tutorial.html.md") ou substituir a extensão original por completo (resultando em "/docs/tutorial.md").
Para facilitar a descoberta destas páginas pelos agentes, a atualização introduz duas relações de ligação. O atributo rel="alternate" com o tipo text/markdown fornece uma ligação direta de uma página para a sua versão em Markdown. Adicionalmente, o atributo rel="describedby" aponta para o ficheiro llms.txt que a abrange, uma vez que um único ficheiro pode descrever todas as páginas sob o seu diretório.
As organizações podem incluir estas relações de ligação como elementos normais de HTML no cabeçalho da página ou através de um cabeçalho de resposta HTTP Link. A opção do cabeçalho é versátil, pois pode ser adicionada através da configuração do servidor ou CDN, eliminando a necessidade de alterar o código do site.
O motivo da atualização e a posição da Google
Segundo Howard, a mudança baseia-se em dois anos de experiência prática. Atualmente, milhares de sites publicam o ficheiro llms.txt, e plataformas como a Mintlify criam-no automaticamente para cada site que alojam. A equipa do Chrome da Google adicionou uma verificação para este ficheiro na categoria Agentic Browsing do Lighthouse. Além disso, a Anthropic, a OpenAI e a equipa do Gemini já publicam os seus próprios ficheiros llms.txt para a documentação de programadores.
A atualização não altera a posição da equipa de pesquisa da gigante tecnológica, que há mais de um ano indicou que o suporte para o llms.txt não faz parte dos seus planos. O guia de otimização refere que a própria pesquisa não utiliza estes ficheiros, sublinhando que a sua manutenção "não prejudicará nem ajudará a visibilidade ou as classificações do seu site".
A ferramenta Lighthouse do Chrome, por outro lado, tenta recuperar o ficheiro e assinala erros de servidor. Um ficheiro em falta que devolva um erro 404 é tratado como não aplicável, uma vez que a sua inclusão é opcional. A ferramenta encara esta funcionalidade como uma forma de ajudar os agentes do navegador a ler a estrutura de um site de forma mais rápida.
Foco no desenvolvimento e próximos passos
O verdadeiro foco desta atualização demonstra a quem se destina este formato. Ferramentas de documentação e agentes de programação já leem os ficheiros llms.txt para acelerar as pesquisas de API, um caso de uso que não está relacionado com a visibilidade nos motores de busca.
Para os programadores e empresas tecnológicas em Portugal, adotar esta nova versão significa preparar as plataformas para o futuro da navegação baseada em IA, garantindo que as ferramentas de desenvolvimento conseguem ler a documentação com máxima eficiência. As plataformas que mantêm o ficheiro apenas para influenciar os resumos de IA continuam sem dados que sustentem esse objetivo.
A V2 ainda está aberta a comentários no GitHub. Desta forma, a sintaxe ainda pode sofrer alterações antes de a versão estável ser finalizada.












Nenhum comentário
Seja o primeiro!