FERRAMENTAS LINUX: O Debate no LLVM sobre os AGENTS.md: Um Arquivo Pode Domar os Agentes de IA?

sexta-feira, 4 de setembro de 2026

O Debate no LLVM sobre os AGENTS.md: Um Arquivo Pode Domar os Agentes de IA?

 



O debate no LLVM sobre o AGENTS.md para os agentes de IA divide opiniões. Entenda os prós, contras e o que isso significa para o futuro do código aberto.


Os desenvolvedores do LLVM (Low Level Virtual Machine), o renomado projeto de infraestrutura de compiladores que sustenta desde chips de smartphones até supercomputadores, iniciaram uma discussão acalorada que pode definir o futuro das contribuições de IA no código aberto. 

A questão em jogo é simples, mas carregada de nuances: o projeto deve adicionar um arquivo AGENTS.md (e seu equivalente CLAUDE.md) ao seu repositório Git para orientar agentes de inteligência artificial?

O que parece uma decisão técnica trivial se transformou em um debate profundo sobre eficiência, manutenção, filosofia de projeto e o papel da IA no desenvolvimento de software. 

Este artigo mergulha nos detalhes dessa discussão, explorando os argumentos de ambos os lados e o que essa decisão pode significar para o ecossistema de código aberto como um todo.


O que é o AGENTS.md e por que ele está em alta?


A Ascensão de um Padrão para Agentes de IA


O AGENTS.md é um arquivo de texto simples, geralmente localizado na raiz de um repositório, que serve como um manual de instruções para ferramentas de codificação com IA. 

Ele diz aos agentes como construir o projeto, executar testes, respeitar convenções de codificação e, crucialmente, quais áreas evitar.

Popularizado pela OpenAI e agora sob a guarda da Agentic AI Foundation da Linux Foundation, o formato se tornou um padrão emergente. Mais de 60.000 repositórios de código aberto já incluem um arquivo desse tipo. 

Projetos como o vLLM e o NixOS já lidaram com questões semelhantes, debatendo se o arquivo serve como um filtro contra patches de IA de baixa qualidade.



O Contexto do LLVM: Um Gigante com Peculiaridades


O LLVM não é um projeto comum. Ele é a base de ferramentas essenciais para o desenvolvimento de software em baixo nível, com uma base de código massiva e complexa, composta por diversos subprojetos com escopos e requisitos diferentes. 
Seus mantenedores já gastaram anos aperfeiçoando uma infraestrutura crítica. 

Além disso, o LLVM já possui uma política rigorosa para o uso de ferramentas de IA, estabelecida em janeiro. 

A política exige um "humano no circuito" (human-in-the-loop): o contribuidor deve ler e revisar todo o código ou texto gerado antes de submeter, permanecendo totalmente responsável por ele. Agentes totalmente autônomos, como certos bots do GitHub, são proibidos.


O Coração do Debate: Prós, Contras e Evidências Científicas


A discussão foi iniciada no Discourse do LLVM pelo desenvolvedor de longa data Nick Desaulniers. 

Ele propôs a adição de um AGENTS.md mínimo que, em sua essência, direcionaria os agentes de IA para a documentação oficial do projeto sobre a política de contribuição de IA e os padrões de codificação. No entanto, as respostas da comunidade têm sido mistas.




O Argumento a Favor: Um "Norte" para Evitar Erros Repetitivos


Os defensores, como o desenvolvedor JDevlieghere, argumentam que um arquivo compartilhado seria uma "fonte única de verdade" (universal source of truth). Atualmente, muitos desenvolvedores mantêm seus próprios arquivos de configuração para agentes em repositórios particulares. 

Um AGENTS.md oficial evitaria esse retrabalho e garantiria que todos os agentes, independentemente de quem os utiliza, tivessem acesso às mesmas diretrizes básicas. 

A lógica é que, ao estabelecer expectativas claras, o arquivo poderia reduzir o número de patches de baixa qualidade que consomem o tempo valioso dos revisores. 

Nick Desaulniers resumiu essa visão: "O valor de um AGENTS compartilhado é preencher as lacunas que muitos de nós provavelmente já experimentaram".



O Argumento Contra: Mais Ruído, Mais Custo, Menos Eficácia


A oposição é igualmente robusta e se baseia em três pilares principais:


1. Ineficácia Comprovada: O desenvolvedor Aaron Ballman trouxe à tona uma pesquisa do ETH Zurich e da LogicStar.ai que coloca em xeque a utilidade desses arquivos. O estudo, que utilizou um benchmark chamado AGENTBENCH com 138 tarefas do mundo real, chegou a conclusões surpreendentes:


Arquivos de contexto gerados por LLM reduziram as taxas de sucesso das tarefas.
Eles aumentaram os custos de inferência em mais de 20%, pois os agentes realizavam passos de raciocínio extras e exploravam mais caminhos.


Arquivos escritos por humanos ofereceram apenas ganhos marginais (cerca de 4%).

2. Violação de Princípios: Alguns desenvolvedores argumentam que a adição do arquivo vai contra os princípios fundamentais do LLVM, que é não moldar os fluxos de trabalho privados de nenhum desenvolvedor.

3. Risco de Bloat e Manutenção: Há o receio de que o arquivo se torne inchado, desatualizado e contraproducente. Um arquivo com muitas instruções pode levar os agentes a uma "exploração não limitada" em vez de um trabalho focado. A manutenção desse arquivo se tornaria um fardo adicional para a equipe principal.




O Dilema da Fragmentação: CLAUDE.md vs. AGENTS.md

Um ponto de complexidade adicional é a fragmentação do mercado. Embora a maioria dos agentes de codificação leia o AGENTS.md, o Claude Code, da Anthropic, é uma exceção notável, preferindo seu próprio formato CLAUDE.md.

A proposta de Nick Desaulniers aborda isso sugerindo que um CLAUDE.md simples importe o AGENTS.md principal. No entanto, essa solução não elimina a necessidade de gerenciar múltiplos arquivos, adicionando outra camada de decisão para o projeto.


Produto Recomendado


Anker Adaptador otg USB-C para USB 3.0 pacote com 2, adaptador usb tipo c  -> https://link.amazon/B06KCkIYd


Eu ganho uma comissão quando você faz uma compra.


O Contexto Mais Amplo: O Que Está em Jogo ?


A decisão do LLVM vai muito além de um único arquivo. O projeto está na encruzilhada de uma tendência tecnológica massiva: o influxo de código gerado por IA.


A Pressão dos Agentes Autônomos


Relatos indicam que agentes de codificação autônomos têm aparecido cada vez mais nas pull requests do LLVM. Enquanto alguns trazem correções úteis, outros despejam patches de baixa qualidade que desperdiçam o tempo dos revisores. Essa pressão foi o que motivou a política de IA de janeiro.


O Experimento de US$ 20.000 da Anthropic


O debate ganhou ainda mais peso após um experimento do pesquisador da Anthropic, Nicholas Carlini, que orquestrou dezesseis agentes Claude para construir um compilador C baseado em Rust. 

O esforço custou cerca de US$ 20.000 em chamadas de API ao longo de duas semanas. O compilador resultante foi capaz de lidar com o kernel Linux, mas humanos ainda precisaram intervir para redesenhar testes, corrigir integrações contínuas quebradas e resolver bugs de deadlock.

Esse experimento demonstrou o potencial, mas também as limitações atuais dos agentes, reforçando a hesitação do LLVM em adotar medidas que possam incentivar contribuições marginais em um projeto que valoriza a expertise profunda.


Perguntas Frequentes (FAQ)


1. O que é exatamente o LLVM ?

O LLVM (Low Level Virtual Machine) é um projeto de infraestrutura de compiladores que fornece um conjunto de ferramentas e bibliotecas reutilizáveis para desenvolvimento de linguagens de programação. Ele é a base de compiladores como o Clang (para C/C++) e é usado em tudo, desde sistemas operacionais até placas gráficas.


2. Por que o LLVM está hesitando em adotar o AGENTS.md?

A hesitação do LLVM se baseia em três fatores principais: (1) pesquisas mostram que esses arquivos podem aumentar custos e não melhorar a eficácia dos agentes; (2) o projeto tem uma política rigorosa que exige um "humano no circuito" para todas as contribuições; e (3) há uma preocupação filosófica em não moldar os fluxos de trabalho privados dos desenvolvedores.


3. Como isso afeta os desenvolvedores que usam o LLVM?

A decisão final definirá o tom para a interação com ferramentas de IA no projeto. Se aprovado, o AGENTS.md servirá como um guia oficial para agentes, potencialmente reduzindo o número de patches de baixa qualidade. Se rejeitado, o LLVM manterá sua abordagem atual, que depende da responsabilidade humana e do julgamento individual para lidar com contribuições assistidas por IA.


Conclusão: Um Microcosmo do Futuro do Código Aberto


O debate sobre o AGENTS.md no LLVM é um microcosmo dos desafios que todo grande projeto de código aberto enfrentará na era dos agentes de IA. É um equilíbrio delicado entre abraçar a automação para aumentar a produtividade e proteger a qualidade e a integridade do projeto contra um dilúvio de contribuições superficiais.

LLVM's careful approach, demanding accountability and understanding from every contributor, offers one model. A decisão final, seja pela inclusão de um arquivo mínimo ou pela manutenção .do status quo, servirá de precedente para toda a indústria.

Qual é a sua opinião? O LLVM deve adicionar o AGENTS.md ou a pesquisa científica prova que esses arquivos são ineficazes ?


📋 Checklist para Avaliar a Inclusão de AGENTS.md no Seu Projeto:


Copie e use esse checklist


1. Avalie a necessidade real: Você tem recebido contribuições de IA de baixa qualidade que poderiam ser evitadas com diretrizes claras?

2. Consulte a pesquisa: Revise estudos como o do ETH Zurich que indicam que arquivos de contexto podem aumentar custos e não melhorar a eficácia.

3. Mantenha a simplicidade: Se optar por criar um, mantenha-o extremamente conciso. Evite repetir conteúdo do README. Foque em comandos de build, testes e proibições explícitas.

4. Alinhe com sua política de IA: Certifique-se de que o arquivo reforça, e não contradiz, sua política existente sobre o uso de ferramentas de IA (ex: "humano no circuito").

5. Planeje a manutenção: Designe alguém para manter o arquivo atualizado. Um arquivo desatualizado é pior do que nenhum.

6. Considere a fragmentação: Decida se você suportará apenas AGENTS.md ou também formatos específicos como CLAUDE.md.



Nenhum comentário:

Postar um comentário