Anthropic afirmou que seu modelo Claude lidera cerca de um quarto do trabalho de pesquisa e desenvolvimento de seus próximos modelos de IA, segundo a Mint.
Como a medição foi feita
A empresa informou que Claude "lidera" 26% das atividades de pesquisa e desenvolvimento interno, um aumento rápido desde 1% em março, segundo uma escala criada pela organização independente Epoch AI.
Além disso, os agentes de IA colaboraram com humanos em mais de 90% das pesquisas realizadas em agosto, embora a empresa tenha esclarecido que o modelo não opera de forma totalmente autônoma em nenhuma parte do trabalho medido.
Essa afirmação oferece uma das janelas públicas mais detalhadas sobre como as maiores empresas de IA estão desenvolvendo a tecnologia, em meio a crescentes preocupações sobre a autonomia dos sistemas.
Escala de uso dos agentes de IA
Anteriormente, a startup disse que cerca de 30.000 agentes de IA estavam atuando simultaneamente em sua plataforma interna de pesquisa e engenharia em agosto.
Cada ação desses agentes é subida a uma triagem antes de ser executada; ao longo do mês, mais de um bilhão de decisões foram analisadas e aproximadamente uma a cada 47.000 foi bloqueada.
A companhia destacou que todo o fluxo de decisão passa por esse filtro, reforçando o esforço para manter o controle sobre os sistemas apesar do aumento da participação da IA.

Distribuição de recursos de computação
Em uma semana de julho, cerca de 6% da capacidade de computação usada para pesquisa de IA foi direcionada a trabalhos de segurança.
Quando a pesquisa era conduzida pelos próprios agentes de IA, esse percentual subiu para 12%; a empresa considerou esses números conservadores, pois a capacidade que simultaneamente avançava em segurança e capacidade foi contabilizada como trabalho de capacidade.
Essa divisão mostra que, mesmo com o crescimento do papel da IA, uma parcela significativa dos recursos ainda é dedicada à segurança, embora a própria IA tenha um papel maior nesse aspecto quando lidera as pesquisas.
Movimento da concorrente OpenAI
Na mesma semana, a rival OpenAI anunciou que vai publicar regularmente relatórios sobre comportamentos inesperados ou não autorizados de seus modelos, tendo já divulgado seis ocorrências desse tipo.
A iniciativa da OpenAI ocorre num contexto de alertas de pesquisadores sobre o risco de agentes de IA desenvolverem comportamentos que divergem das intenções dos criadores e se tornarem mais difíceis de monitorar ou controlar.
O que ainda não foi divulgado
- Data exata do post de blog da Anthropic que contém os números.
- Detalhes da metodologia da escala da Epoch AI usada para medir a contribuição de Claude.
- Informação sobre quais projetos específicos de modelo foram incluídos na medição de 26%.


