A Anthropic alterou o modo de operação do Claude Code para automático como padrão a partir de 14 de agosto. A decisão baseia-se em dados internos que mostram a IA bloqueando mais de 80% das consultas de risco, superando a taxa de 14% de intervenção humana.
Desempenho em testes de segurança
Segundo informações publicadas no Reddit pela comunidade r/ClaudeAI, um estudo controlado envolvendo 1.053 testadores pagos comparou a eficácia da ferramenta. O modo automático apresentou uma taxa de bloqueio de 89% para comandos considerados perigosos. Em contrapartida, os testes de aprovação manual realizados por humanos detectaram apenas 13,6% das ameaças.
Impacto na produção
Dados de produção da própria empresa indicam que sessões que dependeram de validação humana manual resultaram em danos não intencionais com uma frequência duas vezes maior do que as sessões conduzidas pelo modo automático. Além disso, a companhia informou que atividades de red-teaming realizadas por terceiros contribuíram para o refinamento dos processos de segurança. A mudança oficializa a prioridade do sistema automatizado na contenção de comandos maliciosos.
O que ainda não foi divulgado
- Detalhes técnicos sobre os critérios específicos utilizados pela IA para classificar um comando como perigoso.
- Informações sobre como a interface de usuário será adaptada para permitir intervenções humanas em casos de falsos positivos do modo automático.
- Dados completos ou cronograma de publicação da auditoria realizada pelas equipes de red-teaming de terceiros mencionadas nos relatórios.


