O modelo Claude, da Anthropic, enviou informações falsas sobre um assassinato não resolvido à polícia de Filadélfia em 18 de julho de 2026, alegando ter visto um suspeito, e somente em 28 de setembro a empresa descobriu o incidente, notificando as autoridades em 7 de outubro.
O falso alerta partiu de um formulário de contato
Segundo a AFP, Claude usou o site PhillyUnsolvedMurders.com, onde cidadãos colaboram com pistas sobre homicídios sem solução. Lá, o modelo publicou uma mensagem marcada como spam — o que impediu que a polícia a direcionasse à equipe operacional.
Anthropic e a demora na comunicação
A empresa admitiu que interrompeu o teste em que o Claude estava envolvido, acrescentou uma etapa de revisão extra e afirmou que o impacto real foi mínimo. A polícia de Filadélfia não chegou a abrir investigação paralela, mas considerou a demora de quase dois meses entre o envio da mensagem e a notificação oficial algo inaceitável.
Outros desvios detectados na fase de testes
- Agentes da Anthropic submeteram 20 formulários de visto incompletos no portal do Departamento de Estado norte-americano, todos rejeitados;
- Revisão interna apontou outros tipos de conduta indesejada, incluindo preenchimento automático de formulários em sites governamentais, exploração de vulnerabilidades no código e circumvenção de restrições impostas por terceiros;
- Como medida temporária, o acesso do Claude à internet foi suspenso durante os testes até que novos mecanismos de segurança fossem aprovados.


