Anthropic anunciou na quinta-feira que bloqueou tentativas de maus atores de usar seus modelos de IA para atividades maliciosas, incluindo ciberataques, vigilância e pesquisa que poderia apoiar o desenvolvimento de armas biológicas.
Conteúdo do relatório de uso indevido
A empresa divulgou seu terceiro relatório de uso indevido de IA desde março de 2025, abrangendo casos identificados entre dezembro de 2025 e agosto de 2026. Segundo fontes consultadas pela Mint e pelo Anchorage Daily News, o documento inclui trechos de código malicioso e de prompts usados pelos atores e pede que governos e concorrentes identifiquem e impeçam abusos semelhantes.
A Anthropic afirmou ter responsabilidade de divulgar o uso indevido de seus serviços e destacou que, à medida que os modelos ficam mais capazes, os riscos aumentam se desenvolvedores e a sociedade não agirem para torná‑los mais seguros.
Casos específicos bloqueados
- Um pedido de financiamento científico visava realizar pesquisa de ganho de função no vírus chikungunya, com foco em aumentar sua transmissibilidade e capacidade de escapar do sistema imune, segundo a Mint.
- Os sistemas da Anthropic bloquearam uma campanha industrial‑scale e cúbrida de extração de capacidades de um modelo para reproduzi‑las em outro modelo sem autorização, informa a Mint. Trata‑se de um caso de destilação ilícita.
- Entre dezembro de 2025 e agosto de 2026, foram identificadas tentativas de uso dos modelos por fornecedores de spyware, indivíduos motivados politicamente e grupos patrocinados por estados que espalhavam propaganda, segundo a Mint.
- O Anchorage Daily News destaca que os esforços bloqueados incluíam atividades de ciberataque e vigilância, além de pesquisas que poderiam levar ao desenvolvimento de armas biológicas.
Medidas de segurança e contexto dos modelos
A Anthropic afirmou, segundo a Mint, que adicionou salvaguardas mais fortes em seus modelos mais recentes para restringir pesquisas biológicas que também poderiam ser usadas na criação de armas. Já os modelos mais antigos, como Claude Opus 4 e Claude Sonnet 4.5 de 2025, ficaram abaixo do limiar que permitiria a um usuário sofisticado conduzir pesquisas biológicas perigosas, o que justificou salvaguardas menos rígidas nessas versões.

O relatório foi publicado dois dias após um pesquisador da Anthropic anunciar sua demissão, citando preocupações sobre o desenvolvimento responsável da IA pelas empresas do setor, conforme destaca o Anchorage Daily News. A saída do profissional acendeu debates sobre os riscos da tecnologia.
Ambas as fontes apontam que a Anthropic está se preparando para uma oferta pública inicial neste outono.


