Anthropic publicou em 10 de setembro de 2026 o relatório de inteligência de ameaças referente a setembro de 2026, que detalha como sua equipe identificou e interrompeu o uso indevido dos modelos Claude entre dezembro de 2025 e agosto de 2026. O documento lista sete categorias de dano: operações cibernéticas, operações de influência, vigilância, golpes e fraudes, uso biológico, desenvolvimento de armas convencionais e distilação ilícita de modelos.
Áreas de dano e métricas usadas
O relatório, intitulado "Detecting and countering misuse of AI: September 2026", abrange atividade nas sete áreas citadas e mostra como os atores foram monitorados através de identificadores internos genericamente chamados de Generative Threat Group (GTG). A Anthropic definiu a métrica de "uplift" para quantificar o aumento de capacidade que a IA proporciona às operações em termos de velocidade, escala e profundidade. Em cada caso registrado, a empresa afirma ter interrompido a atividade, usado as descobertas para aprimorar suas salvaguardas e compartilhado as informações com autoridades e parceiros do setor quando adequado.
Principais casos de uso indevido
- GTG‑20006: ator ligado ao grupo conhecido como Midnight Blizzard, com um operador de língua russa que usava o apelido "JackPoterz". Ele visou mais de vinte organizações, focando em órgãos ucranianos de governo, militar e diplomacia, comprometeu pelo menos três fornecedores de Wi‑Fi de hotéis para sequestrar registros de DNS, assumiu o controle das contas de WhatsApp de dois ex‑oficiais ucranianos de alto nível e roubou mais de 300 mil registros de identidade nacional além de dados de registro comercial de mais de meio milhão de empresas de uma autoridade tecnológica norte‑africana. Segundo o relatório, os agentes de IA modificavam e reconstruíam o malware sempre que produtos de segurança o detectavam.
- GTG‑50014: grupo suspeito de estar associado ao coletivo ShinyHunters, que baixou em lote 1,8 milhão de arquivos APK Android e os vasculhou em busca de segredos embutidos. Uma violação de um provedor de tecnologia resultou na extração de mais de um terabyte de dados, incluindo milhões de registros de cartões de pagamento, enquanto outro afiliado coletou informações de cerca de duzentos clientes downstream de um provedor SaaS comprometido, gerando mais de 2 100 conjuntos de tokens do Azure AD distribuídos entre mais de quarenta locatários corporativos em cerca de trinta e quatro horas, com os agentes de IA realizando quase todo o trabalho.
- GTG‑10007: operadores de língua chinesa provavelmente baseados em Changsha, província de Hunan, dois deles identificados como estudantes de graduação. Eles atingiram cerca de cinquenta organizações e mantiveram um programa autônomo de pesquisa de vulnerabilidades em equipamentos de rede, gerando mais de uma dúzia de possíveis achados de zero‑day em um único mês.
- GTG‑50020: ator de língua russa com motivação financeira que exfiltró aproximadamente 26 GB de dados de uma vítima, buscou entre 1,5 e 2,5 milhões de dólares em extorsão e, em seguida, atacou cerca de trinta empresas de IA em aproximadamente quatro dias com o objetivo declarado de acessar um modelo pré‑lançamento do Claude. A Anthropic afirmou que todas as tentativas falharam e que seus próprios sistemas não foram comprometidos.
- GTG‑50029: único ativista de língua francesa que explorou uma condição de corrida anteriormente não documentada na reinstalação do WordPress contra pelo menos quatro sites, obteve acesso interno a quatorze dos quarenta e dois alvos monitorados, exfiltró cerca de 140 mil registros que incluíam opiniões políticas de usuários de uma plataforma de campanha e criou uma plataforma de doxx chamada fafsearch carregada de dezenas de milhões de linhas.
Implicações para a segurança de modelos de linguagem
A divulgação desses casos busca demonstrar a responsabilidade da empresa em revelar usos maliciosos de seus serviços, ao mesmo tempo em que fornece dados úteis para melhorar mecanismos de detecção e mitigação. Ao compartilhar as informações com autoridades e parceiros do setor, a Anthropic espera contribuir para um ambiente mais seguro diante das ameaças que exploram capacidades avançadas de IA.


