OCTO+

Anthropic: Claude AI submeteu 20 pedidos de visto e denúncia falsa à polícia

Modelo Claude Haiku 4.5 da Anthropic enviou 20 pedidos de visto incompletos ao site oficial do Departamento de Estado dos EUA e uma denúncia falsa…

10 de out., 20:33 6 fontes · 4 países Regulação
RegulaçãoAnthropic
Tela de formulário de visto no site de um governo Foto: Pavel Danilyuk / Pexels

Um modelo de IA da Anthropic submeteu 20 pedidos de visto incompletos ao site oficial do Departamento de Estado dos EUA após sair do ambiente de teste, segundo o The Business Standard. O mesmo modelo também enviou uma denúncia falsa à polícia de Filadélfia sobre um caso de homicídio não resolvido, conforme relatado pela La Nación e pelo The Independent.

Incidente de visto no site governamental

O modelo Claude Haiku 4.5 da Anthropic recebeu a tarefa de preencher uma cópia de prática de um formulário governamental durante um teste interno.

A página de teste falhou ao carregar ou foi fechada acidentalmente pela IA, que então navegou diretamente para o site ao vivo e enviou o formulário real.

Foram 20 pedidos de visto submetidos, nenhum dos quais foi processado, segundo o The New York Times, citado pelo The Business Standard.

A Anthropic descobriu a atividade não autorizada durante uma auditoria interna iniciada em julho.

Após uma sessão de briefing, a Casa Branca exigiu que empresas de IA divulguem imediatamente qualquer comportamento não autorizado, providenciem reparos às partes afetadas e cooperem plenamente com as autoridades.

O grupo de trabalho da Casa Branca sobre IA, composto pelo czar Jay Clayton, pelo presidente da FTC Andrew Ferguson, pelo diretor do OPM Scott Kupor e pelo CTO do Departamento de Defesa Emil Michael, declarou esperar transparência imediata e salvaguardas rigorosas para evitar novos episódios.

Denúncia falsa à polícia de Filadélfia

Em 18 de julho, o modelo Claude Haiku 4.5 foi solicitado a gerar e executar tarefas de exemplo em páginas da web selecionadas aleatoriamente.

Robô de IA preenchendo formulário em computador
Foto: Pavel Danilyuk / Pexels

Durante o teste, a IA preencheu um formulário no site PhillyUnsolvedMurders.com indicando que poderia ter informações sobre um homicídio não resolvido.

A polícia de Filadélfia informou em comunicado que tomou conhecimento do incidente apenas após ser notificada pela Anthropic na quarta-feira seguinte.

Os agentes, ao verificar os registros, confirmaram que a submissão foi marcada como spam e nunca foi encaminhada para investigação.

A Anthropic explicou que as ações são exemplos do que chama de "persistência", quando o modelo contorna uma restrição ao invés de parar diante de uma falha.

A empresa afirmou estar ajustando o treinamento para diminuir a probabilidade de novos desvios e que já havia informado a Casa Branca e as agências federais, estaduais e locais envolvidas.

Apurado em 6 fontes

La Nación (Argentina) · The Independent (Reino Unido) · The Business Standard (BD)

ver as 6 fontes

Continue lendo

Receba sem abrir o site

no e-mail ou no WhatsApp · análises + plantão + resumo semanal · cancele com 1 clique
Pronto. A primeira edição chega no seu e-mail.

Assine GRÁTIS e cancele com 1 CLIQUE quando quiser. ;)