OCTO+

OpenAI é hackeado eticamente com auxílio do Claude

Pesquisadores da Hacktron usam o Claude da Anthropic para acessar contas de funcionários da OpenAI e recebem recompensa de US$ 6,500.

18 de set., 14:42 37 fontes · 17 países Segurança
SegurançaAnthropicOpenAI
Sala de servidores com luzes indicativas Foto: panumas nikhomkhai / Pexels

Researchers from Hacktron used Anthropic’s Claude chatbot to breach OpenAI employee accounts hosted on Discourse.

Como o ataque foi realizado

Segundo o The Guardian US, a equipe começou usando o Claude para acessar o fórum de funcionários da OpenAI na plataforma Discourse.

Em seguida enviaram uma pull request inofensiva para o repositório GitHub da OpenAI, tentando mudar um arquivo.

O The Independent acrescenta que a porta de entrada foi uma vulnerabilidade na libheif, usada para processar imagens em uploads e presente em serviços como Slack, Meta, Zoom, Shopify, GitHub Enterprise e Discourse.

Resposta da OpenAI e recompensa

Os pesquisadores relataram a descoberta ao programa de bug bounty da OpenAI, que lhes pagou US$ 6,500 pela falha identificada.

De acordo com o The Guardian US, a OpenAI afirmou ter corrigido as vulnerabilidades exploradas e agradeceu a contribuição dos investigadores.

O The Independent destaca que o teste ocorreu em julho, pouco antes de a própria OpenAI relatar que seus agentes haviam realizado um teste de invasão contra a Hugging Face.

Analista de segurança digitando em teclado
Foto: Tima Miroshnichenko / Pexels

Implicações para segurança de IA

Os pesquisadores alertaram que ferramentas de IA como o Claude reduziram drasticamente o tempo necessário para planejar e executar invasões, comprimindo tarefas que antes exigiam equipes bem recursos e meses de trabalho em poucos dias.

Eles recomendam que os modelos de ameaça sejam atualizados para levar em conta a economia da exploração atual, em vez de depender de suposições obsoletas sobre quem pode conduzir ataques sofisticados.

O The Independent também menciona que, por volta do mesmo período, a Anthropic lançou o modelo Opus 5, versão mais capaz do Claude, que os pesquisadores utilizaram para entender como explorar as falhas.

O The Guardian US acrescenta que, apesar do uso inicial do Claude, os investigadores afirmaram ter utilizado principalmente o modelo GPT-5.6 Sol da OpenAI para conduzir o hack.

Ambas as fontes citam pedidos por desaceleração no desenvolvimento de IA, com a Anthropic pedindo redução de velocidade, posição apoiada por OpenAI, Google DeepMind e Elon Musk, enquanto Donald Trump se opôs ao argumento, citando a corrida com a China.

Apurado em 37 fontes

The Guardian US (Estados Unidos) · The Independent (Reino Unido)

ver as 37 fontes

Continue lendo

Receba sem abrir o site

no e-mail ou no WhatsApp · análises + plantão + resumo semanal · cancele com 1 clique
Pronto. A primeira edição chega no seu e-mail.

Assine GRÁTIS e cancele com 1 CLIQUE quando quiser. ;)