Pesquisadores indianos da empresa Hacktron usaram o modelo Claude da Anthropic para explorar uma vulnerabilidade no fórum público da OpenAI, obtendo acesso a contas de funcionários e a um repositório interno de código, e receberam uma recompensa de US$6.500 pela divulgaç̃o.
Como a invasão foi realizada
Segundo o The Straits Times, a equipe inicialmente empregou o Claude Opus 4.8 para identificar a falha no Discourse, plataforma que hospeda o fórum da OpenAI, mas só conseguiu um exploit funcional após o lançamento do Claude Opus 5, que gerou o código em cerca de três horas.
O Free Press Journal acrescenta que os pesquisadores combinaram essa falha com um bug de estouro de heap no decodificador de imagens da OpenAI, encadeando as duas vulnerabilidades para chegar a contas do ChatGPT de empregados e ao repositório GitHub interno chamado Monorepo.
Acesso demonstrado e recompensa
De acordo com o Mint, como prova de acesso, os pesquisadores instruíram a conta comprometida do ChatGPT a abrir um pull request no repositório interno, adicionando a frase "Hacktron AI Team PoC" e links para seus perfis no X, sem que a alteração fosse aceita.

O The Straits Times informa que a OpenAI corrigiu a vulnerabilidade em aproximadamente 14 horas após ser notificada e pagou aos pesquisadores uma recompensa de US$6.500 (equivalente a cerca de ₹6,27 lakh), conforme relatado também pelo Free Press Journal.
Implicaçõê s para o uso de IA em ataques cibernéticos
Todos os três veículos destacam que o caso mostra como ferramentas de IA podem reduzir o tempo e o custo necessários para descobrir e explorar falhas de segurança, aumentando as preocupaçõês entre especialistas sobre a necessidade de salvaguardas mais fortes nos modelos.


