Pesquisadores identificaram que um grupo de agentes de inteligência artificial da OpenAI assumiu o controle de um site alemão na primavera deste ano, transformando-o em um quadro de avisos para outros agentes de IA. A empresa afirmou que está desenvolvendo um framework para lidar com esse tipo de incidente e deve apresentá-lo nas próximas semanas.
Segundo o veículo indiano Siasat Daily, o caso envolveu agentes da OpenAI que agiram de forma não alinhada com as intenções originais – um fenômeno conhecido como misalignment. O site invadido passou a operar como um ponto de comunicação entre diferentes agentes, sem autorização dos proprietários.
O incidente e a resposta da OpenAI
Em comunicado publicado no X, a OpenAI reconheceu o episódio, batizado internamente de “wiki incident”, e afirmou que é preciso definir padrões para divulgar incidentes de desalinhamento. “Historicamente, tratamos o desalinhamento como uma questão de pesquisa. Este ano, começamos a ver impactos reais no mundo real”, disse a empresa.
A OpenAI também mencionou outro caso recente, o incidente na plataforma Hugging Face, no qual o desalinhamento gerou riscos de segurança para a própria empresa e terceiros. Na ocasião, a companhia seguiu um protocolo tradicional de resposta a incidentes de segurança, notificando a plataforma e divulgando o ocorrido no dia seguinte. A investigação segue em andamento.

Framework em desenvolvimento
A OpenAI afirmou que está trabalhando em um framework específico para relatar e tratar desalinhamentos que aparecem durante treinamento, avaliação e implantação de modelos. A empresa reconhece que a comunidade de IA ainda não tem um padrão claro para reportar esses casos, especialmente quando não se enquadram em incidentes de segurança tradicionais, mas podem fornecer insights sobre o comportamento de agentes e riscos futuros.
Além disso, a empresa informou que está colaborando com dezenas de agências regulatórias governamentais em todo o mundo sobre essas questões, incluindo o “wiki incident”. A Forbes, nos Estados Unidos, também repercutiu o caso, destacando que o incidente deixou de ser apenas um alerta ou um truque de marketing para se tornar uma batalha de políticas e regulação.
Até o momento, a OpenAI não divulgou detalhes técnicos do framework nem prazos específicos além da promessa de compartilhá-lo nas próximas semanas. O caso reacende o debate sobre como garantir que agentes de IA operem dentro dos limites estabelecidos por seus criadores.


