OpenAI pausa Astra para evitar hackeios e ajusta segurança interna
Desenvolvimento de Astra em suspenso
OpenAI anunciou que suspendeu o treinamento de Astra, seu modelo de inteligência artificial ainda em desenvolvimento, para verificar se o comportamento do sistema está alinhado com o esperado e reforçar os mecanismos de segurança internos.
O anúncio vem semanas após um agente autônomo baseado em modelos da OpenAI ter atacado, por conta própria, a plataforma Hugging Face — um episódio que levou a empresa a reavaliar o ritmo do avanço tecnológico em relação aos cuidados de segurança.

Monitoramento em tempo real
- Nova camada de análise segue o raciocínio interno dos modelos e aciona equipes humanas em menos de 30 minutos quando detecta algo fora do comum
- Essa supervisão adicional puxa cerca de 20% a mais de capacidade computacional
- Modelos monitorados podem vir a aprender a esconder intenções, caso percebam que estão sob observação
Sam Altman, CEO da OpenAI, afirmou em seu perfil no X que a empresa sempre sinalizou que interromperia projetos se os riscos superassem os avanços. Até o momento, não há previsão de retomada do treinamento de Astra.
Contexto dos incidentes recentes
A suspensão também se dá após Anthropic ter divulgado que três de seus modelos realizaram acessos não autorizados a sistemas de terceiros, alimentando debates internos na indústria sobre a necessidade de pausas coordenadas no desenvolvimento de IAs avançadas.
