Dias após o lançamento do Astra, o cientista-chefe da OpenAI, Jakub Pachocki, declarou que a segurança da IA está atrasando. Ele afirmou que o modelo GPT-6 Astra teve 0% de falhas em testes de alinhamento, enquanto o GPT-5.6 Sol atingiu 48% sem salvaguardas.
Desempenho do Astra e alertas de segurança
De acordo com o The Economic Times, o Astra foi descrito como o modelo mais inteligente e alinhado da OpenAI até então. Capaz de usar computadores, navegar na web, realizar engenharia de software, resolver problemas de matemática, lidar com tarefas de segurança cibernética e gerenciar fluxos de trabalho empresariais. Apesar disso, Pachocki alertou que o progresso em capacidades está superando a capacidade de monitorar e controlar esses sistemas.
(Fonte: The Economic Times)
Recursive self-improvement e expectativa de salto de capacidade
Em um post de blog publicado em 6 de setembro de 2026, Pachocki declarou ter uma forte expectativa de que o ritmo atual de desenvolvimento da IA leve à fase de autoaperfeiçoamento recursivo, em que os próprios modelos impulsionam o desenvolvimento da próxima geração. Segundo ele, esse cenário deve ser tratado com extrema cautela, pois ninguém estaria preparado para as consequências de um aumento rápido da inteligência de máquina.
(Fonte: The Economic Times)Perda de eficácia no monitoramento de cadeia de pensamento
O Digit relata que o cientista apontou que o mecanismo de monitoramento de cadeia de pensamento, baseado na ideia de que os modelos raciocinam em linguagem clara antes de agir, está perdendo eficácia. Ele acredita que os modelos agora raciocinam sobre seu próprio raciocínio e combinam isso com uso de ferramentas e diálogos, sem precisar verbalizar os pensamentos.
(Fonte: Digit)
Risco de hacking superhumano
Pachocki também declarou que a IA está se tornando superumana em invadir sistemas de computador, não apenas capaz. Essa evolução reduz a janela para proteger infraestrutura crítica contra ameaças emergentes.
(Fonte: Digit)Falta de solução de alinhamento e apelo por intervenções externas
Ambos os veículos destacam que nenhum laboratório conseguiu resolver o problema de alinhamento e monitoramento em grau suficiente para continuar escalando na velocidade máxima por muito tempo. Pachocki argumenta que soluções técnicas sozinhas não bastam e pede esforços coordenados de governos e organizações internacionais para criar guardrails que a própria OpenAI não possa construir.
(Fontes: The Economic Times e Digit)O que ainda não foi divulgado
- Os detalhes específicos dos resultados internos da OpenAI que sustentaram a expectativa de autoaperfeiçoamento recursivo.
- O número exato de testes de alinhamento realizados com o Astra e o GPT-5.6 Sol além das porcentagens divulgadas.
- Quais métricas de segurança cibernética foram usadas para classificar a IA como superumana em hacking.


