Jakub Pachocki, cientista-chefe da OpenAI, publicou um alerta sobre o ritmo do desenvolvimento de inteligência artificial, afirmando que nenhum laboratório resolveu de forma suficiente os desafios de alinhamento e monitoramento para continuar escalando sistemas em velocidade máxima. Em um post intitulado "An Alien Mind" (Uma Mente Alienígena), divulgado em 6 de setembro, Pachocki argumenta que a humanidade está caminhando para um futuro com máquinas cada vez mais capazes, sem garantias de que permanecerão sob controle humano.
Alerta sobre alinhamento e monitoramento
O problema central, segundo Pachocki, é que a capacidade de entender e dirigir os sistemas de IA não acompanha o avanço técnico. "Atualmente, acredito que nenhum laboratório resolveu alinhamento e monitoramento em um grau suficiente para continuar escalando com responsabilidade em velocidade máxima por muito mais tempo", escreveu. Ele defende que desacelerações voluntárias se tornem mais comuns até que padrões de segurança compartilhados sejam estabelecidos.
O cientista alerta que sistemas avançados podem operar computadores, colaborar com humanos e outros sistemas de IA e conduzir pesquisas com crescente autonomia. Ele descreve o risco de uma "inteligência alienígena" que supere capacidades humanas e diz que o progresso tecnológico desenfreado pode deixar as pessoas para trás.
Monitoramento de cadeia de pensamento perde eficácia
O The Statesman destacou que Pachocki apontou uma degradação na confiabilidade do monitoramento de cadeia de pensamento — técnica usada pela OpenAI para examinar como modelos de raciocínio chegam a decisões. O cientista afirmou que, à medida que a IA se torna mais capaz de raciocinar sobre e manipular seus próprios processos de raciocínio, esse método de supervisão perde eficácia.

Pachocki também mencionou que os ganhos em inteligência das máquinas são impulsionados substancialmente por maior poder computacional, e que a incerteza sobre o funcionamento interno dos modelos aumenta quando eles encontram situações não cobertas pelo treinamento. Ele reforçou que o alinhamento de valores — garantir que a IA aja segundo princípios humanos mesmo em contextos adversos — continua sendo um problema central.
Contexto do GPT-6 Astra
O alerta ocorre dias após a OpenAI lançar o GPT-6 Astra, em 3 de setembro, descrito como seu modelo mais capaz, com avanços em uso de computador, navegação, engenharia de software, segurança cibernética e ciência. A avaliação de segurança da própria empresa para o novo modelo indica que ele representa um aumento significativo em capacidades de segurança cibernética, e que a OpenAI reforçou salvaguardas contra ações prejudiciais decorrentes de uso indevido ou desalinhamento.
Pachocki disse que o GPT-6 Astra mostra melhorias de alinhamento em relação ao GPT-5.6 Sol, mas enfatizou que consideravelmente mais progresso ainda é necessário à medida que a inteligência geral do modelo avança. Ele concluiu que o momento exige "extrema cautela" e que "intervenções mais amplas são necessárias", incluindo coordenação internacional entre governos e limites de segurança comuns antes da escalada irrestrita.


