Segundo a Reuters, conforme divulgado pelos veículos russos Prime e Overclockers.ru, os principais desenvolvedores chineses de inteligência artificial publicam resultados de testes de segurança somente para uma fração mínima de seus lançamentos. A análise foi publicada em 9 de outubro de 2026 e abrangeu 857 modelos lançados entre 2021 e 15 de setembro de 2026 por nove gigantes do setor — Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax e StepFun. A pesquisa da SemiAnalysis constatou que apenas 31 releases (3,6%) apresentaram dados de teste comparáveis a um modelo específico e apenas nove releases (1,1%) tiveram tais informações disponíveis no momento ou antes do lançamento. Essa baixa taxa de divulgação levanta questões sobre a transparência das práticas de segurança no ecossistema de IA da China. O volume de 857 modelos analisados reflete a acelerada velocidade de lançamento de soluções de IA pelas empresas chinesas durante o período estudado.
Cobertura dos testes de segurança divulgados
Sob a definição usada pela SemiAnalysis, divulgação significa a apresentação de resultados específicos vinculados a um modelo nomeado, incluindo testes de saída prejudicial, resistência a jailbreak, toxicidade, privacidade, comportamento em situação de falha e capacidades perigosas, com os resultados vinculados a um nome de modelo específico e não a agregações genéricas. Segundo o relatório, essas métricas foram públicamente relatadas apenas nos 31 casos identificados, enquanto os demais 826 lançamentos não disponibilizaram informações comparáveis. O estudo também ressalta que as regras obrigatórias de Pequim concentram‑se principalmente nas aplicações e em seu impacto sobre os usuários, não exigindo que os desenvolvedores de modelos de fronteira realizem ou publiquem avaliações de risco baseadas nas capacidades dos próprios sistemas. Esse enfoque regulatório ajuda a explicar por que poucos modelos chineses têm dados de segurança publicados em nível de modelo. Os pesquisadores consideraram apenas aquelas versões em que os dados de segurança foram divulgados de forma pública e diretamente atrelados ao modelo em questão.
Comparação com empresas americanas
O relatório indica que nenhum dos grandes desenvolvedores chineses lançou um modelo de fronteiriça com testes públicos de capacidades perigosas que incluíssem riscos cibernéticos, biológicos ou de perda de controle. Em contraste, companhias estadunidenses como OpenAI, Anthropic e Google DeepMind costumam divulgar relatórios detalhados desse tipo para seus lançamentos de modelos avançados, tornando a prática de transparência em testes de segurança mais comum entre as firms daquele país. A diferença destaca uma divergência nas abordagens de divulgação de risco entre os dois ecossistemas de IA. Essa ausência de testes públicos impede que stakeholders verifiquem independentemente afirmações sobre a robustez dos modelos frente a ameaças cibernéticas, biológicas ou de perda de controle, o que pode afetar avaliações de risco para usuários finais e reguladores.
O que ainda não foi divulgado
A SemiAnalysis não especifica quais modelos exatos ficaram sem os dados de segurança publicados, nem explica os motivos pelos quais as empresas chinesas optaram por não divulgar tais informações. Tampouco há registro de respostas oficiais das companhias analisadas às conclusões do estudo, deixando aberto se as avaliações foram realizadas internamente sem tornar‑se públicas ou se simplesmente não foram conduzidas. O relatório também não indica se há expectativa de mudança futura nas práticas de divulgação, nem menciona eventuais pressões externas que pudesse influenciar esse cenário. Além disso, o estudo não compara a taxa de divulgação chinesa com nenhum histórico anterior, o que limita a capacidade de avaliar se o padrão observado representa uma mudança, uma estabilidade ou uma tendência descendente.


