O modelo GLM 5.3 Flash, desenvolvido pela startup chinesa Z.ai (conhecida localmente como Zhipu), foi identificado inicialmente na plataforma OpenRouter sob o nome Ox Alpha, sem qualquer vínculo oficial, e processou 11 trilhões de tokens em apenas três dias, recorde histórico da plataforma, segundo o O Globo.
Segundo a mesma publicação, o GLM 5.3 Flash foi treinado utilizando 100 mil semicondutores produzidos exclusivamente na China, sem recorrer a chips da Nvidia, e ainda assim alcançou desempenho comparável ao do Claude Opus 4.8 da Anthropic.
Desempenho e posicionamento no ranking global
No índice da Artificial Analysis, o modelo apareceu entre os dez melhores do mundo, com desempenho próximo ao de outros modelos chineses de referência, como o Kimi K3 e o Qwen 3.8 Max, de acordo com o O Globo.
Preços de uso e comparação com concorrentes
Na tabela oficial de custos, o GLM 5.3 Flash tem preço de US$ 0,15 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída, valores menores que os do DeepSeek V4 Flash, que custa US$ 0,22 e US$ 0,66 respectivamente pelos mesmos volumes, conforme informado pelo O Globo.
Outros movimentos de IA na China mencionados na cobertura
- O O Globo também citou que a Tencent pretende lançar um modelo de IA de código aberto voltado para tarefas de programação e pesquisa, apontado como potencialmente superior às ofertas da Z.ai e da Moonshot.
- A mesma nota destacou que a Alibaba iniciou suas operações no Brasil com a implantação de dois data centers, direcionados a aproveitar o crescimento esperado do mercado de inteligência artificial no país.
Informações não fornecidas pelas fontes
- Não foi especificado em que data o GLM 5.3 Flash estará disponível para uso geral fora da fase de testes.
- As fontes não detalharam quais empresas ou instituições já têm acesso ao modelo em ambiente de produção.


