A Alibaba lançou em 26 de agosto de 2026 o Qwen3.8‑Flash, novo modelo multimodal de IA que reduz o custo de treinamento para cerca de um nono do antecessor Qwen3.7‑Plus, segundo a Olhar Digital.
Custo, acesso e contexto
Segundo a Olhar Digital, o acesso via API será cobrado a 1 yuan (cerca de R$ 0,77) por milhão de tokens de entrada e 3 yuans (cerca de R$ 2,30) por milhão de tokens de saída. O modelo suporta janela de contexto padrão de 262.144 tokens, expansível até 1 milhão de tokens, permitindo processar arquivos grandes e conversas longas em uma única sessão. A mesma fonte menciona que a Alibaba também lançou uma oferta de ações de HK$ 80 bilhões em 23 de agosto para financiar seus gastos com IA.
Arquitetura experimental e indicações para o Qwen4
De acordo com o Unite.AI, o Qwen3.8‑Flash‑Next, lançado na mesma data, é um modelo de peso aberto com 125 bilhões de parâmetros totais, dos quais apenas 6 bilhões são ativados por token. A arquitetura inclui atenção híbrida, mecanismo de porta residual, camada de embutimento n‑gram e um plano de treinamento que reduz o total de passos do otimizador. O Unite.AI destaca que o modelo é um passo concreto rumo à família Qwen4, focado em eficiência de inferência para cargas de trabalho agente com longos contextos.

Onde a cobertura diverge
A Olhar Digital enfatiza o aspecto de custo reduzido, o preço da API e o contexto ampliado, além de ligar o lançamento à expansão financeira da Alibaba na China. Já o Unite.AI concentra‑se nos detalhes técnicos da arquitetura híbrida, nos parâmetros ativos e na relação com o futuro Qwen4, sem tratar de preços ou de ofertas de ações.
O que ainda não foi divulgado
As fontes não especificam a data exata a partir de laquelle o modelo estará disponível para download, nem esclarecem a diferença entre as variantes mencionadas como 125B‑A6B ou 35B‑A3B.


