OCTO+

Qwen3.8-Flash da Alibaba corta custos de treino 9x

Modelo tem janela de contexto de até 1 milhão de tokens e API a 1 yuan de entrada, segundo a Olhar Digital.

29 de ago., 09:10 31 fontes · 16 países Modelos Produto
ModelosQwen
Servidor com placas de processamento para inteligência artificial Foto: Pixabay / Pexels

A Alibaba lançou em 26 de agosto de 2026 o Qwen3.8‑Flash, novo modelo multimodal de IA que reduz o custo de treinamento para cerca de um nono do antecessor Qwen3.7‑Plus, segundo a Olhar Digital.

Custo, acesso e contexto

Segundo a Olhar Digital, o acesso via API será cobrado a 1 yuan (cerca de R$ 0,77) por milhão de tokens de entrada e 3 yuans (cerca de R$ 2,30) por milhão de tokens de saída. O modelo suporta janela de contexto padrão de 262.144 tokens, expansível até 1 milhão de tokens, permitindo processar arquivos grandes e conversas longas em uma única sessão. A mesma fonte menciona que a Alibaba também lançou uma oferta de ações de HK$ 80 bilhões em 23 de agosto para financiar seus gastos com IA.

Arquitetura experimental e indicações para o Qwen4

De acordo com o Unite.AI, o Qwen3.8‑Flash‑Next, lançado na mesma data, é um modelo de peso aberto com 125 bilhões de parâmetros totais, dos quais apenas 6 bilhões são ativados por token. A arquitetura inclui atenção híbrida, mecanismo de porta residual, camada de embutimento n‑gram e um plano de treinamento que reduz o total de passos do otimizador. O Unite.AI destaca que o modelo é um passo concreto rumo à família Qwen4, focado em eficiência de inferência para cargas de trabalho agente com longos contextos.

Desenvolvedor usando laptop para programar IA
Foto: olia danilevich / Pexels

Onde a cobertura diverge

A Olhar Digital enfatiza o aspecto de custo reduzido, o preço da API e o contexto ampliado, além de ligar o lançamento à expansão financeira da Alibaba na China. Já o Unite.AI concentra‑se nos detalhes técnicos da arquitetura híbrida, nos parâmetros ativos e na relação com o futuro Qwen4, sem tratar de preços ou de ofertas de ações.

O que ainda não foi divulgado

As fontes não especificam a data exata a partir de laquelle o modelo estará disponível para download, nem esclarecem a diferença entre as variantes mencionadas como 125B‑A6B ou 35B‑A3B.

Apurado em 31 fontes

Olhar Digital (Brasil) · Unite.AI

ver as 31 fontes

Continue lendo

Receba sem abrir o site

no e-mail ou no WhatsApp · análises + plantão + resumo semanal · cancele com 1 clique
Pronto. A primeira edição chega no seu e-mail.

Assine GRÁTIS e cancele com 1 CLIQUE quando quiser. ;)