Alibaba liberou os pesos abertos do Qwen3.8-27B, modelo de 27 bilhões de parametros com multimodalidade nativa e arquitetura densa para inferencia local. Contexto de 262.144 tokens extensivel a 1 milhao via YaRN. O lancamento ocorre sob licenca Apache 2.0, posicionando o modelo como alternativa open-weight a sistemas proprietarios.
Desempenho tecnico em hardware especifico
- Implementacoes no Japao usando DGX Spark (GB10) com llama.cpp mediram velocidade base de 9,38 tokens por segundo (c=1) na configuracao de temperatura padrao, com melhorias de 66,7% usando investigacao c=8 e 60,4% com c=16 quando o head MTP esta ativado.
- A arquitetura hibrida tem 16 camadas de atencao plena e 48 Gated DeltaNet (atencao linear), reduzindo cache KV para aproximadamente 1/4 do tamanho tradicional, enquanto head MTP treinado mantem eficacia de especulacao ate c=32, diferentemente de outros modelos onde efeito cessa entre c=16 e c=24.
Onde a cobertura diverge: foco tecnico vs mercado
- Cobertura tailandesa enfatiza comparacoes com Claude Opus 4.6, citando melhorias em Terminal Bench (de 63,4 para 73,0 na v2.1) e SWE-bench Pro (de 45,5 para 61,7).
- Tailandesa tambem menciona preco OpenRouter: AkashML oferece a 0,45 dolar por 3,2 milhoes de tokens, considerado alto para o tamanho, enquanto indiana destaca acessibilidade open-weight para desenvolvedores e pesquisadores que buscam executar localmente sem dependencia de nuves.
Recursos de lancamento e licenca Apache 2.0
- Modelo disponibilizado em 15 de agosto de 2026, um dia apos anuncio do Qwen3.8-Max de 2,4 trilhoes de parametros (API apenas), com pesos open-weight no HuggingFace conforme cronograma de contagem regressiva.
- Suporta multimodalidade nativa para texto, imagens e video, com deployment flexivel em infraestrutura local ou nuvem, atendendo desenvolvedores e pesquisadores que buscam alternativas a modelos de fronteira proprietarios.


