A DeepSeek publicou a versão final do V4-Flash no Hugging Face com licença MIT. Segundo o Inside, o modelo tem 284 bilhões de parâmetros totais e ativa cerca de 13 bilhões por vez na arquitetura de mistura de especialistas, com suporte a contexto de um milhão de tokens.
Os números explicam o nome
Mistura de especialistas é o desenho em que o modelo tem muitos parâmetros armazenados e usa uma fração deles em cada resposta. Aqui a proporção é agressiva: 13 bilhões ativos de 284 bilhões guardados.
Na prática isso significa qualidade de modelo grande com custo de inferência de modelo pequeno. É o eixo em que a DeepSeek vem competindo desde o começo, e é o que interessa a quem monta produto com margem apertada.
Licença MIT é a parte que muda o jogo
MIT é uma das licenças mais permissivas que existem: permite uso comercial, modificação e redistribuição sem exigir abertura do que for construído em cima.

Publicar um modelo desse porte sob MIT coloca capacidade de fronteira ao alcance de quem tem hardware, sem contrato e sem dependência de API. Para empresa brasileira com restrição de dado, é a diferença entre poder e não poder usar.
O contraste com a semana
O movimento contrasta com o outro lançamento da própria DeepSeek nos últimos dias, o V4 Flash Vision Exp, disponível apenas na plataforma paga de desenvolvedores. A empresa está testando os dois caminhos ao mesmo tempo.
O que ainda não foi divulgado
- Requisito mínimo de hardware para rodar
- Resultados em testes independentes
- Se haverá versões menores da mesma família
- Como se compara em custo com a API própria


