DeepSeek lançou oficialmente o modelo V4.1 Flash em 10 de setembro, apresentando-o como o menor membro de sua nova família de arquiteturas e afirmando que supera o V4 Pro em desempenho, custo, velocidade e tempo total de conclusão.
Desempenho e eficiência
TechNode informa que o V4.1 Flash é um modelo de raciocínio multimodal com maior eficiência e menor consumo de cache KV, superando diversos modelos flagship nos benchmarks de codificação e raciocínio. Neowin acrescenta que o modelo entrega desempenho superior em tarefas de raciocínio e programação.
Preços e roteamento de requisições
TechNode informa que, a partir de 14 de setembro ao meio‑dia em horário de Pequim, as requisições ao V4 Pro serão redirecionadas automaticamente para o V4.1 Flash e cobradas conforme a tabela Flash‑series. Nos períodos fora do pico o preço é de RMB 0,02 por milhão de tokens de entrada com cache hit, RMB 1 por milhão de tokens de entrada com cache miss e RMB 4 por milhão de tokens de saída; nos horários de pico os valores são dobrados.
Contexto de mercado
The Business Standard afirma que o lançamento ocorre enquanto a DeepSeek se prepara para uma oferta pública inicial no mercado STAR de Xangai. The Economic Times confirma a mesma informação, citando a Reuters como fonte.


