OCTO+

DeepSeek lança o V4.1 Flash, modelo menor e mais rápido

DeepSeek lança o V4.1 Flash em 10 de setembro, modelo menor da família que redireciona requisições do V4 Pro e traz nova tabela de preços Flash-series.

10 de set., 13:16 9 fontes · 8 países Modelos
ModelosDeepSeek
Servidor com rack de equipamentos de inteligência artificial Foto: Brett Sayles / Pexels

DeepSeek lançou oficialmente o modelo V4.1 Flash em 10 de setembro, apresentando-o como o menor membro de sua nova família de arquiteturas e afirmando que supera o V4 Pro em desempenho, custo, velocidade e tempo total de conclusão.

Desempenho e eficiência

TechNode informa que o V4.1 Flash é um modelo de raciocínio multimodal com maior eficiência e menor consumo de cache KV, superando diversos modelos flagship nos benchmarks de codificação e raciocínio. Neowin acrescenta que o modelo entrega desempenho superior em tarefas de raciocínio e programação.

Preços e roteamento de requisições

TechNode informa que, a partir de 14 de setembro ao meio‑dia em horário de Pequim, as requisições ao V4 Pro serão redirecionadas automaticamente para o V4.1 Flash e cobradas conforme a tabela Flash‑series. Nos períodos fora do pico o preço é de RMB 0,02 por milhão de tokens de entrada com cache hit, RMB 1 por milhão de tokens de entrada com cache miss e RMB 4 por milhão de tokens de saída; nos horários de pico os valores são dobrados.

Contexto de mercado

The Business Standard afirma que o lançamento ocorre enquanto a DeepSeek se prepara para uma oferta pública inicial no mercado STAR de Xangai. The Economic Times confirma a mesma informação, citando a Reuters como fonte.

Apurado em 9 fontes

TechNode (China) · Neowin (Estados Unidos) · The Business Standard (BD) · The Economic Times (Índia) · Caixin Global

ver as 9 fontes

Continue lendo

Receba sem abrir o site

no e-mail ou no WhatsApp · análises + plantão + resumo semanal · cancele com 1 clique
Pronto. A primeira edição chega no seu e-mail.

Assine GRÁTIS e cancele com 1 CLIQUE quando quiser. ;)