DeepSeek abriu beta limitado do modelo multimodal V4.1 Flash, que chega a 427 tokens/s segundo o Developpez; o TechNode anunciou o acesso via API e o IT Home detalhou as novas funções do Harness v0.1.5 que dá suporte ao modelo.
Desempenho e preço
Segundo o Developpez, o V4.1 Flash atinge 427 tokens/s e supera a V4 Pro em desempenho, custo e tempo de execução.
O TechNode diz que o beta mantém os preços da V4 Flash e permanecerá ativo até 10 de setembro de 2026, quando será descontinuado.
Acesso e limites
O TechNode explica que desenvolvedores acessam o modelo pela API existente da DeepSeek usando o identificador deepseek-v4.1-flash-expires-on-0910, com limite de 20 requisições simultâneas por conta.
O Developpez confirma o mesmo teto e aponta que, apesar da velocidade, o modelo tende a “super‑pensar” e fica atrás de concorrentes como GPT‑6, Astra e Fable 5.1 em simulações de física.

Integração com o DeepSeek Harness
Segundo o IT Home, o Harness 0.1.5 foi lançado para se adaptar profundamente ao V4.1 Flash, com treinamento nos modos padrão, de chamada de ferramentas programáticas (PTC) e minimalista.
O update permite atualizar o prompt do sistema preservando o KV Cache, acrescenta upload de arquivos e preview na barra lateral, suportando imagens, PDFs, Markdown, HTML e códigos comuns.
O Harness ganhou entradas padronizadas para plugins, apresentou desempenho otimizado em longas conversas e habilitou comunicação bidirecional entre agentes pai e filho.
Também inclui a função experimental Agent Teams, que possibilita criar equipes de agentes com listas de tarefas compartilhadas.


