A DeepSeek apresentou o V4 Flash Vision Exp, novo modelo multimodal de sua série principal V4. Segundo o SiliconANGLE, o modelo está disponível apenas pela plataforma paga de desenvolvedores da startup chinesa, e é posicionado como competitivo com o Opus 4.8, da Anthropic.
Multimodal é o terreno onde a comparação fica difícil
Modelo que lê imagem além de texto muda o conjunto de tarefas que dá para automatizar: documento escaneado, planta, gráfico, captura de tela. É a capacidade que separa assistente de conversa de ferramenta de processo.
Também é a área onde comparar modelos vira exercício frágil. Não há um teste único aceito, e cada laboratório escolhe o conjunto em que se sai melhor.
Lançar só na plataforma paga diz algo
A DeepSeek ficou conhecida por entregar capacidade de fronteira a custo baixo e com peso aberto. Estrear um modelo apenas na plataforma paga de desenvolvedor é movimento diferente do que construiu a reputação da empresa.

O sufixo Exp no nome indica versão experimental, o que enquadra o lançamento como teste de mercado antes de decisão sobre distribuição.
A corrida onde ela acontece
A disputa entre laboratório chinês e americano se dá hoje menos em capacidade máxima e mais em preço por token entregue. É nesse eixo que a DeepSeek vem pressionando, e é o que interessa a quem monta produto com margem apertada.
O que ainda não foi divulgado
- Preço por token do novo modelo
- Resultados em testes públicos de referência
- Se haverá versão com peso aberto
- Limites de contexto e de imagem por chamada


