OCTO+

Teste de DeepSeek 80x mais barato usa quatro H200s

Uma consultoria alugou quatro GPUs Nvidia H200s para verificar a afirmação de que o DeepSeek V4.1 Flash é 80 vezes mais barato; testes no Japão e na Rússia most

03 de out., 13:30 6 fontes · 6 países Modelos Pesquisa
ModelosNVIDIADeepSeek
Servidores em um data center com luzes azuladas Foto: panumas nikhomkhai / Pexels

Segundo o Tom's Hardware, uma consultoria de call center alugou quatro GPUs Nvidia H200 por US$ 13.200 mensais para rodar o DeepSeek V4.1 Flash no ambiente do Claude Code e testar a afirmação de que o modelo seria 80 vezes mais barato que alternativas. A mesma matéria aponta que o aluguel dobrou a conta do Claude e que falhas de segurança mantiveram o código gerado offline.

Testes de código realizados no Japão

O Zenn descreveu experimentos comparando o DeepSeek V4.1 Flash e o GPT-6 Astra, ambos com limite de 4.096 tokens de saída e temperature zero. Na tarefa de arredondamento de números decimais, o DeepSeek retornou respostas vazias em ambas as execuções (27,35 segundos e 24,06 segundos), tendo atingido o limite de tokens, enquanto o GPT-6 Astra produziu o código correto em aproximadamente 9,16 segundos e 8,72 segundos.

Na tarefa de subtrair intervalos (remover intervalos ocupados de um intervalo maior), o DeepSeek acertou os 105 casos de teste na primeira tentativa, levando 17,53 segundos, mas na segunda rodada novamente retornou resposta vazia após consumir os 4.096 tokens (25,87 segundos). O GPT-6 Astra completou ambas as rodadas com respostas corretas em torno de 13,30 segundos e 12,28 segundos. O Zenn também informa que o cálculo dos intervalos consumiu quatro chamadas de API, totalizando 54 créditos de gateway, equivalente a nove ienes; incluindo chamadas preparatórias e de confirmação, o consumo foi de 363 créditos, ou 60,50 ienes, dentro de um orçamento de 2.700 ienes com reserva conservadora de 2.674 ienes.

Preço e desempenho segundo análise russa

O Habr apresentou uma tabela de custos por tarefa resolvida, não por token. Segundo essa análise, o DeepSeek V4.1 Flash tem custo de 27 centavos por tarefa e pontuação de 39 pontos; o DeepSeek V4 Pro custa 67 centavos por tarefa com 36 pontos. O GPT-6 Astra foi mencionado como custando US$ 3,26 por tarefa, sendo duas vezes mais barato que o Opus 5.5, enquanto o GPT-6.1 Sol tem custo de 72 centavos por tarefa e o GPT-6 Luna de sete centavos por tarefa. Entre os modelos mais caros ficam o Sonnet 5.5 (US$ 7,67 por tarefa), o Fable 5.1 (US$ 7,63) e o Opus 5.5 (US$ 5,98). O Habr enfatiza que a escolha de modelo deve levar em conta o custo por tarefa resolvida, pois modelos com preço semelhante por token podem apresentar custos por tarefa muito diferentes devido a diferenças na verbosidade da saída.

Apurado em 6 fontes

Tom's Hardware (Estados Unidos) · Zenn — tópicos IA e LLM (tech) (Japão) · Habr (Rússia)

ver as 6 fontes

Continue lendo

Receba sem abrir o site

no e-mail ou no WhatsApp · análises + plantão + resumo semanal · cancele com 1 clique
Pronto. A primeira edição chega no seu e-mail.

Assine GRÁTIS e cancele com 1 CLIQUE quando quiser. ;)