tech & talk
IA22 de ago. de 2026, 07:10

DeepSeek lança modelo que processa 1 milhão de palavras por US$ 0,87

A versão experimental V4-Flash-Vision-Exp venceu o Claude Opus 4.8 em 3 de 11 testes internos, mas perdeu nos outros 8. Os números são da própria DeepSeek e não foram verificados por terceiros.

Por Marina Sato · Repórter de IA

Compartilhar

Um milhão de palavras por menos de US$ 1

A DeepSeek lançou, em 21 de agosto, o V4-Flash-Vision-Exp. É uma versão experimental do V4-Flash, agora com leitura de imagens além de texto. O apelo é o preço: processar um milhão de palavras custa cerca de US$ 0,87, segundo a empresa chinesa.

A API cobra US$ 0,22 por milhão de tokens de entrada e US$ 0,66 por milhão de tokens de saída. Ler uma imagem consome até 384 tokens, após redimensionamento automático — sem cobrança extra por isso.

Onde bate o Opus 4.8, e onde não bate

A DeepSeek divulgou resultados em 11 benchmarks comparando o novo modelo ao Claude Opus 4.8, da Anthropic. O V4-Flash-Vision-Exp venceu em três.

No Agents' Last Exam, marcou 27,3 contra 25,7 do Opus 4.8. No ZeroBench (Pass@5), ficou em 35,0 contra 34,0. Nos outros oito testes, perdeu. No NL2Repo, a diferença foi grande: 57,7 a 69,7. No Terminal Bench 2.1, 83,9 a 85,0. No ApexBench (Pass@1), 36,5 a 39,4.

Um detalhe pesa contra a comparação direta: os números saíram de avaliação interna da própria DeepSeek, rodada em modo simplificado ("Harness Minimal Mode"). Não houve checagem independente até a publicação desta matéria.

Arquitetura enxuta

O modelo usa mistura de especialistas: 284 bilhões de parâmetros no total, mas só 13 bilhões ativos por consulta. É esse desenho que permite o preço baixo — outros modelos ocidentais de porte comparável cobram valores bem mais altos pelo mesmo volume de processamento, segundo comparações de mercado.

O V4-Flash-Vision-Exp está disponível apenas via API da DeepSeek. Diferente de outros lançamentos da empresa, não há pesos abertos para rodar localmente.

O que falta responder

Os números de desempenho vieram de teste interno, sem auditoria externa. Falta saber se avaliações independentes confirmam a vantagem nos três benchmarks — e se a Anthropic vai responder com ajuste de preço ou um novo modelo.

deepseekclaude opusanthropicmodelos multimodaiscusto de ia
Compartilhar