FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

DeepSeek V4 Flash free: o que o preço zero esconde

Modelo gratuito da DeepSeek tem 1M de contexto e 284B de parâmetros, mas o catálogo não publica benchmark. Para quem ele serve — e quando fugir.

Redação FalaVIP IA 3 min de leitura
US$ 0por milhão de tokens de entrada e saída
1.048.576tokens de contexto (1M)
US$ 1,74custo do V4 Pro pago por milhão de tokens de saída

53 modelos em 30 dias, e um deles é grátis

O catálogo fechou esta semana com 443 modelos de 61 criadores diferentes. Nos últimos 30 dias, 53 foram lançados — um ritmo que não dá tempo de testar tudo. Um deles se destaca por um motivo que desenvolvedores adoram e gestores de orçamento veneram: custa zero. O DeepSeek V4 Flash (free) está no ar desde 24 de abril e traz especificações que, no papel, parecem um presente — 1 milhão de tokens de contexto, 284 bilhões de parâmetros totais, 13 bilhões ativados por passagem. Arquitetura Mixture-of-Experts, otimizada para inferência rápida.

Ficha técnica — DeepSeek V4 Flash 0423
CampoValor
Identificadordeepseek/deepseek-v4-flash
Criadordeepseek
Preço de entradaUS$ 0.089 / M tokens
Preço de saídaUS$ 0.177 / M tokens
Janela de contexto1.05M
Modalidadetext->text
Leitura de cacheUS$ 0.018 / M (80% de desconto)

Mas "no papel" é a palavra-chave aqui.

O detalhe que o preço zero esconde

O V4 Flash free entra no catálogo sem nota de IQ, sem benchmark de coding, sem agentic, sem blended. Zero. Para um modelo com 284B de parâmetros totais, essa ausência pesa. Não é que o modelo seja ruim — é que ninguém te deu evidência pública de que ele é bom. Em um catálogo onde o DeepSeek V4 Pro pago marca IQ 45,268 e o Gemini 3.1 Pro Preview marca 47,738, o silêncio sobre o irmão gratuito é um dado em si. Você está comprando no escuro.

O que "free" costuma custar de verdade

Modelos gratuitos em catálogos de API não são caridade. São três coisas, geralmente ao mesmo tempo: isca para adoção, laboratório de teste em produção e, com frequência, alvo de deprecation silenciosa. Você não tem SLA, não tem rate limit documentado de forma estável, e não tem garantia de que o modelo continua disponível daqui a seis meses. Está trocando dinheiro por risco operacional. Em workloads de prototipagem, é uma troca justa. Em produção crítica, é uma aposta que pode quebrar o produto.

O irmão pago que define o preço da categoria

Se você quer a mesma família com números publicados, o DeepSeek V4 Pro é hoje a referência. É o modelo mais barato do catálogo inteiro acima de IQ 45: US$ 1,74 por milhão de tokens de saída. Compare com os vizinhos: Gemini 3.1 Pro Preview a US$ 12 e GPT-5.3 Codex a US$ 14. A diferença é de 7 a 8 vezes. Para a maioria dos workloads que precisam de qualidade alta, o V4 Pro é o custo-base da categoria — e o fato de vir da mesma criadora do Flash free dá uma dica do que o gratuito provavelmente entrega em termos de qualidade.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 443 modelos disponíveis no catálogo nesta data.

Quando o Flash free é a melhor escolha

Três cenários onde o custo zero vence a ausência de benchmark:

  • Prototipagem e exploração: você está validando uma ideia e não quer queimar caixa antes de saber se funciona.
  • Volume alto, valor unitário baixo: classificação em lote, sumarização de documentos longos, RAG sobre base interna onde o custo por chamada multiplica no fim do mês.
  • Ensino, demos e provas de conceito: quando o objetivo é mostrar o que dá para fazer, não garantir SLA ou continuidade.

Nesses casos, o Flash free é a porta de entrada certa — e o fato de ter 1M de contexto ajuda em workloads de documentos longos.

Quando ele não entra

Produção com SLA, código complexo, decisões automatizadas onde a resposta errada tem custo real. Se você precisa provar que o modelo acertou — para auditoria, cliente ou compliance —, um modelo sem benchmark publicado não te dá esse papel. E se você já roda o V4 Pro a US$ 1,74/M, a economia de trocar pelo free só compensa em escala muito alta, onde o custo marginal pesa mais que a diferença de qualidade medida.

O que fazer agora

Comece pelo free para mapear o terreno. Meça a qualidade com seu próprio eval set antes de colocar em produção. E se o workload depender de continuidade, trate "free" como experimento, não como infraestrutura. O V4 Pro pago segue sendo o melhor custo-benefício da casa para quem precisa de IQ acima de 45 — e, por tabela, a régua contra a qual o Flash free deveria ser comparado quando (ou se) a DeepSeek publicar benchmarks dele.

Em uma frase

Use o Flash free para prototipar e processar volume em escala; quando precisar de qualidade medida e SLA, pague os US$ 1,74/M do V4 Pro, que segue sendo o melhor custo-benefício da casa acima de IQ 45.

Perguntas frequentes

O DeepSeek V4 Flash free é realmente grátis?

Sim, o catálogo lista US$ 0 por milhão de tokens de entrada e saída. O custo real é a ausência de SLA, rate limits instáveis e risco de deprecation sem aviso — você troca dinheiro por risco operacional.

Qual a diferença entre o V4 Flash free e o V4 Pro pago?

O V4 Pro tem IQ 45,268 publicado e custa US$ 1,74 por milhão de tokens de saída. O Flash free não tem benchmark publicado e custa zero. Vêm da mesma criadora, mas o Pro é o modelo que a casa usa para se posicionar no topo.

Quando NÃO usar o V4 Flash free?

Em produção crítica, código complexo ou qualquer fluxo onde você precisa provar a qualidade da resposta com benchmark público. Para esses casos, o V4 Pro pago entrega evidência e continuidade por US$ 1,74/M de saída.

Leia também