DeepSeek V4 Flash free: o que o preço zero esconde
Modelo gratuito da DeepSeek tem 1M de contexto e 284B de parâmetros, mas o catálogo não publica benchmark. Para quem ele serve — e quando fugir.
53 modelos em 30 dias, e um deles é grátis
O catálogo fechou esta semana com 443 modelos de 61 criadores diferentes. Nos últimos 30 dias, 53 foram lançados — um ritmo que não dá tempo de testar tudo. Um deles se destaca por um motivo que desenvolvedores adoram e gestores de orçamento veneram: custa zero. O DeepSeek V4 Flash (free) está no ar desde 24 de abril e traz especificações que, no papel, parecem um presente — 1 milhão de tokens de contexto, 284 bilhões de parâmetros totais, 13 bilhões ativados por passagem. Arquitetura Mixture-of-Experts, otimizada para inferência rápida.
| Campo | Valor |
|---|---|
| Identificador | deepseek/deepseek-v4-flash |
| Criador | deepseek |
| Preço de entrada | US$ 0.089 / M tokens |
| Preço de saída | US$ 0.177 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text->text |
| Leitura de cache | US$ 0.018 / M (80% de desconto) |
Mas "no papel" é a palavra-chave aqui.
O detalhe que o preço zero esconde
O V4 Flash free entra no catálogo sem nota de IQ, sem benchmark de coding, sem agentic, sem blended. Zero. Para um modelo com 284B de parâmetros totais, essa ausência pesa. Não é que o modelo seja ruim — é que ninguém te deu evidência pública de que ele é bom. Em um catálogo onde o DeepSeek V4 Pro pago marca IQ 45,268 e o Gemini 3.1 Pro Preview marca 47,738, o silêncio sobre o irmão gratuito é um dado em si. Você está comprando no escuro.
O que "free" costuma custar de verdade
Modelos gratuitos em catálogos de API não são caridade. São três coisas, geralmente ao mesmo tempo: isca para adoção, laboratório de teste em produção e, com frequência, alvo de deprecation silenciosa. Você não tem SLA, não tem rate limit documentado de forma estável, e não tem garantia de que o modelo continua disponível daqui a seis meses. Está trocando dinheiro por risco operacional. Em workloads de prototipagem, é uma troca justa. Em produção crítica, é uma aposta que pode quebrar o produto.
O irmão pago que define o preço da categoria
Se você quer a mesma família com números publicados, o DeepSeek V4 Pro é hoje a referência. É o modelo mais barato do catálogo inteiro acima de IQ 45: US$ 1,74 por milhão de tokens de saída. Compare com os vizinhos: Gemini 3.1 Pro Preview a US$ 12 e GPT-5.3 Codex a US$ 14. A diferença é de 7 a 8 vezes. Para a maioria dos workloads que precisam de qualidade alta, o V4 Pro é o custo-base da categoria — e o fato de vir da mesma criadora do Flash free dá uma dica do que o gratuito provavelmente entrega em termos de qualidade.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
Quando o Flash free é a melhor escolha
Três cenários onde o custo zero vence a ausência de benchmark:
- Prototipagem e exploração: você está validando uma ideia e não quer queimar caixa antes de saber se funciona.
- Volume alto, valor unitário baixo: classificação em lote, sumarização de documentos longos, RAG sobre base interna onde o custo por chamada multiplica no fim do mês.
- Ensino, demos e provas de conceito: quando o objetivo é mostrar o que dá para fazer, não garantir SLA ou continuidade.
Nesses casos, o Flash free é a porta de entrada certa — e o fato de ter 1M de contexto ajuda em workloads de documentos longos.
Quando ele não entra
Produção com SLA, código complexo, decisões automatizadas onde a resposta errada tem custo real. Se você precisa provar que o modelo acertou — para auditoria, cliente ou compliance —, um modelo sem benchmark publicado não te dá esse papel. E se você já roda o V4 Pro a US$ 1,74/M, a economia de trocar pelo free só compensa em escala muito alta, onde o custo marginal pesa mais que a diferença de qualidade medida.
O que fazer agora
Comece pelo free para mapear o terreno. Meça a qualidade com seu próprio eval set antes de colocar em produção. E se o workload depender de continuidade, trate "free" como experimento, não como infraestrutura. O V4 Pro pago segue sendo o melhor custo-benefício da casa para quem precisa de IQ acima de 45 — e, por tabela, a régua contra a qual o Flash free deveria ser comparado quando (ou se) a DeepSeek publicar benchmarks dele.
Use o Flash free para prototipar e processar volume em escala; quando precisar de qualidade medida e SLA, pague os US$ 1,74/M do V4 Pro, que segue sendo o melhor custo-benefício da casa acima de IQ 45.
Perguntas frequentes
O DeepSeek V4 Flash free é realmente grátis?
Sim, o catálogo lista US$ 0 por milhão de tokens de entrada e saída. O custo real é a ausência de SLA, rate limits instáveis e risco de deprecation sem aviso — você troca dinheiro por risco operacional.
Qual a diferença entre o V4 Flash free e o V4 Pro pago?
O V4 Pro tem IQ 45,268 publicado e custa US$ 1,74 por milhão de tokens de saída. O Flash free não tem benchmark publicado e custa zero. Vêm da mesma criadora, mas o Pro é o modelo que a casa usa para se posicionar no topo.
Quando NÃO usar o V4 Flash free?
Em produção crítica, código complexo ou qualquer fluxo onde você precisa provar a qualidade da resposta com benchmark público. Para esses casos, o V4 Pro pago entrega evidência e continuidade por US$ 1,74/M de saída.