Seed-2.0-Mini da ByteDance entra a US$ 0,40 por milhão de tokens de saída
Modelo multimodal de 256k de contexto chega mais barato que o MiMo-V2-Flash da Xiaomi e promete rivalizar com o Seed-1.6 — mas sem nota de inteligência publicada.
O preço que entra no catálogo HOJE
A ByteDance Seed colocou no catálogo um modelo multimodal com 256 mil tokens de contexto cobrando US$ 0,10 por milhão de tokens de entrada e US$ 0,40 por milhão de tokens de saída. Traduzindo o release: a ByteDance está dizendo que o Seed-2.0-Mini tem performance próxima da geração anterior (Seed-1.6) e foi pensado para cenários onde latência, concorrência e custo pesam mais do que a nota máxima de inteligência.
| Campo | Valor |
|---|---|
| Identificador | google/gemini-3.1-flash-image-preview |
| Criador | |
| Preço de entrada | US$ 0.500 / M tokens |
| Preço de saída | US$ 3.00 / M tokens |
| Janela de contexto | 66k |
| Modalidade | text+image->text+image |
O que ficou mais barato — e o que não mudou
A conta mais simples: para cada milhão de tokens que o modelo cospe na resposta, você paga quarenta centavos de dólar. Os modelos acima de IQ 45 do catálogo de hoje — Gemini 3.1 Pro Preview, da Google, e GPT-5.3-Codex, da OpenAI — custam US$ 12 e US$ 14 por milhão de tokens de saída, respectivamente. São 30× e 35× mais caros na saída.
Na entrada, o Seed-2.0-Mini também entra barato: US$ 0,10 por milhão. O catálogo não publicou preço de cache para esse modelo, então quem usava estratégia agressiva de cache prompt precisa testar antes de cravar economia.
Onde ele se encaixa no tabuleiro
O Seed-2.0-Mini chega num catálogo com 350 modelos listados, 52 criadores diferentes, e 25 lançamentos nos últimos 30 dias. Não é um lançamento isolado — é parte de uma enxurrada. O topo de inteligência hoje segue com Gemini 3.1 Pro Preview (IQ 47,7), GPT-5.3-Codex (IQ 45,5) e Claude Sonnet 4.6 (IQ 35,1).
O detalhe que pega: o Seed-2.0-Mini não tem nota de inteligência publicada no catálogo. Sem IQ, sem benchmark de coding, sem agentic, sem blended. Você não consegue colocar ele no gráfico de custo-benefício com os mesmos números dos rivais. É um modelo que entra pela porta do preço, não pela porta da capacidade mensurada.
Para quem vale — e para quem não muda nada
Vale repensar se você está usando Gemini 3.1 Pro Preview ou GPT-5.3-Codex para tarefas que não precisam daquela nota de IQ 47. Resumo de texto, classificação, extração, agentes de alto volume, atendimento — qualquer cenário onde o gargalo é a fatura e não a qualidade da resposta tem um candidato novo na mesa.
Não muda nada para quem precisa de benchmark auditado antes de colocar em produção crítica. Não muda nada para quem já roda MiMo-V2-Flash da Xiaomi (US$ 0,30 por milhão de tokens de saída, o modelo mais barato do topo de IQ atual). Não muda nada para quem usa Claude Sonnet 4.6 por contrato ou por preferência de estilo — o Seed-2.0-Mini não traz comparação direta publicada.
A implicação prática
A próxima vez que você for rotear uma chamada de API para um modelo caro, pergunta primeiro: essa tarefa precisa mesmo de IQ 45+? Se a resposta for não, o Seed-2.0-Mini acabou de entrar como uma das opções mais agressivas em preço no catálogo multimodal. Teste em sandbox, meça latência e qualidade no seu caso de uso, e só depois mova tráfego — porque sem benchmark público, a validação é sua.
Antes de pagar US$ 12 a US$ 14 por milhão de tokens de saída em modelos top de IQ, teste o Seed-2.0-Mini em tarefas de alto volume — mas valide qualidade no seu próprio caso, porque o catálogo não publicou nota de inteligência para ele.
Perguntas frequentes
Quanto custa o Seed-2.0-Mini da ByteDance?
US$ 0,10 por milhão de tokens de entrada e US$ 0,40 por milhão de tokens de saída. O catálogo não publicou preço de cache para esse modelo.
O Seed-2.0-Mini tem benchmark de inteligência?
Não. O modelo entrou no catálogo sem nota de IQ, sem benchmark de coding e sem agentic publicados. A avaliação de qualidade precisa ser feita no caso de uso específico.
Seed-2.0-Mini é multimodal?
Sim. A ficha indica modalidade texto+imagem+vídeo como entrada e texto como saída, com 256 mil tokens de contexto e quatro modos de esforço de raciocínio (minimal, low, medium, high).