Seed-2.0-Lite da ByteDance custa um sexto do Gemini Pro
Modelo multimodal de 262 mil tokens entra no catálogo a US$ 0,25 por milhão de entrada — mas sem índice de inteligência publicado, a comparação com o topo da tabela fica em outra moeda.
Você está olhando para a fatura da API e quer saber se vale trocar o modelo padrão por algo que entrou no catálogo há 12 dias. A resposta curta: depende do que você está rodando, e o Seed-2.0-Lite da ByteDance expõe isso com clareza incomodo.
O preço é o argumento
O Seed-2.0-Lite cobra US$ 0,25 por milhão de tokens de entrada e US$ 2 por milhão de tokens de saída. Coloque isso do lado do que lidera o topo do catálogo hoje: o Google Gemini 3.1 Pro Preview sai a US$ 12 por milhão de tokens de saída. São seis vezes mais caro para gerar a mesma resposta. A diferença não é margem de negociação, é outra ordem de grandeza.
| Campo | Valor |
|---|---|
| Identificador | bytedance-seed/seed-2.0-lite |
| Criador | bytedance-seed |
| Preço de entrada | US$ 0.250 / M tokens |
| Preço de saída | US$ 2.00 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image+video->text |
Para quem processa volume — sumarização de logs, classificação de tickets, extração de dados em documentos longos, pipelines de RAG — esse múltiplo muda a conta no fim do mês. Não muda a arquitetura.
O que o Seed-2.0-Lite entrega de fato
A ficha técnica divulgada pela ByteDance aponta um modelo multimodal: aceita texto, imagem e vídeo, devolve texto. A janela de contexto é de 262.144 tokens, o que coloca o modelo no mesmo clube de modelos que digerem livros inteiros ou vídeos longos sem precisar quebrar o arquivo. A descrição oficial o chama de "workhorse" corporativo — tradução: foi pensado para rodar em produção, não para ganhar benchmark.
O catálogo não publicou índice de inteligência para este modelo. Isso é importante: significa que não dá para colocá-lo na régua do topo da tabela e dizer "ele é X% mais burro que o Gemini". Você está comprando no escuro em capacidade cognitiva e no claro em custo.
Onde ele se encaixa no tabuleiro
Olhando o topo de inteligência do catálogo nesta data, a fotografia é outra. O Gemini 3.1 Pro Preview lidera com 47,7, seguido do GPT-5.3-Codex da OpenAI com 45,5. O Claude Sonnet 4.6 da Anthropic aparece em 35,1, e o Qwen3.5 397B da Alibaba em 34,2. O Seed-2.0-Lite não tem nota — então não está nessa régua.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
A comparação útil não é Seed contra Gemini em inteligência. É Seed contra Gemini em custo por tarefa. Se a sua tarefa é "extrair campos de uma nota fiscal em PDF e jogar num JSON", você provavelmente não precisa do modelo mais inteligente do catálogo. Precisa de um modelo multimodal barato que não invente campo. É nesse nicho que o Seed-2.0-Lite entra.
Para quem vale a troca
Vale se você está rodando hoje um modelo premium em tarefas que não exigem raciocínio de fronteira — classificação, extração, reformulação, tradução, sumarização de documentos longos. A economia de seis vezes no token de saída se traduz direto em fatura menor, especialmente em workloads com muito output.
Vale também se multimodalidade nativa importa e você está pagando caro por isso em outro fornecedor. Aceitar imagem e vídeo na mesma chamada, sem orquestrar dois modelos, simplifica o pipeline e corta latência.
Para quem não muda nada
Não muda nada se o seu gargalo é qualidade de raciocínio: código complexo, planejamento multi-etapa, análise jurídica ou médica, geração criativa longa. Nesses casos, sem índice de inteligência publicado, você está apostando — e o histórico mostra que o topo da régua costuma custar caro por um motivo.
Também não muda nada se você já tem um contrato enterprise com desconto agressivo. A conta de API pública raramente é o que uma empresa grande paga de verdade.
E não muda nada se você precisa de cache de prompt publicado — o catálogo não traz valor para o Seed-2.0-Lite nesse campo, o que significa que você não consegue precificar o desconto em chamadas repetitivas.
O teste que você deveria rodar hoje
Pegue o seu caso de uso mais caro em produção — provavelmente é extração ou classificação em volume. Rode 1.000 amostras no Seed-2.0-Lite e 1.000 no seu modelo atual. Meça qualidade com a métrica que importa para o seu negócio, não com benchmark genérico. Meure custo. Aí você decide se seis vezes mais barato compensa a diferença de qualidade que aparecer — ou não aparecer.
Teste o Seed-2.0-Lite nas tarefas de alto volume e baixa exigência cognitiva antes de migrar qualquer workload crítico — o ganho de custo é real, mas a ausência de índice de inteligência publicado impede comparar com o topo da régua.
Perguntas frequentes
Quanto custa o Seed-2.0-Lite da ByteDance?
O catálogo lista US$ 0,25 por milhão de tokens de entrada e US$ 2 por milhão de tokens de saída. O preço de cache de prompt não foi publicado pela ByteDance neste modelo.
O Seed-2.0-Lite é multimodal?
Sim. Aceita texto, imagem e vídeo como entrada e devolve texto. A janela de contexto é de 262.144 tokens, suficiente para documentos e vídeos longos sem fragmentação.
O Seed-2.0-Lite tem índice de inteligência publicado?
Não. O catálogo não traz nota de inteligência, coding, agentic nem blended para este modelo, então não dá para colocá-lo na mesma régua do Gemini 3.1 Pro Preview ou do GPT-5.3-Codex.