Step 3.5 Flash entra pelo preço do topo, sem nota de IQ
StepFun traz foundation model open-source de 196B (11B ativos por token) a US$ 0,10/M de entrada — o mais barato entre modelos de 200k+ de contexto hoje.
Step 3.5 Flash chegou hoje cobrando US$ 0,30 por milhão de tokens de saída. O mesmo valor que o Xiaomi MiMo-V2-Flash, atual nº 1 do índice de inteligência do catálogo. A diferença: a StepFun não publicou nota de inteligência para o modelo. Você está comprando um gato escaldado de 196 bilhões de parâmetros no escuro — e essa é a primeira coisa que vale entender antes de colocar na fila da API.
O preço de entrada que nenhum rival do topo oferece
A US$ 0,10 por milhão de tokens de entrada, o Step 3.5 Flash é o mais barato entre os modelos de 200k+ de contexto visíveis no topo do catálogo hoje. Para colocar em números: o OpenAI o3 cobra US$ 8 por milhão de tokens de saída. São cerca de 27 vezes mais. Em uma esteira de indexação de documentação ou sumarização em massa, essa diferença muda a conta no fim do mês.
O que isso significa na prática: 100 milhões de tokens de saída por mês caem de US$ 800 para US$ 30. É o tipo de economia que justifica trocar de modelo sem mexer no resto do stack.
Sparse MoE em uma frase
Step 3.5 Flash é uma rede Mixture of Experts de 196 bilhões de parâmetros totais. Mas só 11 bilhões ficam ativos a cada token processado. Pense num restaurante com 196 cozinheiros: para cada pedido, só 11 entram na cozinha. O custo de rodar cai sem precisar treinar uma rede menor do zero — o preço de operação sai pelo de um modelo pequeno, com a capacidade total de um grande nos bastidores.
A janela de contexto é de 262.144 tokens. Dá para enfiar um repositório inteiro de código fonte ou um PDF de 800 páginas numa única chamada sem particionar.
Onde ele se encaixa no tabuleiro
Sem nota de IQ publicada, o comparativo de hoje é só de preço e contexto. Olhando para os três modelos que ocupam o topo do índice de inteligência:
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Step 3.5 Flash (o novo) | — | 0.1 | 0.3 | 262k |
| MiMo-V2-Flash | 34.0 | 0.1 | 0.3 | 262k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
A faixa de preço de saída (US$ 0,30) coloca o Step 3.5 Flash lado a lado com o Xiaomi MiMo-V2-Flash, que lidera com IQ 34,024. Mas sem nota de IQ para o Step, o gráfico de custo-benefício mostra exatamente o problema:
O ponto aparece sem coordenada vertical. Pode ser que o IQ dele fique em 32 e ele entre no topo; pode ser que fique em 18 e ele perca até para o Devstral. Sem benchmark próprio rodado pela StepFun ou por quem está testando, não tem como saber.
Para quem vale, para quem não muda nada
Vale a pena testar agora se você:
- Quer um foundation model open-source para rodar localmente ou em cloud privada
- Precisa de contexto longo (262k) com o preço de entrada mais agressivo da categoria
- Tem capacidade técnica de avaliar o modelo no próprio workload antes de comprometer produção
- Está comparando alternativas ao gpt-oss-120b (US$ 0,17/M de saída) com orçamento folgado para experimentar
Não muda nada se você:
- Compra por índice de inteligência externo e não roda benchmark próprio
- Precisa de SLA, suporte comercial ou latência garantida pelo catálogo
- Opera em volume tão pequeno que a economia de US$ 0,07 por milhão na entrada não cobre o trabalho de migrar
| Campo | Valor |
|---|---|
| Identificador | stepfun/step-3.5-flash |
| Criador | stepfun |
| Preço de entrada | US$ 0.100 / M tokens |
| Preço de saída | US$ 0.300 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text->text |
O que fazer na prática
A jogada sensata é tratar o Step 3.5 Flash como candidato à fila do fine-tuning ou de workloads onde há avaliação interna. Em produção direta, sem nota de IQ, ele fica atrás do MiMo-V2-Flash e do o3 no ranking — até rodar o benchmark de cada um. O custo de experimentação é baixo: a US$ 0,10 por milhão de tokens de entrada, dá para estressar o modelo com os piores prompts sem chegar perto dos US$ 1.
Trate o Step 3.5 Flash como candidato a fine-tuning ou a workloads com avaliação interna: a US$ 0,10/M de entrada dá para estressar sem gastar quase nada, mas sem nota de IQ publicada ele não entra no ranking até você medir no seu próprio caso.
Perguntas frequentes
Step 3.5 Flash é mais barato que o OpenAI o3?
Sim, e muito. O o3 cobra US$ 8 por milhão de tokens de saída; o Step 3.5 Flash cobra US$ 0,30 — cerca de 27 vezes menos. A entrada do Step também é mais agressiva, a US$ 0,10 por milhão.
Step 3.5 Flash tem nota de inteligência publicada?
Não. O catálogo não trouxe IQ, score de código nem de agente para o modelo, então não dá para colocá-lo na régua do Xiaomi MiMo-V2-Flash (34,024), do OpenAI o3 (31,096) ou do Claude Haiku 4.5 (29,892) sem rodar benchmark próprio.
O que é a arquitetura MoE do Step 3.5 Flash?
É uma rede Mixture of Experts de 196 bilhões de parâmetros que ativa apenas 11 bilhões por token processado. A ideia é despachar só os especialistas necessários para cada entrada — o custo de operação fica parecido com o de um modelo pequeno, com a capacidade total de um grande nos bastidores.