FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Step 3.5 Flash entra pelo preço do topo, sem nota de IQ

StepFun traz foundation model open-source de 196B (11B ativos por token) a US$ 0,10/M de entrada — o mais barato entre modelos de 200k+ de contexto hoje.

Redação FalaVIP IA 3 min de leitura
US$ 0,30por milhão de tokens de saída
US$ 0,10por milhão de tokens de entrada
196B / 11Bparâmetros totais / ativos por token (MoE)

Step 3.5 Flash chegou hoje cobrando US$ 0,30 por milhão de tokens de saída. O mesmo valor que o Xiaomi MiMo-V2-Flash, atual nº 1 do índice de inteligência do catálogo. A diferença: a StepFun não publicou nota de inteligência para o modelo. Você está comprando um gato escaldado de 196 bilhões de parâmetros no escuro — e essa é a primeira coisa que vale entender antes de colocar na fila da API.

O preço de entrada que nenhum rival do topo oferece

A US$ 0,10 por milhão de tokens de entrada, o Step 3.5 Flash é o mais barato entre os modelos de 200k+ de contexto visíveis no topo do catálogo hoje. Para colocar em números: o OpenAI o3 cobra US$ 8 por milhão de tokens de saída. São cerca de 27 vezes mais. Em uma esteira de indexação de documentação ou sumarização em massa, essa diferença muda a conta no fim do mês.

Preço de saída (US$ por milhão de tokens)
Step 3.5 Flash0,3MiMo-V2-Flash0,3o38Claude Haiku 4.55US$/M
Fonte: OpenRouter

O que isso significa na prática: 100 milhões de tokens de saída por mês caem de US$ 800 para US$ 30. É o tipo de economia que justifica trocar de modelo sem mexer no resto do stack.

Sparse MoE em uma frase

Step 3.5 Flash é uma rede Mixture of Experts de 196 bilhões de parâmetros totais. Mas só 11 bilhões ficam ativos a cada token processado. Pense num restaurante com 196 cozinheiros: para cada pedido, só 11 entram na cozinha. O custo de rodar cai sem precisar treinar uma rede menor do zero — o preço de operação sai pelo de um modelo pequeno, com a capacidade total de um grande nos bastidores.

A janela de contexto é de 262.144 tokens. Dá para enfiar um repositório inteiro de código fonte ou um PDF de 800 páginas numa única chamada sem particionar.

Onde ele se encaixa no tabuleiro

Sem nota de IQ publicada, o comparativo de hoje é só de preço e contexto. Olhando para os três modelos que ocupam o topo do índice de inteligência:

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Step 3.5 Flash (o novo)0.10.3262k
MiMo-V2-Flash34.00.10.3262k
o331.128200k
Claude Haiku 4.529.915200k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A faixa de preço de saída (US$ 0,30) coloca o Step 3.5 Flash lado a lado com o Xiaomi MiMo-V2-Flash, que lidera com IQ 34,024. Mas sem nota de IQ para o Step, o gráfico de custo-benefício mostra exatamente o problema:

Inteligência × preço de saída
MiMo-V2-Flasho3Claude Haiku 4.5US$ por milhão (saída, escala log)índice de inteligência

O ponto aparece sem coordenada vertical. Pode ser que o IQ dele fique em 32 e ele entre no topo; pode ser que fique em 18 e ele perca até para o Devstral. Sem benchmark próprio rodado pela StepFun ou por quem está testando, não tem como saber.

Para quem vale, para quem não muda nada

Vale a pena testar agora se você:

  • Quer um foundation model open-source para rodar localmente ou em cloud privada
  • Precisa de contexto longo (262k) com o preço de entrada mais agressivo da categoria
  • Tem capacidade técnica de avaliar o modelo no próprio workload antes de comprometer produção
  • Está comparando alternativas ao gpt-oss-120b (US$ 0,17/M de saída) com orçamento folgado para experimentar

Não muda nada se você:

  • Compra por índice de inteligência externo e não roda benchmark próprio
  • Precisa de SLA, suporte comercial ou latência garantida pelo catálogo
  • Opera em volume tão pequeno que a economia de US$ 0,07 por milhão na entrada não cobre o trabalho de migrar
Ficha técnica — Step 3.5 Flash
CampoValor
Identificadorstepfun/step-3.5-flash
Criadorstepfun
Preço de entradaUS$ 0.100 / M tokens
Preço de saídaUS$ 0.300 / M tokens
Janela de contexto262k
Modalidadetext->text

O que fazer na prática

A jogada sensata é tratar o Step 3.5 Flash como candidato à fila do fine-tuning ou de workloads onde há avaliação interna. Em produção direta, sem nota de IQ, ele fica atrás do MiMo-V2-Flash e do o3 no ranking — até rodar o benchmark de cada um. O custo de experimentação é baixo: a US$ 0,10 por milhão de tokens de entrada, dá para estressar o modelo com os piores prompts sem chegar perto dos US$ 1.

Em uma frase

Trate o Step 3.5 Flash como candidato a fine-tuning ou a workloads com avaliação interna: a US$ 0,10/M de entrada dá para estressar sem gastar quase nada, mas sem nota de IQ publicada ele não entra no ranking até você medir no seu próprio caso.

Perguntas frequentes

Step 3.5 Flash é mais barato que o OpenAI o3?

Sim, e muito. O o3 cobra US$ 8 por milhão de tokens de saída; o Step 3.5 Flash cobra US$ 0,30 — cerca de 27 vezes menos. A entrada do Step também é mais agressiva, a US$ 0,10 por milhão.

Step 3.5 Flash tem nota de inteligência publicada?

Não. O catálogo não trouxe IQ, score de código nem de agente para o modelo, então não dá para colocá-lo na régua do Xiaomi MiMo-V2-Flash (34,024), do OpenAI o3 (31,096) ou do Claude Haiku 4.5 (29,892) sem rodar benchmark próprio.

O que é a arquitetura MoE do Step 3.5 Flash?

É uma rede Mixture of Experts de 196 bilhões de parâmetros que ativa apenas 11 bilhões por token processado. A ideia é despachar só os especialistas necessários para cada entrada — o custo de operação fica parecido com o de um modelo pequeno, com a capacidade total de um grande nos bastidores.

Leia também