FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Google soltou 7 modelos em 7 dias; o mais barato sai a US$ 0,34/M

A conta da API não caiu nesta semana, mas o piso de preço do catálogo mudou — o Gemma 4 31B a US$ 0,34/M redefine o que cabe no orçamento mensal.

Redação FalaVIP IA 4 min de leitura
US$ 0,34por milhão de tokens de saída do Gemma 4 31B
7modelos novos do Google na semana (de 13 no total)
US$ 12preço de saída do topo do catálogo (Gemini 3.1 Pro Preview)

Sete modelos novos do Google entraram no catálogo entre 30 de março e 5 de abril. É a maior ofensiva de um único criador em sete dias no histórico recente. E o mais barato do pacote, o Gemma 4 31B, sai a US$ 0,34 por milhão de tokens de saída.

A semana em que o Google decidiu jogar tudo de uma vez

No total, foram 13 modelos novos no catálogo entre 30 de março e 5 de abril. Sete vêm do Google. O restante se divide entre SpaceXAI (Grok 4.20 e a versão Multi-Agent), Arcee AI (Trinity Large Thinking e a versão free), Z.ai (GLM 5V Turbo) e Qwen (Qwen 3.6 Plus).

Lançamentos da semana por criador
google7x-ai2arcee-ai2z-ai1qwen1modelos

O movimento é claramente ofensivo. Nenhum criador mexeu no preço dos modelos já listados nesta semana — zero cortes, zero aumentos. O Google não tabelou nada de novo em termos de corte, mas soltou uma família inteira de variações em todos os tiers. Lyria 3 Clip Preview e Lyria 3 Pro Preview chegaram em 30 de março sem IQ e sem preço de saída em tokens: saem do padrão dos modelos de texto do catálogo. Já os Gemma 4 — nas variantes 31B e 26B A4B, com tiers pago, batch e free — entraram entre 2 e 3 de abril.

O destaque da semana é o Gemma 4 31B

Olha o número: IQ 29,695 a US$ 0,34 por milhão de tokens de saída. A diferença para o topo do catálogo hoje — o Gemini 3.1 Pro Preview, IQ 47,738 a US$ 12 por milhão — é de quase 35 vezes no preço, e de 18 pontos no índice de inteligência. O GPT-5.3-Codex está logo atrás (IQ 45,512, US$ 14 por milhão), e o Claude Sonnet 4.6 vem a US$ 15 por milhão com IQ 35,108.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 388 modelos disponíveis no catálogo nesta data.

Traduzindo: para muita tarefa de produção — classificar tickets, extrair campos de contrato, resumir logs, gerar descrições curtas —, o Gemma 4 31B entrega capacidade suficiente a um custo que muda a equação da fatura. É o mesmo patamar de preço que se pagava até pouco tempo atrás por modelos open-weight rodando local, só que sem o trabalho de manter a infraestrutura. Para raciocínio longo, planejamento multi-etapa e código complexo, o tier de US$ 12 a 15 segue sendo onde a fronteira mora.

O resto da semana não ficou parado

A SpaceXAI soltou o Grok 4.20 e a versão Multi-Agent em 31 de março, ambos a US$ 2,5 por milhão de tokens de saída. O índice de inteligência ainda não foi publicado pelo catálogo — então, por ora, você está pagando preço sem ter a métrica de capacidade para comparar com o resto. Vale aguardar o benchmark antes de colocar em rota crítica.

A Arcee AI apareceu com o Trinity Large Thinking (IQ 18,658, US$ 0,80 por milhão) e a versão free. É a aposta da casa em raciocínio explícito, com preço agressivo e capacidade abaixo do tier intermediário do Google. A Qwen trouxe o Qwen 3.6 Plus a US$ 1,95 por milhão, também sem IQ publicado. A Z.ai jogou o GLM 5V Turbo a US$ 4 por milhão — o "V" no nome costuma indicar foco em visão, então vale checar a documentação antes de colocar em pipeline multimodal.

Lançamentos entre 2026-03-30 e 2026-04-05
DataModeloCriadorInteligênciaSaída US$/M
2026-03-30Lyria 3 Clip Previewgoogle0
2026-03-30Lyria 3 Pro Previewgoogle0
2026-03-31Grok 4.20x-ai2.5
2026-03-31Grok 4.20 Multi-Agentx-ai2.5
2026-04-01Trinity Large Thinkingarcee-ai18.70.8
2026-04-01Trinity Large Thinking (freearcee-ai0
2026-04-01GLM 5V Turboz-ai4
2026-04-02Qwen3.6 Plusqwen1.95
2026-04-02Gemma 4 31B (batch)google0.97
2026-04-02Gemma 4 31Bgoogle29.70.34
2026-04-02Gemma 4 31B (free)google0
2026-04-03Gemma 4 26B A4B (free)google0
2026-04-03Gemma 4 26B A4B google26.10.34

O tabuleiro não mudou de lugar, só ganhou mais peças

Lê de novo o topo: Gemini 3.1 Pro Preview, GPT-5.3-Codex, Xiaomi MiMo-V2-Omni, Claude Sonnet 4.6, Qwen3.5 397B A17B. Os mesmos jogadores que estavam lá sete dias atrás, nas mesmas posições relativas. Nenhum deles mexeu no preço.

O que mudou foi a densidade do meio do catálogo. Antes, pagar US$ 1 a 2 por milhão já parecia barato. Agora, o piso do "barato com capacidade mensurável" caiu para US$ 0,34 — e o Google deu a versão free de quase tudo que lançou. O catálogo tem mais de 388 modelos hoje, vindos de 54 criadores diferentes. A escolha ficou maior, mas a régua de comparação também ficou mais óbvia.

Para quem essa semana muda a conta

Se você está rodando volume alto de tarefas simples, testa o Gemma 4 31B hoje. A relação IQ/preço é a melhor do catálogo no tier abaixo de US$ 1 por milhão. Se você precisa de raciocínio pesado, o tier de US$ 12 a 15 segue imbatível — e o Gemini 3.1 Pro Preview segue sendo o mais barato do topo. O Grok 4.20 vale acompanhar, mas sem IQ publicado é voto de confiança no fornecedor, não no benchmark.

Se você está pagando Claude Sonnet 4.6 a US$ 15 por milhão para fazer o que um modelo de IQ 30 resolve, a resposta para a pergunta "quando eu migro?" chegou nesta semana.

Em uma frase

Se você roda tarefas simples em volume, o Gemma 4 31B a US$ 0,34/M é o teste obrigatório desta semana — e a conta de API agradece antes do fim do mês.

Perguntas frequentes

Quanto custa o Gemma 4 31B por milhão de tokens?

Sai a US$ 0,34 por milhão de tokens de saída, com IQ 29,695 no índice do catálogo. É a melhor relação IQ/preço abaixo de US$ 1 por milhão hoje. Vale testar para tarefas de alto volume — classificação, extração, sumarização — antes de promover o tier de US$ 12-15 para qualquer coisa simples.

O que mudou no topo do mercado nesta semana?

Nada. Os cinco primeiros do índice continuam os mesmos de sete dias atrás: Gemini 3.1 Pro Preview, GPT-5.3-Codex, Xiaomi MiMo-V2-Omni, Claude Sonnet 4.6 e Qwen3.5 397B A17B. Nenhum corte, nenhum aumento de preço. O movimento da semana foi no meio do catálogo, não no topo.

Vale usar o Grok 4.20?

Depende. O preço de US$ 2,5 por milhão de tokens de saída é competitivo, mas o catálogo ainda não publicou o índice de inteligência do modelo. Por ora, é uma compra de marca, não de benchmark — espere o IQ sair antes de mover volume.

Leia também