Google soltou 7 modelos em 7 dias; o mais barato sai a US$ 0,34/M
A conta da API não caiu nesta semana, mas o piso de preço do catálogo mudou — o Gemma 4 31B a US$ 0,34/M redefine o que cabe no orçamento mensal.
Sete modelos novos do Google entraram no catálogo entre 30 de março e 5 de abril. É a maior ofensiva de um único criador em sete dias no histórico recente. E o mais barato do pacote, o Gemma 4 31B, sai a US$ 0,34 por milhão de tokens de saída.
A semana em que o Google decidiu jogar tudo de uma vez
No total, foram 13 modelos novos no catálogo entre 30 de março e 5 de abril. Sete vêm do Google. O restante se divide entre SpaceXAI (Grok 4.20 e a versão Multi-Agent), Arcee AI (Trinity Large Thinking e a versão free), Z.ai (GLM 5V Turbo) e Qwen (Qwen 3.6 Plus).
O movimento é claramente ofensivo. Nenhum criador mexeu no preço dos modelos já listados nesta semana — zero cortes, zero aumentos. O Google não tabelou nada de novo em termos de corte, mas soltou uma família inteira de variações em todos os tiers. Lyria 3 Clip Preview e Lyria 3 Pro Preview chegaram em 30 de março sem IQ e sem preço de saída em tokens: saem do padrão dos modelos de texto do catálogo. Já os Gemma 4 — nas variantes 31B e 26B A4B, com tiers pago, batch e free — entraram entre 2 e 3 de abril.
O destaque da semana é o Gemma 4 31B
Olha o número: IQ 29,695 a US$ 0,34 por milhão de tokens de saída. A diferença para o topo do catálogo hoje — o Gemini 3.1 Pro Preview, IQ 47,738 a US$ 12 por milhão — é de quase 35 vezes no preço, e de 18 pontos no índice de inteligência. O GPT-5.3-Codex está logo atrás (IQ 45,512, US$ 14 por milhão), e o Claude Sonnet 4.6 vem a US$ 15 por milhão com IQ 35,108.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
Traduzindo: para muita tarefa de produção — classificar tickets, extrair campos de contrato, resumir logs, gerar descrições curtas —, o Gemma 4 31B entrega capacidade suficiente a um custo que muda a equação da fatura. É o mesmo patamar de preço que se pagava até pouco tempo atrás por modelos open-weight rodando local, só que sem o trabalho de manter a infraestrutura. Para raciocínio longo, planejamento multi-etapa e código complexo, o tier de US$ 12 a 15 segue sendo onde a fronteira mora.
O resto da semana não ficou parado
A SpaceXAI soltou o Grok 4.20 e a versão Multi-Agent em 31 de março, ambos a US$ 2,5 por milhão de tokens de saída. O índice de inteligência ainda não foi publicado pelo catálogo — então, por ora, você está pagando preço sem ter a métrica de capacidade para comparar com o resto. Vale aguardar o benchmark antes de colocar em rota crítica.
A Arcee AI apareceu com o Trinity Large Thinking (IQ 18,658, US$ 0,80 por milhão) e a versão free. É a aposta da casa em raciocínio explícito, com preço agressivo e capacidade abaixo do tier intermediário do Google. A Qwen trouxe o Qwen 3.6 Plus a US$ 1,95 por milhão, também sem IQ publicado. A Z.ai jogou o GLM 5V Turbo a US$ 4 por milhão — o "V" no nome costuma indicar foco em visão, então vale checar a documentação antes de colocar em pipeline multimodal.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-03-30 | Lyria 3 Clip Preview | — | 0 | |
| 2026-03-30 | Lyria 3 Pro Preview | — | 0 | |
| 2026-03-31 | Grok 4.20 | x-ai | — | 2.5 |
| 2026-03-31 | Grok 4.20 Multi-Agent | x-ai | — | 2.5 |
| 2026-04-01 | Trinity Large Thinking | arcee-ai | 18.7 | 0.8 |
| 2026-04-01 | Trinity Large Thinking (free | arcee-ai | — | 0 |
| 2026-04-01 | GLM 5V Turbo | z-ai | — | 4 |
| 2026-04-02 | Qwen3.6 Plus | qwen | — | 1.95 |
| 2026-04-02 | Gemma 4 31B (batch) | — | 0.97 | |
| 2026-04-02 | Gemma 4 31B | 29.7 | 0.34 | |
| 2026-04-02 | Gemma 4 31B (free) | — | 0 | |
| 2026-04-03 | Gemma 4 26B A4B (free) | — | 0 | |
| 2026-04-03 | Gemma 4 26B A4B | 26.1 | 0.34 |
O tabuleiro não mudou de lugar, só ganhou mais peças
Lê de novo o topo: Gemini 3.1 Pro Preview, GPT-5.3-Codex, Xiaomi MiMo-V2-Omni, Claude Sonnet 4.6, Qwen3.5 397B A17B. Os mesmos jogadores que estavam lá sete dias atrás, nas mesmas posições relativas. Nenhum deles mexeu no preço.
O que mudou foi a densidade do meio do catálogo. Antes, pagar US$ 1 a 2 por milhão já parecia barato. Agora, o piso do "barato com capacidade mensurável" caiu para US$ 0,34 — e o Google deu a versão free de quase tudo que lançou. O catálogo tem mais de 388 modelos hoje, vindos de 54 criadores diferentes. A escolha ficou maior, mas a régua de comparação também ficou mais óbvia.
Para quem essa semana muda a conta
Se você está rodando volume alto de tarefas simples, testa o Gemma 4 31B hoje. A relação IQ/preço é a melhor do catálogo no tier abaixo de US$ 1 por milhão. Se você precisa de raciocínio pesado, o tier de US$ 12 a 15 segue imbatível — e o Gemini 3.1 Pro Preview segue sendo o mais barato do topo. O Grok 4.20 vale acompanhar, mas sem IQ publicado é voto de confiança no fornecedor, não no benchmark.
Se você está pagando Claude Sonnet 4.6 a US$ 15 por milhão para fazer o que um modelo de IQ 30 resolve, a resposta para a pergunta "quando eu migro?" chegou nesta semana.
Se você roda tarefas simples em volume, o Gemma 4 31B a US$ 0,34/M é o teste obrigatório desta semana — e a conta de API agradece antes do fim do mês.
Perguntas frequentes
Quanto custa o Gemma 4 31B por milhão de tokens?
Sai a US$ 0,34 por milhão de tokens de saída, com IQ 29,695 no índice do catálogo. É a melhor relação IQ/preço abaixo de US$ 1 por milhão hoje. Vale testar para tarefas de alto volume — classificação, extração, sumarização — antes de promover o tier de US$ 12-15 para qualquer coisa simples.
O que mudou no topo do mercado nesta semana?
Nada. Os cinco primeiros do índice continuam os mesmos de sete dias atrás: Gemini 3.1 Pro Preview, GPT-5.3-Codex, Xiaomi MiMo-V2-Omni, Claude Sonnet 4.6 e Qwen3.5 397B A17B. Nenhum corte, nenhum aumento de preço. O movimento da semana foi no meio do catálogo, não no topo.
Vale usar o Grok 4.20?
Depende. O preço de US$ 2,5 por milhão de tokens de saída é competitivo, mas o catálogo ainda não publicou o índice de inteligência do modelo. Por ora, é uma compra de marca, não de benchmark — espere o IQ sair antes de mover volume.