o3 um ano depois: ainda vale pagar 23× o preço do Gemma 4 31B?
Veterano da OpenAI cobra US$ 8 por milhão de tokens de saída; o modelo de 30,7B do Google, lançado há doze dias, cobra US$ 0,34 e devolve a diferença em janela de contexto, multimodalidade e pesos abertos.
O abismo de preço que ninguém comenta
OpenAI o3: US$ 8 por milhão de tokens de saída. Google Gemma 4 31B: US$ 0,34. Mesmo milhão de tokens, diferença de 23,5×. É o tipo de número que precisa de contexto antes de virar preferência — e é exatamente esse o ponto deste comparativo.
Os dois rodam texto e imagem, ambos têm modo de raciocínio e foram desenhados para uso técnico. O o3 estreou em 16 de abril de 2025, quase um ano atrás. O Gemma 4 31B Instruct chegou em 2 de abril de 2026, há doze dias. Comparar um veterano com um recém-chegado que custa uma fração do preço é justo justamente porque a OpenAI ainda cobra tabela cheia — e você, que paga a fatura, precisa saber o que está levando.
A conta, em números reais
O o3 cobra US$ 2 por milhão de tokens de entrada e US$ 8 por milhão de saída, com cache a US$ 0,50. O Gemma 4 31B cobra US$ 0,09 de entrada, US$ 0,34 de saída e US$ 0,05 de cache. Traduzindo para a sua realidade: em 10 milhões de tokens de saída por mês, são US$ 80 no o3 e US$ 3,40 no Gemma 4. A diferença paga um almoço — ou a conta de API de outra startup inteira.
A conta piora para o o3 quando você olha a janela de contexto: 200 mil tokens contra 262 mil do Gemma 4, com a vantagem de o modelo do Google também aceitar vídeo. O o3 lê texto, imagem e arquivo; o Gemma 4 lê texto, imagem e vídeo.
Inteligência: o3 lidera, mas por pouco
O índice de inteligência da Artificial Analysis coloca o o3 em 31,096 e o Gemma 4 31B em 29,695. Diferença de 1,4 ponto, ou cerca de 4,7%. Para efeito de comparação, o topo do catálogo hoje está em 47,7 (Gemini 3.1 Pro Preview) e 45,5 (GPT-5.3-Codex). Nenhum dos dois é modelo de fronteira; os dois brigam pelo meio do pacote, onde 4,7% de QI raramente vale 23× o preço.
Onde o Gemma 4 compensa com folga é em coding: 43,431, contra dado não publicado do o3. Em agentic, 14,379, também sem par no recorte do OpenAI. Os números do Google vieram acompanhados; os da OpenAI vieram vazios — e o vazio, aqui, já diz alguma coisa.
Pesos abertos mudam a equação
| Critério | o3 | Gemma 4 31B |
|---|---|---|
| Índice de inteligência | 31.1 | 29.7 |
| Entrada US$/M | 2 | 0.09 |
| Saída US$/M | 8 | 0.34 |
| Contexto | 200k | 262k |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 109 | 35 |
| Índice de código | — | 43.4 |
| Índice agêntico | — | 14.4 |
O Gemma 4 31B é open weights, com 30,7 bilhões de parâmetros densos. Você baixa, roda local, hospeda em servidor próprio, faz fine-tune sem pedir licença. O o3 é API fechada — só pelo caminho da OpenAI, com a tabela de preços atual.
Para uma equipe que precisa de soberania sobre os dados, reprodutibilidade de inferência ou simplesmente quer cortar intermediários, o Gemma 4 não é "mais barato" — é um produto diferente. O o3, em troca, entrega velocidade: 108,93 tokens por segundo contra 35,06 do Gemma 4. Três vezes mais rápido, o que pesa em qualquer fluxo interativo onde o usuário fica esperando resposta.
Quem leva cada um
O o3 ganha quando a tarefa exige resposta em tempo real, a fatura cabe no orçamento e multimodalidade com vídeo não entra no escopo. Pense em IDE agêntico, ferramenta de código com latência baixa, geração rápida de textos longos em produção.
O Gemma 4 31B ganha quando a conta no fim do mês importa mais do que 4,7% de índice de inteligência, quando você quer rodar na sua infraestrutura, quando o input inclui vídeo, ou quando a janela maior de contexto ajuda. É o modelo certo para batch jobs, processamento massivo de documentos e qualquer cenário onde o volume de tokens é o vilão da fatura.
Se a pergunta é "qual modelo você contrata hoje", a resposta não está no QI: está na planilha.
Volume alto, vídeo no input ou inferência local vão para o Gemma 4 31B; latência baixa e ecossistema OpenAI continuam a favor do o3.
Perguntas frequentes
OpenAI o3 ainda vale a pena em 2026?
Vale, mas não é mais referência de fronteira. Ele fica abaixo do Gemini 3.1 Pro Preview e do GPT-5.3-Codex em inteligência, e a vantagem real hoje é velocidade (108,93 tok/s) e maturidade do ecossistema OpenAI.
Quanto custa o Gemma 4 31B comparado ao o3?
Para tokens de saída, US$ 0,34 contra US$ 8 por milhão — cerca de 23,5× mais barato. Entrada sai por US$ 0,09 contra US$ 2, e cache por US$ 0,05 contra US$ 0,50 por milhão de tokens.
O que significa open weights no Gemma 4 31B?
Significa que os 30,7 bilhões de parâmetros podem ser baixados e rodados localmente ou em servidor próprio, sem pagar por token ao provedor — uma alternativa real a depender da API da OpenAI.