Cinco modelos em sete dias: o que a semana entregou de barato e caro
Anthropic, Google e Poolside lançaram entre 29 de junho e 5 de julho; preço do Claude Sonnet 5 virou referência e a Poolside entrou com porta grátis.
O que aconteceu, em uma frase
Você abriu o painel da API nesta semana e viu cinco modelos novos aparecerem entre 29 de junho e 5 de julho. Três vieram da Anthropic e do Google — os dois times que brigam pelo topo do ranking — e dois vieram da Poolside, uma francesa que decidiu chamar atenção pelo preço, não pelo IQ.
O evento principal: Anthropic cortou o próprio Sonnet 5
O lançamento mais barulhento da semana foi o Claude Sonnet 5, no dia 30 de junho, a US$ 10 por milhão de tokens de saída. Parece caro até você comparar com o que a Anthropic cobrava antes pelo Sonnet 4 — e até olhar a tabela de IQ. O modelo entrou no catálogo com nota 55,261, segunda posição geral, atrás só do Claude Fable 5 (62,073). Em outras palavras: você está pagando caro, mas está pagando caro por algo que, hoje, é o segundo mais capaz do mercado.
A jogada esperta veio junto: no mesmo dia, a Anthropic publicou a versão batch do mesmo modelo, a US$ 5 por milhão de tokens. Batch significa que você entrega um lote de requisições e aceita esperar — não é para chat em tempo real, é para processar mil PDFs de madrugada, por exemplo. Quem pode esperar, paga a metade. Quem não pode, paga o dobro. Mesma inteligência, embalagem diferente.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-06-30 | Nano Banana 2 Lite (Gemini 3 | — | 1.5 | |
| 2026-06-30 | Claude Sonnet 5 | anthropic | 55.3 | 10 |
| 2026-06-30 | Claude Sonnet 5 (batch) | anthropic | — | 5 |
| 2026-07-02 | Laguna XS 2.1 | poolside | — | 0.12 |
| 2026-07-02 | Laguna XS 2.1 (free) | poolside | — | 0 |
O contraponto do Google: barato, mas sem nota ainda
No mesmo 30 de junho, o Google empurrou para o catálogo o Nano Banana 2 Lite, a US$ 1,50 por milhão de tokens de saída. O nome comercial esconde o que importa: é um Gemini 3.1 Flash focado em geração de imagem, com custo quase dez vezes menor que o Sonnet 5. A nota de IQ ainda não foi publicada — o catálogo só marca índice quando tem medição consolidada — então não dá para dizer se ele troca em qualidade com o Sonnet. Dá para dizer que, se o seu produto depende mais de gerar imagem do que de raciocinar, esta é a conta que você deveria estar fechando.
Para quem está montando pipeline multimodal hoje, a escolha ficou menos óbvia: até a semana passada, a referência era o Gemini 3.1 Pro Preview (IQ 47,738, a US$ 12). Agora há um Flash Lite Image a um oitavo do preço, com a ressalva de que ainda não tem nota pública.
Poolside: a francesa que entrou pela porta dos fundos
Em 2 de julho, a Poolside — criadora francesa, não americana nem chinesa — lançou o Laguna XS 2.1 a US$ 0,12 por milhão de tokens de saída, e uma variante gratuita no mesmo dia. É o menor preço da semana por uma margem absurda: custa menos de um centavo e meio por milhão de tokens, e a versão free literalmente zera a conta. O detalhe é que o índice de IQ não foi publicado para nenhum dos dois, então não há como comparar capacidade com o resto do catálogo.
Aqui está o que interessa: a Poolside não está brigando pelo topo da tabela de inteligência. Está brigando pelo volume de chamadas de quem está prototipando, testando prompt, ou queimando tokens em tarefas onde o modelo caro não se paga. Para um CTO de startup brasileira queimando US$ 300 por mês em experimentação, isso muda o cálculo. Para uma fintech que precisa de raciocínio confiável em produção, não muda nada.
O tabuleiro depois da semana
Cinco lançamentos em sete dias, mas o topo do ranking continua o mesmo: Claude Fable 5 na frente, Claude Sonnet 5 logo atrás, Z.ai GLM 5.2 em terceiro com IQ 52,641 e o melhor custo-benefício entre os fortes (US$ 3,036 por milhão de tokens de saída). O catálogo fechou a semana com 482 modelos listados, 62 criadores diferentes, e 23 novidades nos últimos 30 dias.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| Claude Sonnet 5 | 55.3 | 10 |
| GLM 5.2 | 52.6 | 3.036 |
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
E o preço? A semana registrou 32 mudanças de preço — 13 cortes e 14 aumentos. Ou seja: não é só barateza. Quem está comparando fatura precisa olhar para os dois lados, porque enquanto a Anthropic e a Poolside apertaram o preço em casos específicos, outros criadores fizeram o caminho oposto.
O que você faz com isso
Se você está rodando o Claude Sonnet 5 em produção e pode agendar o trabalho, migre as requisições não-interativas para o modo batch esta semana. Se o seu gargalo é gerar imagem e você está pagando caro por isso, teste o Nano Banana 2 Lite antes de renovar contrato. E se você está na fase de protótipo e o modelo não precisa ser brilhante, o Laguna XS 2.1 free existe justamente para isso — use até quebrar, e só então decida se precisa gastar.
Migre o que puder para batch, teste o Nano Banana 2 Lite em imagem e use o Laguna XS 2.1 free enquanto o modelo não precisar de nota alta — é a tríade que entrega economia imediata sem trocar de fornecedor.
Perguntas frequentes
Quanto custa o Claude Sonnet 5 em modo batch?
US$ 5 por milhão de tokens de saída, metade do preço da versão em tempo real (US$ 10). A diferença é que o batch aceita latência maior — você entrega um lote e coleta o resultado depois.
O Nano Banana 2 Lite tem nota de IQ publicada?
Não. O índice de IQ só aparece no catálogo quando há medição consolidada; até 5 de julho de 2026, o modelo entrou sem nota, então não há como comparar capacidade com o Gemini 3.1 Pro Preview ou com o Claude Sonnet 5.
Vale usar o Poolside Laguna XS 2.1 em produção?
Depende do que você chama de produção. Para protótipo, teste de prompt e tarefas onde o modelo caro não se paga, o preço de US$ 0,12 por milhão (ou a versão gratuita) é difícil de bater. Para fluxo com exigência de raciocínio consistente, a falta de IQ publicado impede a comparação — espere uma medição antes de comprometer receita.