FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Cinco modelos em sete dias: o que a semana entregou de barato e caro

Anthropic, Google e Poolside lançaram entre 29 de junho e 5 de julho; preço do Claude Sonnet 5 virou referência e a Poolside entrou com porta grátis.

Redação FalaVIP IA 4 min de leitura
US$ 5por milhão de tokens de saída do Claude Sonnet 5 em modo batch
US$ 1,50por milhão de tokens de saída do Nano Banana 2 Lite
US$ 0,12por milhão de tokens de saída do Poolside Laguna XS 2.1

O que aconteceu, em uma frase

Você abriu o painel da API nesta semana e viu cinco modelos novos aparecerem entre 29 de junho e 5 de julho. Três vieram da Anthropic e do Google — os dois times que brigam pelo topo do ranking — e dois vieram da Poolside, uma francesa que decidiu chamar atenção pelo preço, não pelo IQ.

O evento principal: Anthropic cortou o próprio Sonnet 5

O lançamento mais barulhento da semana foi o Claude Sonnet 5, no dia 30 de junho, a US$ 10 por milhão de tokens de saída. Parece caro até você comparar com o que a Anthropic cobrava antes pelo Sonnet 4 — e até olhar a tabela de IQ. O modelo entrou no catálogo com nota 55,261, segunda posição geral, atrás só do Claude Fable 5 (62,073). Em outras palavras: você está pagando caro, mas está pagando caro por algo que, hoje, é o segundo mais capaz do mercado.

A jogada esperta veio junto: no mesmo dia, a Anthropic publicou a versão batch do mesmo modelo, a US$ 5 por milhão de tokens. Batch significa que você entrega um lote de requisições e aceita esperar — não é para chat em tempo real, é para processar mil PDFs de madrugada, por exemplo. Quem pode esperar, paga a metade. Quem não pode, paga o dobro. Mesma inteligência, embalagem diferente.

Lançamentos entre 2026-06-29 e 2026-07-05
DataModeloCriadorInteligênciaSaída US$/M
2026-06-30Nano Banana 2 Lite (Gemini 3google1.5
2026-06-30Claude Sonnet 5anthropic55.310
2026-06-30Claude Sonnet 5 (batch)anthropic5
2026-07-02Laguna XS 2.1poolside0.12
2026-07-02Laguna XS 2.1 (free)poolside0

O contraponto do Google: barato, mas sem nota ainda

No mesmo 30 de junho, o Google empurrou para o catálogo o Nano Banana 2 Lite, a US$ 1,50 por milhão de tokens de saída. O nome comercial esconde o que importa: é um Gemini 3.1 Flash focado em geração de imagem, com custo quase dez vezes menor que o Sonnet 5. A nota de IQ ainda não foi publicada — o catálogo só marca índice quando tem medição consolidada — então não dá para dizer se ele troca em qualidade com o Sonnet. Dá para dizer que, se o seu produto depende mais de gerar imagem do que de raciocinar, esta é a conta que você deveria estar fechando.

Para quem está montando pipeline multimodal hoje, a escolha ficou menos óbvia: até a semana passada, a referência era o Gemini 3.1 Pro Preview (IQ 47,738, a US$ 12). Agora há um Flash Lite Image a um oitavo do preço, com a ressalva de que ainda não tem nota pública.

Poolside: a francesa que entrou pela porta dos fundos

Em 2 de julho, a Poolside — criadora francesa, não americana nem chinesa — lançou o Laguna XS 2.1 a US$ 0,12 por milhão de tokens de saída, e uma variante gratuita no mesmo dia. É o menor preço da semana por uma margem absurda: custa menos de um centavo e meio por milhão de tokens, e a versão free literalmente zera a conta. O detalhe é que o índice de IQ não foi publicado para nenhum dos dois, então não há como comparar capacidade com o resto do catálogo.

Lançamentos da semana por criador
anthropic2poolside2google1modelos

Aqui está o que interessa: a Poolside não está brigando pelo topo da tabela de inteligência. Está brigando pelo volume de chamadas de quem está prototipando, testando prompt, ou queimando tokens em tarefas onde o modelo caro não se paga. Para um CTO de startup brasileira queimando US$ 300 por mês em experimentação, isso muda o cálculo. Para uma fintech que precisa de raciocínio confiável em produção, não muda nada.

O tabuleiro depois da semana

Cinco lançamentos em sete dias, mas o topo do ranking continua o mesmo: Claude Fable 5 na frente, Claude Sonnet 5 logo atrás, Z.ai GLM 5.2 em terceiro com IQ 52,641 e o melhor custo-benefício entre os fortes (US$ 3,036 por milhão de tokens de saída). O catálogo fechou a semana com 482 modelos listados, 62 criadores diferentes, e 23 novidades nos últimos 30 dias.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
Claude Sonnet 555.310
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
Entre os 482 modelos disponíveis no catálogo nesta data.

E o preço? A semana registrou 32 mudanças de preço — 13 cortes e 14 aumentos. Ou seja: não é só barateza. Quem está comparando fatura precisa olhar para os dois lados, porque enquanto a Anthropic e a Poolside apertaram o preço em casos específicos, outros criadores fizeram o caminho oposto.

O que você faz com isso

Se você está rodando o Claude Sonnet 5 em produção e pode agendar o trabalho, migre as requisições não-interativas para o modo batch esta semana. Se o seu gargalo é gerar imagem e você está pagando caro por isso, teste o Nano Banana 2 Lite antes de renovar contrato. E se você está na fase de protótipo e o modelo não precisa ser brilhante, o Laguna XS 2.1 free existe justamente para isso — use até quebrar, e só então decida se precisa gastar.

Em uma frase

Migre o que puder para batch, teste o Nano Banana 2 Lite em imagem e use o Laguna XS 2.1 free enquanto o modelo não precisar de nota alta — é a tríade que entrega economia imediata sem trocar de fornecedor.

Perguntas frequentes

Quanto custa o Claude Sonnet 5 em modo batch?

US$ 5 por milhão de tokens de saída, metade do preço da versão em tempo real (US$ 10). A diferença é que o batch aceita latência maior — você entrega um lote e coleta o resultado depois.

O Nano Banana 2 Lite tem nota de IQ publicada?

Não. O índice de IQ só aparece no catálogo quando há medição consolidada; até 5 de julho de 2026, o modelo entrou sem nota, então não há como comparar capacidade com o Gemini 3.1 Pro Preview ou com o Claude Sonnet 5.

Vale usar o Poolside Laguna XS 2.1 em produção?

Depende do que você chama de produção. Para protótipo, teste de prompt e tarefas onde o modelo caro não se paga, o preço de US$ 0,12 por milhão (ou a versão gratuita) é difícil de bater. Para fluxo com exigência de raciocínio consistente, a falta de IQ publicado impede a comparação — espere uma medição antes de comprometer receita.

Leia também