FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2025-11

59 reportagens neste mês.

Lançamentos

Gemini 3 Pro Image Preview chega a US$ 12 por milhão de saída

Google coloca no catálogo o Nano Banana Pro, herdeiro do modelo de imagem viral, com preço de texto e contexto de 65k — sem índice de inteligência divulgado.

Análise

Grok 4.1 Fast custa metade do Claude Haiku 4.5

xAI entra na briga dos modelos agentic com 2 milhões de contexto e preço de commodity — mas sem nota de inteligência medida.

Lançamentos

Grok 4.1 Fast custa 16 vezes menos que o3 por token de saída

xAI entra no catálogo com modelo agente a US$ 0,50/M de saída e 2M de contexto, mas o índice de inteligência ainda não foi medido

Análise

Amazon Nova Premier cobra 31 vezes mais que o Nemotron e entrega IQ quase igual

Comparativo frente a frente entre dois modelos lançados em outubro de 2025 mostra que o preço, e não a capacidade, decide a escolha.

Análise

GPT-5.1 custa US$ 10 por milhão e ainda não tem nota de inteligência

Cinco dias após o lançamento, o modelo topo de linha da OpenAI segue sem índice publicado no catálogo — e cobra US$ 2 a mais por milhão de saída do que o o3, que lidera a régua.

Análise

GPT-5.1 batch custou US$ 4,40 por milhão de saída — vale o que sobra da fila?

A OpenAI oferece o modelo top em modo assíncrono a um quinto do preço cheio, mas só se você aceitar esperar e não medir inteligência.

Análise

Qwen3 Next 80B custa 9% do Nemotron 70B e responde quase 4x mais rápido

Dois modelos abertos, preços em ordens de grandeza diferentes e uma escolha que cabe no bolso de quem paga a API.

Retrospectiva

OpenAI despejou cinco GPT-5.1 em três dias e ninguém falou em corte de preço

A semana foi da OpenAI: cinco variantes do GPT-5.1, um modelo da Deep Cogito e zero mudanças de tabela — o que isso diz sobre a estratégia da empresa.

Análise

GPT-5.1 Chat cobra US$ 10 por milhão de saída: vale o troco contra o3?

Três dias após o lançamento, o Instant da nova família da OpenAI ainda não tem índice de inteligência publicado — e isso muda quem deveria cogitá-lo.

Análise

Qwen3 Next 80B Instruct cobra 9× menos que Command A e entrega quase o dobro de inteligência

Mesmo com 3 bilhões de parâmetros ativos contra 111 bilhões do rival canadense, o modelo chinês vence em IQ, velocidade e preço por token de saída.

Análise

GPT-5.1-Codex cobra US$ 10 por milhão de saída: vale para quem?

Versão focada em código da OpenAI estreia com janela de 400 mil tokens e preço oito vezes maior que o do o3, que lidera o ranking de inteligência.

Análise

Qwen3 Next 80B A3B cobra 7x mais que Nemotron Nano 9B V2

Dois modelos abertos lançados com seis dias de diferença em setembro. Qwen tem quase 60% mais inteligência e cobra US$ 1,10 por milhão na saída; Nemotron cobra US$ 0,16 e tem modo raciocínio nativo.

Análise

GPT-5.1-Codex-Mini: 4× mais barato que o3, mas sem QI no catálogo

Lançado ontem pela OpenAI, o modelo menor da linha Codex cobra US$ 0,03 por milhão em cache hit. O catálogo ainda não tem nota de inteligência, score de código ou índice agentic para ele.

Lançamentos

Cogito v2.1 671B a US$ 1,25/M: o que o marketing não entrega

O catálogo não publicou índice de inteligência para o modelo. O preço, simétrico e abaixo do Haiku 4.5 e do o3, já está tabelado.

Lançamentos

OpenAI lança GPT-5.1-Codex a US$ 10 por milhão de tokens de saída

Versão especializada em código estreia ao mesmo preço do GPT-5.1 padrão e mais cara que o o3, seu rival interno de raciocínio.

Análise

1 milhão de tokens não impressiona mais — o que importa agora é o preço

No recorte de janelas longas, Scout cobra US$ 0,30 e Nova Premier, US$ 12,50 por milhão de tokens de saída — mesma janela, preços 41 vezes diferentes.

Análise

Qwen3 Next 80B Instruct custa quase o dobro do Nemotron Nano 12B VL — mas entrega 56% mais IQ

Comparativo frente a frente entre dois modelos abertos lançados em menos de 60 dias: quem ganha em texto puro, quem ganha em multimodal, e por que a conta da API não fecha sozinha.

Análise

ERNIE 4.5 cobra 64% mais caro na entrada e ainda perde em IQ

Os dois modelos chineses cobram US$ 1,10 por milhão de tokens de saída. A diferença mora no que entra — e o índice de inteligência também não ajuda a Baidu.

Análise

Pesos abertos já respondem por 15 dos 270 modelos do catálogo — e o mais barato custa US$ 0,13

OpenAI, Meta, Qwen e NVIDIA disputam um nicho que saiu da promessa e entrou na conta da API.

Análise

Qwen3 Next 80B custa 64% menos que Llama 3.3 70B na saída

Dois modelos abertos, preços e inteligências bem diferentes — e a conta de API não mente.

← anteriores página 2 de 3 próximas →