Lançamentos
157 reportagens de lançamentos sobre modelos de inteligência artificial.
Thinking Machines lança Inkling com 975B; rivais entregam mais IQ por menos dinheiro
Modelo multimodal de pesos abertos da Thinking Machines chega com 975 bilhões de parâmetros e preço de US$ 4,05 por milhão de tokens de saída. Para a conta de API, há alternativas mais baratas que pontuam mais alto no índice de inteligência.
Thinking Machines lança Inkling de 975B; rivais a US$ 1,20 já ganham em IQ
Open-weights, multimodal e com 1M de contexto, o modelo entra no catálogo com cache a US$ 0,17 — mas a defesa do Inkling não é o preço da API.
Kimi K3 cobra US$ 15 por milhão de tokens — um terço do Claude Fable 5
Modelo aberto de 2,8T de parâmetros da MoonshotAI entra com IQ 59,7 e abre a briga com o GPT-5.6 Sol pela faixa de IQ 60.
GPT-5.6 Sol custa 5 vezes menos que o Claude Fable 5 e quase empata em inteligência
OpenAI soltou 11 variantes hoje; o flagship cobra US$ 10 por milhão de saída e fica a 1,1 ponto do topo do catálogo.
Grok 4.5 cobra US$ 6 por milhão de tokens e mira o topo da Anthropic
Modelo da SpaceXAI entra no catálogo com IQ 55,7 e preço de saída quase nove vezes menor que o Claude Fable 5, mas ainda acima de alternativas chinesas.
Tencent entra no jogo dos MoE com Hy3 a US$ 0,33 por milhão de saída
Modelo de 295B parâmetros com 21B ativos mira reasoning e agentes por uma fração do preço dos rivais americanos
Sonnet 5 chega a US$ 10 por milhão, um quinto do Fable 5
À frente do Gemini 3.1 Pro Preview em IQ e abaixo do Fable 5 no preço, o Sonnet 5 entra no catálogo com cache a US$ 0,20 o milhão de tokens.
Google cobra US$ 12 por milhão de tokens no novo Nano Banana Pro
Modelo de imagem topo de linha da Gemini 3 Pro chega ao catálogo pelo mesmo preço de saída do Gemini 3.1 Pro Preview e quatro vezes mais caro que o Nano Banana 2
Cohere lança North Mini Code grátis com 30B de parâmetros e abre a família North
Modelo de codificação agentic estreia com pesos abertos, contexto de 256 mil tokens e preço zero — mas o índice de inteligência fica bem abaixo dos concorrentes pagos.
GLM 5.2 da Z.ai chega a US$ 3 por milhão de saída e encosta nos grandes
Modelo chinês de 753 bilhões de parâmetros tem nota de inteligência 52,6 e custa quase 17 vezes menos que o Claude Fable 5 no token de saída.
OpenRouter lança Fusion e deixa o preço em branco no catálogo
A nova função não é um modelo — é uma camada que dispara vários em paralelo. A fatura, porém, continua imprevisível.
Claude Fable 5 chega a US$ 50 por milhão de saída e destrava 62 de IQ
Anthropic põe a família inteira no ar hoje; o flagship custa 4x o Gemini 3.5 Flash e entrega o dobro de inteligência no índice atual.
Claude Fable Latest cobra US$ 50 por milhão de saída e não traz nota de inteligência
Um alias para o Claude Fable 5 com a mesma janela de um milhão de tokens, mas sem benchmark publicado — e o preço de topo do catálogo
Nex AGI solta modelo de 397B grátis, mas IQ não entra no top 5
Versão gratuita do Nex-N2-Pro traz pesos abertos, multimodal e a maior nota de coding entre pesos abertos recentes. Para o topo de inteligência, o caminho segue em Gemini 3.1 Pro e GPT-5.3-Codex.
Nemotron 3 Ultra cobra US$ 2,40/M, mas perde em inteligência para rivais mais baratos
Modelo da NVIDIA chega com 55B ativos em MoE de 550B, pesos abertos e arquitetura Transformer-Mamba, mas o índice de inteligência de 38,319 fica quase 10 pontos abaixo do Gemini 3.1 Pro.
Qwen3.7 Plus cobra US$ 1,28 por milhão de saída — e fica fora do top 5
Lançamento da Alibaba entra no catálogo com preço baixo, mas índice de inteligência 6 pontos abaixo do líder e 8 abaixo do M3, da própria MiniMax.
MiniMax M3 chega ao top 4 cobrando 11 vezes menos que o GPT-5.3-Codex
Modelo chinês de 428 bilhões de parâmetros (23 bilhões ativos por inferência) entra com pesos abertos, multimodal e IQ 45,397 — e o que mais chama atenção na fatura é o US$ 1,20 por milhão de tokens de saída.
StepFun entra no catálogo com modelo de 196B a US$ 1,15 por milhão de tokens
Step 3.7 Flash é multimodal e tem pesos abertos, mas fica longe do topo de inteligência — e isso muda o cálculo de quem paga a API.
Qwen3.7 Max estreia a US$ 4,42 por milhão de saída sem índice de inteligência
Preço coloca o flagship da Alibaba entre o DeepSeek V4 Pro e o Gemini 3.5 Flash, mas a nota do Artificial Analysis ainda não foi divulgada — e isso muda o cálculo de quem escolhe modelo.
Gemini 3.5 Flash chega a US$ 9 por milhão, a 1 ponto do Pro
Multimodal, com 1 milhão de contexto e raciocínio habilitado. Dentro da casa da Google é o mais barato acima de IQ 45 — mas o DeepSeek V4 Pro cobra 5 vezes menos por IQ quase igual.