FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Thinking Machines lança Inkling Small a US$ 1,20 por milhão de tokens de saída

Modelo multimodal com 12B parâmetros ativos vem em três sabores: pago, batch e gratuito; nota de inteligência ainda não foi divulgada.

Redação FalaVIP IA 3 min de leitura
US$ 1,20por milhão de tokens de saída no Inkling Small
US$ 0,50por milhão de tokens de entrada
US$ 0,10por milhão de tokens com cache no modo batch

Você abre o painel da API, olha o extrato do mês e pensa: o output está comendo meu orçamento. Pois é. A Thinking Machines Lab resolveu colocar um modelo multimodal novo no mercado HOJE cobrando US$ 1,20 por milhão de tokens de saída — o mesmo preço de saída do MiniMax M3 e do GPT-5.6 Luna, que são duas das opções mais baratas do catálogo.

O que é o Inkling Small

Inkling Small é um mixture-of-experts com 12 bilhões de parâmetros ativos de um total de 276 bilhões, multimodal (aceita texto, imagem e áudio; devolve texto) e de pesos abertos. É o irmão menor de uma família que a Thinking Machines ainda não detalhou, e a descrição oficial o posiciona como a versão eficiente da linha. Traduzindo: você não está olhando para um flagship — está olhando para o carro de entrada da montadora, com a mesma plataforma multimodual, mas com o motor ajustado para rodar barato.

Preço de saída (US$ por milhão de tokens)
Inkling Small1,2Claude Opus 525Claude Fable 550GPT-5.6 Sol10MiniMax M31,2GPT-5.6 Luna1,2US$/M
Fonte: OpenRouter

Três sabores no mesmo dia

A estratégia de lançamento lembra a de outras casas que tentam cobrir todo o espectro: saiu o Inkling Small em três variantes.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Inkling Small (free)001.05M
Inkling Small (batch)0.51.2524k

A versão paga padrão cobra US$ 0,45 por milhão de tokens de entrada e US$ 1,20 de saída, com janela de 1 milhão de tokens. O modo batch derruba a entrada para US$ 0,50, mantém a saída em US$ 1,20 e encolhe a janela para 524 mil tokens — e traz cache a US$ 0,10 por milhão, útil quando você repete o mesmo prompt longo em milhares de chamadas. E tem o Inkling Small grátis, com a janela grande do padrão e custo zero, só para testar.

A nota de inteligência

Aqui está o detalhe que incomoda. A Thinking Machines não publicou IQ, Coding, Agentic, Blended nem nada do índice da Artificial Analysis para o Inkling Small. Você consegue colocar o modelo na API, mas ainda não consegue comparar no mesmo gráfico com o Claude Opus 5, que lidera o catálogo com IQ 63,053, ou com o GPT-5.6 Sol, que marca 60,93. A régua está faltando.

Índice de inteligência (Artificial Analysis)
Claude Opus 563,1Claude Fable 562,1GPT-5.6 Sol60,9MiniMax M345,4GPT-5.6 Luna52,3índice
Fonte: Artificial Analysis
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Entre os 525 modelos disponíveis no catálogo nesta data.

Então a pergunta de quem paga a conta é direta: vale pagar US$ 1,20 por milhão de saída num modelo sem benchmark público, quando dá pra pegar o GPT-5.6 Luna pelo mesmo preço com IQ 52,318 medido? Você só descobre testando, e isso tem custo — de tempo e de tokens.

Onde ele entra no tabuleiro

Olhando o catálogo HOJE, com mais de 525 modelos listados vindos de 66 criadores, o Inkling Small batch entra na faixa de preço do MiniMax M3 e do GPT-5.6 Luna. O Claude Opus 5, da Anthropic, cobra US$ 25 por milhão de saída — 21 vezes mais caro. Já o Claude Fable 5, também da Anthropic, salta para US$ 50. É outro planeta.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Inkling Small (o novo)0.451.21.05M
Claude Opus 563.15251M
Claude Fable 562.110501M
GPT-5.6 Sol60.92101.05M
MiniMax M345.40.31.21.05M
GPT-5.6 Luna52.30.21.21.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.
Inteligência × preço de saída
Claude Opus 5Claude Fable 5GPT-5.6 SolMiniMax M3GPT-5.6 LunaUS$ por milhão (saída, escala log)índice de inteligência

Mas preço não é tudo. O Opus 5 tem IQ 63,053; o Fable 5 tem 62,073. Se o Inkling Small chegar perto disso custando 1/40 do preço de saída, ele muda a conta. Se chegar perto do Luna, ele é só mais uma opção barata — útil, mas nada disruptivo.

Para quem vale e para quem não muda nada

Vale para você se está montando pipeline que engole muita imagem e áudio e precisa manter o custo de saída abaixo de US$ 1,50 por milhão. A versão batch com cache a US$ 0,10 é especialmente interessante para jobs em lote onde o mesmo contexto se repete.

Não muda nada para você se já está rodando com GPT-5.6 Luna ou MiniMax M3 e está satisfeito com o IQ medido. Sem benchmark público, trocar para o Inkling Small é um ato de fé — e a fatura não perdoa.

O que fazer agora

Espere a nota de inteligência aparecer antes de migrar produção. Enquanto isso, a versão grátis existe exatamente para você fazer um pilot sem colocar dinheiro: rode um conjunto representativo das suas tarefas, meça qualidade e só então decida se os US$ 0,45 de entrada e US$ 1,20 de saída valem a troca.

Em uma frase

Só vale trocar do Luna ou do MiniMax M3 depois que a nota de inteligência do Inkling Small sair; até lá, use a versão grátis para testar.

Perguntas frequentes

Quanto custa o Thinking Machines Inkling Small?

A versão padrão custa US$ 0,45 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída. O modo batch custa US$ 0,50 de entrada e US$ 1,20 de saída, com cache a US$ 0,10. Há também uma versão gratuita com a mesma janela de 1 milhão de tokens.

O Inkling Small tem nota de inteligência publicada?

Não. Os índices de inteligência, coding e agentic ainda não foram divulgados pela Thinking Machines nem medidos de forma pública até a data deste artigo, então não dá para colocar o modelo no mesmo gráfico que o Claude Opus 5 ou o GPT-5.6 Sol.

Inkling Small é multimodal?

Sim. Aceita entradas de texto, imagem e áudio e devolve apenas texto. É um mixture-of-experts com 12 bilhões de parâmetros ativos de um total de 276 bilhões, segundo a descrição do criador.

Leia também