Thinking Machines lança Inkling Small a US$ 1,20 por milhão de tokens de saída
Modelo multimodal com 12B parâmetros ativos vem em três sabores: pago, batch e gratuito; nota de inteligência ainda não foi divulgada.
Você abre o painel da API, olha o extrato do mês e pensa: o output está comendo meu orçamento. Pois é. A Thinking Machines Lab resolveu colocar um modelo multimodal novo no mercado HOJE cobrando US$ 1,20 por milhão de tokens de saída — o mesmo preço de saída do MiniMax M3 e do GPT-5.6 Luna, que são duas das opções mais baratas do catálogo.
O que é o Inkling Small
Inkling Small é um mixture-of-experts com 12 bilhões de parâmetros ativos de um total de 276 bilhões, multimodal (aceita texto, imagem e áudio; devolve texto) e de pesos abertos. É o irmão menor de uma família que a Thinking Machines ainda não detalhou, e a descrição oficial o posiciona como a versão eficiente da linha. Traduzindo: você não está olhando para um flagship — está olhando para o carro de entrada da montadora, com a mesma plataforma multimodual, mas com o motor ajustado para rodar barato.
Três sabores no mesmo dia
A estratégia de lançamento lembra a de outras casas que tentam cobrir todo o espectro: saiu o Inkling Small em três variantes.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Inkling Small (free) | 0 | 0 | 1.05M |
| Inkling Small (batch) | 0.5 | 1.2 | 524k |
A versão paga padrão cobra US$ 0,45 por milhão de tokens de entrada e US$ 1,20 de saída, com janela de 1 milhão de tokens. O modo batch derruba a entrada para US$ 0,50, mantém a saída em US$ 1,20 e encolhe a janela para 524 mil tokens — e traz cache a US$ 0,10 por milhão, útil quando você repete o mesmo prompt longo em milhares de chamadas. E tem o Inkling Small grátis, com a janela grande do padrão e custo zero, só para testar.
A nota de inteligência
Aqui está o detalhe que incomoda. A Thinking Machines não publicou IQ, Coding, Agentic, Blended nem nada do índice da Artificial Analysis para o Inkling Small. Você consegue colocar o modelo na API, mas ainda não consegue comparar no mesmo gráfico com o Claude Opus 5, que lidera o catálogo com IQ 63,053, ou com o GPT-5.6 Sol, que marca 60,93. A régua está faltando.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
Então a pergunta de quem paga a conta é direta: vale pagar US$ 1,20 por milhão de saída num modelo sem benchmark público, quando dá pra pegar o GPT-5.6 Luna pelo mesmo preço com IQ 52,318 medido? Você só descobre testando, e isso tem custo — de tempo e de tokens.
Onde ele entra no tabuleiro
Olhando o catálogo HOJE, com mais de 525 modelos listados vindos de 66 criadores, o Inkling Small batch entra na faixa de preço do MiniMax M3 e do GPT-5.6 Luna. O Claude Opus 5, da Anthropic, cobra US$ 25 por milhão de saída — 21 vezes mais caro. Já o Claude Fable 5, também da Anthropic, salta para US$ 50. É outro planeta.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Inkling Small (o novo) | — | 0.45 | 1.2 | 1.05M |
| Claude Opus 5 | 63.1 | 5 | 25 | 1M |
| Claude Fable 5 | 62.1 | 10 | 50 | 1M |
| GPT-5.6 Sol | 60.9 | 2 | 10 | 1.05M |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
| GPT-5.6 Luna | 52.3 | 0.2 | 1.2 | 1.05M |
Mas preço não é tudo. O Opus 5 tem IQ 63,053; o Fable 5 tem 62,073. Se o Inkling Small chegar perto disso custando 1/40 do preço de saída, ele muda a conta. Se chegar perto do Luna, ele é só mais uma opção barata — útil, mas nada disruptivo.
Para quem vale e para quem não muda nada
Vale para você se está montando pipeline que engole muita imagem e áudio e precisa manter o custo de saída abaixo de US$ 1,50 por milhão. A versão batch com cache a US$ 0,10 é especialmente interessante para jobs em lote onde o mesmo contexto se repete.
Não muda nada para você se já está rodando com GPT-5.6 Luna ou MiniMax M3 e está satisfeito com o IQ medido. Sem benchmark público, trocar para o Inkling Small é um ato de fé — e a fatura não perdoa.
O que fazer agora
Espere a nota de inteligência aparecer antes de migrar produção. Enquanto isso, a versão grátis existe exatamente para você fazer um pilot sem colocar dinheiro: rode um conjunto representativo das suas tarefas, meça qualidade e só então decida se os US$ 0,45 de entrada e US$ 1,20 de saída valem a troca.
Só vale trocar do Luna ou do MiniMax M3 depois que a nota de inteligência do Inkling Small sair; até lá, use a versão grátis para testar.
Perguntas frequentes
Quanto custa o Thinking Machines Inkling Small?
A versão padrão custa US$ 0,45 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída. O modo batch custa US$ 0,50 de entrada e US$ 1,20 de saída, com cache a US$ 0,10. Há também uma versão gratuita com a mesma janela de 1 milhão de tokens.
O Inkling Small tem nota de inteligência publicada?
Não. Os índices de inteligência, coding e agentic ainda não foram divulgados pela Thinking Machines nem medidos de forma pública até a data deste artigo, então não dá para colocar o modelo no mesmo gráfico que o Claude Opus 5 ou o GPT-5.6 Sol.
Inkling Small é multimodal?
Sim. Aceita entradas de texto, imagem e áudio e devolve apenas texto. É um mixture-of-experts com 12 bilhões de parâmetros ativos de um total de 276 bilhões, segundo a descrição do criador.