FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

14 vezes mais barato, quase o dobro de inteligência: Maverick contra Command A

Em preço, contexto, multimodalidade e velocidade o modelo da Meta vence. O canadense só se sustenta onde a Cohere já é parte do stack.

Redação FalaVIP IA 3 min de leitura
US$ 10 vs US$ 0,70por milhão de tokens de saída (Command A vs Maverick)
14,5 vs 7,5índice de inteligência (Maverick vs Command A)
1.048.576 vs 256.000tokens de contexto máximo

A conta da API no fim do mês nunca mente. Para cada milhão de tokens que você gera, o Cohere Command A cobra US$ 10. O Meta Llama 4 Maverick cobra US$ 0,696. Para o mesmo volume de saída, a fatura da Cohere sai cerca de catorze vezes mais cara que a da Meta — sem o dobro de inteligência para compensar.

Preço de saída (US$ por milhão de tokens)
Llama 4 Maverick0,696Command A10US$/M
Fonte: OpenRouter

Do lado da entrada, a desproporção continua. O Maverick custa US$ 0,20 por milhão de tokens lidos; o Command A cobra US$ 2,50. Em uma aplicação que processa muito PDF, base de código ou transcrição antes de gerar, esse multiplicador de doze vezes vira a maior linha da sua invoice.

Inteligência medida, não prometida

No índice Artificial Analysis, o Llama 4 Maverick marca 14,477. O Command A marca 7,463 — pouco mais da metade. Em coding, o dado do Maverick é 16,277; o Command A não publicou valor para esse eixo no catálogo. Em agentic, 1,237 para o modelo da Meta; o dado do concorrente também não consta.

Índice de inteligência (Artificial Analysis)
Llama 4 Maverick14,5Command A7,5índice
Fonte: Artificial Analysis

A leitura honesta do release da Cohere — "111B parâmetros focado em agentic, multilingual e coding" — é que focado não significa superior. Onde há dado comparável, o Maverick entrega mais. E ainda aceita imagem como entrada, coisa que o Command A não faz.

Um milhão de contexto é outro jogo

O Llama 4 Maverick aceita 1.048.576 tokens por requisição. O Command A trava em 256.000. Para quem joga um livro inteiro, a transcrição de uma semana de chamadas ou um repositório grande na janela do modelo, isso muda a arquitetura que você precisa montar do lado de fora.

Pense na diferença entre um carro que aguenta 600 km de tanque e outro que precisa parar a cada 150. Os dois rodam, mas só um te leva sem reabastecer no meio do caminho. O detalhe técnico é que o Maverick usa uma arquitetura mixture-of-experts: 17 bilhões de parâmetros ativos, 402 bilhões no total. Menos cálculo por token, mais janela pelo mesmo dinheiro.

Llama 4 Maverick × Command A
CritérioLlama 4 MaverickCommand A
Índice de inteligência14.57.5
Entrada US$/M0.22.5
Saída US$/M0.69610
Contexto1.05M256k
Pesos abertossimsim
Velocidade (tok/s)8658
Índice de código16.3
Índice agêntico1.2

Velocidade que paga a conta duas vezes

O catálogo mede tokens por segundo. Maverick: 86,45. Command A: 58,44. Mais rápido e mais barato ao mesmo tempo — combinação rara. Para produtos sensíveis a latência, cada ponto a mais de velocidade significa resposta mais rápida e mais requisições por hora na mesma infraestrutura.

Para quem cada um faz sentido

Llama 4 Maverick ganha em quase todos os cenários mensuráveis — custo, inteligência bruta, contexto, multimodalidade, velocidade. Se sua empresa paga a fatura da API e roda volume, é a escolha direta. O bônus é que os pesos são abertos: dá para hospedar em infraestrutura própria se o orçamento apertar ainda mais.

Cohere Command A faz sentido em dois cenários específicos. O primeiro é exigência contratual de soberania de dados: a Cohere é canadense, e contratos públicos e financeiros no Canadá pedem fornecedor nacional. O segundo é equipe já integrada ao ecossistema Cohere — trocar tudo para economizar na geração é mais caro do que parece. Fora desses dois casos, pagar US$ 10 por milhão de tokens de saída para um modelo com metade da inteligência do concorrente é difícil de colocar na planilha.

Onde os dois ficam no tabuleiro

Nenhum dos dois está perto da fronteira. Em 24 de outubro de 2025, o topo do índice é do OpenAI o3, com 31,096, seguido do Claude Haiku 4.5, com 29,892. O catálogo tem 263 modelos; o Maverick e o Command A ocupam o meio do pacote — úteis, mas distantes dos líderes.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 263 modelos disponíveis no catálogo nesta data.

Nos últimos 30 dias, 26 modelos novos entraram no catálogo. O cenário gira rápido. O que não muda é a conta: se você precisa de mais inteligência por dólar, o Maverick hoje é a referência entre os modelos de pesos abertos. O Command A continua sendo o carro-chefe da Cohere, mas o preço desse título subiu muito em relação à concorrência direta.

Em uma frase

Se você paga a fatura da API, o Llama 4 Maverick vence em quase tudo; o Command A só se justifica em contratos canadenses de soberania de dados ou em stacks já integradas ao ecossistema Cohere.

Perguntas frequentes

Llama 4 Maverick ou Cohere Command A: qual é mais barato?

O Llama 4 Maverick, em uma margem grande. Cobra US$ 0,696 por milhão de tokens de saída, contra US$ 10 do Command A — cerca de catorze vezes menos. Na entrada, a diferença também é grande: US$ 0,20 contra US$ 2,50 por milhão.

Qual dos dois aceita imagem como entrada?

Apenas o Llama 4 Maverick. O modelo da Meta trabalha com texto e imagem gerando texto (modalidade text+image->text). O Command A é exclusivamente texto para texto.

Quanto de contexto cada modelo aguenta?

O Llama 4 Maverick aceita até 1.048.576 tokens por requisição, enquanto o Command A trava em 256.000 tokens — um quarto do tamanho do concorrente.

Leia também