14 vezes mais barato, quase o dobro de inteligência: Maverick contra Command A
Em preço, contexto, multimodalidade e velocidade o modelo da Meta vence. O canadense só se sustenta onde a Cohere já é parte do stack.
A conta da API no fim do mês nunca mente. Para cada milhão de tokens que você gera, o Cohere Command A cobra US$ 10. O Meta Llama 4 Maverick cobra US$ 0,696. Para o mesmo volume de saída, a fatura da Cohere sai cerca de catorze vezes mais cara que a da Meta — sem o dobro de inteligência para compensar.
Do lado da entrada, a desproporção continua. O Maverick custa US$ 0,20 por milhão de tokens lidos; o Command A cobra US$ 2,50. Em uma aplicação que processa muito PDF, base de código ou transcrição antes de gerar, esse multiplicador de doze vezes vira a maior linha da sua invoice.
Inteligência medida, não prometida
No índice Artificial Analysis, o Llama 4 Maverick marca 14,477. O Command A marca 7,463 — pouco mais da metade. Em coding, o dado do Maverick é 16,277; o Command A não publicou valor para esse eixo no catálogo. Em agentic, 1,237 para o modelo da Meta; o dado do concorrente também não consta.
A leitura honesta do release da Cohere — "111B parâmetros focado em agentic, multilingual e coding" — é que focado não significa superior. Onde há dado comparável, o Maverick entrega mais. E ainda aceita imagem como entrada, coisa que o Command A não faz.
Um milhão de contexto é outro jogo
O Llama 4 Maverick aceita 1.048.576 tokens por requisição. O Command A trava em 256.000. Para quem joga um livro inteiro, a transcrição de uma semana de chamadas ou um repositório grande na janela do modelo, isso muda a arquitetura que você precisa montar do lado de fora.
Pense na diferença entre um carro que aguenta 600 km de tanque e outro que precisa parar a cada 150. Os dois rodam, mas só um te leva sem reabastecer no meio do caminho. O detalhe técnico é que o Maverick usa uma arquitetura mixture-of-experts: 17 bilhões de parâmetros ativos, 402 bilhões no total. Menos cálculo por token, mais janela pelo mesmo dinheiro.
| Critério | Llama 4 Maverick | Command A |
|---|---|---|
| Índice de inteligência | 14.5 | 7.5 |
| Entrada US$/M | 0.2 | 2.5 |
| Saída US$/M | 0.696 | 10 |
| Contexto | 1.05M | 256k |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 86 | 58 |
| Índice de código | 16.3 | — |
| Índice agêntico | 1.2 | — |
Velocidade que paga a conta duas vezes
O catálogo mede tokens por segundo. Maverick: 86,45. Command A: 58,44. Mais rápido e mais barato ao mesmo tempo — combinação rara. Para produtos sensíveis a latência, cada ponto a mais de velocidade significa resposta mais rápida e mais requisições por hora na mesma infraestrutura.
Para quem cada um faz sentido
Llama 4 Maverick ganha em quase todos os cenários mensuráveis — custo, inteligência bruta, contexto, multimodalidade, velocidade. Se sua empresa paga a fatura da API e roda volume, é a escolha direta. O bônus é que os pesos são abertos: dá para hospedar em infraestrutura própria se o orçamento apertar ainda mais.
Cohere Command A faz sentido em dois cenários específicos. O primeiro é exigência contratual de soberania de dados: a Cohere é canadense, e contratos públicos e financeiros no Canadá pedem fornecedor nacional. O segundo é equipe já integrada ao ecossistema Cohere — trocar tudo para economizar na geração é mais caro do que parece. Fora desses dois casos, pagar US$ 10 por milhão de tokens de saída para um modelo com metade da inteligência do concorrente é difícil de colocar na planilha.
Onde os dois ficam no tabuleiro
Nenhum dos dois está perto da fronteira. Em 24 de outubro de 2025, o topo do índice é do OpenAI o3, com 31,096, seguido do Claude Haiku 4.5, com 29,892. O catálogo tem 263 modelos; o Maverick e o Command A ocupam o meio do pacote — úteis, mas distantes dos líderes.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
Nos últimos 30 dias, 26 modelos novos entraram no catálogo. O cenário gira rápido. O que não muda é a conta: se você precisa de mais inteligência por dólar, o Maverick hoje é a referência entre os modelos de pesos abertos. O Command A continua sendo o carro-chefe da Cohere, mas o preço desse título subiu muito em relação à concorrência direta.
Se você paga a fatura da API, o Llama 4 Maverick vence em quase tudo; o Command A só se justifica em contratos canadenses de soberania de dados ou em stacks já integradas ao ecossistema Cohere.
Perguntas frequentes
Llama 4 Maverick ou Cohere Command A: qual é mais barato?
O Llama 4 Maverick, em uma margem grande. Cobra US$ 0,696 por milhão de tokens de saída, contra US$ 10 do Command A — cerca de catorze vezes menos. Na entrada, a diferença também é grande: US$ 0,20 contra US$ 2,50 por milhão.
Qual dos dois aceita imagem como entrada?
Apenas o Llama 4 Maverick. O modelo da Meta trabalha com texto e imagem gerando texto (modalidade text+image->text). O Command A é exclusivamente texto para texto.
Quanto de contexto cada modelo aguenta?
O Llama 4 Maverick aceita até 1.048.576 tokens por requisição, enquanto o Command A trava em 256.000 tokens — um quarto do tamanho do concorrente.