Três lançamentos em 48 horas: o que saiu e a que preço
A xAI abriu o Grok 4.5 em 8 de julho posicionando-o como o modelo de codificação e tarefas agênticas mais barato entre os modelos de ponta. O preço de $2,00 por milhão de tokens de entrada e $6,00 por milhão de saída está cerca de 3 vezes abaixo do Claude Opus 4.8 ($5/$25) e em linha com Claude Sonnet. A janela de contexto é de 500 mil tokens, e o modelo serve 80 tokens por segundo — velocidade relevante para pipelines de agentes.
No dia seguinte, 9 de julho, Meta e OpenAI chegaram quase simultaneamente. A Meta lançou o Muse Spark 1.1 e, pela primeira vez na história da empresa, cobrou pelos seus modelos via API. A precificação — $1,25 input / $4,25 output por milhão de tokens — é agressiva: fica cerca de 4 vezes mais barata que o Opus 4.8 e oferece um token de entrada em cache a $0,15, o que pode ser decisivo para aplicações com prompts de sistema longos ou RAG.
A OpenAI completou o trio com a disponibilidade geral do GPT-5.6, que chegou como família de três modelos: Sol (raciocínio pesado, $5/$30), Terra (qualidade GPT-5.5 pela metade do preço) e Luna (velocidade e custo baixo para volume). O ChatGPT adotou o Sol como padrão.
Comparativo de preços: o novo piso do mercado
Colocar os números lado a lado torna o impacto mais claro. Há seis meses, rodar um modelo de ponta via API custava entre $5 e $15 por milhão de tokens de entrada. Agora há três opções capazes de competir em benchmarks de topo por $1,25 a $5.
A tabela abaixo consolida os preços de API por milhão de tokens dos modelos relevantes disponíveis hoje.
| Modelo | Input ($/1M tokens) | Output ($/1M tokens) | Contexto |
|---|---|---|---|
| GPT-5.6 Sol (OpenAI) | $5,00 | $30,00 | n/d |
| GPT-5.6 Terra (OpenAI) | ~$2,50 | ~$15,00 | n/d |
| Claude Opus 4.8 (Anthropic) | $5,00 | $25,00 | 200K |
| Claude Sonnet 4.6 (Anthropic) | $2,00 | $10,00 | 200K |
| Grok 4.5 (xAI) | $2,00 | $6,00 | 500K |
| Meta Muse Spark 1.1 (Meta) | $1,25 | $4,25 | 1M |
Benchmarks: preço barato com desempenho de ponta?
O Grok 4.5 acerta 83,3% no Terminal-Bench 2.1 e 64,7% no SWE-Bench Pro — benchmark padrão do setor para avaliação de código. Mais relevante ainda: segundo a xAI, o modelo resolve uma tarefa média do SWE-Bench Pro usando cerca de 15.954 tokens de saída, contra 67.020 do Opus 4.8 em modo máximo. Isso significa que o custo real por tarefa resolvida é muito menor do que a tabela de preços sugere à primeira vista.
O Meta Muse Spark 1.1 é descrito como modelo multimodal com orquestração nativa de agentes primários e subagentes, contexto de 1 milhão de tokens autogerenciado e desempenho que rivaliza com GPT-5.5 e Opus 4.8 em avaliações agnósticas, segundo dados da Artificial Analysis. A ressalva importante: o acesso público está em preview e restrito a desenvolvedores nos EUA — quem estiver no Brasil entra numa lista de espera.
O GPT-5.6 Sol registrou 91,91% no Terminal-Bench 2.1 em modo ultra, número que coloca o modelo acima de qualquer outro publicado até agora no benchmark. O Sol passou a ser o padrão do ChatGPT, o que significa que usuários do plano Plus já estão interagindo com ele.
O que muda para quem desenvolve com IA no Brasil
Para desenvolvedores e empresas brasileiras, o cenário mistura boas e más notícias. A redução de custo por token é real e significativa — quem usa modelos de ponta em pipelines de produção pode revisar contratos e estimativas com folga. A queda de custo já é válida para Grok 4.5 e GPT-5.6, disponíveis globalmente via API.
O ponto de atenção está no Meta Muse Spark 1.1: o acesso público ainda é restrito aos EUA. Empresas brasileiras interessadas podem entrar na lista de espera diretamente na Meta Developer Platform, mas sem prazo confirmado para abertura global.
O câmbio, como sempre, permanece o multiplicador que nenhum corte de preço em dólar elimina completamente. Com o dólar acima de R$ 5,50, rodar o Grok 4.5 a $6/1M tokens de saída ainda representa custo relevante em reais para volumes altos. Mesmo assim, a queda de 60-80% em relação ao patamar anterior é uma mudança estrutural — não apenas uma promoção.
Contexto: por que julho de 2026 ficará marcado
Três grandes labs lançando modelos competitivos em menos de dois dias úteis não é coincidência — é pressão mútua. A xAI veio primeiro com preço baixo e benchmark de código forte. A Meta respondeu com precificação ainda mais agressiva e contexto de 1 milhão de tokens. A OpenAI fechou o ciclo com uma família que separa casos de uso (raciocínio pesado vs. velocidade vs. custo).
O efeito colateral positivo para o mercado é que o 'piso de qualidade' subiu: o que custava $15/1M tokens há seis meses, hoje custa $2-4. Para startups e agências que usam IA como infraestrutura, isso pode mudar o modelo de negócio — tanto em viabilidade de produtos quanto em margem.
Perguntas frequentes
O Grok 4.5 está disponível para desenvolvedores brasileiros?
Quando o Meta Muse Spark 1.1 estará disponível no Brasil?
Qual é a diferença entre GPT-5.6 Sol, Terra e Luna?
Esses novos preços de API afetam o custo do ChatGPT Plus para usuários finais?
- xAI lança Grok 4.5 com foco em codificação e preço agressivo
- Grok 4.5: benchmarks, preços e janela de contexto
- Meta cobra pela API do Muse Spark 1.1 com preço abaixo dos concorrentes
- Meta Muse Spark 1.1: guia do desenvolvedor, benchmarks e API
- GPT-5.6 Sol: benchmarks e preços
- Muse Spark 1.1 — Artificial Analysis Intelligence Index
Leia também
Grok vs ChatGPT: o que muda na prática em 2026?
Grok da xAI tem acesso ao X em tempo real e tom mais direto. ChatGPT tem ecossistema maior e melhor para código. Comparamos os dois ponto a ponto para você decidir.
Ler →
DeepSeek vs ChatGPT: qual IA escolher?
DeepSeek ou ChatGPT? Compare capacidades, preços, privacidade e casos de uso reais. Descubra qual modelo se encaixa melhor no seu contexto.
Ler →
Claude vs ChatGPT: qual é melhor em 2026?
Comparativo direto entre Claude (Anthropic) e ChatGPT (OpenAI) em 2026: escrita, código, raciocínio, preço e quando usar cada um.
Ler →