Blogs

Review do Grok 4.5 (2026): Benchmarks, Preços e Guia da API

14 July 2026  ·  Atualizado 31 July 2026

Gabriel Caetano

Gabriel Caetano

INTERNATIONAL

Review do Grok 4.5 (2026): Benchmarks, Preços e Guia da API

Conheça o Grok 4.5, o mais novo modelo de IA da xAI. Compare benchmarks, preços, desempenho em programação, acesso à API e como ele se compara ao GPT, Claude e Gemini.

grok 4.5

Tudo Sobre o Grok 4.5: O Modelo de IA Agêntica Mais Avançado da xAI Explicado

O Grok 4.5 é o modelo de linguagem principal da SpaceXAI, lançado em 8 de julho de 2026, desenvolvido especificamente para programação, tarefas agênticas e trabalho com conhecimento. É um modelo de mistura de especialistas treinado em conjunto com o Cursor, com preço de $2 por 1 milhão de tokens de entrada e $6 por 1 milhão de tokens de saída, com esforço de raciocínio configurável. Ele obteve 54 pontos no Artificial Analysis Intelligence Index, ocupando a 4ª posição geral, atrás do Fable 5, GPT-5.5 e Opus 4.8. Vale destacar que suas maiores vantagens não estão na dominância bruta em benchmarks, mas sim na eficiência de custo e na velocidade. Uma única tarefa do Intelligence Index custa apenas $0,31, cerca de 5x mais barato que o Claude Sonnet 5 (máximo).

Se você usa ferramentas de IA para desenvolvimento, trading ou pesquisas do dia a dia, o dinheiro que você economiza com ferramentas mais inteligentes se acumula, assim como o dinheiro que você economiza com 0% de taxas de câmbio ao gastar no exterior com um cartão fintech como o Bleap.

Gastando com ferramentas de IA e SaaS de provedores internacionais? A maioria dos cartões cobra de 2 a 3% em cada compra estrangeira. O Bleap cobra 0% de taxas de câmbio e oferece até 20% de cashback em games, streaming e gastos do dia a dia, sem assinatura mensal. Peça o cartão Bleap →

1. Um breve histórico dos modelos Grok: como chegamos até aqui

A família de modelos Grok evoluiu rapidamente desde a fundação da xAI. O Grok foi lançado em novembro de 2023 como um chatbot integrado ao X. O Grok-1 era um modelo Mixture-of-Experts com 314 bilhões de parâmetros e, em março de 2024, a xAI disponibilizou os pesos do Grok-1 como código aberto sob a licença Apache 2.0.

O Grok-1.5 ampliou as capacidades de contexto longo no início de 2024, enquanto o Grok-2 chegou em agosto de 2024 com raciocínio aprimorado, mais ferramentas e entrada multimodal. O Grok-3 veio em fevereiro de 2025 com raciocínio mais robusto e fluxos de trabalho com uso de ferramentas, treinado no supercomputador Colossus da xAI. O Grok-4 tornou-se o modelo principal em julho de 2025, com uso nativo de ferramentas, busca em tempo real e um nível multi-agente Heavy.

O Grok 4.5 não é apenas mais um passo incremental. É o primeiro modelo treinado em conjunto com o Cursor, incorporando trilhões de tokens de interações reais de desenvolvedores com bases de código e ferramentas de software. Isso o torna uma mudança arquitetural, não apenas um ajuste fino.

2. O que é o Grok 4.5? Definição e posicionamento

O Grok 4.5 é o modelo mais avançado da SpaceXAI, desenvolvido para se destacar em programação, tarefas agênticas e trabalho com conhecimento. O Cursor o descreve como um modelo Mixture-of-Experts, com preços confirmados de $2/$6 por milhão de tokens, taxa de entrada em cache de $0,50 e uma janela de contexto de 500K tokens.

No cenário de IA, o Artificial Analysis classifica o Grok 4.5 em quarto lugar em seu Índice de Inteligência, atrás do Fable 5, GPT-5.5 e Opus 4.8, mas à frente de todos os modelos de código aberto e dos modelos Gemini do Google. Seu foco principal de design é voltado para desenvolvedores: ele é mais indicado para trabalhar em bases de código existentes, depuração, refatoração e navegação em código desconhecido, tornando-se uma ferramenta prática para desenvolvedores, equipes de engenharia e empresas que precisam de execução agêntica confiável em larga escala.

3. A Parceria de Treinamento Conjunto entre xAI e Cursor

O Grok 4.5 é o primeiro modelo treinado em conjunto pela xAI e pelo Cursor, utilizando dados reais de interações de desenvolvedores em vez de repositórios de código estáticos. Essa parceria é inédita no campo de IA de fronteira.

Quando a xAI incorporou os dados do Cursor ao treinamento suplementar, o modelo foi exposto a sessões de desenvolvimento reais: bugs autênticos, padrões de depuração, decisões de arquitetura e refatorações. Repositórios de código contêm o resultado do desenvolvimento, mas os dados do Cursor contêm o processo de desenvolvimento. Em vez de treinar um modelo genérico e depois ajustá-lo para código, a SpaceXAI integrou engenheiros do Cursor diretamente no ciclo de treinamento, o que significa que o Grok 4.5 entende padrões específicos de IDE, como autocompletar por tabulação, edições em múltiplos arquivos e recuperação de contexto com consciência de projeto desde o treinamento base.

O resultado prático: as principais vantagens do Grok 4.5 são a compreensão de bases de código com múltiplos arquivos, o alinhamento com a intenção do desenvolvedor e a coerência ao longo de sessões de programação extensas. Nenhum outro laboratório de IA de fronteira possui essa profundidade de dados sobre processos reais de codificação no momento do treinamento.

4. Arquitetura do Modelo e Detalhes de Treinamento

Filosofia de Design Técnico

O Grok 4.5 é um modelo de mistura de especialistas treinado pela SpaceXAI em conjunto com a equipe de modelos da Cursor, na infraestrutura Colossus, com dezenas de milhares de GPUs NVIDIA GB300. Além do volume bruto de dados, a xAI investiu pesado em filtragem de dados, deduplicação, pontuação de qualidade e seleção focada em domínios, além de escalar o aprendizado por reforço em centenas de milhares de tarefas voltadas para engenharia de software em múltiplas etapas.

A xAI também introduziu o aprendizado assíncrono, que permite que execuções de treinamento agêntico de várias horas ocorram em paralelo com o treinamento contínuo do modelo, em vez de de forma sequencial. É isso que permite ao modelo lidar com tarefas longas e repletas de ferramentas sem perder a coerência.

Capacidades de Janela de Contexto Longo

O Grok 4.5 tem uma janela de contexto de 500.000 tokens, o equivalente a aproximadamente 1.000 páginas de texto em um único prompt. Isso é bastante amplo, embora menor do que os 1 milhão de tokens declarados do Grok 4.3 e os 1,05 milhão do GPT-5.6. A escolha foi deliberada: a xAI otimizou o Grok 4.5 para inteligência e eficiência por tarefa, em vez de maximizar o contexto, tornando-o mais adequado para fluxos de trabalho agênticos onde a precisão importa mais do que o volume de entrada.

5. Principais Capacidades do Grok 4.5

Programação e Compreensão de Bases de Código com Múltiplos Arquivos

O Grok 4.5 é incrivelmente capaz em programação, desde tarefas desafiadoras em Rust e C/C++ até a criação de aplicativos do início ao fim, do prompt à produção. O co-treinamento com o Cursor moldou a forma como o modelo lida com contextos de múltiplos arquivos, aprendendo a rastrear os relacionamentos entre arquivos da mesma forma que um desenvolvedor os navega em uma IDE, em vez de tratar cada arquivo de forma independente.

Execução de Tarefas Agênticas

No contexto do Grok 4.5, IA agêntica significa que o modelo consegue planejar, executar e iterar em tarefas de múltiplas etapas de forma autônoma. Os ambientes de aprendizado por reforço ensinam o modelo a investigar problemas, usar ferramentas, se recuperar de erros e verificar resultados. Ele suporta raciocínio configurável nos níveis baixo, médio e alto, chamada de funções, pesquisa na web, pesquisa no X e execução de código.

Trabalho em Escritório e Gestão do Conhecimento

O Grok Build, desenvolvido com o Grok 4.5, consegue criar modelos complexos no Excel com uso de fórmulas em múltiplas planilhas, elaborar apresentações no PowerPoint com formas e diagramas nativos, e escrever textos claros no Word. Na avaliação Snorkel GDPVal+, o Grok 4.5 demonstrou forte desempenho em trabalhos jurídicos (40%), educação (58%) e saúde (35%), superando o GPT-5.5 e o Opus 4.8 nessas áreas.

Quando você paga por ferramentas de software, acesso a APIs e assinaturas de SaaS de fornecedores internacionais, essas taxas vão se acumulando. Usar o Mastercard autocustodial da Bleap com 0% de taxas de câmbio significa que você mantém mais do seu orçamento para as ferramentas que realmente importam.

6. Desempenho em Benchmarks: Como o Grok 4.5 se Compara

Grok 4.5 vs Claude (Opus e Fable)

O quadro de benchmarks é competitivo, mas cheio de nuances. No SWE Bench Pro, o Grok 4.5 marca 64,7%, ficando atrás do Fable 5 com 80,4%, mas à frente do Opus 4.7 com 64,3% e do GPT-5.5 com 58,6%. No entanto, o Grok 4.5 resolve tarefas com uma média de aproximadamente 15.954 tokens de saída, cerca de 4,2 vezes menos do que o Opus 4.8, que usa 67.020.

Grok 4.5 vs GPT-5.5

No Terminal Bench 2.1, o Grok 4.5 marca 83,3%, praticamente empatando com o GPT-5.5, que tem 83,4%. No DeepSWE 1.0, o GPT-5.5 lidera com 64,31% contra 62,0% do Grok 4.5. A diferença aumenta no DeepSWE 1.1, onde o Grok 4.5 chega a 53%, bem abaixo dos 67% do GPT-5.5.

Tabela Resumida

Benchmark

Grok 4.5

Claude Fable 5

GPT-5.5

Claude Opus 4.8

Terminal Bench 2.1

83,3%

84,3%

83,4%

78,9%

SWE Bench Pro

64,7%

80,4%

58,6%

69,2%

DeepSWE 1.0

62,0%

66,1%

64,3%

55,8%

SWE Marathon

29,0%

24,0%

N/A

26,0%

Velocidade e Eficiência

O Grok 4.5 processa 80 tokens por segundo, com cerca do dobro da eficiência de saída em comparação a modelos similares nas mesmas tarefas. No Coding Agent Index, o Grok 4.5 no Grok Build custou US$ 2,49 por tarefa, enquanto o Fable 5 no Claude Code custou US$ 11,80 e o GPT-5.5 no Codex, US$ 5,07.

Os custos com modelos de IA estão pesando no seu bolso? Seja com chamadas de API ou ferramentas SaaS, o Bleap ajuda você a guardar mais de cada euro. 0% de taxas de câmbio em compras internacionais, até 20% de cashback e sem mensalidade. Peça o cartão Bleap →

7. Preços e Opções de Acesso

Preços da API do Grok 4.5

O Grok 4.5 custa $2,00 por 1M de tokens de entrada, $6,00 por 1M de tokens de saída e $0,50 por 1M de tokens de entrada em cache. Isso é cerca de 3x mais barato que o Claude Opus 4.8 ($5/$25) na entrada e 4,2x mais barato na saída. A xAI aplica preços escalonados com um limite de 200K tokens no prompt: prompts acima de 200K custam $4,00/$1,00/$12,00 por 1M de tokens.

Para comparar, o GPT-5.6 Luna da OpenAI custa $1 na entrada e $6 na saída, sendo mais barato na entrada, mas equivalente na saída.

Acesso ao Grok Build

O Grok 4.5 é agora o modelo padrão do Grok Build, o agente de codificação com IA baseado em terminal da xAI. A xAI está oferecendo uso gratuito do Grok 4.5 por tempo limitado no Grok Build e no Cursor. O Grok Build suporta não apenas programação, mas também tarefas no Excel, PowerPoint e Word, e pode executar até 8 sub-agentes em paralelo.

Acesso pela Integração com o Cursor

O Grok 4.5 está disponível como modelo padrão no Cursor em todos os planos de assinatura sem custo adicional, incluindo os planos Gratuito, Pro e Business. Os planos de assinatura do Cursor incluem uso significativo do modelo, com uso dobrado na primeira semana. A integração nativa com a IDE permite que os desenvolvedores usem o Grok 4.5 sem precisar mudar de contexto.

8. Principais casos de uso do Grok 4.5

Engenharia de software e fluxos de trabalho para desenvolvedores

O Grok 4.5 foi desenvolvido para trabalhar em repositórios reais, lidar com alterações que afetam múltiplos arquivos e rodar dentro de agentes que planejam e chamam ferramentas. Bons pontos de partida são assistentes de codificação com consciência de repositório, auxiliares de revisão de código e fluxos de issue para PR.

Automação agêntica

O Grok 4.5 foi criado para o ciclo do agente: ler, planejar, editar, executar, inspecionar e repetir. Seus recursos de chamada de funções e uso de ferramentas o tornam adequado para construir agentes autônomos que orquestram processos de negócios, integram APIs externas e executam fluxos de trabalho com múltiplas etapas.

Trabalho de conhecimento corporativo

O Grok 4.5 também está sendo promovido para trabalhos jurídicos, financeiros e de escritório que dependem de documentos longos e raciocínio estruturado. Ele ocupa o primeiro lugar no Harvey's Legal Agent Benchmark e, na avaliação GDPVal+ da Snorkel, alcançou uma taxa média de aprovação de 29%, superando o GPT-5.5 (22%) e o Opus 4.8 (21%).

Os cofres de poupança da Bleap também podem complementar seu planejamento empresarial. Com o Steady a 3,65% AER e o Dynamic a 3,83% AER em USD, depósito mínimo de US$ 1 e 0% de taxas de saque, eles oferecem um lugar prático para estacionar capital de giro entre despesas.

9. Posicionamento Empresarial e Considerações de Governança

Integrando o Grok 4.5 em Fluxos de Trabalho em Produção

Para a maioria das equipes, a abordagem prática é avaliar o Grok 4.5 junto com os modelos existentes em dimensões como qualidade de código, comportamento de agentes, latência, custo e governança. O modelo suporta os formatos de API de Respostas e Chat Completions, o que significa que ele se encaixa em bases de código já construídas sobre APIs compatíveis com OpenAI sem necessidade de modificações.

IA Responsável e Gestão de Riscos

A Artificial Analysis apontou uma fraqueza relevante: a taxa de alucinação do Grok 4.5 saltou de 25% (Grok 4.3) para 54%, o que significa que o modelo sabe mais, mas também é mais confiante quando erra. O Cursor adicionou novas salvaguardas que refletem as capacidades de segurança cibernética do modelo. As equipes empresariais devem implementar verificação humana no processo para outputs críticos, especialmente em setores regulamentados.

10. Primeiros Passos: Integração via API e Guia de Início Rápido

Para começar a usar o Grok 4.5, siga alguns passos:

  1. Crie uma conta de desenvolvedor na xAI em console.x.ai e gere uma chave de API.
  2. Consulte a documentação oficial e o cartão do modelo em x.ai/news/grok-4-5.
  3. Faça sua primeira chamada de API. A API da xAI é compatível com a OpenAI, então aponte o mesmo cliente para https://api.x.ai/v1 com sua chave xAI e o nome do modelo grok-4.5.
  4. Teste as capacidades de contexto longo e agênticas carregando uma base de código com vários arquivos em uma única chamada e pedindo ao modelo para refatorar ou depurar.
  5. Explore o Grok Build para orquestração avançada de agentes com sub-agentes paralelos e uso de ferramentas.

Dicas práticas: fique atento ao preço escalonado acima de 200K de entrada. Use o cache de prompts de forma agressiva (US$ 0,50/1M de entrada em cache vs US$ 2,00 no padrão). E lembre-se de que o Grok 4.5 ainda não está disponível na UE, com previsão de chegada para meados de julho de 2026.

Desenvolvendo com ferramentas de IA e pagando por assinaturas SaaS globalmente? O Mastercard com autocustódia da Bleap oferece 0% de taxas de câmbio em cada compra internacional, até 20% de cashback e sem mensalidade. Seus fundos ficam sob o seu controle. Abra uma conta na Bleap →

11. Perguntas Frequentes sobre o Grok 4.5

O que é a API do Grok 4.5 e como faço para acessá-la?

O Grok 4.5 está disponível na API da xAI pelo console de desenvolvedores do SpaceXAI. O ID do modelo é grok-4.5. A autenticação usa um token bearer, e o endpoint é compatível com a OpenAI, o que facilita a integração para configurações já existentes.

Como o Grok 4.5 se compara ao GPT-5.5 em tarefas de programação?

O Grok 4.5 está praticamente empatado com o GPT-5.5 no Terminal Bench 2.1 (83,3% vs 83,4%) e lidera no SWE Bench Pro (64,7% vs 58,6%), mas fica atrás no DeepSWE 1.1 (53% vs 67%). A vantagem do Grok 4.5 está no custo e na eficiência por tarefa concluída.

Qual é a estrutura de preços do Grok 4.5?

O Grok 4.5 custa $2 por milhão de tokens de entrada e $6 por milhão de tokens de saída, com $0,50/1M para entrada em cache. Prompts acima de 200K tokens têm taxas por token mais altas.

O Grok 4.5 é melhor que o Claude para fluxos de trabalho agênticos?

No GDPval-AA v2, Banking e Terminal-Bench v2.1, o Grok 4.5 fica na mesma linha ou à frente do Claude Opus 4.8 e do GPT-5.5 em tarefas agênticas. Ele lidera em custo por tarefa. Para precisão bruta de programação nos problemas mais difíceis, o Fable 5 e o Opus 4.8 ainda levam vantagem.

O que é o Grok Build e para quem ele é indicado?

O Grok Build é o agente de programação com IA da xAI, agora usando o Grok 4.5 como modelo padrão. Ele é voltado para desenvolvedores que querem programação agêntica via terminal, com sub-agentes paralelos, chamadas de ferramentas e integrações com o Office. O uso gratuito está disponível por tempo limitado.

O que torna o Grok 4.5 um modelo de IA para contextos longos?

O Grok 4.5 suporta uma janela de contexto de 500K tokens (cerca de 375.000 palavras), grande o suficiente para processar bases de código inteiras, artigos de pesquisa ou históricos longos de conversas de uma só vez. Para equipes de engenharia, isso significa carregar limites inteiros de serviço sem precisar dividir o conteúdo em partes.

Conclusão: O Grok 4.5 é o modelo certo para você?

O Grok 4.5 ocupa uma posição bem definida no cenário de IA de 2026: um modelo classificado em 4º lugar pela Artificial Analysis, com preço de $2/$6 por 1 milhão de tokens e que gera muito menos tokens de saída em tarefas agênticas, tornando-se uma das propostas de valor mais atraentes para desenvolvedores e empresas. Seus principais diferenciais são a competência em codificação, a execução de tarefas agênticas e a eficiência de custo, e não necessariamente a liderança absoluta em benchmarks.

A parceria entre xAI e Cursor confere ao Grok 4.5 uma vantagem estrutural de treinamento que nenhum outro laboratório consegue replicar. Se os seus fluxos de trabalho giram em torno de código, tarefas de agentes de longa duração ou trabalho de conhecimento corporativo, ele merece estar na sua lista de avaliação ao lado do Claude e do GPT.

Enquanto você constrói seu fluxo de trabalho com IA, garanta que o lado financeiro da sua stack seja igualmente eficiente. O Mastercard autocustodial da Bleap, com 0% de taxas de câmbio e até 20% de cashback, faz com que cada euro gasto em SaaS internacional, créditos de API ou ferramentas de desenvolvimento renda mais. Sem assinatura mensal, sem cobranças escondidas.

Experimente a Bleap →

Um jeito mais inteligente de gastar, enviar, ganhar e negociar

Imagem da Seção de Principais Conclusões
  • international

Artigos relacionados