Em 8 de julho de 2026, a xAI lançou o Grok 4.5, o seu primeiro modelo criado especificamente para programação e trabalho agêntico. Não se trata de uma melhoria geral de capacidades. É um pivô deliberado para os programadores, com treino realizado com dados reais de sessões de programadores no Cursor e benchmarks concebidos para medir o que uma IA consegue realmente fazer dentro de uma base de código real ao longo de uma sessão longa. Foi substituído em 12 de agosto de 2026 pelo Grok 4.6, uma atualização pós-treino sobre a mesma base.
O resultado é um modelo que obtém 56 pontos no Artificial Analysis Intelligence Index, à frente de todos os modelos Gemini, a uma fração do custo de operação da fronteira atual. A Artificial Analysis gastou $0.36 para avaliar o Grok 4.5 no índice, contra $1.23 para o GPT-5.6 Sol e $2.34 para o Claude Opus 5 em raciocínio máximo.
Elon Musk posicionou-o diretamente: «É um modelo da classe Opus, mas mais rápido, mais eficiente em tokens e mais barato.» Numa publicação seguinte, foi mais preciso: «O Grok 4.5 é aproximadamente comparável ao Opus 4.7, mas muito mais rápido.»
Musk também assinalou que as velocidades atuais não são o limite. A xAI ainda não implementou a sua stack de inferência em C/C++ desenvolvida internamente, que mapeia diretamente para o hardware GB300, e quando o fizer, espera que as velocidades dupliquem ou mais. Sinalizou um novo lançamento com uma mudança significativa para o mês seguinte; até 10 de agosto de 2026, nada foi lançado, e grok-4.5-latest continua a ser o alias atual na lista de modelos da xAI.
Os Principais Pontos a Reter
- O Grok 4.5 foi lançado em 8 de julho de 2026 e obtém 56 pontos no Artificial Analysis Intelligence Index v4.1.1, à frente de todos os modelos Gemini. Ficou em 4.º lugar no lançamento e agora ocupa a 15.ª posição de 185 entradas.
- Construído sobre a base V9 de 1,5 biliões de parâmetros e treinado com dados reais de sessões do Cursor para tarefas de programação e agênticas.
- Com um preço de $2 / $6 por milhão de tokens, com a entrada em cache a $0.30, contra $5 / $25 do atual Claude Opus 5. Na Artificial Analysis, é o modelo mais barato do top 15 a executar através do Intelligence Index.
- Altamente eficiente em tokens, utilizando cerca de 14.000 tokens de saída por tarefa do Intelligence Index, contra 67.020 do Opus 4.8 na comparação da xAI no dia do lançamento.
- Musk chama-lhe «classe Opus, mas mais rápido», com uma stack de inferência personalizada que se espera que duplique os atuais ~80 tokens/seg.
O Que É Realmente o Grok 4.5
O Grok 4.5 é o primeiro modelo da xAI treinado de raiz para tarefas de programação e agênticas, em vez de inteligência geral. Construído sobre o modelo de base V9 de 1,5 biliões de parâmetros, foi treinado em parceria com a Cursor para lidar com tarefas de longa duração em múltiplos repositórios e para funcionar com intervenção humana mínima ao longo de centenas de chamadas a ferramentas. Essa parceria produziu mais tarde o produto de agente da SpaceXAI, que aplica a mesma abordagem numa aplicação de computador.
As especificações principais são diretas.
| Especificação | Detalhe |
|---|---|
| Nome do modelo na API | grok-4.5 |
| Arquitetura | Modelo de base V9, 1,5 biliões de parâmetros (3x maior do que o V8 do Grok 4.3) |
| Janela de contexto | 500k tokens |
| Velocidade | aproximadamente 80 tokens por segundo |
| Modalidades de entrada | texto e imagens (visão) |
| Raciocínio | configurável com esforço baixo, médio, alto ou xhigh (predefinição: alto) |
| APIs suportadas | Responses API e Chat Completions |
| Capacidades incorporadas | chamada de funções, pesquisa na web, pesquisa no X, execução de código |
O nome V9 marca uma mudança completa de geração em relação à série V8 que impulsionava o Grok 4.3, triplicando a escala e deslocando totalmente o foco do treino para tarefas de programação e agênticas. A janela de contexto desceu do 1 milhão de tokens do Grok 4.3 para 500k, o que é um verdadeiro compromisso para quem precisava do milhão completo.
A Ligação ao Cursor
A ideia de «treinado com o Cursor» no anúncio não é apenas uma parceria de marketing. Em meados de junho de 2026, a SpaceX adquiriu o Cursor por aproximadamente $60 mil milhões, trazendo um dos editores de código com IA mais utilizados diretamente para o ecossistema da xAI. Foi essa aquisição que permitiu que o treino do Grok 4.5 incorporasse dados reais de sessões de programadores no Cursor, dando à xAI acesso direto aos fluxos de trabalho reais, aos padrões de contexto e às estruturas de tarefas de longo prazo que os programadores utilizam em produção.
Ao contrário do treino com repositórios de código públicos, os dados de sessões reais captam a forma como os programadores iteram sobre um problema, alternam o contexto entre ficheiros e tomam decisões em várias etapas dentro de projetos reais. O Grok 4.5 é o primeiro modelo a refletir isso.
A xAI também introduziu uma nova metodologia de treino juntamente com este modelo, a aprendizagem assíncrona, que permite que execuções de treino agêntico de várias horas decorram em paralelo com o treino contínuo do modelo, em vez de sequencialmente. O efeito prático é que os ciclos de feedback entre o comportamento do modelo e as suas atualizações de treino se tornam muito mais rápidos, o que é o que permite ao modelo lidar com o tipo de sessões autónomas de longa duração em que a maioria dos agentes atualmente encalha.
Resultados de Benchmarks
Benchmarks Publicados pela xAI no Lançamento
| Benchmark | Fable 5 | GPT-5.5 | Grok 4.5 | Opus 4.8 | GLM-5.2 |
|---|---|---|---|---|---|
| DeepSWE 1.0 | 66,1% | 64,3% | 62,0% | 55,8% | n/d |
| DeepSWE 1.1 | 70,0% | 67,0% | 53,0% | 59,0% | 44,0% |
| Terminal-Bench 2.1 | 84,3% | 83,4% | 83,3% | 78,9% | n/d |
| SWE-Bench Pro | 80,4% | n/d | 64,7% | 69,2% | 62,1% |
Estes são os valores que a xAI publicou em 8 de julho de 2026, medidos em relação aos modelos que eram atuais nesse dia. Lendo-os diretamente: o Grok 4.5 supera o Opus 4.8 em dois dos quatro benchmarks (DeepSWE 1.0 e Terminal-Bench 2.1) e fica atrás em dois outros (DeepSWE 1.1 e SWE-Bench Pro). O Claude Fable 5 lidera nos quatro, e no Terminal-Bench 2.1 a margem entre o Grok 4.5 (83,3%) e o GPT-5.5 (83,4%) é de apenas uma décima de ponto. O Opus 4.8 e o GPT-5.5 foram entretanto substituídos pelo Claude Opus 5 e pelo GPT-5.6 Sol, para os quais a xAI ainda não publicou números, pelo que a secção de classificações atuais abaixo é a que deve ser consultada para decisões de compra.
Benchmarks Independentes da Artificial Analysis
No Artificial Analysis Intelligence Index, agora na versão v4.1.1, o Grok 4.5 com raciocínio alto obtém 56 pontos. O Grok 4.3 obtém 37 pontos com raciocínio médio no mesmo ranking, o que faz deste o maior salto de geração para geração que a xAI já registou neste índice, e o Grok 4.5 continua a superar todos os modelos Gemini listados; o melhor deles, o Gemini 3.6 Flash, situa-se nos 52 pontos. A pontuação em si subiu de 54 para 56 em agosto porque a Artificial Analysis reavaliou todo o ranking em alta na v4.1.1, e não porque o modelo tenha mudado.
A sua posição, no entanto, mudou, e vale a pena dizê-lo com clareza. O Grok 4.5 ficou em quarto lugar de 168 entradas no lançamento, a 8 de julho. No ranking do início de setembro está em 15.º lugar de 185, com o Claude Opus 5, o Claude Fable 5, o GPT-5.6 Sol, o Kimi K3, o Qwen3.8 Max, o Muse Spark 1.3 e o GPT-5.6 Terra todos com pontuações acima da sua. O Claude Opus 4.8, contra o qual o Grok 4.5 foi comparado no lançamento, já nem sequer consta do ranking. A pontuação não baixou, foi o panorama que mudou.
Uma das afirmações do lançamento inverteu-se por completo. O Grok 4.5 já não supera todos os modelos de pesos abertos, porque o Kimi K3 lançou os seus pesos abertos a 27 de julho de 2026 e obtém 60 pontos no mesmo índice.
No GDPval-AA v2, o benchmark que mede o trabalho de conhecimento agêntico sustentado, o Grok 4.5 obtém um Elo de 1.543, à frente do GLM-5.2 com 1.513 e atrás do Claude Opus 4.8 com 1.600. Ficou em quarto lugar no lançamento, mas o Claude Opus 5 já registou 1.861 pontos no mesmo benchmark, pelo que essa posição também mudou. Na sub-tarefa de raciocínio financeiro mais difícil, tau3-Banking, o Grok 4.5 atinge 33%, a pontuação mais alta entre todos os modelos avaliados, superando o GPT-5.5 (xhigh) com 31%.
No Artificial Analysis Coding Agent Index (que combina DeepSWE, Terminal-Bench v2 e SWE-Atlas QnA), o Grok 4.5 no harness Grok Build obtém 76 pontos, ficando em terceiro lugar. Está ao nível do GPT-5.5 (xhigh) no Codex e fica logo abaixo do Fable 5 (max) no Claude Code.
A xAI reporta ainda o Harvey Legal Agent Benchmark, onde o Grok 4.5 fica em primeiro lugar. Combinado com a pontuação máxima no tau3-Banking, isto aponta para o trabalho de conhecimento jurídico e financeiro como pontos fortes específicos, para além do que os benchmarks de programação por si só captam.

Eficiência de Tokens
O preço por token é o destaque, mas a eficiência de tokens é o número mais relevante. No SWE-Bench Pro, o Grok 4.5 utilizou aproximadamente 15.954 tokens de saída por tarefa, contra os 67.020 do Opus 4.8, uma diferença de 4,2x. No Artificial Analysis Intelligence Index utiliza cerca de 14.000 tokens de saída por tarefa, mais de 60% menos do que o Opus 4.8. No Coding Agent Index tem uma média de 1,9 milhões de tokens totais por tarefa, contra 7,2 milhões do Fable 5 no Claude Code e 6,2 milhões do GPT-5.5 no Codex.
Um modelo que utiliza 4x menos tokens não é apenas mais barato por tarefa. É mais rápido e produz menos ruído em pipelines agênticos, o que é importante para trabalho autónomo em várias etapas.
Preços e Custo por Tarefa
O Grok 4.5 tem um preço de $2.00 por milhão de tokens de entrada e $6.00 por milhão de tokens de saída. Os acertos de cache têm um desconto de 85%, o que reduz os tokens de entrada em cache para $0.30 por milhão. Um aviso importante: o preço duplica para entradas com mais de 200k tokens. Para uma análise completa dos preços de subscrição e de API do Grok, incluindo os planos de consumidor, esse guia cobre todas as opções.
Face à fronteira atual, isto é bem menos de metade do que o Claude Opus 5 cobra, a $5 / $25. Mas o custo por tarefa é o número mais relevante, uma vez que tem em conta quantos tokens cada modelo realmente gasta. A tabela abaixo apresenta os valores da xAI e da Artificial Analysis conforme publicados no lançamento, em julho de 2026.
| Modelo | Entrada (por 1M) | Saída (por 1M) | Custo por tarefa no Intelligence Index | Custo por tarefa no Coding Agent |
|---|---|---|---|---|
| Grok 4.5 | $2.00 | $6.00 | $0.31 | $2.49 |
| GPT-5.5 (Codex) | $5.00 | $30.00 | mais alto | $5.07 |
| Fable 5 (Claude Code) | $10.00 | $50.00 | mais alto | $11.80 |
| Opus 4.8 | $5.00 | $25.00 | mais alto | n/d |
Os valores por tarefa é que realmente importam à escala de produção. O Grok 4.5 alcançou um desempenho de agente de programação quase equivalente a cerca de metade do custo do GPT-5.5 e a menos de um quarto do custo do Fable 5 por tarefa concluída. Essa vantagem manteve-se à medida que o panorama evoluiu. No Intelligence Index atual, a Artificial Analysis situa o custo de executar o Grok 4.5 em $0.36, contra $1.23 para o GPT-5.6 Sol e $2.34 para o Claude Opus 5, ambos com raciocínio máximo.
Onde o Grok 4.5 Está Disponível
O Grok 4.5 ficou disponível numa ampla gama de plataformas logo no dia do lançamento. Está disponível na API da xAI sob o nome de modelo grok-4.5, no Grok Build (o harness de agente de programação da própria xAI) e no Cursor em todos os planos. O acesso de terceiros abrange OpenRouter, Vercel, Cloudflare, Snowflake e Databricks Mosaic. Também está disponível no Fello AI, no Mac, no iPhone e no iPad.
O lançamento do plugin para Office é digno de nota. A xAI está a posicionar o Grok 4.5 não apenas como um modelo de programação, mas como um modelo de trabalho de conhecimento capaz de construir modelos complexos do Excel com investigação na web integrada e gerar conteúdo sofisticado do PowerPoint. Isso alarga bastante o âmbito de utilização, para além do desenvolvimento de software.
O atraso na UE já foi resolvido. O Grok 4.5 foi lançado em 47 países, mas ficou bloqueado em todos os 27 estados-membros da UE, um atraso atribuído ao trabalho de conformidade ao abrigo da Lei de IA da UE, que trata os modelos treinados acima de 1025 FLOPs como portadores de risco sistémico. A xAI abriu o acesso na UE mais tarde em julho de 2026, e a sua documentação para programadores já não apresenta a restrição regional que mostrava no lançamento.
O modelo suporta tanto o formato Responses API como o Chat Completions, o que significa que se integra em bases de código já construídas sobre APIs compatíveis com a OpenAI sem qualquer modificação.
O Que Disse Elon Musk
Musk fez várias declarações em torno do dia do lançamento que indicam onde este modelo se encaixa e para onde está a caminhar.
Sobre o posicionamento de capacidades: «É um modelo da classe Opus, mas mais rápido, mais eficiente em tokens e mais barato», com um esclarecimento posterior de que é «aproximadamente comparável ao Opus 4.7, mas muito mais rápido». Esse último detalhe é importante. Musk está a comparar com o Opus 4.7, não com o 4.8, o que os dados independentes apoiam em grande medida.
Sobre o limite de velocidade: «O Grok 4.5 ainda não está a utilizar o nosso software de inferência em C/C++ desenvolvido internamente, que mapeia exatamente para o hardware GB300. É provavelmente possível duplicar ou mais a velocidade atual.» O débito atual, de cerca de 80 tokens por segundo, não é o número final. A stack de inferência personalizada está em desenvolvimento e irá acrescentar mais velocidade sem alterar os pesos do modelo.
Sobre o que vem a seguir: «O lançamento do próximo mês será outra melhoria com uma mudança significativa, à medida que fechamos o ciclo de resolução de problemas reais de engenharia na Tesla, na SpaceX, na Neuralink e na Boring Company.» Esse ciclo de feedback vindo de trabalho real de engenharia nas empresas irmãs da xAI é uma fonte de dados de treino que nenhum outro laboratório tem à mesma escala.
Sobre futuras capacidades multimodais: o Grok vai ganhar a capacidade de chamar o Grok Imagine como ferramenta em modo agêntico, invocando a geração de imagem e vídeo como parte de um fluxo de trabalho autónomo mais longo, em vez de como uma funcionalidade separada. Musk assinalou isto como especialmente valioso para programadores de jogos.
Reações Iniciais dos Utilizadores
O feedback dos programadores com acesso antecipado no Cursor foi positivo. Danny Limanseta descreveu-o como «o Opus 4.8 ao dobro da velocidade e a um preço muito mais barato», depois de o utilizar para fazer brainstorming, planear e implementar uma funcionalidade complexa de um jogo ao longo de uma sessão completa, sem precisar de o corrigir manualmente em cada etapa.
A Artificial Analysis resumiu a mudança competitiva sem rodeios no dia do lançamento, escrevendo que o Grok 4.5 «coloca a SpaceXAI na fronteira da inteligência, atrás apenas da OpenAI e da Anthropic, e supera todos os modelos de pesos abertos e, em particular, os modelos Gemini da Google». A parte dessa frase relativa aos pesos abertos já foi ultrapassada, como referido acima.
Como o Grok 4.5 Se Compara à Concorrência
Face à fronteira atual, o Grok 4.5 raramente ocupa o primeiro lugar absoluto em capacidade bruta, mas vence sistematicamente em custo e eficiência de tokens. Eis como se compara modelo a modelo, utilizando o ranking v4.1.1 da Artificial Analysis para tudo o que é atual e os valores de lançamento da xAI onde estes são os únicos números publicados.
Comparação com o Grok 4.3
56 pontos contra os 37 do Grok 4.3 é o maior salto geracional na linhagem Grok. A janela de contexto foi reduzida a metade, de 1M para 500k tokens, e as modalidades de entrada ficaram limitadas a texto e imagens, que são os dois verdadeiros compromissos. Se tem estado a utilizar o Grok 4.3 para programação, o Grok 4.5 é uma melhoria significativa em todas as outras dimensões.
Comparação com o Claude Opus 5
O Claude Opus 5 ocupa o segundo lugar no Intelligence Index, com 63 pontos, atrás do atual modelo de topo da Anthropic, o Claude Fable 5.1, com 66, e sete pontos à frente do Grok 4.5. Também tem uma janela de contexto de 1M tokens, contra os 500k do Grok 4.5. A comparação de custos vai no sentido inverso, e não por pouco. O Opus 5 tem um preço de $5 / $25 por milhão de tokens, contra $2 / $6, e a Artificial Analysis gastou $2.34 para avaliar o Opus 5 no índice, contra $0.36 para o Grok 4.5. Para o trabalho de programação aberto mais difícil, o Opus 5 tem vantagem; para pipelines agênticos em que o custo por tarefa se acumula ao longo de centenas de chamadas a ferramentas, o Grok 4.5 tem a melhor economia.
Comparação com o Claude Fable 5
O Fable 5 lidera nos quatro benchmarks da xAI e no Intelligence Index. A diferença de custo é a maior de todas as comparações: $2.49 contra $11.80 por tarefa no Coding Agent, quase 5x. Para cargas de trabalho em que o desempenho de programação absolutamente máximo é obrigatório, o Fable 5 continua à frente. Para um desempenho próximo da fronteira a uma fração do custo, o Grok 4.5 vence.
Comparação com o GPT-5.6 Sol
O Sol é o modelo de topo atual da OpenAI e a comparação mais próxima no ranking. Obtém 61 pontos com raciocínio máximo e 57 com raciocínio alto, o que coloca os 56 pontos do Grok 4.5 a apenas um ponto do Sol na definição alta. O custo é o que os separa: a Artificial Analysis avaliou o Sol no máximo através do índice por $1.23, contra $0.36 do Grok 4.5. Se a escolha for por capacidade bruta, o Sol vence; se for por capacidade por dólar em escala, é o Grok 4.5 que vence.
Comparação com o Par do Dia do Lançamento, Opus 4.8 e GPT-5.5
Ambos os modelos com que o Grok 4.5 foi comparado em julho passaram entretanto a estatuto de legado, mas os números continuam a valer a pena reter porque são os únicos dados diretos que a xAI publicou. Contra o Opus 4.8, o Grok 4.5 venceu no DeepSWE 1.0 e no Terminal-Bench 2.1 e perdeu no DeepSWE 1.1 e no SWE-Bench Pro. Contra o GPT-5.5, a margem no Terminal-Bench 2.1 foi de uma décima de ponto (83,3% vs 83,4%), o Coding Agent Index terminou empatado, e o Grok 4.5 liderou o tau3-Banking por 2 pontos a cerca de metade do custo por tarefa ($2.49 vs $5.07).
Comparação com o GLM-5.2
O Grok 4.5 fica ligeiramente à frente do GLM-5.2 no GDPval-AA v2 (Elo 1.543 vs 1.513). O Grok 4.5 lidera no Intelligence Index geral e no tau3-Banking.

Porque É Que Este Lançamento É Importante
Três aspetos destacam-se no lançamento do Grok 4.5 e valem a pena acompanhar para além dos números dos benchmarks.
A xAI chegou à fronteira da inteligência. O Grok 4.3 não competia com a Anthropic e a OpenAI no topo das classificações de capacidade, com 37 pontos no Intelligence Index. O Grok 4.5 já compete, com 56 pontos. Isso muda a estrutura competitiva do mercado, de uma corrida entre dois para uma disputa a três.
A eficiência de custos é real, não é apenas um desconto de preço. O Grok 4.5 é mais barato por token, mas também é dramaticamente mais eficiente em tokens por tarefa. Um modelo que produz o mesmo resultado em 14.000 tokens quando um concorrente usa 67.000 não é apenas mais barato de executar, é mais rápido e gera menos ruído em fluxos de trabalho agênticos. Ambos os fatores importam à escala de produção.
O limite de velocidade ainda não foi atingido. 80 tokens por segundo é o valor atual. Quando a xAI implementar a sua stack de inferência personalizada em C/C++, mapeada para o hardware GB300, Musk espera que isso duplique ou mais. Um modelo já competitivo em custo e qualidade fica significativamente mais rápido sem ser necessária qualquer atualização do modelo.
O Grok 4.5 está disponível no Fello AI, onde pode utilizá-lo ao lado do Claude, do ChatGPT, do Gemini, do DeepSeek e do Perplexity numa única aplicação nativa para Mac, iPhone e iPad, comparando a mesma tarefa em todos os modelos de fronteira com uma única subscrição, em vez de gerir contas separadas. Para contexto sobre o que vem depois do Grok 4.5, o artigo Grok 5 cobre o que a xAI já sinalizou sobre a próxima versão principal.
FAQ
Quando foi lançado o Grok 4.5?
A xAI lançou o Grok 4.5 em 8 de julho de 2026. É o primeiro modelo da xAI criado especificamente para programação e trabalho agêntico, treinado com dados reais de sessões de programadores no Cursor.
Quanto custa o Grok 4.5?
O preço na API é de $2.00 por milhão de tokens de entrada e $6.00 por milhão de tokens de saída. Os acertos de cache têm um desconto de 85%, o que reduz a entrada em cache para $0.30 por milhão. O preço duplica para entradas com mais de 200k tokens.
O Grok 4.5 é melhor do que o Claude Opus 5?
Não em capacidade bruta. O Claude Opus 5 obtém 63 pontos no Artificial Analysis Intelligence Index, contra os 56 do Grok 4.5, e tem uma janela de contexto de 1M tokens, contra 500k. O Grok 4.5 vence claramente em custo, com $2 / $6 por milhão de tokens, contra $5 / $25, e em eficiência de tokens por tarefa concluída.
Qual é a janela de contexto do Grok 4.5?
O Grok 4.5 tem uma janela de contexto de 500k tokens, uma redução face ao 1 milhão de tokens do Grok 4.3. É o único compromisso claro numa atualização que, de resto, é generalizada.
Posso utilizar o Grok 4.5 no Fello AI?
Sim. O Grok 4.5 está disponível no Fello AI, pelo que pode utilizá-lo ao lado do Claude, do ChatGPT, do Gemini, do DeepSeek e do Perplexity numa única aplicação nativa para Mac, iPhone e iPad, e comparar a mesma tarefa em todos os modelos de fronteira com uma única subscrição.