xAI lança o Grok 4.5, seu modelo mais forte, com uma janela de contexto de 500.000 tokens

A xAI lançou o Grok 4.5 em 8 de julho, classificando-o como seu modelo mais forte até o momento. Treinado em dezenas de milhares de GPUs Nvidia GB300 e construído sobre um novo modelo de fundação de 1,5 trilhão de parâmetros que a xAI chama de V9, o modelo já está disponível no Grok Build, em todos os planos do Cursor e por meio do console da API xAI.
O que o modelo pode fazer
O Grok 4.5 suporta uma janela de contexto de 500.000 tokens, juntamente com entrada de texto e imagem, chamada de funções, saídas estruturadas, pesquisa na web e no X, execução de código e profundidade de raciocínio configurável. A xAI o serve a aproximadamente 80 tokens por segundo, e a empresa afirma que ele oferece o dobro da eficiência de tokens em comparação com modelos concorrentes de fronteira em tarefas comparáveis — o que significa que pode produzir resultados equivalentes consumindo menos tokens, reduzindo o custo efetivo de uma tarefa antes mesmo de considerar o preço de tabela.
O preço é definido em US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída, com um desconto de US$ 0,50 por milhão para entrada em cache e taxas mais altas quando uma solicitação excede 200.000 tokens.
Resultados de benchmarks, com algumas ressalvas
A xAI posiciona o Grok 4.5 principalmente como um modelo de codificação e trabalho agentivo. No benchmark SWE Marathon — um teste de tarefas sustentadas de engenharia de software em várias etapas — o Grok 4.5 obteve uma taxa de resolução pass@1 de 29,0%, à frente do Opus 4.8 da Anthropic com 26,0% e do modelo anterior Fable da xAI com 24,0%. O modelo também lidera no DeepSWE 1.0 (62,0%) e no Terminal-Bench 2.1 (83,3%).
No entanto, essa liderança não é universal. Dos quatro benchmarks que a xAI escolheu publicar junto com o lançamento, o Grok 4.5 vence dois e perde dois para o Opus 4.8 — uma divisão que sugere que o modelo é um verdadeiro passo à frente em fluxos de trabalho de codificação específicos, e não uma melhoria geral sobre todos os concorrentes em todas as tarefas.
Lacuna de disponibilidade na UE
O Grok 4.5 ainda não está disponível para usuários europeus, seja por meio dos próprios produtos da xAI ou de seu console de API. A xAI afirma que o acesso na UE é esperado para meados de julho, sem dar uma data firme. Esse atraso coloca o Grok 4.5 junto a um padrão de lançamentos de modelos de IA em 2026 em que a revisão regulatória — seja verificações de conformidade com a Lei de IA da UE ou processos semelhantes — separou a data de lançamento inicial de um modelo de sua disponibilidade na Europa por dias ou semanas.
Contexto competitivo
O lançamento ocorre na mesma semana em que a OpenAI está concluindo a implantação gradual de sua família GPT-5.6 (Sol, Terra e Luna) e pressiona a Anthropic, cujo Opus 4.8 continua competitivo em dois dos quatro benchmarks que a xAI selecionou. Para desenvolvedores que escolhem entre modelos de codificação de fronteira, a conclusão prática é que nenhum modelo único atualmente lidera em todos os aspectos: os resultados do Grok 4.5 no SWE Marathon e Terminal-Bench o tornam uma escolha forte para certas tarefas de codificação agentiva, enquanto o Opus 4.8 permanece à frente nos benchmarks que a xAI não venceu.
Originally reported by xAI. Read the original article for additional details.
View original source