AIO APEX

xAI lanza Grok 4.5, su modelo más potente, con una ventana de contexto de 500.000 tokens

xAI
Compartir:
xAI lanza Grok 4.5, su modelo más potente, con una ventana de contexto de 500.000 tokens

xAI lanzó Grok 4.5 el 8 de julio, calificándolo como su modelo más fuerte hasta la fecha. Entrenado en decenas de miles de GPUs Nvidia GB300 y construido sobre un nuevo modelo base de 1,5 billones de parámetros que xAI llama V9, el modelo ya está disponible en Grok Build, en todos los planes de Cursor y a través de la consola API de xAI.

Qué puede hacer el modelo

Grok 4.5 soporta una ventana de contexto de 500.000 tokens, junto con entrada de texto e imagen, llamadas a funciones, salidas estructuradas, búsqueda web y de X, ejecución de código y profundidad de razonamiento configurable. xAI lo sirve a aproximadamente 80 tokens por segundo, y la empresa afirma que ofrece el doble de eficiencia de tokens que los modelos frontera rivales en tareas comparables, lo que significa que puede producir resultados equivalentes consumiendo menos tokens, lo que reduce el coste efectivo de una tarea dada incluso antes de considerar el precio de etiqueta.

El precio se fija en 2 dólares por cada millón de tokens de entrada y 6 dólares por cada millón de tokens de salida, con un descuento de 0,50 dólares por millón para entrada en caché y tarifas más altas una vez que una solicitud supere los 200.000 tokens.

Resultados de benchmarks, con algunas advertencias

xAI posiciona a Grok 4.5 principalmente como un modelo de codificación y trabajo agentivo. En el benchmark SWE Marathon — una prueba de tareas sostenidas de ingeniería de software de múltiples pasos — Grok 4.5 obtuvo una tasa de resolución pass@1 del 29,0%, superando el 26,0% de Opus 4.8 de Anthropic y el 24,0% del modelo anterior Fable de xAI. El modelo también lidera en DeepSWE 1.0 (62,0%) y Terminal-Bench 2.1 (83,3%).

Sin embargo, ese liderazgo no es universal. De los cuatro benchmarks que xAI eligió publicar junto con el lanzamiento, Grok 4.5 gana dos y pierde dos frente a Opus 4.8 — una división que sugiere que el modelo es un verdadero paso adelante en flujos de trabajo de codificación específicos más que una mejora general sobre todos los rivales en todas las tareas.

Brecha de disponibilidad en la UE

Grok 4.5 aún no está disponible para los usuarios europeos, ni a través de los productos propios de xAI ni de su consola API. xAI dice que el acceso en la UE se espera para mediados de julio, sin dar una fecha firme. Ese retraso coloca a Grok 4.5 junto a un patrón de lanzamientos de modelos de IA en 2026 donde la revisión regulatoria — ya sean controles de cumplimiento de la Ley de IA de la UE o procesos similares — ha separado la fecha de lanzamiento inicial de un modelo de su disponibilidad en Europa por días o semanas.

Contexto competitivo

El lanzamiento se produce la misma semana en que OpenAI está completando el despliegue gradual de su familia GPT-5.6 (Sol, Terra y Luna) y presiona a Anthropic, cuyo Opus 4.8 sigue siendo competitivo en dos de los cuatro benchmarks que xAI seleccionó. Para los desarrolladores que eligen entre modelos de codificación frontera, la conclusión práctica es que ningún modelo único lidera actualmente en todos los ámbitos: los resultados de Grok 4.5 en SWE Marathon y Terminal-Bench lo convierten en una opción sólida para ciertas tareas de codificación agentiva, mientras que Opus 4.8 sigue adelante en los benchmarks que xAI no ganó.

Originally reported by xAI. Read the original article for additional details.

View original source
Compartir: