Grok 4.5 ya está aquí: el nuevo flagship de clase Opus de xAI, ahora en MuiRouter
xAI lanzó Grok 4.5, un nuevo flagship entrenado junto a Cursor y comparado con Claude Opus 4.8, y luego llevó Grok a Cloudflare AI Gateway. Hemos añadido grok-4.5, grok-4.3 y grok-imagine-image al catálogo de MuiRouter: esto es lo que llegó y cómo empezar.
El 8 de julio de 2026, xAI lanzó Grok 4.5: su nuevo modelo flagship, entrenado junto a Cursor (el editor de código con IA que xAI aceptó adquirir por 60.000 millones de dólares el mes anterior) y posicionado directamente frente a Claude Opus 4.8. Elon Musk lo llamó “un modelo de clase Opus, pero más rápido, más eficiente en tokens y de menor coste”. Es una afirmación grande para el día de lanzamiento, y llega encima de una racha de mejoras en toda la línea Grok: una ventana de contexto mucho mayor, entrada de vídeo nativa, una stack Imagine de vídeo más rápida, además de un nuevo canal de distribución: Grok ya está disponible directamente a través de Cloudflare AI Gateway.
Esa última parte es lo que nos permitió movernos rápido. Hoy hemos añadido grok-4.5, grok-4.3 y grok-imagine-image al catálogo de MuiRouter, accesibles mediante los mismos endpoints /v1/chat/completions y /v1/images/generations que ya usas para OpenAI, Anthropic y Gemini.
Qué lanzó xAI: Grok 4.5
Grok 4.5 está construido sobre la base V9 de xAI, de 1,5 billones de parámetros, y ahora es el modelo por defecto dentro de Grok Build. Cuesta $2 por millón de tokens de entrada y $6 por millón de tokens de salida, y funciona a unas 80 tokens por segundo.
Los benchmarks del día de lanzamiento publicados por xAI, comparados con Claude Opus 4.8:
| Benchmark | Grok 4.5 | Opus 4.8 (max) |
|---|---|---|
| SWE Marathon (pass@1) | 29.0% | 26.0% |
| Terminal Bench 2.1 | 83.3% | 78.9% |
| SWE-Bench Pro (tasa de resolución) | 64.7% | 69.2% |
El número que merece atención no es la columna de ganar o perder, sino la eficiencia de tokens: en SWE-Bench Pro, xAI afirma que Grok 4.5 resuelve tareas usando una media de 15.954 tokens de salida, frente a 67.020 para Opus 4.8 en el mismo benchmark: una brecha de 4,2x. Si eso se sostiene en cargas reales, un precio por token más alto no implica necesariamente un coste mayor por tarea terminada.
Conviene decir una advertencia claramente: estos son datos auto-reportados por xAI en su propia página de lanzamiento, sin verificación independiente todavía. Es normal en una salida del mismo día. Léelos como la afirmación del proveedor, y confirma cualquier capacidad crítica en tu propia carga antes de construir sobre ella.
El resto de la línea
Grok 4.5 no es el único movimiento reciente. grok-4.3 — todavía en el catálogo como opción de mayor contexto — soporta una ventana de 1M tokens y entrada de vídeo nativa, y puede generar PDF, hojas de cálculo y presentaciones directamente. Grok Imagine saltó a la versión 1.5, generando vídeo 720p a 24 fps con audio sincronizado nativo, y subió a lo más alto de rankings terceros de image-to-video en el lanzamiento. xAI también lanzó 21 voces multilingües y una API Speech-to-Text generalmente disponible en 25 idiomas. Nada de eso es el titular de esta semana, pero es el suelo sobre el que se apoya Grok 4.5.
Qué hemos añadido a MuiRouter
Tres modelos, para empezar:
grok-4.5— el nuevo flagship de xAI. Vale la pena probarlo primero en cualquier carga agentic o intensiva en código.grok-4.3— la opción de contexto 1M, útil cuando necesitas más espacio que la ventana de 500K de 4.5.grok-imagine-image— generación de texto a imagen mediante la misma forma/v1/images/generationsque ya usas paragpt-image-2.
El acceso pasa por Cloudflare AI Gateway del mismo modo que OpenAI y Gemini ya lo hacen en MuiRouter: sin cuenta xAI separada ni gestión de claves por tu parte. El precio actual por token está en la página de precios, que se mantiene sincronizada con lo que realmente cobramos; preferimos que mires esa página antes que un número congelado en un blog post.
La generación de vídeo (grok-imagine-video) no está en esta release. Es una API asíncrona basada en jobs — enviar una solicitud, hacer polling hasta completarse — que tiene una forma de integración distinta a todos los demás modelos que enrutamos hoy. Está en la roadmap; escribiremos sobre ello cuando esté listo.
Qué significa para desarrolladores
- Grok 4.5 es una afirmación de día de lanzamiento contra un modelo probado, no un resultado cerrado: ejecuta tu propia carga agentic o de código antes de tratar la tabla de benchmarks como una decisión de compra.
- Si la eficiencia de tokens se sostiene en tus prompts, cambia la matemática de costes incluso con un precio por token más alto. Vale la pena medirlo directamente.
- La ventana de 1M tokens de
grok-4.3merece una prueba en cualquier tarea que hayas estado troceando para encajar en un contexto más pequeño. grok-imagine-imageencaja directamente en cualquier workflow ya construido alrededor de/v1/images/generations.
Qué significa para usuarios de MuiRouter
Es la misma historia cada vez que añadimos un proveedor: tu integración no cambia. Una API key, una forma de solicitud, y el catálogo de modelos crece por debajo. Añadir Grok hoy — el mismo día en que salió su nuevo flagship — significa que puedes comparar grok-4.5 con los modelos que ya estás ejecutando de inmediato: misma facturación, mismos límites, misma cuenta, sin una segunda integración solo para saber si encaja mejor.
En resumen
Grok 4.5 es una afirmación seria desde el primer día: un modelo de clase Opus construido con el ADN de coding de Cursor, con precio y benchmarks para competir directamente con el nivel frontier de Anthropic. Falta ver si esa afirmación se sostiene bajo pruebas independientes, pero el hecho de que ahora puedas apuntar una sola API key de MuiRouter hacia él, junto con todos los demás modelos que ya ejecutas, significa que averiguarlo solo cuesta cambiar el nombre del modelo.
Fuentes de referencia
Fuente principal publicada el 8 de julio de 2026.
Prepárate para el próximo cambio de la IA
Empieza con una API Key y una ruta más clara para mantener estable el acceso a modelos mientras cambian las herramientas y la disponibilidad upstream.