Blog

Reseña de Grok 4.5 (2026): Benchmarks, Precios y Guía de la API

14 July 2026  ·  Actualizado 31 July 2026

Gabriel Caetano

Gabriel Caetano

INTERNATIONAL

Reseña de Grok 4.5 (2026): Benchmarks, Precios y Guía de la API

Conoce Grok 4.5, el nuevo modelo de IA de xAI. Compara benchmarks, precios, rendimiento en programación, acceso a la API y cómo compite contra GPT, Claude y Gemini.

grok 4.5

Todo sobre Grok 4.5: el modelo de IA agéntica más avanzado de xAI explicado

Grok 4.5 es el modelo de lenguaje grande insignia de SpaceXAI, lanzado el 8 de julio de 2026, diseñado específicamente para programación, tareas agénticas y trabajo de conocimiento. Es un modelo de mezcla de expertos entrenado en conjunto con Cursor, con un precio de $2 por 1M de tokens de entrada y $6 por 1M de tokens de salida, con esfuerzo de razonamiento configurable. Obtiene una puntuación de 54 en el Índice de Inteligencia de Artificial Analysis, colocándolo en el 4º lugar general, detrás de Fable 5, GPT-5.5 y Opus 4.8. Ten en cuenta que sus mayores ventajas no son dominar los benchmarks en bruto, sino su eficiencia en costos y velocidad. Una sola tarea del Índice de Inteligencia cuesta apenas $0.31, aproximadamente 5 veces más barato que Claude Sonnet 5 (max).

Si usas herramientas de IA para desarrollo, trading o investigación del día a día, el dinero que ahorras con herramientas más inteligentes se va acumulando, igual que el dinero que ahorras con comisiones de 0% en cambio de divisas al gastar en el extranjero con una tarjeta fintech como Bleap.

¿Gastas en herramientas de IA y SaaS de proveedores internacionales? La mayoría de las tarjetas cobran entre 2 y 3% en cada compra en el extranjero. Bleap cobra 0% en comisiones de cambio de divisas y te da hasta 20% de cashback en gaming, streaming y gastos del día a día, sin suscripción mensual. Obtén la tarjeta Bleap →

1. Breve historia de los modelos Grok: cómo llegamos hasta aquí

La familia de modelos Grok ha evolucionado rápidamente desde la fundación de xAI. Grok se lanzó en noviembre de 2023 como un chatbot integrado con X. Grok-1 era un modelo Mixture-of-Experts de 314 mil millones de parámetros, y en marzo de 2024, xAI publicó los pesos de Grok-1 como código abierto bajo una licencia Apache 2.0.

Grok-1.5 mejoró las capacidades de contexto largo a principios de 2024, mientras que Grok-2 llegó en agosto de 2024 con razonamiento mejorado, herramientas y entrada multimodal. Grok-3 siguió en febrero de 2025 con razonamiento más sólido y flujos de trabajo con uso de herramientas, entrenado en la supercomputadora Colossus de xAI. Grok-4 se convirtió en el modelo insignia en julio de 2025 con uso nativo de herramientas, búsqueda en tiempo real y un nivel multiagente Heavy.

Grok 4.5 no es simplemente otro paso incremental. Es el primer modelo entrenado en conjunto con Cursor, que incorpora billones de tokens de interacciones reales de desarrolladores con bases de código y herramientas de software. Eso lo convierte en una evolución arquitectónica, no en un simple ajuste.

2. ¿Qué es Grok 4.5? Definición y posicionamiento

Grok 4.5 es el modelo más avanzado de SpaceXAI, diseñado para destacar en programación, tareas agénticas y trabajo del conocimiento. Cursor lo describe como un modelo Mixture-of-Experts, con un precio confirmado de $2/$6 por millón de tokens, una tarifa de entrada en caché de $0.50 y una ventana de contexto de 500K.

Dentro del panorama de la IA, Artificial Analysis ubica a Grok 4.5 en el cuarto lugar de su Índice de Inteligencia, por detrás de Fable 5, GPT-5.5 y Opus 4.8, pero por delante de todos los modelos de código abierto y los modelos Gemini de Google. Su enfoque de diseño principal está orientado a los desarrolladores: es ideal para trabajar en bases de código existentes, depurar, refactorizar y navegar por código desconocido, lo que lo convierte en una herramienta práctica para desarrolladores, equipos de ingeniería y usuarios empresariales que necesitan una ejecución agéntica confiable a escala.

3. La asociación de entrenamiento conjunto entre xAI y Cursor

Grok 4.5 es el primer modelo entrenado de forma conjunta por xAI y Cursor, usando datos reales de interacciones de desarrolladores en lugar de repositorios de código estáticos. Esta asociación no tiene precedentes en el espacio de la IA de frontera.

Cuando xAI incorporó datos de Cursor en el entrenamiento suplementario, el modelo quedó expuesto a sesiones de desarrollo reales: bugs auténticos, patrones de depuración, decisiones de arquitectura y rondas de refactorización. Los repositorios de código contienen el resultado del desarrollo, pero los datos de Cursor contienen el proceso del desarrollo. En lugar de entrenar un modelo general y luego ajustarlo para código, SpaceXAI integró directamente a ingenieros de Cursor en el ciclo de entrenamiento, lo que significa que Grok 4.5 entiende patrones específicos del IDE como el autocompletado por tabulación, ediciones en múltiples archivos y recuperación de contexto con conciencia del proyecto desde el entrenamiento base.

El resultado práctico: las ventajas clave de Grok 4.5 son la comprensión de bases de código con múltiples archivos, la alineación con la intención del desarrollador y la coherencia a lo largo de sesiones de programación extendidas. Ningún otro laboratorio de IA de frontera tiene esta profundidad de datos sobre procesos de programación del mundo real al momento del entrenamiento.

4. Arquitectura del modelo y detalles de entrenamiento

Filosofía de diseño técnico

Grok 4.5 es un modelo de mezcla de expertos entrenado por SpaceXAI junto con el equipo de modelos de Cursor, en la infraestructura Colossus, utilizando decenas de miles de GPUs NVIDIA GB300. Más allá del volumen bruto de datos, xAI invirtió fuertemente en filtrado de datos, deduplicación, puntuación de calidad y selección enfocada por dominio, para luego escalar el aprendizaje por refuerzo a través de cientos de miles de tareas centradas en ingeniería de software de múltiples pasos.

xAI también introdujo el aprendizaje asíncrono, que permite que las sesiones de entrenamiento agéntico de varias horas se ejecuten en paralelo con el entrenamiento continuo del modelo, en lugar de hacerlo de forma secuencial. Esto es lo que le permite al modelo manejar tareas largas y con uso intensivo de herramientas sin perder coherencia.

Capacidades de ventana de contexto extendida

Grok 4.5 tiene una ventana de contexto de 500,000 tokens, lo que equivale aproximadamente a 1,000 páginas de texto en un solo prompt. Es bastante amplia, aunque menor que el millón de tokens que se le atribuye a Grok 4.3 y el 1.05 millones de GPT-5.6. La decisión fue intencional: xAI optimizó Grok 4.5 para la inteligencia y eficiencia por tarea, en lugar de maximizar el contexto, lo que lo convierte en una mejor opción para flujos de trabajo agénticos donde la precisión importa más que el volumen de entrada.

5. Capacidades principales de Grok 4.5

Programación y comprensión de bases de código con múltiples archivos

Grok 4.5 es increíblemente capaz en programación, desde tareas complejas en Rust y C/C++ hasta el desarrollo completo de aplicaciones, del prompt a producción. El co-entrenamiento con Cursor moldeó la forma en que el modelo maneja contextos de múltiples archivos, aprendiendo a rastrear las relaciones entre archivos como lo haría un desarrollador navegando por un IDE, en lugar de tratar cada archivo de forma independiente.

Ejecución de tareas agénticas

En el contexto de Grok 4.5, la IA agéntica significa que el modelo puede planear, ejecutar e iterar en tareas de múltiples pasos de forma autónoma. Los entornos de aprendizaje por refuerzo entrenan al modelo para investigar problemas, usar herramientas, recuperarse de errores y verificar resultados. Soporta razonamiento configurable en niveles bajo/medio/alto, llamadas a funciones, búsqueda web, búsqueda en X y ejecución de código.

Trabajo de oficina y gestión del conocimiento

Grok Build, impulsado por Grok 4.5, puede construir modelos complejos en Excel con uso de fórmulas en múltiples hojas, crear presentaciones en PowerPoint con formas y diagramas nativos, y redactar textos claros en Word. En la evaluación Snorkel GDPVal+, Grok 4.5 mostró un rendimiento sólido en trabajo legal (40%), educación (58%) y salud (35%), superando a GPT-5.5 y Opus 4.8 en esas áreas.

Cuando pagas por herramientas de software, acceso a APIs y suscripciones SaaS de proveedores internacionales, esos costos se van acumulando. Usar la Mastercard autocustodiada de Bleap con 0% de comisiones por cambio de divisa significa que conservas más de tu presupuesto para las herramientas que realmente importan.

6. Rendimiento en benchmarks: cómo se posiciona Grok 4.5

Grok 4.5 vs Claude (Opus y Fable)

El panorama en benchmarks es competitivo pero con matices. En SWE Bench Pro, Grok 4.5 obtiene un 64.7%, por debajo de Fable 5 con 80.4%, pero por encima de Opus 4.7 con 64.3% y GPT-5.5 con 58.6%. Sin embargo, Grok 4.5 resuelve tareas con un promedio de aproximadamente 15,954 tokens de salida, unas 4.2 veces menos que Opus 4.8 con 67,020.

Grok 4.5 vs GPT-5.5

En Terminal Bench 2.1, Grok 4.5 obtiene 83.3%, casi igualando a GPT-5.5 con 83.4%. En DeepSWE 1.0, GPT-5.5 va adelante con 64.31% frente al 62.0% de Grok 4.5. La diferencia se amplía en DeepSWE 1.1, donde Grok 4.5 llega al 53%, muy por detrás de GPT-5.5 con 67%.

Tabla comparativa

Benchmark

Grok 4.5

Claude Fable 5

GPT-5.5

Claude Opus 4.8

Terminal Bench 2.1

83.3%

84.3%

83.4%

78.9%

SWE Bench Pro

64.7%

80.4%

58.6%

69.2%

DeepSWE 1.0

62.0%

66.1%

64.3%

55.8%

SWE Marathon

29.0%

24.0%

N/A

26.0%

Velocidad y eficiencia

Grok 4.5 opera a 80 tokens por segundo, con una eficiencia de salida aproximadamente el doble que la de modelos comparables en las mismas tareas. En el Coding Agent Index, Grok 4.5 en Grok Build tuvo un costo de $2.49 por tarea, mientras que Fable 5 en Claude Code costó $11.80 y GPT-5.5 en Codex $5.07.

¿Los costos de modelos de IA están afectando tu presupuesto? Ya sea que gastes en llamadas a API o en herramientas SaaS, Bleap te ayuda a conservar más de cada peso. 0% de comisiones en cambio de divisas en compras internacionales, hasta 20% de cashback y sin suscripción mensual. Consigue la tarjeta Bleap →

7. Precios y opciones de acceso

Precios de la API de Grok 4.5

Grok 4.5 tiene un precio de $2.00 por cada millón de tokens de entrada, $6.00 por cada millón de tokens de salida y $0.50 por cada millón de tokens de entrada en caché. Esto lo pone por debajo de Claude Opus 4.8 ($5/$25) en aproximadamente 3 veces en entrada y 4.2 veces en salida. xAI aplica precios escalonados con un umbral de 200K en el prompt: los prompts que superan los 200K tienen un costo de $4.00/$1.00/$12.00 por cada millón de tokens.

Como referencia, el GPT-5.6 Luna de OpenAI tiene un precio de $1 en entrada y $6 en salida, lo que lo hace más económico en entrada pero comparable en salida.

Acceso a Grok Build

Grok 4.5 es ahora el modelo predeterminado que impulsa Grok Build, el agente de codificación con IA basado en terminal de xAI. xAI ofrece uso gratuito de Grok 4.5 por tiempo limitado en Grok Build y Cursor. Grok Build no solo admite tareas de programación, sino también tareas en Excel, PowerPoint y Word, y puede ejecutar hasta 8 sub-agentes en paralelo.

Acceso mediante integración con Cursor

Grok 4.5 está disponible como modelo predeterminado en Cursor en todos los niveles de suscripción sin costo adicional, incluyendo los planes gratuito, Pro y Business. Los planes de suscripción de Cursor incluyen un uso significativo del modelo, con el doble de uso durante la primera semana. La integración nativa con el IDE significa que los desarrolladores pueden usar Grok 4.5 sin tener que cambiar de entorno.

8. Casos de uso clave de Grok 4.5

Ingeniería de software y flujos de trabajo para desarrolladores

Grok 4.5 está diseñado para trabajar con repositorios reales, manejar cambios que afectan múltiples archivos y funcionar dentro de agentes que planifican y llaman herramientas. Buenos puntos de partida son los asistentes de código con conciencia del repositorio, herramientas de revisión de código y flujos de issue a PR.

Automatización agéntica

Grok 4.5 está construido para el ciclo del agente: leer, planificar, editar, ejecutar, inspeccionar y repetir. Sus capacidades de llamada a funciones y uso de herramientas lo hacen ideal para crear agentes autónomos que orquestan procesos de negocio, se integran con APIs externas y ejecutan flujos de trabajo de múltiples pasos.

Trabajo del conocimiento empresarial

Grok 4.5 también se está posicionando para tareas legales, financieras y de oficina que dependen de documentos extensos y razonamiento estructurado. Ocupa el primer lugar en el Legal Agent Benchmark de Harvey y, en la evaluación GDPVal+ de Snorkel, logró una tasa de aprobación promedio del 29%, superando a GPT-5.5 (22%) y Opus 4.8 (21%).

Las bóvedas de ahorro de Bleap también pueden complementar tu planeación empresarial. Con Steady al 3.65% AER y Dynamic al 3.83% AER en USD, un depósito mínimo de $1 y 0% de comisiones por retiro, ofrecen un lugar práctico para guardar capital de trabajo entre gastos.

9. Consideraciones de Posicionamiento Empresarial y Gobernanza

Integrando Grok 4.5 en Flujos de Trabajo en Producción

Para la mayoría de los equipos, el enfoque práctico es evaluar Grok 4.5 junto con los modelos existentes en dimensiones como calidad del código, comportamiento de agentes, latencia, costo y gobernanza. El modelo es compatible tanto con la API de Responses como con los formatos de Chat Completions, lo que significa que se integra sin modificaciones en bases de código ya construidas sobre APIs compatibles con OpenAI.

IA Responsable y Gestión de Riesgos

Artificial Analysis identificó una debilidad importante: la tasa de alucinaciones de Grok 4.5 aumentó del 25% (Grok 4.3) al 54%, lo que significa que el modelo sabe más, pero también es más seguro de sí mismo cuando se equivoca. Cursor ha añadido nuevas medidas de seguridad que reflejan las capacidades del modelo en ciberseguridad. Los equipos empresariales deberían implementar verificación humana en el proceso para los resultados críticos, especialmente en industrias reguladas.

10. Cómo empezar: Integración con la API y guía de inicio rápido

Poner en marcha Grok 4.5 requiere unos pocos pasos:

  1. Crea una cuenta de desarrollador en xAI en console.x.ai y genera una clave API.
  2. Revisa la documentación oficial y la ficha del modelo en x.ai/news/grok-4-5.
  3. Haz tu primera llamada a la API. La API de xAI es compatible con OpenAI, así que apunta el mismo cliente a https://api.x.ai/v1 con tu clave de xAI y el nombre del modelo grok-4.5.
  4. Prueba las capacidades de contexto largo y agénticas cargando una base de código con varios archivos en una sola llamada y pidiéndole al modelo que refactorice o depure el código.
  5. Explora Grok Build para la orquestación avanzada de agentes con subagentes en paralelo y uso de herramientas.

Consejos prácticos: ten en cuenta el precio escalonado por encima de 200K de entrada. Usa el caché de prompts de forma intensiva ($0.50/1M de entrada en caché vs $2.00 estándar). Y considera que Grok 4.5 todavía no está disponible en la UE; se espera que llegue a mediados de julio de 2026.

¿Construyes con herramientas de IA y pagas suscripciones SaaS a nivel global? La Mastercard de autocustodia de Bleap te da 0% de comisiones por cambio de divisa en cada compra internacional, hasta 20% de cashback y sin suscripción mensual. Tus fondos siempre bajo tu control. Abre una cuenta en Bleap →

11. Preguntas frecuentes sobre Grok 4.5

¿Qué es la API de Grok 4.5 y cómo puedo acceder a ella?

Grok 4.5 está disponible en la API de xAI a través de la consola para desarrolladores de SpaceXAI. El ID del modelo es grok-4.5. La autenticación usa un token bearer y el endpoint es compatible con OpenAI, lo que facilita la integración con configuraciones existentes.

¿Cómo se compara Grok 4.5 con GPT-5.5 en tareas de programación?

Grok 4.5 está prácticamente empatado con GPT-5.5 en Terminal Bench 2.1 (83.3% vs 83.4%) y lleva ventaja en SWE Bench Pro (64.7% vs 58.6%), aunque se queda atrás en DeepSWE 1.1 (53% vs 67%). La ventaja de Grok 4.5 está en el costo y la eficiencia por tarea completada.

¿Cuánto cuesta usar Grok 4.5?

Grok 4.5 tiene un precio de $2 por millón de tokens de entrada y $6 por millón de tokens de salida, con $0.50/1M para entradas en caché. Los prompts que superan los 200K tokens tienen tarifas más altas por token.

¿Grok 4.5 es mejor que Claude para flujos de trabajo agénticos?

En GDPval-AA v2, Banking y Terminal-Bench v2.1, Grok 4.5 está a la par o por delante de Claude Opus 4.8 y GPT-5.5 en tareas agénticas. Lleva ventaja en costo por tarea. Para tareas de programación pura en los problemas más difíciles, Fable 5 y Opus 4.8 todavía tienen cierta ventaja.

¿Qué es Grok Build y para quién es?

Grok Build es el agente de programación con IA de xAI, ahora impulsado por Grok 4.5 como modelo predeterminado. Está diseñado para desarrolladores que quieren programación agéntica desde la terminal, con sub-agentes en paralelo, llamadas a herramientas e integraciones con Office. Por tiempo limitado, el uso es gratuito.

¿Qué hace de Grok 4.5 un modelo de IA de contexto largo?

Grok 4.5 soporta una ventana de contexto de 500K tokens (aproximadamente 375,000 palabras), suficiente para procesar bases de código completas, artículos de investigación o historiales de conversación extensos de una sola vez. Para equipos de ingeniería, esto significa cargar límites de servicio completos sin necesidad de dividirlos en fragmentos.

Conclusión: ¿Grok 4.5 es el modelo indicado para ti?

Grok 4.5 ocupa un lugar bien definido en el panorama de la IA en 2026: un modelo rankeado en 4º lugar por Artificial Analysis, con un precio de $2/$6 por millón de tokens, y que genera muchos menos tokens de salida en tareas agénticas, lo que lo convierte en una de las propuestas de mayor valor para desarrolladores y empresas. Sus principales fortalezas son la capacidad en programación, la ejecución de tareas agénticas y la eficiencia de costos, más que dominar los benchmarks de forma absoluta.

La alianza xAI-Cursor le da a Grok 4.5 una ventaja de entrenamiento estructural que ningún otro laboratorio puede replicar. Si tu flujo de trabajo se centra en código, tareas de agente de larga duración o trabajo de conocimiento empresarial, merece estar en tu lista de evaluación junto con Claude y GPT.

Mientras construyes tu flujo de trabajo impulsado por IA, asegúrate de que el lado financiero de tu stack sea igual de eficiente. La Mastercard de autocustodia de Bleap, con 0% de comisiones por cambio de divisa y hasta 20% de cashback, hace que cada euro que gastas en SaaS internacional, créditos de API o herramientas de desarrollo rinda más. Sin suscripción mensual ni cargos ocultos.

Prueba Bleap →

Una forma más inteligente de gastar, enviar, ganar y operar

Imagen de la sección Puntos Clave
  • international

Artículos relacionados