Añadir Mangas Verdes como fuente preferida de Google de forma gratuita.
Mantente informado con las últimas noticias de actualidad.
Empatar en cabeza no siempre significa dominar. Grok 4.6 ha alcanzado 61 puntos en el índice de inteligencia de Artificial Analysis y esa marca lo coloca al nivel de GPT-5.6 Sol, aunque todavía queda a un punto de Claude Fable 5 y a dos de Claude Opus 5.
Grok 4.6 ganó cinco puntos en un mes
Hace un mes, Grok 4.5 estaba cinco puntos por debajo. Ese salto tan rápido comprime la distancia entre modelos que hasta hace poco parecían ordenados con más claridad.
SpaceXAI mantiene el precio en 2 dólares por millón de tokens de entrada y 6 dólares por millón de tokens de salida.
Ahí aparece una de las claves de esta carrera. No basta con subir en un ranking si el coste se dispara, porque el mercado del código y de los asistentes para empresas mira cada vez más la relación entre rendimiento y factura, algo que ya pesa en la comparación entre modelos y uso real de tokens coste por token.
La compra de Cursor empuja a SpaceXAI hacia la empresa
La operación de 60.000 millones de dólares para comprar Cursor no encaja solo como una adquisición de talento. También abre la puerta a recopilar datos de actividad y a empujar la entrada en el mercado empresarial apoyándose en las infraestructuras Colossus y Colossus 2.
Visto así, Grok 4.6 no llega solo como un modelo que mejora una nota. Llega acompañado de una pieza que conecta el rendimiento del laboratorio con una herramienta usada a diario por programadores, justo donde hoy se decide buena parte del negocio del software asistido por IA.
Las pruebas de código aprietan más que el ranking general
Cognition asegura que Grok 4.6 supera a GPT-5.6 en sus pruebas con Devin.
Code Arena, sin embargo, dibuja una foto más apretada. Allí Grok 4.6 aparece prácticamente empatado con GPT-5.6 Sol y Claude Fable 5 en desarrollo web, un terreno donde las diferencias pequeñas pueden parecer decisivas por la mañana y quedarse en matiz por la tarde, como ya ocurre en creación de apps y webs guiada por lenguaje natural.
Dos medidas distintas dejan una tensión difícil de ignorar. El índice general lo empata con GPT-5.6 Sol, pero las pruebas centradas en programación lo mueven dentro de un grupo muy estrecho donde tres modelos pelean casi hombro con hombro.
La distancia entre el primero y Grok 4.6 es de solo dos puntos. En un mercado que además se juega precios, datos de uso y acceso a clientes empresariales, esa brecha tan corta vale menos como coronación que como aviso de lo comprimida que se ha vuelto la carrera.