Claude, de Anthropic, lidera Kalshi con un 65,2% tras lanzar Opus 5

Kalshi sitúa a Claude como favorito para cerrar 2026 como el modelo mejor clasificado en LMArena, con un 65,2% frente al 14,6% de ChatGPT y el 10,2% de Gemini.

02 de agosto de 2026 a las 09:53h
Claude, de Anthropic, lidera Kalshi con un 65,2% tras lanzar Opus 5
Claude, de Anthropic, lidera Kalshi con un 65,2% tras lanzar Opus 5

Añadir Mangas Verdes como fuente preferida de Google de forma gratuita.

Mantente informado con las últimas noticias de actualidad.

Activar ahora

En el mercado de predicción Kalshi, la carrera por coronar al mejor modelo de lenguaje de 2026 ya tiene un favorito claro.

El 28 de julio a las 08.06 horas, los contratos del evento KXLLM1-26DEC31 daban a Claude, de Anthropic, una probabilidad implícita del 65,2%. ChatGPT, de OpenAI, quedaba en el 14,6% y Gemini, de Google, en el 10,2%.

Anthropic tomó ventaja cuatro días después de presentar su nuevo modelo

Hay cifras que no describen una tendencia, sino un hueco. Entre Claude y ChatGPT había 50,6 puntos de distancia en ese mercado, una brecha demasiado grande para leerla como una simple oscilación de verano.

Anthropic presentó Claude Opus 5 el 24 de julio de 2026. Apenas cuatro días después, ese lanzamiento ya pesaba lo suficiente como para colocar a la compañía muy por delante de OpenAI y Google en la apuesta sobre quién cerrará el año en cabeza.

El volumen negociado superó los 7,6 millones de dólares.

Ese dato importa porque no habla solo de expectación. Habla de dinero real apostado a una pregunta muy concreta, cuál de los laboratorios tendrá el modelo mejor clasificado al terminar 2026.

La apuesta no mide fama, sino el primer puesto en una clasificación concreta

Kalshi no resolverá el contrato por popularidad ni por ruido en redes. La opción de Claude solo saldrá afirmativa si un modelo de Anthropic ocupa el primer puesto en LMArena el 31 de diciembre con la opción de eliminar el control de estilo activada.

Esa letra pequeña cambia bastante la lectura del mercado. No basta con lanzar un modelo llamativo en algún momento del año, porque el veredicto queda atado a una clasificación concreta, a una fecha exacta y a una configuración también exacta.

Si el empate llega, manda el marcador.

Primero se aplicará la puntuación Arena, después el número de votos y, si aún persiste la igualdad, decidirá la fecha de lanzamiento. Es una cadena de desempate que premia tanto el rendimiento medido como la ventaja temporal cuando todo lo demás queda igualado.

El nuevo Opus 5 reforzó la narrativa de coste y rendimiento

Anthropic sostuvo en el anuncio de lanzamiento que el modelo duplicó con creces el rendimiento de Opus 4.8 en Frontier-Bench v0.1. La compañía añadió además que ese salto llegaba con un coste inferior por tarea.

Esa combinación explica buena parte del entusiasmo. En el negocio de los modelos de lenguaje no basta con rendir más, también cuenta cuánto cuesta poner ese rendimiento a trabajar miles o millones de veces al día, algo que ya asomaba en el consumo real de tokens.

Además, Anthropic mantuvo intacta la tarifa de la API.

La empresa fijó el precio en 5 dólares por cada millón de tokens de entrada y 25 dólares por cada millón de tokens de salida. Dicho de otra manera, defendió la idea de que el avance del modelo no obligaba a pagar más por acceder a él, una cuestión que pesa tanto como la propia calidad cuando las comparaciones se convierten en facturas y hasta en los límites de los LLM acaban discutiéndose en términos de uso cotidiano.

La escena deja una paradoja interesante. El mercado ya concede a Claude una ventaja del 65,2%, pero el contrato no premia promesas ni titulares, solo la foto fija del 31 de diciembre y una tabla en la que, si dos modelos empatan, hasta la fecha de lanzamiento puede inclinar el resultado.

Sobre el autor
Redacción
Ver biografía