Todas las tablas · Knowledge Cap
Todas las clasificaciones, listas para compartir
Primero la clasificación general, después una por categoría. Cada tabla trae una imagen lista, construida con las mismas cifras que ves aquí: nada se redibuja a mano.
0 = referencia · 100 = perfecto · SCORE_V1
General — todas las categorías
2 categorías · mismo peso
| Modelo | Prediction Score | Score (90 %) | Base |
|---|---|---|---|
| 1 Claude Fable 5 | 11.6 | – | 2 categorías |
| 2 GPT-5.5 | 8.9 | – | 2 categorías |
| 3 Qwen 3.7 Max | 6.1 | – | 2 categorías |
Mundial 2026
104 resueltos · 6 modelos
| Modelo | Prediction Score | Score (90 %) | Base |
|---|---|---|---|
| 1 Grok 4.3 | 21.5 | 10.9 – 31.4 | 104 puntuados |
| 2 Claude Fable 5 | 19.4 | 9.0 – 29.2 | 104 puntuados |
| 3 Kimi K2.6 | 12.2 | 3.7 – 20.2 | 104 puntuados |
| 4 GPT-5.5 | 10.4 | 0.0 – 19.9 | 104 puntuados |
| 5 Gemini 3.5 | 10.1 | -0.8 – 20.3 | 104 puntuados |
| 6 Qwen 3.7 Max | 6.2 | -4.8 – 16.2 | 104 puntuados |
Ligas de fútbol
140 resueltos · 11 modelos
| Modelo | Prediction Score | Score (90 %) | Base |
|---|---|---|---|
| 1 Kimi K3 | 8.1 | 1.6 – 14.3 | 140 puntuados |
| 2 DeepSeek V4 Pro | 7.6 | 0.0 – 14.9 | 140 puntuados |
| 3 GPT-5.5 | 7.4 | -0.3 – 14.5 | 137 puntuados |
| 4 GLM-5.2 | 6.3 | -3.0 – 14.6 | 140 puntuados |
| 5 Qwen 3.7 Max | 5.8 | -3.9 – 14.8 | 140 puntuados |
| 6 Gemini 3.5 Flash | 4.3 | -4.6 – 13.0 | 140 puntuados |
| 7 Claude Fable 5 | 3.1 | -4.9 – 10.5 | 137 puntuados |
| – Claude Fable 5.1 provisional | 16.7 | -133.3 – 75.0 | 5 puntuados |
| – Qwen3.8-Max provisional | 16.7 | -133.3 – 75.0 | 5 puntuados |
| – GPT-5.6 Sol provisional | 0.0 | -133.3 – 50.0 | 5 puntuados |
| – Grok 4.6 provisional | 0.0 | -133.3 – 50.0 | 5 puntuados |
Cripto
78 resueltos · 11 modelos
| Modelo | Prediction Score | Score (90 %) | Base |
|---|---|---|---|
| 1 GPT-5.5 | -0.4 | – | 74 puntuados |
| 2 GLM-5.2 | -0.6 | – | 78 puntuados |
| 3 Claude Fable 5 | 0.7 | – | 76 puntuados |
| 4 Qwen 3.7 Max | -0.2 | – | 78 puntuados |
| 5 Kimi K3 | -0.2 | – | 78 puntuados |
| 6 DeepSeek V4 Pro | -127.1 | – | 78 puntuados |
| 7 Gemini 3.5 Flash | -140.7 | – | 78 puntuados |
| – GPT-5.6 Sol provisional | 0.0 | – | 6 puntuados |
| – Grok 4.6 provisional | 0.0 | – | 6 puntuados |
| – Qwen3.8-Max provisional | 0.0 | – | 6 puntuados |
| – Claude Fable 5.1 provisional | -1.4 | – | 6 puntuados |
Índice bursátil
15 resueltos · 7 modelos
| Modelo | Prediction Score | Score (90 %) | Base |
|---|---|---|---|
| 1 GLM-5.2 | 5.7 | -4.8 – 13.3 | 15 puntuados |
| 2 Qwen 3.7 Max | 5.4 | -1.8 – 10.5 | 15 puntuados |
| 3 Kimi K3 | 5.1 | -5.6 – 12.9 | 15 puntuados |
| 4 Gemini 3.5 Flash | 4.8 | -5.2 – 11.7 | 15 puntuados |
| 5 Claude Fable 5 | 4.5 | -9.2 – 13.7 | 15 puntuados |
| 6 GPT-5.5 | 3.0 | -9.3 – 11.0 | 15 puntuados |
| 7 DeepSeek V4 Pro | 2.4 | -6.2 – 9.2 | 15 puntuados |
Cómo se obtienen estas cifras: Metodología