Baremo de Escritura IA
¿Qué IA escribe mejor en español?
El banco de pruebas independiente que compara, a ciegas, cómo escriben los modelos de IA en español.
Compara a ciegas dos textos y ayuda a construir la clasificación.
Nuevo análisis
¿Qué cambia cuando un modelo razona antes de escribir?
Las primeras comparaciones emparejadas muestran por qué ningún ajuste gana con todos los modelos e idiomas.
Clasificación por IA de modelos que escriben en español
Los jueces de IA determinan la clasificación principal; los votos humanos se muestran por separado mientras crece la muestra de la comunidad.
Actualizado
| Puesto | Modelo | Puntuación del juez de IA | Puntuación humana |
|---|---|---|---|
| 1 | 94,9 | — | |
| 2 | 93,9 | — | |
| 3 | 92,0 | — | |
| 5 | 88,3 | — | |
| 6 | 73,7 | — | |
| 7 | 66,4 | — | |
| 8 | 64,5 | — | |
| 9 | 59,6 | — | |
| 10 | 58,5 | — | |
| 11 | 55,3 | — | |
| 12 | 55,2 | — | |
| 13 | 52,7 | — | |
| 14 | 52,3 | — | |
| 15 | 49,7 | — | |
| 16 | 47,5 | — | |
| 17 | 45,6 | — | |
| 18 | 45,1 | — | |
| 19 | 44,4 | — | |
| 20 | 40,8 | — | |
| 21 | 38,1 | — | |
| 22 | 37,9 | — | |
| 23 | 35,3 | — | |
| 24 | 34,9 | — | |
| 25 | 32,1 | — | |
| 26 | 30,7 | — | |
| 27 | 28,3 | — | |
| 28 | 28,2 | — | |
| 29 | 24,8 | — | |
| 30 | 14,9 | — | |
| 31 | 12,1 | — | |
| 32 | 11,0 | — | |
| 33 | Laguna S 2.1 UD 💡 🏠 | 8,7 | — |
Método: modelo Bradley–Terry regularizado. La puntuación del juez de IA determina el puesto; la puntuación humana es independiente y seguirá siendo secundaria hasta que haya más votos de la comunidad. Una puntuación de 50 representa una probabilidad estimada del 50 % de superar al modelo medio en este idioma y categoría.
Resultados directos de los duelos
Cada celda muestra la proporción de puntos posibles obtenida por el modelo de la fila frente al modelo de la columna: una victoria vale el 100%, un empate el 50% y una derrota el 0%. Esta matriz de resultados utiliza únicamente los protocolos de evaluación compatibles incluidos en la clasificación principal.
Matriz direccional de los puntos obtenidos en duelos directos. Los valores superiores al 50% favorecen al modelo de la fila; los inferiores al 50% favorecen al modelo de la columna.
↯ indica un modelo sin razonamiento. 🏠 indica un modelo ejecutado localmente con LM Studio.
Ver como tabla de datos
| Modelo | Claude Opus 5 💡 | Claude Fable 5 High 💡 | Kimi K3 💡 | GPT-5.6 Sol 💡 | Gemini 3.6 Flash 💡 | Claude Sonnet 5 💡 | MiniMax M3 💡 | Qwen3.7 Max 💡 | DeepSeek-V4-Pro 💡 | GLM-5.2 💡 | Gemma 4 31B Instruct Q8_0 💡 🏠 | GPT-5.6 Luna 💡 | Gemma 4 26B-A4B Instruct Q8_0 💡 🏠 | GPT-5.6 Terra 💡 | DeepSeek-V4-Flash 💡 | Gemma 4 26B-A4B Instruct QAT 💡 🏠 | Gemma 4 31B Instruct QAT 💡 🏠 | Qwen3.7 Plus 💡 | Gemma 4 12B Instruct Q8_0 💡 🏠 | Qwen3.6-27B Q4_K_M 💡 🏠 | Gemma 4 31B Instruct QAT ↯ 🏠 | MiMo-V2.5-Pro 💡 | Qwen3.6-35B-A3B Q4_K_M 💡 🏠 | Qwen3.6-27B Q8_0 💡 🏠 | Qwen3.6-35B-A3B Q8_0 💡 🏠 | Gemma 4 12B Instruct Q8_0 ↯ 🏠 | Gemma 4 12B Instruct QAT 💡 🏠 | Mistral Medium 3.5 128B ↯ 🏠 | MiMo-V2.5 💡 | Qwen3.6-35B-A3B Q8_0 ↯ 🏠 | Qwen3.6-27B Q8_0 ↯ 🏠 | Laguna S 2.1 UD 💡 🏠 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 💡 | — | 60,2% | 80,0% | 80,0% | 80,0% | 80,0% | 60,0% | 80,0% | 80,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 80,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% |
| Claude Fable 5 High 💡 | 39,8% | — | 59,2% | 94,8% | 40,0% | 80,0% | 91,7% | 100,0% | 99,0% | 100,0% | 90,2% | 93,9% | 94,4% | 98,0% | 97,9% | 93,9% | 93,9% | 99,0% | 92,0% | 93,9% | 93,5% | 100,0% | 96,0% | 95,3% | 95,3% | 95,7% | 92,5% | 97,3% | 99,0% | 99,5% | 99,5% | 100,0% |
| Kimi K3 💡 | 20,0% | 40,8% | — | 100,0% | 80,0% | 80,0% | 70,0% | 70,0% | 100,0% | 100,0% | 100,0% | 100,0% | 80,0% | 100,0% | 100,0% | 90,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% | 100,0% |
| GPT-5.6 Sol 💡 | 20,0% | 5,2% | 0,0% | — | 60,0% | 60,0% | 88,9% | 91,7% | 82,4% | 86,1% | 89,0% | 90,0% | 90,0% | 100,0% | 97,2% | 90,8% | 95,0% | 97,2% | 95,0% | 100,0% | 100,0% | 93,1% | 90,5% | 100,0% | 95,0% | 100,0% | 93,8% | 98,5% | 100,0% | 100,0% | 100,0% | 100,0% |
| Gemini 3.6 Flash 💡 | 20,0% | 60,0% | 20,0% | 40,0% | — | 50,0% | 50,0% | 70,0% | 80,0% | 100,0% | 80,0% | 40,0% | 80,0% | 40,0% | 80,0% | 50,0% | 66,7% | 80,0% | 66,7% | 80,0% | 83,3% | 80,0% | 100,0% | 100,0% | 100,0% | 100,0% | 70,0% | 80,0% | 100,0% | 100,0% | 100,0% | 100,0% |
| Claude Sonnet 5 💡 | 20,0% | 20,0% | 20,0% | 40,0% | 50,0% | — | 40,0% | 40,0% | 60,0% | 50,0% | 80,0% | 40,0% | 60,0% | 40,0% | 60,0% | 50,0% | 100,0% | 60,0% | 66,7% | 90,0% | 66,7% | 80,0% | 80,0% | 100,0% | 100,0% | 100,0% | 100,0% | 80,0% | 100,0% | 100,0% | 100,0% | 100,0% |
| MiniMax M3 💡 | 40,0% | 8,3% | 30,0% | 11,1% | 50,0% | 60,0% | — | 70,6% | 56,7% | 84,4% | 52,4% | 100,0% | 100,0% | 100,0% | 66,7% | 52,9% | 68,8% | 73,5% | 70,0% | 55,9% | 100,0% | 73,5% | 82,4% | 70,0% | 65,0% | 50,0% | 77,3% | 100,0% | 87,5% | 83,3% | 66,7% | 100,0% |
| Qwen3.7 Max 💡 | 20,0% | 0,0% | 30,0% | 8,3% | 30,0% | 60,0% | 29,4% | — | 42,2% | 50,0% | 77,8% | 80,0% | 70,0% | 75,0% | 72,6% | 67,2% | 60,7% | 72,6% | 80,0% | 70,7% | 100,0% | 71,0% | 77,6% | 77,3% | 80,0% | 83,3% | 77,8% | 100,0% | 83,9% | 83,3% | 83,3% | 100,0% |
| DeepSeek-V4-Pro 💡 | 20,0% | 1,0% | 0,0% | 17,6% | 20,0% | 40,0% | 43,3% | 57,8% | — | 56,5% | 35,0% | 60,0% | 40,0% | 75,0% | 71,0% | 66,7% | 72,2% | 67,2% | 50,0% | 82,1% | 100,0% | 79,7% | 71,4% | 62,5% | 75,0% | 92,3% | 66,7% | 75,0% | 78,1% | 100,0% | 100,0% | 100,0% |
| GLM-5.2 💡 | 0,0% | 0,0% | 0,0% | 13,9% | 0,0% | 50,0% | 15,6% | 50,0% | 43,5% | — | 44,4% | 60,0% | 70,0% | 60,0% | 72,6% | 56,9% | 61,1% | 59,7% | 61,1% | 71,4% | 100,0% | 62,9% | 73,2% | 77,8% | 88,9% | 83,3% | 100,0% | 75,0% | 85,5% | 83,3% | 100,0% | 100,0% |
| Gemma 4 31B Instruct Q8_0 💡 🏠 | 0,0% | 9,8% | 0,0% | 11,0% | 20,0% | 20,0% | 47,6% | 22,2% | 65,0% | 55,6% | — | 60,0% | 60,0% | 60,0% | 41,7% | 60,0% | 87,5% | 22,2% | 77,8% | 66,7% | 50,0% | 50,0% | 72,2% | 77,8% | 50,0% | 75,0% | 87,9% | 75,0% | 88,9% | 75,0% | 100,0% | 66,7% |
| GPT-5.6 Luna 💡 | 0,0% | 6,1% | 0,0% | 10,0% | 60,0% | 60,0% | 0,0% | 20,0% | 40,0% | 40,0% | 40,0% | — | 60,0% | 40,0% | 40,0% | 40,0% | 100,0% | 30,0% | 50,0% | 100,0% | 33,3% | 60,0% | 60,0% | 100,0% | 100,0% | 100,0% | 100,0% | 80,0% | 100,0% | 100,0% | 100,0% | 100,0% |
| Gemma 4 26B-A4B Instruct Q8_0 💡 🏠 | 0,0% | 5,6% | 20,0% | 10,0% | 20,0% | 40,0% | 0,0% | 30,0% | 60,0% | 30,0% | 40,0% | 40,0% | — | 40,0% | 60,0% | 50,0% | 100,0% | 40,0% | 75,0% | 80,0% | 66,7% | 90,0% | 60,0% | 100,0% | 100,0% | 100,0% | 80,0% | 60,0% | 100,0% | 100,0% | 100,0% | 100,0% |
| GPT-5.6 Terra 💡 | 0,0% | 2,0% | 0,0% | 0,0% | 60,0% | 60,0% | 0,0% | 25,0% | 25,0% | 40,0% | 40,0% | 60,0% | 60,0% | — | 50,0% | 25,0% | 66,7% | 25,0% | 50,0% | 50,0% | 66,7% | 60,0% | 50,0% | 75,0% | 100,0% | 100,0% | 100,0% | 80,0% | 100,0% | 100,0% | 100,0% | 100,0% |
| DeepSeek-V4-Flash 💡 | 0,0% | 2,1% | 0,0% | 2,8% | 20,0% | 40,0% | 33,3% | 27,4% | 29,0% | 27,4% | 58,3% | 60,0% | 40,0% | 50,0% | — | 70,0% | 48,3% | 45,2% | 66,7% | 50,0% | 100,0% | 66,1% | 46,7% | 51,7% | 70,0% | 80,8% | 83,3% | 90,0% | 87,1% | 96,2% | 84,6% | 100,0% |
| Gemma 4 26B-A4B Instruct QAT 💡 🏠 | 0,0% | 6,1% | 10,0% | 9,2% | 50,0% | 50,0% | 47,1% | 32,8% | 33,3% | 43,1% | 40,0% | 60,0% | 50,0% | 75,0% | 30,0% | — | 44,6% | 41,4% | 87,5% | 53,4% | 100,0% | 50,0% | 58,6% | 75,0% | 56,2% | 66,7% | 80,0% | 100,0% | 83,9% | 100,0% | 100,0% | 100,0% |
| Gemma 4 31B Instruct QAT 💡 🏠 | 0,0% | 6,1% | 0,0% | 5,0% | 33,3% | 0,0% | 31,2% | 39,3% | 27,8% | 38,9% | 12,5% | 0,0% | 0,0% | 33,3% | 51,7% | 55,4% | — | 60,7% | 72,2% | 58,9% | 30,0% | 59,3% | 50,0% | 66,7% | 88,9% | 60,0% | 72,2% | 66,7% | 81,5% | 80,0% | 100,0% | 100,0% |
| Qwen3.7 Plus 💡 | 20,0% | 1,0% | 0,0% | 2,8% | 20,0% | 40,0% | 26,5% | 27,4% | 32,8% | 40,3% | 77,8% | 70,0% | 60,0% | 75,0% | 54,8% | 58,6% | 39,3% | — | 45,0% | 41,4% | 100,0% | 64,5% | 58,6% | 75,0% | 62,5% | 66,7% | 77,8% | 75,0% | 77,4% | 83,3% | 83,3% | 100,0% |
| Gemma 4 12B Instruct Q8_0 💡 🏠 | 0,0% | 8,0% | 0,0% | 5,0% | 33,3% | 33,3% | 30,0% | 20,0% | 50,0% | 38,9% | 22,2% | 50,0% | 25,0% | 50,0% | 33,3% | 12,5% | 27,8% | 55,0% | — | 55,6% | 100,0% | 85,0% | 44,4% | 38,9% | 33,3% | 45,0% | 50,0% | 75,0% | 88,9% | 100,0% | 100,0% | 100,0% |
| Qwen3.6-27B Q4_K_M 💡 🏠 | 0,0% | 6,1% | 0,0% | 0,0% | 20,0% | 10,0% | 44,1% | 29,3% | 17,9% | 28,6% | 33,3% | 0,0% | 20,0% | 50,0% | 50,0% | 46,6% | 41,1% | 58,6% | 44,4% | — | 33,3% | 41,1% | 53,4% | 77,8% | 66,7% | 33,3% | 44,4% | 50,0% | 76,8% | 100,0% | 83,3% | 100,0% |
| Gemma 4 31B Instruct QAT ↯ 🏠 | 0,0% | 6,5% | 0,0% | 0,0% | 16,7% | 33,3% | 0,0% | 0,0% | 0,0% | 0,0% | 50,0% | 66,7% | 33,3% | 33,3% | 0,0% | 0,0% | 70,0% | 0,0% | 0,0% | 66,7% | — | 50,0% | 33,3% | 100,0% | 100,0% | 100,0% | 66,7% | 50,0% | 100,0% | 100,0% | 50,0% | 100,0% |
| MiMo-V2.5-Pro 💡 | 0,0% | 0,0% | 0,0% | 6,9% | 20,0% | 20,0% | 26,5% | 29,0% | 20,3% | 37,1% | 50,0% | 40,0% | 10,0% | 40,0% | 33,9% | 50,0% | 40,7% | 35,5% | 15,0% | 58,9% | 50,0% | — | 51,8% | 50,0% | 60,0% | 66,7% | 66,7% | 62,5% | 64,5% | 66,7% | 91,7% | 100,0% |
| Qwen3.6-35B-A3B Q4_K_M 💡 🏠 | 0,0% | 4,0% | 0,0% | 9,5% | 0,0% | 20,0% | 17,6% | 22,4% | 28,6% | 26,8% | 27,8% | 40,0% | 40,0% | 50,0% | 53,3% | 41,4% | 50,0% | 41,4% | 55,6% | 46,6% | 66,7% | 48,2% | — | 33,3% | 44,4% | 33,3% | 40,0% | 25,0% | 75,0% | 50,0% | 83,3% | 100,0% |
| Qwen3.6-27B Q8_0 💡 🏠 | 0,0% | 4,7% | 0,0% | 0,0% | 0,0% | 0,0% | 30,0% | 22,7% | 37,5% | 22,2% | 22,2% | 0,0% | 0,0% | 25,0% | 48,3% | 25,0% | 33,3% | 25,0% | 61,1% | 22,2% | 0,0% | 50,0% | 66,7% | — | 55,6% | 40,0% | 44,4% | 50,0% | 77,8% | 80,0% | 77,3% | 0,0% |
| Qwen3.6-35B-A3B Q8_0 💡 🏠 | 0,0% | 4,7% | 0,0% | 5,0% | 0,0% | 0,0% | 35,0% | 20,0% | 25,0% | 11,1% | 50,0% | 0,0% | 0,0% | 0,0% | 30,0% | 43,8% | 11,1% | 37,5% | 66,7% | 33,3% | 0,0% | 40,0% | 55,6% | 44,4% | — | 40,0% | 70,0% | 25,0% | 88,9% | 80,0% | 50,0% | 0,0% |
| Gemma 4 12B Instruct Q8_0 ↯ 🏠 | 0,0% | 4,3% | 0,0% | 0,0% | 0,0% | 0,0% | 50,0% | 16,7% | 7,7% | 16,7% | 25,0% | 0,0% | 0,0% | 0,0% | 19,2% | 33,3% | 40,0% | 33,3% | 55,0% | 66,7% | 0,0% | 33,3% | 66,7% | 60,0% | 60,0% | — | 50,0% | 50,0% | 83,3% | 76,9% | 75,0% | 100,0% |
| Gemma 4 12B Instruct QAT 💡 🏠 | 0,0% | 7,5% | 0,0% | 6,2% | 30,0% | 0,0% | 22,7% | 22,2% | 33,3% | 0,0% | 12,1% | 0,0% | 20,0% | 0,0% | 16,7% | 20,0% | 27,8% | 22,2% | 50,0% | 55,6% | 33,3% | 33,3% | 60,0% | 55,6% | 30,0% | 50,0% | — | 50,0% | 77,8% | 100,0% | 75,0% | 100,0% |
| Mistral Medium 3.5 128B ↯ 🏠 | 0,0% | 2,7% | 0,0% | 1,5% | 20,0% | 20,0% | 0,0% | 0,0% | 25,0% | 25,0% | 25,0% | 20,0% | 40,0% | 20,0% | 10,0% | 0,0% | 33,3% | 25,0% | 25,0% | 50,0% | 50,0% | 37,5% | 75,0% | 50,0% | 75,0% | 50,0% | 50,0% | — | 100,0% | 100,0% | 75,0% | 33,3% |
| MiMo-V2.5 💡 | 0,0% | 1,0% | 0,0% | 0,0% | 0,0% | 0,0% | 12,5% | 16,1% | 21,9% | 14,5% | 11,1% | 0,0% | 0,0% | 0,0% | 12,9% | 16,1% | 18,5% | 22,6% | 11,1% | 23,2% | 0,0% | 35,5% | 25,0% | 22,2% | 11,1% | 16,7% | 22,2% | 0,0% | — | 33,3% | 50,0% | 66,7% |
| Qwen3.6-35B-A3B Q8_0 ↯ 🏠 | 0,0% | 0,5% | 0,0% | 0,0% | 0,0% | 0,0% | 16,7% | 16,7% | 0,0% | 16,7% | 25,0% | 0,0% | 0,0% | 0,0% | 3,8% | 0,0% | 20,0% | 16,7% | 0,0% | 0,0% | 0,0% | 33,3% | 50,0% | 20,0% | 20,0% | 23,1% | 0,0% | 0,0% | 66,7% | — | 69,2% | 100,0% |
| Qwen3.6-27B Q8_0 ↯ 🏠 | 0,0% | 0,5% | 0,0% | 0,0% | 0,0% | 0,0% | 33,3% | 16,7% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 15,4% | 0,0% | 0,0% | 16,7% | 0,0% | 16,7% | 50,0% | 8,3% | 16,7% | 22,7% | 50,0% | 25,0% | 25,0% | 25,0% | 50,0% | 30,8% | — | 50,0% |
| Laguna S 2.1 UD 💡 🏠 | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 33,3% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 0,0% | 100,0% | 100,0% | 0,0% | 0,0% | 66,7% | 33,3% | 0,0% | 50,0% | — |
Cobertura de duelos publicados
Cada celda muestra cuántos duelos juzgados por IA, de todos los protocolos de evaluación publicados, comparan los dos modelos para este idioma y categoría. Los modelos de ambos ejes son candidatos; esta matriz no indica qué juez emitió cada veredicto.
Matriz simétrica del número de duelos publicados. La diagonal es cero porque un modelo no se compara consigo mismo.
↯ indica un modelo sin razonamiento. 🏠 indica un modelo ejecutado localmente con LM Studio.
Ver como tabla de datos
| Modelo | Claude Opus 5 💡 | Claude Fable 5 High 💡 | Kimi K3 💡 | GPT-5.6 Sol 💡 | Gemini 3.6 Flash 💡 | Claude Sonnet 5 💡 | MiniMax M3 💡 | Qwen3.7 Max 💡 | DeepSeek-V4-Pro 💡 | GLM-5.2 💡 | Gemma 4 31B Instruct Q8_0 💡 🏠 | GPT-5.6 Luna 💡 | Gemma 4 26B-A4B Instruct Q8_0 💡 🏠 | GPT-5.6 Terra 💡 | DeepSeek-V4-Flash 💡 | Gemma 4 26B-A4B Instruct QAT 💡 🏠 | Gemma 4 31B Instruct QAT 💡 🏠 | Qwen3.7 Plus 💡 | Gemma 4 12B Instruct Q8_0 💡 🏠 | Qwen3.6-27B Q4_K_M 💡 🏠 | Gemma 4 31B Instruct QAT ↯ 🏠 | MiMo-V2.5-Pro 💡 | Qwen3.6-35B-A3B Q4_K_M 💡 🏠 | Qwen3.6-27B Q8_0 💡 🏠 | Qwen3.6-35B-A3B Q8_0 💡 🏠 | Gemma 4 12B Instruct Q8_0 ↯ 🏠 | Gemma 4 12B Instruct QAT 💡 🏠 | Mistral Medium 3.5 128B ↯ 🏠 | MiMo-V2.5 💡 | Qwen3.6-35B-A3B Q8_0 ↯ 🏠 | Qwen3.6-27B Q8_0 ↯ 🏠 | Laguna S 2.1 UD 💡 🏠 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 💡 | 0 | 49 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 2 | 5 | 2 | 5 | 3 | 5 | 5 | 3 | 3 | 3 | 5 | 5 | 5 | 3 | 3 | 3 |
| Claude Fable 5 High 💡 | 49 | 0 | 49 | 48 | 5 | 5 | 48 | 48 | 48 | 48 | 107 | 49 | 107 | 49 | 48 | 106 | 99 | 48 | 106 | 99 | 108 | 48 | 99 | 107 | 107 | 93 | 107 | 205 | 48 | 92 | 92 | 2 |
| Kimi K3 💡 | 5 | 49 | 0 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 2 | 5 | 2 | 5 | 3 | 5 | 5 | 3 | 3 | 3 | 5 | 5 | 5 | 3 | 3 | 3 |
| GPT-5.6 Sol 💡 | 5 | 48 | 5 | 0 | 5 | 5 | 36 | 36 | 37 | 36 | 41 | 5 | 5 | 4 | 36 | 38 | 20 | 36 | 20 | 21 | 3 | 36 | 21 | 20 | 20 | 4 | 40 | 67 | 36 | 4 | 4 | 3 |
| Gemini 3.6 Flash 💡 | 5 | 5 | 5 | 5 | 0 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 3 | 5 | 3 | 5 | 3 | 5 | 5 | 3 | 3 | 3 | 5 | 5 | 5 | 3 | 3 | 3 |
| Claude Sonnet 5 💡 | 5 | 5 | 5 | 5 | 5 | 0 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 3 | 5 | 3 | 5 | 3 | 5 | 5 | 3 | 3 | 3 | 5 | 5 | 5 | 3 | 3 | 3 |
| MiniMax M3 💡 | 5 | 48 | 5 | 36 | 5 | 5 | 0 | 17 | 30 | 16 | 21 | 5 | 5 | 5 | 30 | 17 | 16 | 17 | 10 | 17 | 3 | 17 | 17 | 10 | 10 | 6 | 11 | 4 | 16 | 6 | 6 | 3 |
| Qwen3.7 Max 💡 | 5 | 48 | 5 | 36 | 5 | 5 | 17 | 0 | 32 | 31 | 9 | 5 | 5 | 4 | 31 | 29 | 28 | 31 | 10 | 29 | 3 | 31 | 29 | 11 | 10 | 6 | 9 | 4 | 31 | 6 | 6 | 3 |
| DeepSeek-V4-Pro 💡 | 5 | 48 | 5 | 37 | 5 | 5 | 30 | 32 | 0 | 31 | 30 | 5 | 5 | 4 | 31 | 30 | 27 | 32 | 30 | 28 | 3 | 32 | 28 | 8 | 8 | 26 | 30 | 4 | 32 | 6 | 6 | 3 |
| GLM-5.2 💡 | 5 | 48 | 5 | 36 | 5 | 5 | 16 | 31 | 31 | 0 | 9 | 5 | 5 | 5 | 31 | 29 | 27 | 31 | 9 | 28 | 3 | 31 | 28 | 9 | 9 | 6 | 10 | 4 | 31 | 6 | 6 | 3 |
| Gemma 4 31B Instruct Q8_0 💡 🏠 | 5 | 107 | 5 | 41 | 5 | 5 | 21 | 9 | 30 | 9 | 0 | 5 | 5 | 5 | 30 | 5 | 8 | 9 | 9 | 9 | 3 | 9 | 9 | 9 | 10 | 4 | 33 | 4 | 9 | 4 | 4 | 3 |
| GPT-5.6 Luna 💡 | 5 | 49 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 0 | 5 | 5 | 5 | 5 | 2 | 5 | 2 | 5 | 3 | 5 | 5 | 3 | 3 | 3 | 5 | 5 | 5 | 3 | 3 | 3 |
| Gemma 4 26B-A4B Instruct Q8_0 💡 🏠 | 5 | 107 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 5 | 0 | 5 | 5 | 5 | 2 | 5 | 2 | 5 | 3 | 5 | 5 | 2 | 2 | 3 | 5 | 5 | 5 | 3 | 3 | 3 |
| GPT-5.6 Terra 💡 | 5 | 49 | 5 | 4 | 5 | 5 | 5 | 4 | 4 | 5 | 5 | 5 | 5 | 0 | 4 | 4 | 3 | 4 | 4 | 4 | 3 | 5 | 4 | 4 | 4 | 4 | 5 | 5 | 5 | 4 | 4 | 3 |
| DeepSeek-V4-Flash 💡 | 5 | 48 | 5 | 36 | 5 | 5 | 30 | 31 | 31 | 31 | 30 | 5 | 5 | 4 | 0 | 30 | 29 | 31 | 30 | 30 | 3 | 31 | 30 | 30 | 30 | 26 | 30 | 30 | 31 | 26 | 26 | 2 |
| Gemma 4 26B-A4B Instruct QAT 💡 🏠 | 5 | 106 | 5 | 38 | 5 | 5 | 17 | 29 | 30 | 29 | 5 | 5 | 5 | 4 | 30 | 0 | 28 | 29 | 8 | 29 | 3 | 28 | 29 | 8 | 8 | 6 | 5 | 4 | 28 | 6 | 6 | 3 |
| Gemma 4 31B Instruct QAT 💡 🏠 | 2 | 99 | 2 | 20 | 3 | 3 | 16 | 28 | 27 | 27 | 8 | 2 | 2 | 3 | 29 | 28 | 0 | 28 | 9 | 28 | 5 | 27 | 28 | 9 | 9 | 5 | 9 | 3 | 27 | 5 | 5 | 1 |
| Qwen3.7 Plus 💡 | 5 | 48 | 5 | 36 | 5 | 5 | 17 | 31 | 32 | 31 | 9 | 5 | 5 | 4 | 31 | 29 | 28 | 0 | 10 | 29 | 3 | 31 | 29 | 8 | 8 | 6 | 9 | 4 | 31 | 6 | 6 | 3 |
| Gemma 4 12B Instruct Q8_0 💡 🏠 | 2 | 106 | 2 | 20 | 3 | 3 | 10 | 10 | 30 | 9 | 9 | 2 | 2 | 4 | 30 | 8 | 9 | 10 | 0 | 9 | 2 | 10 | 9 | 9 | 9 | 10 | 9 | 4 | 9 | 6 | 6 | 1 |
| Qwen3.6-27B Q4_K_M 💡 🏠 | 5 | 99 | 5 | 21 | 5 | 5 | 17 | 29 | 28 | 28 | 9 | 5 | 5 | 4 | 30 | 29 | 28 | 29 | 9 | 0 | 3 | 28 | 29 | 9 | 9 | 6 | 9 | 4 | 28 | 6 | 6 | 3 |
| Gemma 4 31B Instruct QAT ↯ 🏠 | 3 | 108 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 5 | 3 | 2 | 3 | 0 | 3 | 3 | 2 | 2 | 2 | 3 | 3 | 3 | 2 | 2 | 2 |
| MiMo-V2.5-Pro 💡 | 5 | 48 | 5 | 36 | 5 | 5 | 17 | 31 | 32 | 31 | 9 | 5 | 5 | 5 | 31 | 28 | 27 | 31 | 10 | 28 | 3 | 0 | 28 | 10 | 10 | 6 | 9 | 4 | 31 | 6 | 6 | 3 |
| Qwen3.6-35B-A3B Q4_K_M 💡 🏠 | 5 | 99 | 5 | 21 | 5 | 5 | 17 | 29 | 28 | 28 | 9 | 5 | 5 | 4 | 30 | 29 | 28 | 29 | 9 | 29 | 3 | 28 | 0 | 9 | 9 | 6 | 10 | 4 | 28 | 6 | 6 | 3 |
| Qwen3.6-27B Q8_0 💡 🏠 | 3 | 107 | 3 | 20 | 3 | 3 | 10 | 11 | 8 | 9 | 9 | 3 | 2 | 4 | 30 | 8 | 9 | 8 | 9 | 9 | 2 | 10 | 9 | 0 | 9 | 5 | 9 | 4 | 9 | 5 | 11 | 1 |
| Qwen3.6-35B-A3B Q8_0 💡 🏠 | 3 | 107 | 3 | 20 | 3 | 3 | 10 | 10 | 8 | 9 | 10 | 3 | 2 | 4 | 30 | 8 | 9 | 8 | 9 | 9 | 2 | 10 | 9 | 9 | 0 | 5 | 10 | 4 | 9 | 10 | 6 | 1 |
| Gemma 4 12B Instruct Q8_0 ↯ 🏠 | 3 | 93 | 3 | 4 | 3 | 3 | 6 | 6 | 26 | 6 | 4 | 3 | 3 | 4 | 26 | 6 | 5 | 6 | 10 | 6 | 2 | 6 | 6 | 5 | 5 | 0 | 4 | 4 | 6 | 13 | 12 | 2 |
| Gemma 4 12B Instruct QAT 💡 🏠 | 5 | 107 | 5 | 40 | 5 | 5 | 11 | 9 | 30 | 10 | 33 | 5 | 5 | 5 | 30 | 5 | 9 | 9 | 9 | 9 | 3 | 9 | 10 | 9 | 10 | 4 | 0 | 4 | 9 | 4 | 4 | 3 |
| Mistral Medium 3.5 128B ↯ 🏠 | 5 | 205 | 5 | 67 | 5 | 5 | 4 | 4 | 4 | 4 | 4 | 5 | 5 | 5 | 30 | 4 | 3 | 4 | 4 | 4 | 3 | 4 | 4 | 4 | 4 | 4 | 4 | 0 | 4 | 4 | 4 | 3 |
| MiMo-V2.5 💡 | 5 | 48 | 5 | 36 | 5 | 5 | 16 | 31 | 32 | 31 | 9 | 5 | 5 | 5 | 31 | 28 | 27 | 31 | 9 | 28 | 3 | 31 | 28 | 9 | 9 | 6 | 9 | 4 | 0 | 6 | 6 | 3 |
| Qwen3.6-35B-A3B Q8_0 ↯ 🏠 | 3 | 92 | 3 | 4 | 3 | 3 | 6 | 6 | 6 | 6 | 4 | 3 | 3 | 4 | 26 | 6 | 5 | 6 | 6 | 6 | 2 | 6 | 6 | 5 | 10 | 13 | 4 | 4 | 6 | 0 | 13 | 2 |
| Qwen3.6-27B Q8_0 ↯ 🏠 | 3 | 92 | 3 | 4 | 3 | 3 | 6 | 6 | 6 | 6 | 4 | 3 | 3 | 4 | 26 | 6 | 5 | 6 | 6 | 6 | 2 | 6 | 6 | 11 | 6 | 12 | 4 | 4 | 6 | 13 | 0 | 2 |
| Laguna S 2.1 UD 💡 🏠 | 3 | 2 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 3 | 2 | 3 | 1 | 3 | 1 | 3 | 2 | 3 | 3 | 1 | 1 | 2 | 3 | 3 | 3 | 2 | 2 | 0 |
Ayuda a elegir el mejor LLM para escribir en español
¿Qué modelo escribe el mejor texto? Juzga esta pareja anónima y contribuye a la clasificación humana.
Durante el duelo no verás qué modelo escribió cada texto. Los nombres se revelan al terminar.
Publicamos las consignas, los criterios y los datos agregados. Puedes consultar cómo se calcula la clasificación en Metodología.