La nota (0–100)
- Escribir y preguntar: Nota = puntuación de 0 a 100 en una batería de pruebas difíciles e independientes (índice de Artificial Analysis).
- Programar: Nota = % de tareas reales de programación que resuelve en una prueba independiente (Terminal-Bench 4.0).
- Imágenes y vídeo: estas pruebas dan una puntuación Elo (votos a ciegas entre dos resultados). La convertimos en nota con la fórmula del Elo: nota = 2 × probabilidad de que la gente la prefiera frente a la n.º 1. La n.º 1 saca 100; una que gana 4 de cada 10 duelos contra ella saca 80.
En las listas sencillas hay una fila por modelo con su mejor versión; las variantes (max, high, medium…) están en las especificaciones técnicas de cada página.
Las tres tarjetas
«La más potente» es la de mayor nota. «La que más compensa» es la que da más nota por lo que cuesta usarla (está en la frontera eficiente: ningún otro modelo es mejor y más barato a la vez); la revisamos a mano en cada actualización. Regla de adopción: un modelo «Poco probado» (sin evaluación independiente) o «Poco usado» nunca puede ser «La que más compensa» si existe una alternativa bien adoptada (muy usada, o de uso medio si no hay ninguna muy usada); en ese caso se elige esa. Lo mismo vale para «La mejor gratis (open source)»: si el open con más nota es «Poco probado» o «Poco usado» y hay otro open más adoptado (muy usado o de uso medio) y evaluado, se elige el de más nota de esos. Se aplica en todas las categorías. «La más potente» sigue siendo siempre la de mayor nota, aunque esté poco probada; en ese caso la tarjeta lo avisa. «La mejor gratis (open source)» es el mejor modelo que puedes descargar y usar sin pagar y sin límites, entre los que ya han sido medidos por al menos una prueba independiente.
Qué llamamos «gratis». En esta web, «gratis» a secas significa sin pagar y sin límites: modelos open source que descargas y usas en tu equipo. Los planes gratis de las apps (ChatGPT, Claude, Gemini…) aparecen siempre como «Gratis con límites de uso». Solo decimos que una app tiene plan gratis cuando su página oficial lo confirma; si no, ponemos «Precio no confirmado».
Precios en euros
Los precios de las apps (ChatGPT, Claude, Gemini, Midjourney, Cursor…) salen de sus páginas oficiales de precios. Si la página publica el precio en euros para España o la UE, lo mostramos tal cual. Si solo publica dólares, mostramos «≈ X €» redondeado al euro, convertido con 1 € = 1,1206 US$ (tipo de referencia del BCE del 9 de octubre de 2026), y el precio original en dólares al pasar el ratón. Así que «≈» significa siempre «aproximado». Los precios en dólares de muchas páginas no incluyen impuestos; el IVA se suma al pagar. Si un modelo solo está disponible por API, lo indicamos como «Solo por API» y su precio técnico está en las especificaciones técnicas.
Calidad en español
Para la pregunta «¿Cuál escribe mejor en español?» usamos la clasificación en español de LMArena (LMArena · Text Arena, categoría Spanish (votos a ciegas en preguntas escritas en español); datos del 8 de octubre de 2026. 175.361 votos y 298 modelos). Las primeras posiciones están dentro del margen de error (±) unas de otras: no hay un ganador claro. GPT-6.1 Sol y Claude Sonnet 5.5 aún no aparecen en esta categoría. No es una prueba de ortografía ni de estilo: mide qué respuesta prefieren los usuarios en preguntas escritas en español.
Madurez y adopción
Madurez: «Probada» si al menos dos clasificaciones independientes la han medido y tiene uso real (o lleva más de 180 días con uso); «Nueva» si salió hace menos de 30 días o solo la ha medido una clasificación; «Poco probada» si ninguna clasificación independiente la ha medido o casi nadie la usa.
Adopción: «Muy usado» con más de 100.000 descargas al mes en Hugging Face, puesto en el top 20 de OpenRouter o más de 1.000 «me gusta»; «Uso medio» con más de 5.000 descargas al mes, presencia en OpenRouter o más de 100 «me gusta»; «Poco usado» por debajo. Sin datos públicos de uso no se muestra nada.
Fuentes públicas
- Artificial Analysis: índice de inteligencia, Terminal-Bench 4.0, coste por tarea, arenas de imagen y vídeo.
- LMArena (texto, español, programación web, imagen y vídeo), VBench, MTEB y Decision Index.
- Hugging Face (descargas, «me gusta», tamaño real de los archivos y licencias) y OpenRouter (modelos disponibles y ranking de uso).
- Páginas oficiales de precios y documentación de cada modelo y herramienta (requisitos de memoria, planes).
- Banco Central Europeo: tipo de cambio de referencia euro/dólar.
Cada fila de las tablas técnicas enlaza la fuente concreta de su dato. Si un dato no está publicado, se muestra «n/d»: nunca se estima sin decirlo.
Actualización
Se revisa dos veces al día (por la mañana y por la tarde, hora de Madrid): nuevas noticias, modelos nuevos, posiciones en las clasificaciones, descargas y precios. La fecha y hora de la última actualización aparecen arriba de cada página.