Lo que dice la lista
En el ranking semanal de OpenRouter correspondiente a la semana del 28 de julio al 3 de agosto de 2026, los cinco modelos que más tokens movieron son chinos. Encabeza DeepSeek V4-Flash, seguido de MiMo-V2.5 de Xiaomi con 5,4 billones de tokens, Hy3 de Tencent con 4,89 billones, DeepSeek V4-Pro con 3,1 billones y GLM-5.2 de Z.ai con 2,87 billones. Según el recuento de Pandaily, nueve de los diez primeros puestos son modelos chinos, sobre un volumen semanal total de 56,8 billones de tokens.
La cifra del primer puesto no coincide entre fuentes: Pandaily sitúa a V4-Flash en 7,1 billones de tokens y Cubadebate en 7,22. La diferencia no llega al 2 % y lo más probable es que responda al corte exacto de la ventana temporal, pero conviene decirlo en vez de elegir una cifra en silencio.
El modelo que va primero
V4-Flash alcanzó la cabeza cuatro días después de que su build del 31 de julio entrara en beta pública de API. Es un modelo de mezcla de expertos con 284.000 millones de parámetros totales y 13.000 millones activos por token, ventana de contexto de un millón de tokens y pesos publicados bajo licencia MIT. Su hermano mayor, V4-Pro, tiene 1,6 billones de parámetros totales y 49.000 millones activos.
La familia se presentó el 24 de abril de 2026. Simon Willison, que la analizó el mismo día, situó a V4-Pro compitiendo con los modelos de frontera pero por debajo de GPT-5.4 y Gemini 3.1 Pro, con un rezago que estimó entre tres y seis meses respecto al estado del arte. Ahí está la clave para leer el ranking: no lo encabeza el modelo más capaz, sino el que resulta suficiente por mucho menos dinero.
