Xiaomi MiMo-V2.6-Pro lidera open-weights con score 46

¿Qué es MiMo-V2.6-Pro y por qué vuelve a sacudir el open-weights?

Xiaomi presentó el 22 de septiembre de 2026 la serie MiMo-V2.6, con un modelo bandera, MiMo-V2.6-Pro, que Artificial Analysis puntúa con 46 en su Intelligence Index v4.3.2, el mejor resultado registrado por un modelo open-weights hasta la fecha. La ficha técnica de Artificial Analysis lo describe como «amongst the leading models in intelligence and reasonably priced», y ubica al modelo en una franja en la que antes solo aparecían sistemas propietarios.

El hardware interno: una arquitectura Mixture-of-Experts (MoE) con 1,02 billones de parámetros totales pero solo 42.000 millones activos por token, ventana de 1 millón de tokens y soporte nativo para texto, imagen, audio y video en la entrada, con salida de texto. La licencia es MIT, lo que permite uso comercial sin pagar regalías, según reporta Artificial Analysis. Los pesos están en Hugging Face y en ModelScope.

Junto al Pro se publicaron dos variantes más: MiMo-V2.6-Flash (309B totales, 15B activos) para cargas de alto volumen, y MiMo-V2.6-Pro-UltraSpeed, una versión con salida hasta 20 veces más rápida a costa de un precio por token mucho mayor, según Xiaomi.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

El salto generacional: de 26 a 46 en una sola generación

OfficeChai destaca que el salto respecto al MiMo-V2.5-Pro es de 20 puntos (de 26 a 46) en el índice de Artificial Analysis. Antes de esta release, la corona open-weights se la repartían Z.AI con GLM-5.3 y Moonshot con Kimi K3, empatados en 44. MiMo-V2.6-Pro no solo los destrona, sino que se coloca sexto en la tabla global, a un punto de GPT-5.6 Sol (47) y por delante de cualquier otro modelo abierto, según el mismo ranking de Artificial Analysis.

El reporte de OfficeChai sitúa en lo más alto del índice a Claude Fable 5.1 y GPT-6 Astra, empatados en 53, seguidos por Claude Opus 5 (51), Muse Spark 1.3 (48) y GPT-5.6 Sol (47). La diferencia entre MiMo-V2.6-Pro y el techo de los modelos cerrados es ahora de siete puntos, un margen que hace un año parecía inalcanzable para cualquier alternativa open-weights.

Cómo Xiaomi entrenó en público durante seis días

El detalle más llamativo, según Forkast, es que Xiaomi transmitió en vivo el run de reinforcement learning que produjo al modelo. El equipo de MiMo, encabezado por Luo Fuli —ex DeepSeek y Alibaba DAMO, según Gizmochina—, operó durante seis días a un ritmo reportado de US$432.000 diarios (unos US$5 por segundo) en infraestructura de cómputo. Unite.ai documenta que el run completo involucró 30 pasos de RL sobre aproximadamente 750.000 trayectorias, con un costo total de US$2,62 millones para Pro y US$0,85 millones para Flash.

La estrategia, bautizada por Xiaomi como «You Only RL Once», mezcla 23 categorías de tareas —coding, agentes generales, visión, ciberseguridad— en un solo run asíncrono de Group Relative Policy Optimization con 1.568 prompts y 16 rollouts por paso, procesando entre 3,5 y 3,7 mil millones de tokens por step. Para evitar el típico problema del «reward hacking», el equipo introdujo dos mecanismos nuevos: Groupwise Reward Synthesis, que construye rúbricas offline comparando rollouts exitosos, y Groupwise Advantage Redistribution, que rankea online las trayectorias que pasan. Después del RL mixto corre una etapa de destilación on-policy multi-prefijo llamada MOPD2, reporta Unite.ai.

El resultado se nota en DeepSWE v1.1, un benchmark de ingeniería de software de horizonte largo: Xiaomi pasó de 19,0% en V2.5-Pro a 71,9% en V2.6-Pro, según las tablas oficiales que cita Unite.ai, una cifra que deja al modelo a 2,1 puntos de Claude Opus 5 (74,0) y a 0,1 puntos de DeepSeek V4.1 Flash (74,2).

Precio: misma API que V2.5, una fracción del costo frontier

Xiaomi mantuvo exactamente los precios de la generación anterior, según Unite.ai: US$0,435 por millón de tokens de entrada (con un descuento del 99% en cache hit), y US$0,87 por millón de tokens de salida. En el cálculo blended (7:2:1 cache/input/output) que usa Artificial Analysis, eso son US$0,18 por millón de tokens, y un costo de US$0,13 por tarea del Intelligence Index —el mismo dato que coloca al modelo directamente sobre la frontera de Pareto, según el análisis de Artificial Analysis recogido por OfficeChai: no hay modelo más barato con esa inteligencia, ni modelo más inteligente a ese precio.

Xiaomi asegura en su comunicación oficial —citada por OfficeChai— que a inteligencia comparable, MiMo-V2.6-Pro cuesta entre una veinteava y una sesentava parte de los modelos frontera internacionales. Comparado con Claude Fable 5.1, que lidera el índice pero factura «varios dólares por tarea», el diferencial es de aproximadamente 50 veces en costo por tarea, siempre según la misma fuente.

En velocidad, Artificial Analysis midió 124,5–129,7 tokens por segundo de salida y un tiempo al primer token de 2,17–2,34 segundos a través de la API de Xiaomi, con un costo total de US$206,66 para ejecutar el protocolo completo del Intelligence Index.

Dónde MiMo-V2.6-Pro gana, dónde cede terreno

El análisis granular de OfficeChai y las tablas de Xiaomi que reproduce Unite.ai muestran un patrón claro: el modelo es clase frontera en tareas agénticas, pero todavía cede en razonamiento profundo y seguridad ofensiva.

Fortalezas verificadas:

  • AutomationBench v1.0.6: 53,1, supera a los tres rivales cerrados.
  • Terminal Bench 2.1: 89,9, el mejor resultado reportado en la comparativa.
  • MiMo Visual Coding: 72,3, por delante de Claude Opus 5 (70,0) y Fable 5 (69,1).
  • CyberGym (defensa): 94,0; Flash incluso llega a 95,1, según Unite.ai.

Debilidades explícitas:

  • Terminal Bench 4.0: 34,9 contra 49,0 de Claude Opus 5.
  • ProgramBench: 26,5 contra 37,0.
  • ExploitBench: 47,9 contra 78,5 de GPT-5.6 Sol.
  • SEC Bench Pro: 66,3 contra 79,1.

La lectura que hace OfficeChai es directa: el modelo es un «frontier-class agentic model» que cambia golpes con sistemas mucho más caros en automatización, uso de herramientas y trabajo de terminal, pero todavía deja terreno en razonamiento difícil y seguridad ofensiva. Xiaomi atribuye la baja en exploits a una decisión deliberada de alineación («Aligned RL»).

¿Qué significa esto para tu startup?

Tres acciones concretas que un founder puede tomar esta semana:

  • Migrar workloads de alto volumen al Flash vía API. A US$0,14/M de entrada y US$0,28/M de salida (datos de Unite.ai), Flash cuesta aproximadamente un tercio de Pro y es competitivo en tareas diarias según el mismo análisis. Para productos con cientos de miles de llamadas mensuales —asistentes de soporte, generación de borradores, RAG interno— el ahorro es inmediato y el switch técnico es bajo: ambos están en OpenRouter, AI Studio, MiMo Code y MiMo Desktop.

  • Reservar Pro para flujos agénticos complejos con ROI claro. Las demos que Xiaomi reporta (Unite.ai) incluyen control de un brazo robótico Franka Panda, modelado 3D en Blender, desarrollo de juegos multi-agente y una formalización en Lean 4 de más de 6.000 líneas verificada por el kernel. Si tu producto ya orquesta agentes y te duele la factura, Pro es el primer candidato a benchmarkear contra tu stack actual.

  • Pensar el self-host con los pies en el suelo. Un MoE de 1,02T parámetros en BF16 pesa varios cientos de gigabytes y no es realista en una sola máquina, como advierte note.com. La salida pragmática es API, OpenRouter o un cluster multi-nodo H100/H200; evalúa el costo total de propiedad antes de prometer «todo on-prem» a un cliente enterprise.

Para cerrar el contexto: Xiaomi venía de capturar alrededor del 21% del tráfico total en OpenRouter hacia abril de 2026, según Gizmochina, y su CEO Lei Jun anunció en marzo una inversión de US$8.700 millones en IA para tres años. MiMo-V2.6-Pro no es un experimento de laboratorio: es el siguiente paso de una hoja de ruta que ya tiene tracción de uso real.

Fuentes

¿te gustó o sirvió lo que leíste?, Por favor, comparte.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...