- modelos
- Xiaomi
- producto
Xiaomi MiMo V2.6 Pro vs Flash: benchmarks, precio y cuál usar en BrainBox
MiMo V2.6 Pro y Flash de Xiaomi, pesos abiertos MIT y 1M de contexto, ya están en el Asistente de BrainBox: benchmarks, puntaje en Artificial Analysis, unidades de inteligencia por tarea y cuál elegir.
MiMo V2.6 Pro y MiMo V2.6 Flash, los modelos que Xiaomi publicó el 21 de septiembre de 2026 con pesos abiertos bajo licencia MIT, ya se pueden elegir en el Asistente de BrainBox. Los dos tienen un millón de tokens de contexto y aceptan imágenes. Pro es el modelo de pesos abiertos con mejor puntuación en el Intelligence Index de Artificial Analysis a fecha de hoy; Flash se queda cerca en las pruebas de agentes y gasta un tercio de las unidades de inteligencia. Ambos requieren un plan con acceso completo a modelos.
¿Qué son MiMo V2.6 Pro y Flash?
Son dos modelos de mezcla de expertos, o MoE, del equipo MiMo de Xiaomi, entrenados con una sola fase de aprendizaje por refuerzo que mezcla miles de entornos de tareas: programación, agentes generales, tareas visuales y ciberseguridad, según el informe técnico. Xiaomi publicó los pesos en Hugging Face y ModelScope con licencia MIT: MiMo-V2.6-Pro-RL y MiMo-V2.6-Flash-RL. Junto con los pesos publicó el informe técnico, los entornos de entrenamiento, el framework de RL y un modelo destilado de 9.000 millones de parámetros, MiMo-V2.6-Distill-Qwen-9B. Las cifras de la tabla salen de la model card y de la ficha de Xiaomi.
| MiMo V2.6 Pro | MiMo V2.6 Flash | |
|---|---|---|
| Parámetros totales | 1,02 billones | 309.000 millones |
| Parámetros activos por token | 42.000 millones | 15.000 millones |
| Contexto | 1M tokens | 1M tokens |
| Salida máxima | 128.000 tokens | 128.000 tokens |
| Entradas | Texto, imagen, audio, video | Texto, imagen, audio, video |
| Licencia | MIT, pesos abiertos | MIT, pesos abiertos |
| Categoría en el selector de BrainBox | Pro | Predeterminado |
En BrainBox, el audio y el video no se envían al modelo: se transcriben al indexar y el modelo recibe la transcripción con marcas de tiempo. La entrada multimodal que sí usa es la de imágenes.
¿Qué dicen los benchmarks?
Artificial Analysis mide los modelos por su cuenta. MiMo V2.6 Pro obtiene 46 puntos en el Intelligence Index v4.3, primer lugar entre los 114 modelos de pesos abiertos que tienen medidos, y el mismo puntaje que Grok 4.7, publicado el mismo día. Según el leaderboard, queda por encima de Grok 4.6 con 44, Gemini 3.8 Flash con 41 y DeepSeek V4.1 Flash con 39, y siete puntos por debajo de Claude Fable 5.1 y GPT-6 Astra, que puntúan 53 en su configuración máxima. Genera texto a unos 125 tokens por segundo con 2,19 segundos hasta el primer token, y Artificial Analysis lo describe como "algo verboso". Flash todavía no tiene puntaje publicado.
Los benchmarks de agentes que publica Xiaomi en la model card son de la propia empresa, incluidos los valores de los modelos cerrados, y hay que leerlos con esa reserva:
| Benchmark, según Xiaomi | V2.5 Pro | V2.6 Pro | V2.6 Flash | Claude Opus 5 |
|---|---|---|---|---|
| DeepSWE v1.1, agente de software | 19,0 | 71,9 | 67,9 | 74,0 |
| ProgramBench | 12,5 | 26,5 | 26,0 | 37,0 |
| Terminal Bench 4.0 | 1,5 | 34,9 | 28,8 | 49,0 |
| Terminal Bench 2.1 | 65,2 | 89,9 | 87,6 | 89,1 |
| Toolathlon-Verified, uso de herramientas | 49,1 | 76,9 | 73,6 | 80,6 |
| AutomationBench v1.0.6 | 16,0 | 53,1 | 52,3 | 50,3 |
| CyberGym, ciberseguridad | 40,0 | 94,0 | 95,1 | |
| ExploitBench | 16,6 | 47,9 | 25,3 | 70,0 |
El mejor puntaje de cada fila va en negrita.
El informe técnico de Xiaomi habla de "un rendimiento comparable al de los modelos de frontera en varios dominios", y su propia tabla muestra dónde no: Claude Opus 5 sigue delante en DeepSWE v1.1, ProgramBench y Terminal Bench 4.0, y en ExploitBench la brecha es grande. Pro está en el grupo de los modelos de frontera para tareas de agente sin encabezarlo, y en BrainBox gasta una fracción de las unidades de inteligencia que gasta Grok 4.7 en la misma tarea. Flash se queda a entre 1 y 4 puntos de Pro en coding y agentes generales; en ciberseguridad ofensiva la distancia es mayor.
¿Cómo trabaja el Asistente de BrainBox con MiMo V2.6?
El Asistente de BrainBox es un agente. Tú eliges qué Boxes y archivos puede usar y qué modelo razona; el agente decide los pasos. En el chat se ve cada uno: "Listando fuentes", "Buscando en documentos", "Leyendo documento" con las páginas que abrió, "Guardando nota" cuando aparta algo para más adelante, y al final la respuesta con citas a la página. Con un millón de tokens de contexto, MiMo V2.6 puede sostener muchas más lecturas en una misma conversación antes de que el agente tenga que comprimir lo leído, y puede leer un documento de cientos de páginas entero cuando la tarea lo pide.
¿Cómo se eligen en BrainBox?
Confirma que tu plan tiene acceso completo a modelos
Los modelos de Xiaomi llevan la etiqueta Full plan. En cuentas personales de pago aparecen; en un espacio de trabajo, el administrador los habilita en la política de IA.
Abre el Asistente y elige las fuentes
En la barra lateral marcas los Boxes y archivos que el agente puede usar. El selector de modelo está en la barra inferior del chat y tiene buscador.
Escribe 'MiMo'
Aparecen MiMo V2.6 Pro, MiMo V2.6 Flash y las versiones V2.5, con su contexto y etiquetas.
Elige Pro o Flash según la tarea
Pro para revisar y razonar sobre un expediente completo; Flash para preguntas frecuentes y resúmenes por lotes.
Pide la tarea
Si quieres que lea un documento entero, dilo en el mensaje. Si no, el agente busca y lee las páginas que hacen falta. La respuesta sigue llevando citas a la página.
Seleccionar modelo
- MiMo V2.6 ProXiaomi
Modelo insignia de Xiaomi, más de 1T de parámetros, para coding, multimodal y agentes de largo plazo
1M contextoProFull planImágenes - MiMo V2.6 FlashXiaomi
MoE abierto de 309B totales y 15B activos para coding y agentes de largo plazo
1M contextoFull planImágenes
BrainBox es un espacio de trabajo de IA para documentos que responde con citas a la página exacta. Con MiMo V2.6 la respuesta llega desde un modelo abierto, y la cita sigue apuntando al documento del Box.
¿Cuántas unidades de inteligencia gasta cada tarea?
En BrainBox el consumo no se mide en tokens sino en unidades de inteligencia, y cada tarea gasta un número distinto según cuántas búsquedas y lecturas hace el agente, cuánto razona el modelo y cuánto escribe. Estimaciones para el plan estándar, con Grok 4.7 al lado como referencia:
| Tarea en el Asistente | MiMo V2.6 Pro | MiMo V2.6 Flash | Grok 4.7 |
|---|---|---|---|
| Pregunta puntual con citas, una o dos búsquedas | ≈ 1 unidad | ≈ 1 unidad | ≈ 3 unidades |
| Análisis de un Excel con el intérprete de código | ≈ 3 unidades | ≈ 2 unidades | ≈ 8 unidades |
| Revisión de un expediente con unas diez búsquedas y lecturas | ≈ 7 unidades | ≈ 4 unidades | ≈ 20 unidades |
| Lectura completa de un contrato de 200 páginas, página por página | ≈ 7 unidades | ≈ 3 unidades | ≈ 22 unidades |
| Informe en PDF a partir de un expediente, con código y unos quince pasos | ≈ 11 unidades | ≈ 5 unidades | ≈ 35 unidades |
| Expediente de 450 páginas leído entero en una sola pasada | ≈ 14 unidades | ≈ 6 unidades | ≈ 95 unidades |
Son estimaciones: una respuesta más larga, más fuentes o más pasos del agente suben el número. Como referencia, el plan Elite incluye 400 unidades al mes; con Flash, la revisión de un expediente gasta poco más que una pregunta con Grok 4.7.
¿Qué pasa si el Box es más grande que el millón de tokens?
Nada se queda fuera. El Asistente no carga el Box entero en el modelo: busca en las fuentes seleccionadas y lee las páginas que responden la pregunta, cada una con su archivo y su página. Funciona igual con un Box de 200 páginas o de 20.000. Lo que cambia con MiMo V2.6 es cuánto puede tener leído a la vez: más de mil páginas antes de tener que comprimir lo leído en notas.
¿Cuándo conviene Pro, cuándo Flash y cuándo ninguno?
La ventaja de estos modelos en BrainBox está en el contexto: un millón de tokens sin salto de consumo. Con Grok 4.7 un solo paso de más de unas 300 páginas casi dobla las unidades que gasta; con los de Xiaomi el gasto crece parejo hasta el límite.
| Tarea en el Asistente | Modelo | Por qué |
|---|---|---|
| Leer un contrato entero sin saltarse cláusulas en una sola pasada | Pro | 1M de contexto sin salto de consumo; razona mejor que Flash en tareas largas |
| Resumir 50 actas o clasificar correos por lotes | Flash | Una unidad por pregunta; la diferencia de calidad casi no se nota en tareas cortas |
| Pregunta puntual con cita | Flash o el modelo por defecto | Una unidad en cualquier caso; el modelo importa poco |
| Informe en PDF o análisis de datos con el intérprete de código | Pro | Sus mejores resultados están en agentes de coding y herramientas |
| Dictamen o revisión donde el margen de error debe ser mínimo | Claude Opus 5.5 | Siguen siete puntos por encima en el índice independiente; las unidades extra se justifican |
| Equipos con política de proveedores restringida | Depende de la política | El administrador controla qué proveedores y modelos se permiten |
¿En qué se diferencia de usar MiMo en la app de Xiaomi?
Xiaomi ofrece los modelos en su AI Studio, en MiMo Code, en MiMo Desktop y en su API, según la model card. Ahí trabajas con lo que pegues en la conversación. En BrainBox el modelo trabaja sobre el Box.
| AI Studio de Xiaomi | BrainBox con MiMo V2.6 | |
|---|---|---|
| Fuentes | Lo que subas en esa conversación | PDF, Office, audio transcrito e imágenes ya indexados, con permisos por Box |
| Citas | No apunta a la página de tus archivos | Página, fragmento y contexto expandido por afirmación |
| Cambiar de modelo | Solo modelos de Xiaomi | Pro y Flash al lado de Claude, GPT, Gemini y Grok, en el mismo chat |
| Equipo | Cuenta individual | Box compartido con roles y política de modelos por espacio de trabajo |
| Consumo | Según la plataforma | Unidades de inteligencia por uso, según el modelo elegido |
Un equipo de investigación puede subir cien papers, elegir Flash para las preguntas de exploración y pasar a Pro para el análisis final, verificando cada cita en el mismo panel. El resto del espacio de trabajo documental no cambia con el modelo.
Según el informe técnico, la fase de refuerzo costó 2,6 millones de dólares para Pro y 0,9 millones para Flash, con lotes de 1.568 prompts y secuencias de 110.000 a 150.000 tokens. En BrainBox, leer un expediente de 450 páginas entero en una sola pasada gasta unas 14 unidades de inteligencia con Pro y 6 con Flash.
Fuentes
- Xiaomi MiMo, model cards de MiMo-V2.6-Pro-RL y MiMo-V2.6-Flash-RL en Hugging Face: parámetros, contexto, modalidades, licencia MIT, tabla de benchmarks y disponibilidad.
- Xiaomi MiMo, MiMo-V2.6 technical report: entrenamiento por refuerzo, costo de RL, modelo destilado y suite abierta.
- Xiaomi, ficha de MiMo-V2.6-Pro: salida máxima de 128K y modalidades.
- Artificial Analysis, MiMo-V2.6-Pro: Intelligence Index, ranking entre modelos abiertos, velocidad, latencia y costo de evaluación.
- Artificial Analysis, leaderboard de modelos: puntajes de Grok 4.7, Grok 4.6, Gemini 3.8 Flash, DeepSeek V4.1 Flash, Claude Fable 5.1, GPT-6 Astra y MiMo-V2.5-Pro.
Preguntas frecuentes
- ¿Qué diferencia hay entre MiMo V2.6 Pro y Flash?
- Tamaño y consumo. Pro tiene 1,02 billones de parámetros totales con 42.000 millones activos por token; Flash tiene 309.000 millones totales con 15.000 millones activos. Los dos tienen 1 millón de tokens de contexto y aceptan imágenes. En los benchmarks que publica Xiaomi, Flash queda entre 1 y 4 puntos por debajo de Pro en coding y agentes generales, y bastante más lejos en ciberseguridad ofensiva: en ExploitBench, 25,3 frente a 47,9. En BrainBox, Flash gasta cerca de un tercio de las unidades de inteligencia que gasta Pro.
- ¿Cuánto cuestan en BrainBox?
- El consumo se mide en unidades de inteligencia. Estimaciones en el plan estándar: una pregunta puntual con citas, 1 unidad con cualquiera de los dos; una revisión de expediente con búsquedas y lecturas, unas 7 unidades con Pro y 4 con Flash; un informe en PDF a partir de un expediente, unas 11 con Pro y 5 con Flash; un expediente de 450 páginas leído entero en una sola pasada, unas 14 con Pro y 6 con Flash. No hay salto de consumo por contexto largo.
- ¿Por qué necesito un plan con acceso completo a modelos?
- Los modelos de Xiaomi llevan la etiqueta Full plan en el selector. En cuentas personales aparecen para los planes de pago; en un espacio de trabajo, el administrador decide en la política de IA si el equipo puede usarlos.
- ¿Qué tan bueno es MiMo V2.6 Pro comparado con Claude o GPT?
- Artificial Analysis le da 46 puntos en su Intelligence Index v4.3, el mismo puntaje que Grok 4.7 y por encima de Grok 4.6 con 44, Gemini 3.8 Flash con 41 y DeepSeek V4.1 Flash con 39. Claude Fable 5.1 y GPT-6 Astra puntúan 53. En la propia tabla de Xiaomi, Claude Opus 5 sigue delante en DeepSWE v1.1, ProgramBench y Terminal Bench 4.0.
- ¿Qué pasa si mi Box es más grande que el millón de tokens?
- Nada se queda fuera. El Asistente no carga el Box entero de una vez: busca en las fuentes que elegiste y lee las páginas que responden la pregunta, cada una con su cita. El tamaño del Box no limita qué modelo puedes usar.
- ¿Mis documentos van a servidores de Xiaomi?
- Los documentos siguen guardados en BrainBox. Lo que recibe el modelo es el fragmento de contexto de cada pregunta, igual que con cualquier otro modelo del selector. Si tu política de compliance excluye ciertos proveedores, el administrador puede bloquearlos en el espacio de trabajo.
Escrito por
BrainBox Team
Inteligencia documental, por ExaByte Company
Construimos BrainBox — la plataforma que los equipos usan para preguntar sobre sus propios documentos y obtener respuestas con citas exactas de página.
Sigue leyendo
Claude Opus 5.5 en BrainBox: benchmarks, precio y cuándo elegirlo
Anthropic publicó Claude Opus 5.5 el 22 de septiembre de 2026 y ya se puede elegir en el Asistente de BrainBox: es el número uno del Intelligence Index de Artificial Analysis, con benchmarks, unidades de inteligencia por tarea y cuándo conviene.
GPT-6 Sol vs Luna: benchmarks, precio y cuál usar en BrainBox
OpenAI publicó GPT-6 Sol y GPT-6 Luna el 22 de septiembre de 2026 y los dos ya están en el Asistente de BrainBox: benchmarks, puntaje en Artificial Analysis, unidades de inteligencia por tarea y cuál elegir.
Grok 4.7 en BrainBox: benchmarks, precio y cuándo elegirlo
Grok 4.7 de xAI ya se puede elegir en el Asistente de BrainBox: benchmarks frente a Grok 4.6, puntaje en Artificial Analysis, unidades de inteligencia que gasta por tarea y para qué trabajo documental conviene.