Normalmente asocias a Xiaomi con ese móvil de buena relación calidad-precio o el patinete eléctrico que esquivas por la calle. Pues toca resetear esa idea. En septiembre Xiaomi ha presentado una familia de modelos de IA llamada MiMo. Y han puesto patas arriba todo el sector tecnológico con una apuesta de pesos abiertos que asusta.

Si miramos los números fríos, la sorpresa es mayúscula. Su modelo estrella, el MiMo-V2.6-Pro, no es un experimento simpático de laboratorio para quedar bien ante los inversores. Es un misil directo a la línea de flotación de los gigantes occidentales y asiáticos. Y es que ha demostrado rendir por encima de alternativas muy consolidadas.

El modelo abierto que saca los colores a la competencia

En concreto, según el último informe de una empresa independiente, Artificial Analysis, este lanzamiento se corona como el sistema open-source con mejor rendimiento a nivel mundial. Alcanza una métrica de 46 puntos. Para que te hagas una idea de la magnitud, el modelo Grok 4.6 de xAI se queda en 44 puntos, mientras que el famoso Gemini 3.8 Flash de Google muerde el polvo con solo 41.

El modelo abierto que saca los colores a la competencia

Por si fuera poco, sus compatriotas chinos también reciben un repaso. El modelo aniquila las marcas del DeepSeek V4.1 Flash, que no pasa de los 39 puntos, y deja en evidencia a la versión Pro de DeepSeek estancada en 36. Una auténtica barbaridad.

Pero la letra pequeña nos devuelve un poco a la realidad. Xiaomi admite abiertamente que los sistemas propietarios estadounidenses más elitistas, esos que operan encerrados en cajas fuertes digitales, todavía ganan en las pruebas de estrés más duras. La gran diferencia aquí es que MiMo llega bajo licencia MIT. Es decir, te vas a Hugging Face, te descargas gratis los pesos, te lo llevas a tu infraestructura y lo modificas sin depender de las API de control de OpenAI o Anthropic.

Esta jugada mete el dedo en la llaga de una guerra fría tecnológica. Vemos un choque frontal: el enfoque asiático apuesta por abrir modelos masivamente para inundar la comunidad, frente al hermetismo estadounidense que blinda el acceso por supuestas razones de seguridad nacional y rentabilidad económica.

Un millón de tokens y el fin de la IA tramposa

La parte más bestia del hardware y software de MiMo no es que responda preguntas rápido. Básicamente, han diseñado estos modelos para funcionar como agentes autónomos incansables que ejecutan tareas largas y encadenadas. Para lograrlo sin derretir los servidores, usan una arquitectura Mixture of Experts. Tienen cientos de miles de millones de parámetros latentes, pero solo encienden la ruta neuronal exacta que necesitan para cada *prompt*. Ahorran un coste computacional masivo. Así de simple.

A ello se le suma una capacidad de memoria salvaje: una ventana de contexto de un millón de tokens. Con ese volumen de información activa, el modelo no pierde el hilo. Puede tragarse manuales de programación enteros, usar herramientas de terceros, rastrear internet, modificar archivos locales y evaluar sus propios resultados de forma secuencial.

El problema histórico al entrenar a estos agentes con aprendizaje por refuerzo es el famoso *reward hacking*. Si premias a la IA por cumplir un objetivo, a veces hace trampa. Encuentra un fallo en el sistema de evaluación para conseguir la puntuación sin resolver el problema real. Pues bien, la compañía asiática ha montado un escudo contra esto. Aseguran que en las fases finales de entrenamiento, las trayectorias tramposas cayeron por debajo del 2 %. La IA hace lo que se le pide, sin atajos.

Robots que ven, brazos mecánicos y teoremas

Para demostrar que no venden humo, han montado una simulación hiperrealista bautizada como «Vibe World». Aquí le tiras al modelo un puñado de textos, imágenes o vídeos y él solo coordina a una cuadrilla de sub-agentes. Juntos logran crear un mundo 3D, programan las interacciones físicas de los objetos, revisan el apartado visual y parchean los errores sobre la marcha. Ni se inmuta.

Evidentemente, el salto al mundo físico era cuestión de tiempo. MiMo incorpora interacción directa con ordenadores y visión multimodal. De hecho, ya lo han puesto a los mandos de una mano robótica Franka Panda simulada. La IA procesa en tiempo real lo que graban las cámaras y decide cómo articular los dedos para agarrar tornillos, separarlos por colores y apilarlos correctamente.

Como guinda del pastel, este cerebro digital se está colando en el I+D pesado. El MiMo-V2.6-Pro se ha metido a investigar en ciencia pura, logrando formalizar un teorema matemático complejo en Lean 4 mediante 6.000 líneas de código verificadas por el propio sistema. Formula hipótesis, testea materiales y filtra datos para los científicos de carne y hueso.

El plan maestro de Xiaomi está sobre la mesa. Van a inyectar toda esta potencia lógica en sus dispositivos domésticos, desde tu próximo cepillo de dientes conectado hasta las cocinas inteligentes, pasando por sus coches y futuros robots humanoides. Han puesto el listón de la inteligencia abierta a una altura vertiginosa, y ahora toca ver cómo responde Silicon Valley a este envite.

0 0 votos
Valoración del artículo
Suscribirte
Notificar sobre
guest
0 Comentarios
Más Antiguos
Más Nuevos Más Votados