¿Vale la pena pagar mucho más por una inteligencia artificial si, para responder correos, programar tareas repetitivas o atender clientes, otra opción resuelve casi lo mismo por una fracción del precio? Esa pregunta empieza a cambiar el tablero tecnológico.

El hallazgo llega desde China. DeepSeek V4-Flash, Qwen3.8-Flash de Alibaba y GLM-5.3-Flash de Z.ai muestran que los modelos de pesos abiertos, es decir, sistemas cuyo funcionamiento puede descargarse y adaptarse, ya no compiten solo por ser baratos.

Ahora se acercan al rendimiento de los modelos frontera de OpenAI y Anthropic. Estos últimos conservan el liderazgo en capacidad máxima, pero las compañías chinas están afinando otra pieza clave: cuánta inteligencia obtiene una empresa por cada dólar que invierte. DeepSeek V4-Flash, presentado hace pocas semanas por la compañía, cuesta 0,22 dólares por millón de tokens de entrada y 0,66 por los de salida. Los tokens son pequeñas unidades de texto que la IA lee o produce.

La distancia se vuelve visible frente a GPT-5.6 Sol, con precios de 4 y 20 dólares, o Claude Fable 5, con 10 y 50 dólares por cada millón de tokens. DeepSeek no es el modelo más capaz del mercado, pero su coste lo vuelve difícil de ignorar.

También te puede interesar:Z.ai Presenta GLM-5.3-Flash, Modelo Multimodal de IA Bajo Licencia MIT

El mecanismo de los expertos que se encienden solo cuando hacen falta

La clave está en la arquitectura Mixture-of-Experts, o mezcla de expertos: un mecanismo que divide el trabajo entre partes especializadas del modelo. En lugar de poner en marcha toda la maquinaria para cada pedido, activa solo los engranajes necesarios. Es como una casa donde no se encienden todas las luces al entrar, sino únicamente la lámpara de la habitación que se está usando. Así, la IA conserva una estructura enorme, pero reduce electricidad, tiempo de cálculo y dinero en cada respuesta.

Qwen3.8-Flash ilustra ese interruptor digital. Tiene 125.000 millones de parámetros, los ajustes internos que permiten reconocer patrones, pero activa cerca de 6.000 millones en cada momento. Alibaba lo presenta como un adelanto de la futura arquitectura Qwen4.

China Desafía a OpenAI con una IA Más Barata, Pero el Verdadero Problema para Occidente no es el Precio

Según la empresa, puede competir con sistemas mayores en programación y tareas agénticas, es decir, encargos donde la IA ejecuta varios pasos de forma autónoma. Su API, la puerta de acceso para que otras aplicaciones la utilicen, cuesta 0,16 dólares por millón de tokens de entrada y 0,47 por los de salida.

GLM-5.3-Flash, de Z.ai, lleva esa lógica a otra escala. El modelo, conocido inicialmente como Ox Alpha, posee 320.000 millones de parámetros totales, aunque activa solo 18.000 millones por token y puede manejar un millón de tokens de contexto, la memoria temporal de una conversación o documento. Artificial Analysis le otorga 57 puntos en su índice de inteligencia, cerca de los 60 de GLM-5.3 Max. Sin embargo, el coste medio por tarea baja de 0,68 a apenas 0,09 dólares.

Ese dato revela la llamada frontera de Pareto: el punto donde una mejora pequeña de rendimiento obliga a pagar mucho más. GLM y Qwen no desplazan a los modelos occidentales de la gama alta, pero cuestionan si compensa pagar entre un 5% y un 10% adicional de inteligencia a precios muy superiores.

Una oportunidad para la IA cotidiana

También hay una señal de autonomía tecnológica. Z.ai confirmó que Ox Alpha funcionaba íntegramente con chips chinos y anunció una capacidad potencial de hasta 100 billones de tokens diarios. Esa cifra describía la capacidad de infraestructura, no el tráfico real, pero muestra un cableado nacional preparado para atender grandes volúmenes.

Para una empresa que procesa millones de consultas, automatiza soporte o despliega cientos de asistentes, el modelo más caro no siempre es la respuesta inmediata. A veces, la pieza central es una IA suficientemente buena, fiable y accesible.

La carrera ya no consiste solo en construir el motor más potente. También consiste en lograr que más personas puedan encenderlo.

0 0 votos
Valoración del artículo
Suscribirte
Notificar sobre
guest
0 Comentarios
Más Antiguos
Más Nuevos Más Votados