Writer, la empresa de herramientas y agentes de IA para equipos profesionales de marketing, presentó Palmyra X6, su nuevo modelo insignia, junto con mejoras en el harness (la capa que organiza el trabajo de los agentes). El hallazgo de la compañía apunta a un objetivo concreto: contener el coste de los tokens, las pequeñas unidades de texto que procesa la IA.

Palmyra X6 se basa en una variante posterior al entrenamiento de GLM-5.2, un modelo de código abierto de Z.ai. Según Writer, la combinación del nuevo modelo y el ajuste de su infraestructura puede reducir hasta un 50% el coste de las tareas básicas para sus clientes.

El objetivo de Writer con Palmyra X6 es contener el coste de los tokens, las pequeñas unidades de texto que procesa la IA

May Habib, consejera delegada de Writer, señala que las empresas están cansadas de perseguir nuevos récords en benchmarks. Ahora, explica, los responsables tecnológicos buscan una pieza clave mucho más práctica: estabilizar o bajar sus gastos.

El cableado que puede pesar más que el modelo

La clave está en entender que un agente de IA no funciona como una sola bombilla. Se parece más a una casa con cables, interruptores, llaves de paso y electrodomésticos que deben activarse en el orden correcto para cumplir una tarea.

El modelo es el motor que genera texto, analiza documentos o propone una campaña. Pero el harness, la infraestructura que decide qué pasos sigue el agente y cuándo consulta cada herramienta, es el cableado central que evita recorridos innecesarios.

Un modelo potente con un harness ineficiente puede gastar como una casa con las luces encendidas en habitaciones vacías.

Un modelo potente con un harness ineficiente puede gastar como una casa

Writer busca que sus agentes completen trabajos complejos de varios pasos con menos llamadas al modelo y menos tokens. Eso puede incluir resumir información, consultar una base de datos, revisar un texto y preparar una respuesta final sin repetir instrucciones o abrir procesos que no aportan valor.

La oportunidad resulta relevante porque elegir un modelo de código abierto más barato no siempre resuelve el problema. Cada modelo tiene capacidades y precios distintos, y una empresa puede usar varios a la vez según el tipo de tarea.

Por eso, la experiencia de los clientes de Writer seguirá siendo independiente del modelo. Palmyra X6 coexistirá con otros sistemas de la empresa y con modelos externos incorporados mediante Azure o Amazon Bedrock.

Un ajuste pequeño con efecto acumulado

La empresa sostiene que el mecanismo más fiable para reducir costes no siempre consiste en cambiar de modelo. En sus pruebas, las mejoras del harness redujeron los costes un promedio del 40% al aplicarse sobre distintos modelos.

Writer sostiene que el mecanismo más fiable para reducir costes no siempre consiste en cambiar de modelo

Ese resultado aparece detallado en un artículo reciente de investigadores de Writer, que evaluó pequeños cambios de eficiencia en esta capa de control. Los autores subrayan que el beneficio no queda atado a una tecnología concreta: se multiplica sobre los modelos actuales y también sobre los que una organización adopte después.

Habib advierte que el aumento de costes está erosionando la confianza de los CIO, los responsables de tecnología de una empresa, en los grandes laboratorios de IA. Su crítica es directa: esos proveedores tendrían incentivos para que sus sistemas consuman más tokens, mientras los clientes necesitan obtener resultados medibles.

Palmyra X6 y las actualizaciones del harness están disponibles para los clientes de Writer desde el jueves. La promesa no es que la IA haga magia con menos recursos, sino que su engranaje deje de desperdiciar energía antes de encender otra luz.

0 0 votos
Valoración del artículo
Suscribirte
Notificar sobre
guest
0 Comentarios
Más Antiguos
Más Nuevos Más Votados