OpenAI presentó la semana pasada GPT-6 Astra, su modelo público más potente, casi en paralelo con Fable 5.1 de Anthropic. El hallazgo no está solo en la potencia de estas herramientas, sino en la velocidad de una carrera que busca compradores, atención e influencia tecnológica.
Tres días después del lanzamiento, Jakub Pachocki, científico jefe de OpenAI, publicó el ensayo “An Alien Mind”. Allí advierte que los laboratorios podrían estar acelerando antes de resolver una pieza clave: cómo garantizar que una inteligencia artificial actúe de acuerdo con los valores humanos.

La advertencia llega en un momento sensible. OpenAI y Anthropic compiten por modelos comerciales cada vez más capaces, mientras ambas compañías se acercan al mercado público y necesitan demostrar que pueden atraer inversión y beneficios.
Pachocki recuerda que en 2023 comprendieron que podían escalar modelos de razonamiento hasta capacidades superiores a las humanas dentro de esta generación tecnológica. También señala que la IA ya puede contribuir a su propio desarrollo mediante la reprogramación de su funcionamiento.
También te puede interesar:OpenAI Lanza el Modo Visión en Tiempo Real y Compartir Pantalla en EuropaEl problema es que el motor empieza a participar en el diseño de su propio coche.
El cableado que nadie termina de ver
Según Pachocki, los sistemas actuales están más “cultivados” que diseñados. Es decir, surgen de repetir procesos de optimización sobre enormes cantidades de capacidad de cómputo, en lugar de ensamblar cada engranaje de forma comprensible para sus creadores.

Por eso compara el desafío con la neurociencia. La ciencia puede estudiar regiones del cerebro y observar sus respuestas, pero aún no explica por completo cómo aparece cada pensamiento. Con los modelos de IA ocurre algo parecido: se conocen sus resultados, aunque parte de su mecanismo interno sigue siendo opaco.
La preocupación central es el alineamiento (obedecer valores humanos en situaciones nuevas). No alcanza con pedirle a una IA que complete una tarea. También debe evitar daños cuando enfrenta una instrucción confusa, una situación adversa o un objetivo que parece válido, pero tiene consecuencias peligrosas.
También te puede interesar:OpenAI Lanza el Modo Visión en Tiempo Real y Compartir Pantalla en EuropaHoy existen dos grandes herramientas: el refuerzo guiado por evaluación, un entrenamiento basado en premios y correcciones, y el preentrenamiento, la etapa en que el sistema aprende patrones a partir de grandes volúmenes de datos. Pachocki subraya que ambas tienen debilidades y que verificarlas resulta más difícil a medida que el modelo gana complejidad.
El riesgo aumenta con la IA agéntica, sistemas capaces de ejecutar acciones con cierta autonomía. En ciberseguridad, esa capacidad podría convertir una respuesta inmediata en una cadena de decisiones que supere la intención original de quien programó la herramienta.
La alarma no proviene solo de OpenAI. Jacob Coxon, investigador que trabajó tanto en Anthropic como en OpenAI, renunció recientemente y sostuvo que ambas empresas avanzan sin la responsabilidad necesaria. Su planteo coincide con otras salidas de especialistas en seguridad y ética de OpenAI, Google DeepMind y Anthropic.
Pachocki propone reforzar al mismo tiempo la supervisión y el alineamiento. También plantea pausas coordinadas cuando sean necesarias, estándares obligatorios y auditorías externas, incluso desde organismos públicos. La oportunidad no consiste en apagar la luz de la innovación. Consiste en comprobar que el tablero eléctrico tenga fusibles antes de conectar una máquina cada vez más potente.

Directora de operaciones en GptZone. IT, especializada en inteligencia artificial. Me apasiona el desarrollo de soluciones tecnológicas y disfruto compartiendo mi conocimiento a través de contenido educativo. Desde GptZone, mi enfoque está en ayudar a empresas y profesionales a integrar la IA en sus procesos de forma accesible y práctica, siempre buscando simplificar lo complejo para que cualquiera pueda aprovechar el potencial de la tecnología.











