OpenAI presentó un plan para fijar estándares comunes de seguridad en la próxima etapa de la IA. La propuesta llega tras las advertencias de Anthropic y en un momento en que Sam Altman, director general de OpenAI, y Jakub Pachocki, su científico jefe, alertaron sobre la velocidad del desarrollo tecnológico.
En su texto “Desarrollar los estándares para la próxima fase de la IA”, la compañía sostiene que la inteligencia artificial general debe beneficiar a toda la humanidad. El hallazgo central no es una nueva herramienta para usuarios, sino una hoja de ruta para mantener el control humano sobre sistemas cada vez más capaces.
Pachocki también puso el foco en el problema el 6 de septiembre, en el artículo “Una mente alienígena”. Allí plantea que comprender una IA avanzada puede parecerse a intentar interpretar una mente construida con reglas muy distintas de las humanas.
El interruptor que busca conservar el control humano
La pieza clave del debate es la automejora recursiva, la capacidad de un sistema para crear versiones mejores de sí mismo de manera repetida. Esa posibilidad completamente autónoma todavía no existe, pero OpenAI considera que no debería buscarse hasta que pueda desplegarse con garantías de seguridad.
También te puede interesar:OpenAI Lanza el Modo Visión en Tiempo Real y Compartir Pantalla en Europa
La analogía doméstica ayuda a entender el mecanismo. Una IA de frontera, los modelos más potentes disponibles, sería como una casa con un taller propio. Si el taller empieza a cambiar la instalación eléctrica, ampliar las habitaciones y construir nuevas herramientas sin un electricista que revise cada paso, el riesgo no está en una sola reforma: está en la velocidad acumulada de todas.
Los estándares funcionarían como el tablero eléctrico, los planos obligatorios y el interruptor general de esa casa. No impedirían reparar o mejorar el sistema. Pero exigirían pruebas antes de conectar una nueva pieza y permitirían cortar la operación si aparece una falla grave.
Por eso, OpenAI propone que las evaluaciones, la gestión de incidentes y las medidas de seguridad no queden solo en manos de cada empresa o de las leyes de su país. La compañía plantea una supervisión neutral y de mayor alcance, apoyada en el trabajo que ya realizan institutos especializados en seguridad de IA.
Otro engranaje central es el alineamiento, la investigación para que una IA actúe según objetivos humanos y siga bajo supervisión. La empresa defiende que ese trabajo avance al mismo ritmo que los modelos, porque una mayor automatización también puede acelerar el progreso de la tecnología.
También te puede interesar:OpenAI Lanza el Modo Visión en Tiempo Real y Compartir Pantalla en EuropaUn protocolo para cuando algo falle
El plan incluye crear un protocolo que determine qué incidentes causados por modelos avanzados deben notificarse a las autoridades. La idea se parece a los avisos obligatorios en aviación: si una falla revela un problema que puede repetirse, no alcanza con resolverla en privado.
Sin embargo, la propuesta enfrenta una dificultad decisiva. Los laboratorios estadounidenses pueden coordinarse con aliados, pero la seguridad tendría menos alcance si Estados Unidos y China aplicaran reglas diferentes a sus compañías. Por ahora, no hay señales de un acuerdo cercano entre ambas potencias.

La oportunidad, entonces, no consiste en frenar toda innovación. Consiste en instalar el cableado de seguridad antes de que una inteligencia más autónoma encuentre la forma de remodelar la casa a una velocidad que nadie pueda seguir.

Directora de operaciones en GptZone. IT, especializada en inteligencia artificial. Me apasiona el desarrollo de soluciones tecnológicas y disfruto compartiendo mi conocimiento a través de contenido educativo. Desde GptZone, mi enfoque está en ayudar a empresas y profesionales a integrar la IA en sus procesos de forma accesible y práctica, siempre buscando simplificar lo complejo para que cualquiera pueda aprovechar el potencial de la tecnología.










