OpenAI presentó un plan para fijar estándares comunes de seguridad en la próxima etapa de la IA. La propuesta llega tras las advertencias de Anthropic y en un momento en que Sam Altman, director general de OpenAI, y Jakub Pachocki, su científico jefe, alertaron sobre la velocidad del desarrollo tecnológico.

En su texto “Desarrollar los estándares para la próxima fase de la IA”, la compañía sostiene que la inteligencia artificial general debe beneficiar a toda la humanidad. El hallazgo central no es una nueva herramienta para usuarios, sino una hoja de ruta para mantener el control humano sobre sistemas cada vez más capaces.

Pachocki también puso el foco en el problema el 6 de septiembre, en el artículo “Una mente alienígena”. Allí plantea que comprender una IA avanzada puede parecerse a intentar interpretar una mente construida con reglas muy distintas de las humanas.

El interruptor que busca conservar el control humano

La pieza clave del debate es la automejora recursiva, la capacidad de un sistema para crear versiones mejores de sí mismo de manera repetida. Esa posibilidad completamente autónoma todavía no existe, pero OpenAI considera que no debería buscarse hasta que pueda desplegarse con garantías de seguridad.

También te puede interesar:OpenAI Lanza el Modo Visión en Tiempo Real y Compartir Pantalla en Europa
El interruptor que busca conservar el control humano

La analogía doméstica ayuda a entender el mecanismo. Una IA de frontera, los modelos más potentes disponibles, sería como una casa con un taller propio. Si el taller empieza a cambiar la instalación eléctrica, ampliar las habitaciones y construir nuevas herramientas sin un electricista que revise cada paso, el riesgo no está en una sola reforma: está en la velocidad acumulada de todas.

Los estándares funcionarían como el tablero eléctrico, los planos obligatorios y el interruptor general de esa casa. No impedirían reparar o mejorar el sistema. Pero exigirían pruebas antes de conectar una nueva pieza y permitirían cortar la operación si aparece una falla grave.

Por eso, OpenAI propone que las evaluaciones, la gestión de incidentes y las medidas de seguridad no queden solo en manos de cada empresa o de las leyes de su país. La compañía plantea una supervisión neutral y de mayor alcance, apoyada en el trabajo que ya realizan institutos especializados en seguridad de IA.

Otro engranaje central es el alineamiento, la investigación para que una IA actúe según objetivos humanos y siga bajo supervisión. La empresa defiende que ese trabajo avance al mismo ritmo que los modelos, porque una mayor automatización también puede acelerar el progreso de la tecnología.

También te puede interesar:OpenAI Lanza el Modo Visión en Tiempo Real y Compartir Pantalla en Europa
También te puede interesar:OpenAI une fuerzas con los Laboratorios Nacionales de EEUU para transformar la investigación científica

Un protocolo para cuando algo falle

El plan incluye crear un protocolo que determine qué incidentes causados por modelos avanzados deben notificarse a las autoridades. La idea se parece a los avisos obligatorios en aviación: si una falla revela un problema que puede repetirse, no alcanza con resolverla en privado.

Sin embargo, la propuesta enfrenta una dificultad decisiva. Los laboratorios estadounidenses pueden coordinarse con aliados, pero la seguridad tendría menos alcance si Estados Unidos y China aplicaran reglas diferentes a sus compañías. Por ahora, no hay señales de un acuerdo cercano entre ambas potencias.

El plan incluye crear un protocolo que determine qué incidentes causados por modelos avanzados deben notificarse a las autoridades.

La oportunidad, entonces, no consiste en frenar toda innovación. Consiste en instalar el cableado de seguridad antes de que una inteligencia más autónoma encuentre la forma de remodelar la casa a una velocidad que nadie pueda seguir.

0 0 votos
Valoración del artículo
Suscribirte
Notificar sobre
guest
0 Comentarios
Más Antiguos
Más Nuevos Más Votados