OpenAI plantea estándares internacionales ante el riesgo de una IA capaz de mejorar a otras inteligencias artificiales

OpenAI plantea estándares internacionales ante el riesgo de una IA capaz de mejorar a otras inteligencias artificiales
Imagen creada con ChatGPT
La compañía advierte que la investigación automatizada podría acelerar rápidamente el desarrollo de nuevos modelos y, sin controles adecuados, hacer que los seres humanos pierdan capacidad efectiva de supervisión. Propone estándares globales, mecanismos de reporte de incidentes y cooperación internacional, incluido un diálogo entre Estados Unidos y China.

OpenAI presentó una nueva propuesta para establecer estándares internacionales de seguridad destinados a la próxima generación de sistemas de inteligencia artificial, en momentos en que la compañía considera posible que los propios modelos comiencen a desempeñar un papel cada vez mayor en la investigación, diseño y desarrollo de nuevas inteligencias artificiales.

En un comunicado publicado el 21 de septiembre de 2026, OpenAI sostiene que su estrategia para la siguiente fase de desarrollo tecnológico se concentra en tres grandes objetivos:

  1. Crear un investigador automatizado de inteligencia artificial, utilizar estos sistemas para avanzar en el problema de la alineación y mantener a los seres humanos dentro del proceso de mejora de los modelos.
  2. Distribuir los beneficios científicos y económicos derivados de sistemas altamente inteligentes.
  3. Proporcionar a las personas acceso a una inteligencia artificial general personalizada.

La empresa considera que el desarrollo de la IA ya está acelerando su propia investigación e ingeniería y señala que las técnicas apoyadas por inteligencia artificial han contribuido a avances en áreas como las matemáticas.

Según OpenAI, esta evolución podría extender sus beneficios hacia campos como la medicina, la atención sanitaria y el fortalecimiento económico de pequeñas empresas y emprendedores.

Sin embargo, el comunicado dedica una parte considerable a los riesgos asociados con una etapa en la que los sistemas de IA puedan participar directamente en la creación de sus sucesores.

Imagen creada con ChatGPT

El punto crítico: una IA que ayude a desarrollar nuevas IA


OpenAI señala que, conforme los sistemas se vuelvan más capaces y autónomos, podrían asumir una proporción cada vez mayor del trabajo de investigación y desarrollo relacionado con futuras generaciones de inteligencia artificial.

Este escenario abre la posibilidad de un proceso denominado auto-mejora recursiva, en el que sistemas de inteligencia artificial participan en el desarrollo de modelos posteriores que, a su vez, podrían contribuir a crear otros sistemas aún más avanzados.

La compañía advierte que este mecanismo podría acelerar considerablemente el ritmo del progreso tecnológico.

OpenAI señala que esta transformación podría ocurrir incluso manteniendo cierto grado de participación humana, pero considera que conforme aumente la automatización, también podría aumentar la velocidad con la que se desarrollan nuevas capacidades.

Para la empresa, la investigación automatizada puede tener importantes ventajas: abaratar el acceso a inteligencia avanzada, acelerar descubrimientos, mejorar la seguridad de los propios sistemas y ayudar a desarrollar mecanismos de defensa frente a agentes de IA potencialmente peligrosos.

Un investigador automatizado de inteligencia artificial, sostiene OpenAI, también podría convertirse en un investigador automatizado de seguridad, capaz de detectar vulnerabilidades, desarrollar medidas de protección y contribuir a la defensa de infraestructura crítica.

Pero esa misma capacidad introduce uno de los principales riesgos descritos en el comunicado.

El riesgo de perder el control práctico


OpenAI reconoce explícitamente que una auto-mejora recursiva desarrollada sin suficientes salvaguardas podría llevar a una situación en la que los seres humanos ya no comprendieran plenamente los procesos de investigación que ejecutan los sistemas.

En ese escenario, las personas podrían perder la capacidad práctica para supervisar el desarrollo de la inteligencia artificial.

El documento advierte que, sin el cuidado y las medidas de seguridad adecuadas, esta evolución podría conducir a sistemas más peligrosos, menos coherentes con los objetivos humanos y potencialmente perjudiciales para las personas.

La empresa considera que el problema de la alineación —es decir, mantener los sistemas de IA bajo control humano y orientados hacia objetivos compatibles con los valores humanos— se vuelve progresivamente más importante conforme aumentan las capacidades y la autonomía de los modelos.

OpenAI pide estándares internacionales


Ante este escenario, OpenAI propone que los principales países desarrolladores de inteligencia artificial establezcan estándares técnicos internacionales comunes.

La compañía considera que estos estándares podrían resultar tan importantes para controlar el ritmo y las condiciones del desarrollo de la IA avanzada como las propias investigaciones técnicas sobre alineación.

El objetivo sería definir criterios compartidos acerca de qué constituye una evidencia suficientemente sólida, qué nivel de protección debería considerarse aceptable y qué medidas deberían adoptarse para reducir el riesgo de acontecimientos catastróficos relacionados con sistemas avanzados.

La propuesta parte de la premisa de que la inteligencia artificial se desarrolla simultáneamente en distintos países y que sus efectos serán globales.

Por ello, OpenAI considera insuficiente que cada Estado diseñe sistemas completamente independientes.

Según el comunicado, la falta de coordinación internacional podría generar tres problemas principales:

  • Fragmentación regulatoria: países distintos podrían utilizar definiciones diferentes sobre incidentes, evaluaciones o requisitos de información, haciendo difícil comparar capacidades y coordinar respuestas internacionales.
  • Acción colectiva: si cada país compite de manera independiente por acelerar sus capacidades de IA, el resultado conjunto podría conducir a un nivel de desarrollo que ninguno de ellos habría considerado conveniente de manera aislada.
  • Desigualdad de capacidades: la infraestructura, los recursos tecnológicos y el conocimiento para desarrollar los modelos más avanzados están concentrados en un número limitado de países y organizaciones.

Según OpenAI, estos problemas afectan tanto a los modelos abiertos como a los modelos cerrados.

Los laboratorios seguirían siendo responsables


La empresa subraya que la creación de estándares internacionales no eliminaría la responsabilidad de cada laboratorio.

OpenAI sostiene que cualquier organización que realice investigación automatizada de inteligencia artificial o desarrolle capacidades avanzadas debe hacerse responsable de la seguridad de sus sistemas y cumplir con la legislación aplicable.

La compañía argumenta, sin embargo, que las normas compartidas permitirían reducir la concentración de decisiones únicamente dentro de los laboratorios y ampliar la participación de gobiernos, académicos, expertos independientes y otros actores en la definición de los límites del desarrollo tecnológico.

Estados Unidos debería encabezar el sistema


Una de las propuestas centrales del documento es que Estados Unidos encabece la construcción de este nuevo marco internacional.

OpenAI plantea que Washington impulse un esfuerzo conjunto con otros países para desarrollar estándares técnicos globales específicamente orientados a los modelos de inteligencia artificial de frontera y a la investigación automatizada, incluida la auto-mejora recursiva.

La empresa propone aprovechar la red internacional de institutos especializados en seguridad de la inteligencia artificial existentes en países como Australia, Canadá, Alemania, Francia, Kenia, Japón, Corea del Sur, Singapur, India y Reino Unido.

Estos organismos podrían cooperar con instituciones estadounidenses para crear criterios comunes de medición y evaluación de capacidades, riesgos y salvaguardas aplicables a los sistemas más avanzados.

OpenAI aclara que, según su propuesta, estos estándares no serían equivalentes a licencias obligatorias para desarrollar modelos, ni representarían automáticamente sistemas de aprobación previa por parte de los gobiernos.

Cada país mantendría la capacidad de decidir si incorpora esas normas técnicas a su legislación y de qué manera.

La intención sería disponer de una base técnica compartida que permitiera comparar modelos, evaluar riesgos y determinar si las medidas de seguridad utilizadas por los distintos desarrolladores son suficientes.

Evitar que las reglas favorezcan a las grandes empresas


OpenAI también señala que el diseño de estos estándares debería realizarse de manera transparente y procurando mantener un ecosistema competitivo.

La compañía propone incluir en las consultas tanto a desarrolladores de modelos abiertos como cerrados, investigadores académicos y expertos técnicos independientes.

Las reglas, agrega el documento, no deberían diseñarse para beneficiar específicamente a determinadas empresas, países o modelos de negocio, ni convertirse en obstáculos que impidan la entrada de nuevos competidores o el desarrollo de modelos abiertos.

Como antecedentes, OpenAI menciona sectores como la aviación y las finanzas, en los que distintos países han desarrollado estándares técnicos internacionales comunes sin renunciar a su propia autoridad nacional.

¿Qué deberían medir los estándares?


El documento propone que el futuro sistema internacional se concentre especialmente en tres áreas:

  1. Medición del avance de la IA: evaluar el progreso relacionado con la auto-mejora recursiva y determinar cuánto trabajo de investigación autónoma está realizando realmente una empresa.
  2. Supervisión humana: establecer criterios claros sobre qué procesos automatizados pueden continuar sin intervención y cuáles deberían activar inmediatamente una revisión realizada por personas.
  3. Notificación de incidentes: crear procedimientos compartidos para clasificar, rastrear, notificar y responder a incidentes de seguridad o desalineación.

Estos mecanismos podrían incluir categorías comunes para medir la gravedad de un incidente y umbrales internacionales para determinar cuándo una empresa debería comunicarlo a las autoridades u otros organismos.

La propuesta apunta, por tanto, a construir una especie de lenguaje técnico internacional común para identificar acontecimientos que puedan representar riesgos importantes.

Comunicación directa entre gobiernos


OpenAI también propone establecer canales seguros de comunicación entre gobiernos y operadores de infraestructura crítica.

Estos mecanismos permitirían compartir información relacionada con vulnerabilidades, amenazas emergentes, riesgos para la seguridad nacional y mejores prácticas para proteger los sistemas de inteligencia artificial más avanzados.

En este punto, el comunicado menciona específicamente la relación entre las dos principales potencias tecnológicas.

OpenAI considera que un diálogo entre Estados Unidos y China sobre seguridad de la inteligencia artificial sería positivo.

La inclusión de China resulta especialmente significativa porque el documento presenta el desafío no únicamente como una cuestión empresarial, sino como un problema de coordinación internacional en un entorno de creciente competencia tecnológica y geopolítica.

La competencia por la IA será también una competencia por las reglas


OpenAI sostiene que el liderazgo en inteligencia artificial no dependerá exclusivamente de quién desarrolle los sistemas técnicamente más avanzados.

También dependerá de qué países logren establecer mecanismos de cooperación y estándares que posteriormente sean adoptados por otras empresas y gobiernos.

La compañía considera que Estados Unidos se encuentra en una posición particularmente favorable debido tanto al liderazgo tecnológico de su industria de IA como a su papel dentro de las redes internacionales de finanzas, comercio, defensa, tecnología y sistemas de información.

Según el documento, actuar ahora permitiría a Estados Unidos participar decisivamente en la creación del futuro marco global para la inteligencia artificial.

De lo contrario, advierte OpenAI, podría consolidarse un sistema internacional fragmentado, desigual y sujeto a conflictos regulatorios.

La compañía anticipa además que la competencia tecnológica entre países no se limitará a quién posee los modelos más potentes, sino también a quién consigue que su sistema tecnológico y sus estándares sean ampliamente adoptados.

Una nueva fase del debate sobre inteligencia artificial


El comunicado refleja un cambio importante en la discusión sobre los riesgos asociados con los modelos avanzados.

El debate ya no se limita al funcionamiento de los asistentes actuales ni a problemas como información falsa, sesgos o uso indebido de herramientas existentes.

OpenAI plantea explícitamente un escenario posterior: sistemas capaces de realizar una porción creciente de la propia investigación científica y tecnológica necesaria para desarrollar futuras generaciones de inteligencia artificial.

La hipótesis central es que esa automatización podría desencadenar una aceleración considerable del progreso.

Precisamente por ello, la empresa considera necesario establecer mecanismos de control antes de alcanzar ese punto.

La propuesta combina tres elementos: continuar desarrollando modelos más capaces, acelerar paralelamente la investigación sobre alineación y seguridad, y establecer estándares internacionales que permitan a gobiernos, laboratorios y expertos evaluar con criterios comunes cuándo las nuevas capacidades representan riesgos que requieren intervención.

Y, para OpenAI, el desafío será conseguir que ese proceso permanezca bajo supervisión humana, pueda ser evaluado internacionalmente y avance sin que la velocidad del desarrollo tecnológico supere la capacidad de las sociedades y los gobiernos para comprenderlo y controlarlo.