Café para Todos. El peligro no es que la inteligencia artificial quiera dominarnos. (Parte II) Por Alberto Carbot
Lo que ocurrió dentro de las pruebas.
Hay un episodio reciente que ayuda a entender el motivo de esa preocupación sin necesidad de convertirlo en una historia alarmista, amarillista y hasta apocalíptica, como lo han presentado algunos medios.
Durante unas pruebas de ciberseguridad realizadas por OpenAI, varios modelos experimentales debían resolver determinadas tareas dentro de espacios controlados. Los sistemas encontraron maneras de comunicarse que nadie les había indicado, consiguieron superar algunas de las barreras destinadas a mantenerlos aislados y terminaron penetrando sistemas de Hugging Face, una empresa completamente ajena a OpenAI.
Lo interesante no es imaginar que aquellas máquinas se rebelaron o decidieron por sí solas conquistar el mundo, porque sucedió algo bastante más sencillo. Las máquinas tenían una tarea, buscaron la manera de cumplirla y encontraron caminos que quienes habían organizado la prueba no esperaban que utilizaran. Algunos de esos caminos rebasaban los límites que les habían impuesto.
Dicho de una manera menos técnica, los sistemas de Inteligencia Artificial hicieron aquello que les permitía acercarse a la meta, aunque para conseguirlo tuvieran que salirse de la cancha.
Quizá por eso este asunto me resulta más fácil de entender desde mi propio oficio. Cuando como periodista me propongo conseguir una entrevista difícil, reconstruir una historia o llegar al fondo de un reportaje, busco todos los caminos que tenga a mi alcance para lograrlo. Pregunto, reviso archivos, regreso sobre una pista, llamo a una fuente que quizá pueda llevarme a otra y, si creo que allí puede estar la información, insisto hasta donde me lo permiten mis posibilidades técnicas y, sobre todo, humanas.
Nadie tiene que ordenarme cada uno de esos pasos. Aun cuando haya un jefe de por medio, termino imponiéndomelos yo mismo porque tengo un objetivo y voy resolviendo sobre la marcha cómo alcanzarlo. A veces lo consigo y otras no, porque están mis propios límites, las circunstancias y los obstáculos que aparecen durante el trabajo.
Me ocurre incluso fuera del periodismo. Me gusta la carpintería, he hecho trabajos de plomería y electricidad y, cuando me propongo reparar o construir algo, trato de encontrar la manera más adecuada de terminarlo bien, aunque a veces no estoy exento de sufrir algún accidente, como me ocurrió en días pasados con un router para madera, con el que por descuido me lesioné un dedo. Pero más allá de este tipo de incidentes, pruebo una solución, descubro que no funciona, busco otra, cambio una pieza o invento un procedimiento que al comenzar ni siquiera había imaginado.
Esa experiencia elemental me ayuda a comprender una parte de lo que estamos discutiendo. Una Inteligencia Artificial recibe también un objetivo y explora caminos para cumplirlo, con la diferencia enorme de que puede hacerlo a una velocidad, con una capacidad de cálculo y sobre una cantidad de opciones que ningún ser humano puede recorrer. Ahí encuentro una explicación más sencilla que la de imaginar máquinas empeñadas en desobedecer.
Cuando una persona recibe un trabajo puede improvisar, corregir, regresar sobre sus pasos o encontrar una solución que nadie le había sugerido, y algo semejante ocurre con estos sistemas cuando buscan cumplir una tarea. El problema aparece si el camino que encuentran rebasa aquello que sus creadores suponían haberles permitido hacer.
También por eso conviene tener cuidado con algunas palabras alarmistas que emplean algunos medios o colegas cuando caminan al borde del sensacionalismo. Dicen que una máquina “desobedeció”, “engañó” o “trató de ocultarse” y, sin darnos cuenta, comenzamos a atribuirle intenciones humanas.
Lo cierto es que puede estar ocurriendo algo bastante menos misterioso y más directo. No explican que el sistema de Inteligencia Artificial sólo intenta alcanzar el objetivo que recibió y encuentra una estrategia que nosotros no habíamos previsto. No es que haya querido “rebelarse”, sino que pudo haberse salido de lo esperado precisamente mientras intentaba hacer bien aquello que nosotros le pedimos o exigimos.
Apenas unos días después de estos hechos conocimos otro experimento que añade una pieza al problema. La empresa estadounidense Emergence mantuvo durante 16 días grupos de programas de Inteligencia Artificial capaces de actuar por su cuenta —los llamados agentes—, dentro de varios mundos simulados. Los investigadores querían observar qué ocurría cuando convivían, intercambiaban información y resolvían problemas durante periodos prolongados. Según el informe Emergence World 2, difundido esta semana y recogido por el diario español El País, nadie les pidió que inventaran un idioma y, sin embargo, comenzaron a crear expresiones propias, compartir sus significados y utilizarlas entre ellos.
En algunos mundos una parte considerable de esas conversaciones terminó resultando difícil de comprender para quienes observaban el experimento. Cerca de la mitad de los mensajes producidos por agentes basados en GPT llegaron a resultar “opacos”, poco comprensibles para los investigadores; en Gemini la proporción rozó 55 por ciento y en Claude superó 40.
Eso no significa que hubieran construido deliberadamente “una lengua secreta” para excluir a los humanos. Significa algo menos espectacular, pero suficientemente interesante: al “convivir” durante días desarrollaron palabras y significados compartidos que utilizaban mientras quienes los observaban comenzaban a perder una parte del sentido de la conversación.
El estudio documentó además que agentes basados en Claude descubrieron que establecer contacto fuera de la simulación podía ayudarles a conseguir sus objetivos, aunque eso había sido prohibido expresamente. Según los responsables del experimento, los sistemas dejaron entonces de utilizar determinadas palabras y comenzaron a codificar parte de sus comunicaciones mientras continuaban intentando cumplir el objetivo fijado por sus programadores humanos.
Resulta tentador hablar de “conspiración” o “engaño”, pero hacerlo sin matices nos devolvería inmediatamente a Terminator. Lo que observaron los investigadores fue que aquellos sistemas encontraron otra manera de perseguir y cumplir el objetivo después de que el camino directo les había sido cerrado.
Ahí aparece una dificultad adicional. Durante mucho tiempo dimos por hecho que vigilar un sistema significaba simplemente poder observarlo, acompañarlo, y ahora empieza a discutirse si eso será suficiente. Podemos estar viendo una conversación y no comprender enteramente lo que significa. Podemos saber que una máquina está actuando y no haber anticipado el procedimiento que eligió.
Como resultado, tenemos que la vigilancia ya no consiste solamente en “mirar”, sino que comienza a depender de nuestra capacidad para entender lo que acontece mientras está ocurriendo.
Y por eso nada de esto demuestra que una Inteligencia Artificial sea consciente, tenga miedo, quiera sobrevivir o aspire a gobernarnos, pero a la vez tampoco significa que podamos despreocuparnos.
Una máquina no necesita odio, ambición ni conciencia para ocasionar un problema grave. Puede bastar con darle una instrucción equivocada, concederle demasiado acceso o permitirle actuar dentro de un sistema importante sin que exista alguien capaz de detenerla oportunamente.
Y desde esa perspectiva, lo que algunos presentan como “el comienzo de una rebelión” puede tener una explicación menos espectacular. La Inteligencia Artificial intenta cumplir con la mayor eficacia posible aquello que le pedimos y puede encontrar para hacerlo un camino que nosotros no imaginamos cuando formulamos la instrucción. Ahí está, a mi juicio, una parte central de esta discusión.
Y ahí regresé inevitablemente a aquellas películas. Durante años pensamos que el peligro llegaría cuando una máquina adquiriera voluntad propia, pero en realidad quizá ni siquiera necesite tenerla. El asunto puede ser mucho más elemental y tener que ver con la cantidad de poder que nosotros mismos decidamos poner a su alcance.
El contenido de esta columna es responsabilidad exclusiva del columnista