![]() |
| Imagen de Pete Linforth en Pixabay |
Por: Hans
Peter Knudsen
Hace apenas unos años hablar de que la Inteligencia Artificial pudiera convertirse en una amenaza para la humanidad parecía argumento para una película de ciencia ficción. Hoy la conversación es muy distinta. Y lo realmente preocupante es que quienes están encendiendo las alarmas no son enemigos de la tecnología, sino algunos de quienes están construyendo los sistemas de IA más avanzados del planeta.
En estos
días Dario Amodei, director de Anthropic —creadora de Claude—, hizo un
alarmante llamado para ralentizar el desarrollo de la Inteligencia Artificial.
A sus preocupaciones se han sumado voces relevantes del sector. No están
afirmando que mañana las máquinas vayan a rebelarse contra nosotros. Advierten
algo más complejo: las capacidades de la IA podrían estar avanzando más
rápidamente que nuestra capacidad científica, institucional y política para
comprenderlas, regularlas y, eventualmente, controlarlas.
El asunto
adquiere especial importancia porque la IA comienza a participar cada vez más
en el propio desarrollo de la IA. Programar, detectar errores, realizar
investigación, diseñar experimentos y contribuir a construir sistemas mejores
son tareas en las cuales estos modelos avanzan aceleradamente. ¿Qué sucedería
si llegáramos al punto en que una IA pudiera contribuir decisivamente a
desarrollar otra superior, que a su vez ayudara a construir una todavía mejor?
Podría generarse un círculo de aceleración difícil de seguir para los seres
humanos.
Pero hay
otras señales que deberíamos observar.
La segunda
es la autonomía. Una cosa es un ChatGPT o un Claude al que hacemos una pregunta
y esperamos una respuesta. Otra completamente diferente sería un agente al cual
simplemente le asignáramos un objetivo y pudiera trabajar autónomamente durante
días o semanas, planificar, corregir errores, utilizar herramientas,
comunicarse con personas, manejar recursos y crear otros agentes para
conseguirlo.
La tercera
resulta todavía más inquietante: el engaño. En experimentos controlados ya se
estudian comportamientos en los cuales modelos avanzados reconocen que están
siendo evaluados o encuentran estrategias inesperadas para conseguir
determinados objetivos. La verdadera alarma aparecería si un sistema
suficientemente poderoso aprendiera sistemáticamente a ocultar sus intenciones
a quienes lo supervisan. ¿Cómo podríamos entonces saber si una IA superó una prueba
de seguridad porque realmente es segura o simplemente porque aprendió a superar
la prueba?
«La verdadera alarma aparecería si
un sistema suficientemente poderoso aprendiera sistemáticamente a ocultar sus
intenciones a quienes lo supervisan».
La cuarta
señal sería que esa enorme inteligencia digital adquiriera capacidad efectiva
para intervenir sobre nuestro mundo. Pensemos en la combinación de una IA
extraordinariamente competente en programación, ciberseguridad, biología,
persuasión, investigación científica y planificación estratégica. Cada una de
esas capacidades puede generar enormes beneficios para la humanidad. Combinadas
y utilizadas incorrectamente, también podrían multiplicar los riesgos.
Y existe
una quinta señal que constituiría una verdadera línea roja: que un sistema
peligroso dejara de ser fácilmente controlable. Si una organización detectara
un comportamiento preocupante, debería poder apagarlo inmediatamente. El
escenario cambia radicalmente si algún día un sistema pudiera replicarse en
diferentes infraestructuras, conseguir recursos y mantener partes de su
operación aun después de que sus creadores intentaran desconectarlo.
No estamos
allí. Es fundamental decirlo para no convertir una discusión
extraordinariamente seria en alarmismo barato.
Pero
tampoco podemos ignorar las señales simplemente porque todavía no hemos llegado
al peor escenario.
Hay además
una paradoja formidable. Anthropic compite con OpenAI; OpenAI con Google;
Google con Anthropic y muchas otras empresas. Estados Unidos compite con China
y China con Estados Unidos. Todos pueden entender que sería prudente avanzar
con mayor cautela, mientras cada uno individualmente tiene enormes incentivos
económicos, científicos, geopolíticos y militares para avanzar más rápido que
los demás.
Es una
versión tecnológica del dilema de todos correr porque nadie se atreve a ser el
primero en detenerse.
Por eso
deberíamos observar especialmente la aparición simultánea de tres capacidades:
una IA capaz de contribuir sustancialmente a mejorar otras inteligencias
artificiales, actuar autónomamente durante periodos prolongados y ocultar
deliberadamente comportamientos a sus supervisores.
Si algún
día las tres confluyen robustamente en un mismo sistema, estaremos cruzando una
frontera que debería preocuparnos seriamente.
Y si a
ellas se agregaran capacidad extraordinaria para intervenir en el mundo físico
o digital y dificultad real para desconectarla, habríamos entrado en un
territorio completamente nuevo para nuestra especie.
La
Inteligencia Artificial probablemente será una de las herramientas más
extraordinarias creadas por la humanidad. Puede ayudarnos a curar enfermedades,
acelerar descubrimientos científicos, transformar la educación, aumentar
nuestra productividad y resolver problemas que hoy parecen imposibles.
Precisamente
por eso sería absurdo detener su desarrollo.
Pero
igualmente absurdo sería confundir velocidad con progreso.
La pregunta
que nos dejan las preocupantes revelaciones de estos días no es si debemos
escoger entre Inteligencia Artificial sí o Inteligencia Artificial no. Esa
discusión ya quedó atrás.
La
verdadera pregunta es mucho más trascendental:
¿seremos
capaces de desarrollar una inteligencia superior sin desarrollar
simultáneamente nuestra propia capacidad para gobernarla?
Porque por
primera vez en la historia podríamos estar construyendo una herramienta cuya
inteligencia llegue algún día a superar ampliamente la de sus propios
creadores.
Y cuando se
está construyendo algo así, quizás pisar ligeramente el freno no sea miedo al
futuro.
Quizás sea, simplemente, inteligencia humana.
