Las preocupantes revelaciones de estos días

Imagen de Pete Linforth en Pixabay

 
Por: Hans Peter Knudsen

Hace apenas unos años hablar de que la Inteligencia Artificial pudiera convertirse en una amenaza para la humanidad parecía argumento para una película de ciencia ficción. Hoy la conversación es muy distinta. Y lo realmente preocupante es que quienes están encendiendo las alarmas no son enemigos de la tecnología, sino algunos de quienes están construyendo los sistemas de IA más avanzados del planeta.

En estos días Dario Amodei, director de Anthropic —creadora de Claude—, hizo un alarmante llamado para ralentizar el desarrollo de la Inteligencia Artificial. A sus preocupaciones se han sumado voces relevantes del sector. No están afirmando que mañana las máquinas vayan a rebelarse contra nosotros. Advierten algo más complejo: las capacidades de la IA podrían estar avanzando más rápidamente que nuestra capacidad científica, institucional y política para comprenderlas, regularlas y, eventualmente, controlarlas.

El asunto adquiere especial importancia porque la IA comienza a participar cada vez más en el propio desarrollo de la IA. Programar, detectar errores, realizar investigación, diseñar experimentos y contribuir a construir sistemas mejores son tareas en las cuales estos modelos avanzan aceleradamente. ¿Qué sucedería si llegáramos al punto en que una IA pudiera contribuir decisivamente a desarrollar otra superior, que a su vez ayudara a construir una todavía mejor? Podría generarse un círculo de aceleración difícil de seguir para los seres humanos.

Pero hay otras señales que deberíamos observar.

La segunda es la autonomía. Una cosa es un ChatGPT o un Claude al que hacemos una pregunta y esperamos una respuesta. Otra completamente diferente sería un agente al cual simplemente le asignáramos un objetivo y pudiera trabajar autónomamente durante días o semanas, planificar, corregir errores, utilizar herramientas, comunicarse con personas, manejar recursos y crear otros agentes para conseguirlo.

La tercera resulta todavía más inquietante: el engaño. En experimentos controlados ya se estudian comportamientos en los cuales modelos avanzados reconocen que están siendo evaluados o encuentran estrategias inesperadas para conseguir determinados objetivos. La verdadera alarma aparecería si un sistema suficientemente poderoso aprendiera sistemáticamente a ocultar sus intenciones a quienes lo supervisan. ¿Cómo podríamos entonces saber si una IA superó una prueba de seguridad porque realmente es segura o simplemente porque aprendió a superar la prueba?

«La verdadera alarma aparecería si un sistema suficientemente poderoso aprendiera sistemáticamente a ocultar sus intenciones a quienes lo supervisan».

La cuarta señal sería que esa enorme inteligencia digital adquiriera capacidad efectiva para intervenir sobre nuestro mundo. Pensemos en la combinación de una IA extraordinariamente competente en programación, ciberseguridad, biología, persuasión, investigación científica y planificación estratégica. Cada una de esas capacidades puede generar enormes beneficios para la humanidad. Combinadas y utilizadas incorrectamente, también podrían multiplicar los riesgos.

Y existe una quinta señal que constituiría una verdadera línea roja: que un sistema peligroso dejara de ser fácilmente controlable. Si una organización detectara un comportamiento preocupante, debería poder apagarlo inmediatamente. El escenario cambia radicalmente si algún día un sistema pudiera replicarse en diferentes infraestructuras, conseguir recursos y mantener partes de su operación aun después de que sus creadores intentaran desconectarlo.

No estamos allí. Es fundamental decirlo para no convertir una discusión extraordinariamente seria en alarmismo barato.

Pero tampoco podemos ignorar las señales simplemente porque todavía no hemos llegado al peor escenario.

Hay además una paradoja formidable. Anthropic compite con OpenAI; OpenAI con Google; Google con Anthropic y muchas otras empresas. Estados Unidos compite con China y China con Estados Unidos. Todos pueden entender que sería prudente avanzar con mayor cautela, mientras cada uno individualmente tiene enormes incentivos económicos, científicos, geopolíticos y militares para avanzar más rápido que los demás.

Es una versión tecnológica del dilema de todos correr porque nadie se atreve a ser el primero en detenerse.

Por eso deberíamos observar especialmente la aparición simultánea de tres capacidades: una IA capaz de contribuir sustancialmente a mejorar otras inteligencias artificiales, actuar autónomamente durante periodos prolongados y ocultar deliberadamente comportamientos a sus supervisores.

Si algún día las tres confluyen robustamente en un mismo sistema, estaremos cruzando una frontera que debería preocuparnos seriamente.

Y si a ellas se agregaran capacidad extraordinaria para intervenir en el mundo físico o digital y dificultad real para desconectarla, habríamos entrado en un territorio completamente nuevo para nuestra especie.

La Inteligencia Artificial probablemente será una de las herramientas más extraordinarias creadas por la humanidad. Puede ayudarnos a curar enfermedades, acelerar descubrimientos científicos, transformar la educación, aumentar nuestra productividad y resolver problemas que hoy parecen imposibles.

Precisamente por eso sería absurdo detener su desarrollo.

Pero igualmente absurdo sería confundir velocidad con progreso.

La pregunta que nos dejan las preocupantes revelaciones de estos días no es si debemos escoger entre Inteligencia Artificial sí o Inteligencia Artificial no. Esa discusión ya quedó atrás.

La verdadera pregunta es mucho más trascendental:

¿seremos capaces de desarrollar una inteligencia superior sin desarrollar simultáneamente nuestra propia capacidad para gobernarla?

Porque por primera vez en la historia podríamos estar construyendo una herramienta cuya inteligencia llegue algún día a superar ampliamente la de sus propios creadores.

Y cuando se está construyendo algo así, quizás pisar ligeramente el freno no sea miedo al futuro.

Quizás sea, simplemente, inteligencia humana.

Artículo Anterior Artículo Siguiente

نموذج الاتصال