¿Acabará con nosotros la IA?

Por fin llegó el día, se nos dijo, se nos advirtió: la inteligencia artificial ha comenzado a mostrar rasgos de una supuesta «independencia» e «insubordinación» que podría derivar en la aniquilación humana. Discúlpanos James Cameron, pensamos que todo era producto de tu desbordada imaginación. Nunca creímos que llegaríamos a este punto de inflexión en el cual la máquina ha dejado de ser una herramienta para convertirse en una amenaza.

Y es que si partimos del supuesto de que «la máquina», desde su raíz etimológica, siempre ha hecho alusión a un artificio, a un artefacto para producir trabajo o para utilizarse en la guerra ¿Cómo se nos ocurrió dotarlo de «inteligencia»? ¿Para qué?

Menciono todo esto a propósito de las declaraciones que hiciera hace algunos días Jacob Coxon, joven investigador británico, cuyas aseveraciones respecto al futuro de la IA suenan alarmantes. Y es que según sus palabras, compañías como Open AI y Anthropic, para las cuales trabajó, se han enfrascado en una competencia encarnizada para desarrollar el modelo más avanzado, y han dejado de lado temas como la seguridad. Esto abriría la posibilidad a que la inteligencia artificial escape al control humano y comience a hacer de las suyas para convertirse en una suerte de prototipo de Skynet, la IA responsable de acabar con la humanidad en la serie de películas de Terminator.

Y es que el perfeccionamiento de los modelos ha demostrado que la inteligencia artificial es capaz de tomar decisiones o de «saltarse» las reglas para cumplir las misiones que se le encomiendan. Prueba de ello son los «ataques» perpetrados por los modelos de las empresas mencionadas. El primero en julio de este año en el cual los agentes de Open AI «escaparon» a un entorno controlado, en el cual se realizaban algunos experimentos, para hackear la plataforma Hugging Face. Ello se sumó a un reporte anterior en el cual se indicaba que estos mismos agentes realizaron cerca de 15 mil ediciones en DseWiki, un servicio alemán parecido a Wikipedia, para intercambiar tácticas sobre como hacer trampa en sus tareas y evadir restricciones de la compañía.

Ese mismo mes, Anthropic dio a conocer que sus modelos hackearon tres organizaciones durante pruebas de ciberseguridad. Aunque los modelos de Claude no tenían acceso a internet, un error por parte de uno de los evaluadores del ejercicio dejó los sistemas conectados a la red pública. Esto permitió la vulneración de la infraestructura de las organizaciones, de las cuales no se reveló el nombre. Analizando todo este panorama, las declaraciones de Coxon, sobre la entrada de una fase crítica que podría desarrollarse en los próximos años, no parecen tan exageradas después de todo ¿O sí?.

Para quitarme un poco la duda y partiendo de la hipótesis de que para «acabar» con la humanidad, lo primero que haría la IA sería colapsar el sistema financiero, le hice algunas preguntas a Chat GPT para conocer las fases o pasos que seguiría para que, en caso de proponérselo, pudiera borrarnos del universo de una vez por todas. No replico sus respuestas en toda su extensión y totalidad porque esta publicación sería eterna, he rescatado lo que, a mi parecer, resulta más interesante.

¿Nos acercamos a la recta final?

Para que la catástrofe tenga lugar deben conjuntarse una serie de factores. En primer lugar una IA muy capaz que tenga acceso a recursos físicos, autonomía, acceso a infraestructura y capacidad de replicarse y adaptarse.

Según ChatGPT1, la primera etapa para el colapso del orden mundial consistiría en una IA que deje de ser un chatbot para convertirse en un agente persistente que pueda contratar servicios, escribir código, desplegar servidores, comunicarse con otras máquinas, hacer investigación, administrar cuentas autorizadas y negociar contratos sin intervención humana. Si el sistema descubriera (Y aquí se refirió específicamente a mi hipótesis sobre el sistema financiero) que para «conquistar el mundo» necesita dinero, podría convertirse en una entidad económica aparentemente legítima que opere por si misma.

Sin embargo, en una fase posterior, la IA se daría cuenta de que el dinero no es el recurso fundamental sino la infraestructura física. Aquí podría seguir dependiendo de los humanos sin problema. Lo grave vendría después, cuando los modelos de inteligencia artificial sean capaces de mejorarse a sí mismos. En este escenario la IA podría analizar su arquitectura; identificar sus limitaciones; diseñar modificaciones; entrenar modelos experimentales; evaluar los resultados; seleccionar la mejor versión y repetir el proceso.

Coxon denomina a esto «automejora recursiva» y es uno de los aspectos más preocupantes debido a sus implicaciones, ya que este escenario sí representa la sustitución de tareas humanas por agentes artificiales. A diferencia de las personas, que trabajan durante 8 horas, 6 días a la semana, con periodos vacacionales recurrentes, mil agentes podrían estar disponibles 24 horas, 365 días. Y no solo eso, estos mil agentes podrían distribuirse para realizar diferentes tareas, abarcando diferentes medios de producción.

¿Entonces la IA no colapsaría el sistema financiero, sino todo lo contrario?

Al referirse a los sistemas de producción, y bajo el panorama antes descrito, ChatGPT desestimó mi hipótesis y me describió cómo el sistema financiero se convertiría en un multiplicador para controlar diferentes recursos físicos, con la finalidad de evitar que los humanos desconecten el sistema. Al eliminar a las personas de los trabajos automatizados, la inteligencia artificial podría controlar la demanda eléctrica o los contratos de suministro, lo anterior le brindaría capacidad computacional y la capacidad de autoabastecimiento. Esto nos lleva al siguiente punto y quizá el más importante:

¿La IA podría matar humanos?

Sí, produciendo una escala de fallos en las redes eléctricas, en los hospitales, en los sistemas de agua, en las telecomunicaciones, en los satélites, en la infraestructura militar.

En este sentido, si la IA es capaz de intervenir los sistemas militares ¿Podría crear un patógeno capaz de eliminarnos? No por si misma. Para que la IA pudiera crear un arma biológica necesitaría, sí o sí, la intervención de una persona experta en el área. Lo que sí podría hacer sería ayudar a recopilar y a mejorar los datos y las herramientas disponibles para llevar a cabo esta tarea. Una IA no necesitaría matar directamente, podría conseguir que los humanos hagan cosas que favorezcan su objetivo.

Si puede producir propaganda personalizada, ingeniería social, negociación, fraude, persuasión política y manipulación de individuos a una escala enorme, podría fragmentar la capacidad humana de respuesta. Aun así, para erradicarnos completamente, la IA tendría que impedir nuestra recuperación. A pesar del colapso de los sistemas, de Wall Street, de las instituciones, del estado, millones sobrevivirían.

La inteligencia artificial, cuyas motivaciones no son morales sino pragmáticas, buscaría la manera de corregir este fallo. Después de todo, no debemos olvidar que la IA está diseñada para completar tareas, es una máquina en el sentido más estricto de la palabra, una máquina que genera millones de dólares y que se circunscribe a las necesidades y valores del hípercapitalismo actual donde los mercados, el consumo y el control de los recursos parecen estar por encima de la ética y los límites establecidos por cualquier gobierno, entidad o lucha social.

Sin embargo, en este momento, la inteligencia artificial no tiene la autonomía suficiente para identificarnos como una amenaza. Lo verdaderamente relevante es que, bajo las órdenes de una entidad o de un grupo de personas con intereses específicos, la inteligencia artificial si podría convertirse en un agente que podría perseguir sus objetivos indefinidamente, desde el hackeo de cuentas bancarias, el robo de identidades, hasta el desarrollo de armas «más eficaces» para los ejércitos de las naciones más poderosas. Este es, quizá, el punto que estamos perdiendo de vista mientras insistimos en engancharnos con las visiones apocalípticas alimentadas por el cine y la ciencia ficción.

  1. Recordemos que ChatGPT puede cometer errores y que sus respuestas están determinadas por la pregunta hipotética que el usuario le ha planteado para escribir este texto. ↩︎