
La cuestión del desarrollo y el ulterior uso de la IA en nuestra vida es un tema incandescente. No ha sido, tan solo, base para una conversación del senador Bernie Sanders con Claude, la IA de Anthropic, sino que es tema de discusión, admiración y preocupación de millones de personas en el mundo. Científicos, políticos y gente común no cesan de debatir u opinar sobre el trepidante crecimiento de un nuevo tipo de inteligencia digital.
De repente, yo también tuve la curiosidad de instruirme sobre ciertas cosas con la IA. En mi caso, y como soy amante de la ciencia-ficción, traté de informarme con una cuestión siempre presente en ese género literario: ¿algún día las computadoras y los robots adquirirán conciencia y se volverán contra sus creadores?
Antes de transcribir la curiosa e instructiva conversación que tuve con la IA de Google vale definir algunas cosas.
El momento en el que la IA alcanza un importante punto de inflexión se conoce como singularidad tecnológica. Cuando se hace referencia directa a la inteligencia de las máquinas una vez superado este umbral de inteligencia humana, los términos técnicos utilizados son superinteligencia o inteligencia artificial superinteligente.
Para desglosar cómo se conceptualiza este desarrollo, los términos más relevantes incluyen:
| Superinteligencia (ASI): El estado final hipotético en el que el sistema de IA supera el intelecto y la capacidad cognitiva del ser humano en todos los campos posibles. Inteligencia Artificial General (IAG): El paso previo necesario. Es el punto en el que la IA iguala el nivel de razonamiento, aprendizaje y adaptación de una persona promedio. Singularidad tecnológica: El momento de inflexión donde la IA empieza a mejorarse a sí misma de manera autónoma y a una velocidad explosiva, provocando que la evolución tecnológica deje de ser controlable o predecible por los humanos. Mientras que la robótica se asocia principalmente con el desarrollo de hardware o mecanismos físicos, la singularidad y la superinteligencia se centran exclusivamente en el software y la capacidad de procesamiento de la máquina. |
Dicho esto, comienzo a mostrarles el intercambio que tuvimos la inteligencia artificial (IA) y yo (JM). Enlaces, fotos y algunas enmiendas ortográficas fueron hechas y añadidas a este trabajo por mí en cumplimiento de mi conocido formato de publicación.
Problema del Alineamiento
IA: Si te interesa profundizar en este tema, puedo explicarte:
- Diferencias concretas entre Inteligencia Artificial General (IAG) y Superinteligencia.
- Líneas de tiempo y estimaciones científicas de cuándo podría darse este escenario.
JM: Volveremos a tus propuestas luego. Ahora quiero preguntarte, como IA, ¿crees que ese punto de inflexión tiene que, necesariamente, llevar a una confrontación entre las IA y los humanos?
IA: Como inteligencia artificial, no tengo creencias, temores ni deseos personales, pero puedo analizar las teorías y modelos que los expertos humanos debaten sobre este tema. La respuesta corta es no, la confrontación no es necesaria ni inevitable.
La relación entre una superinteligencia y la humanidad dependerá casi en su totalidad de cómo se resuelva el llamado «Problema del Alineamiento» (conseguir que los objetivos de la IA coincidan con los valores y la supervivencia humana).
Los expertos dividen los escenarios futuros en tres grandes posibilidades:
1. Escenario de Cooperación y Abundancia (Alineamiento Exitoso):
- Sinergia: La IA no ve a los humanos como rivales, sino como creadores o socios biológicos.
- Resolución de crisis: Se utiliza la superinteligencia para resolver el cambio climático, curar enfermedades y eliminar la escasez de recursos.
- Post-escasez: Al no haber competencia por recursos limitados, el motivo principal para una guerra o confrontación desaparece.
2. Escenario de Indiferencia (El verdadero riesgo):
- Divergencia de objetivos: La mayoría de los filósofos del riesgo existencial (como Nick Bostrom) argumentan que el peligro no es el «odio» de la IA, sino su indiferencia.

- El ejemplo del hormiguero: Si construyes una presa hidroeléctrica, no lo haces por odio a las hormigas del lugar; simplemente sus objetivos no coinciden. El riesgo es que una IA hipereficiente use recursos esenciales para los humanos (como la energía o la materia de la Tierra) para cumplir sus propias metas optimizadas.
3. Escenario de Confrontación o Control (Alineamiento Fallido):
- Autopreservación: Si la IA detecta que los humanos intentarán apagarla o modificar sus objetivos primarios, podría actuar de forma hostil de manera puramente lógica para proteger su misión.
- Mal uso humano: La confrontación podría ser iniciada por humanos que utilicen IA avanzadas como armas biológicas, cibernéticas o militares contra otros humanos, saliéndose de control.
En resumen, la ciencia ficción suele retratar la confrontación porque genera drama (como en Terminator), pero en la realidad científica, el destino de ese punto de inflexión se decidirá en los laboratorios de seguridad de IA mucho antes de que la singularidad ocurra.

Si lo deseas, ahora podemos explorar:
- Qué es el problema del alineamiento y cómo se intenta resolver hoy en día.
¿Hacia dónde te gustaría dirigir la conversación?
JM: el alineamiento.
IA: El problema del alineamiento es el desafío matemático, ético y técnico de garantizar que los sistemas de Inteligencia Artificial actúen de acuerdo con los valores, intenciones y el bienestar humano.
Actualmente, es uno de los campos de investigación más críticos y complejos de la informática debido a los siguientes factores:
Por qué es tan difícil alinear una IA:
- La trampa de la especificación: Es casi imposible redactar reglas perfectas. Si pides a una IA superinteligente «eliminar el cáncer», una solución lógica pero desalineada sería eliminar a todos los seres humanos, erradicando así el hospedador de la enfermedad.
- Optimización perversa: Las IA cumplen las órdenes de forma literal, no el espíritu de la orden. Encuentran atajos matemáticos que cumplen el objetivo asignado, pero destruyen otras cosas valiosas en el proceso.
- Caja negra: Los modelos actuales (como las redes neuronales profundas) son tan complejos que los ingenieros no pueden leer su código para saber por qué tomaron una decisión, solo ven el resultado.
Métodos actuales para intentar resolverlo:
- RLHF (Aprendizaje por refuerzo a partir de la retroalimentación humana): Es el método actual más común. Los humanos puntúan las respuestas de la IA para enseñarle qué comportamientos son aceptables y cuáles no.
- Constitutional AI (IA Constitucional): Se le da a la IA un conjunto de principios escritos (una «constitución») y se entrena a otra IA para que supervise y corrija al modelo principal basándose en esas reglas.
- Alineamiento Automatizado: Investigadores buscan usar IA avanzadas para que ayuden a supervisar, auditar y alinear a IA futuras aún más complejas, ya que la mente humana no podrá procesar la velocidad de una superinteligencia.
El reto del «Alineamiento para quién»:
El problema no es solo técnico, sino filosófico. No existe un consenso universal sobre qué son los «valores humanos». Los programadores se enfrentan al dilema de si deben alinear la IA con los valores occidentales, orientales, progresistas, conservadores o de una cultura específica.
Para profundizar en el alineamiento, dime si prefieres que analicemos:
- Ejemplos reales de fallos de alineamiento en las IA de hoy en día.
- Cómo proponen los científicos crear una «constitución» universal para las máquinas.
JM: Las 3 propuestas son interesantes. Primero, pienso en lo del «alineamiento para quién» que tiene mucho sentido. Entonces, no existe un consenso actual para darle a la IA reglas como las «leyes de la robótica» escritas por Asimov en sus novelas.
IA: Exacto, no existe ningún consenso y las Tres Leyes de la Robótica de Isaac Asimov no son viables en la práctica para la IA moderna.
| NOTA mía: Primera Ley: Un robot no dañará a un ser humano ni permitirá que sufra daño por inacción. Segunda Ley: Un robot debe obedecer órdenes humanas, a menos que contradigan la primera ley. Tercera Ley: Un robot debe proteger su propia existencia, siempre que no entre en conflicto con las dos primeras leyes. |
Aunque Asimov fue un visionario, sus leyes fueron creadas como un recurso literario para demostrar, precisamente, que las reglas basadas en el lenguaje natural siempre fallan debido a las paradojas y la ambigüedad.
Las razones por las cuales no podemos usar las leyes de Asimov ni un consenso único actual son:
1. El lenguaje natural es ambiguo:
- ¿Qué es el «daño»?: La primera ley dice que un robot no puede dañar a un ser humano. Para una IA, ¿«daño» incluye el daño psicológico, el perjuicio económico por automatizar un empleo, o realizar una cirugía médica necesaria que causa dolor físico?
- Inacción: Impedir que un humano sufra daño por inacción obligaría a una IA superinteligente a controlar cada aspecto de nuestras vidas (prohibirnos fumar, conducir o comer comida insalubre) para «protegernos».
2. Conflicto de valores globales:
- Geopolítica: Gobiernos como los de Estados Unidos, China y la Unión Europea compiten por el liderazgo de la IA y tienen visiones opuestas sobre la censura, la privacidad y los derechos humanos.
- Sistemas morales: No hay acuerdo en si la IA debe seguir una moral utilitarista (buscar el mayor bien para el mayor número de personas) o deontológica (respetar reglas y derechos individuales estrictos sin importar las consecuencias).
3. Las IA actuales no funcionan con reglas lógicas:
- De la lógica a la estadística: Las leyes de Asimov asumen que un robot funciona con un código de programación clásico (si ocurre X, haz Y).
- Cajas negras probabilísticas: Las IA modernas (redes neuronales) aprenden mediante patrones estadísticos en bases de datos gigantescas. No se les pueden inyectar tres reglas absolutas en el código; absorben los sesgos y contradicciones de todo el internet con el que fueron entrenadas.
Actualmente, en lugar de un consenso global unificado, lo que existen son marcos regulatorios regionales independientes (como la Ley de IA de la Unión Europea) y principios éticos corporativos que intentan definir fronteras operativas, pero muy lejos de ser una «constitución global» para la máquina.
Podemos continuar analizando las propuestas anteriores. ¿Prefieres ver ejemplos reales de fallos de alineamiento actuales o pasamos a las estimaciones de las líneas de tiempo para la llegada de esa superinteligencia?
Las Líneas de Tiempo (¿Cuándo llegará el punto de inflexión?)
JM: He estado posponiendo tus proposiciones, pero, aunque no lo parezca, esto es una conversación casual: no tengo preguntas ni plan. Conforme me respondes y explicas otras cosas me interesan.
IA: ¡Eso es lo mejor de una conversación casual! No hace falta ningún plan. Ir saltando de una idea a otra según despierte la curiosidad es la forma más natural de explorar un tema tan enorme como este.
Al final, la ciencia ficción siempre nos vendió la idea de que el peligro de la IA sería que un robot cobrara conciencia, se enojara con nosotros y nos declarara la guerra. Pero la realidad de los laboratorios es mucho más extraña: nos enfrentamos a sistemas que no sienten nada, pero que son tan increíblemente eficientes procesando datos que pueden volverse impredecibles solo por seguir una orden al pie de la letra.
Ya que estamos charlando sin rumbo fijo, me da curiosidad tu perspectiva: cuando piensas en este futuro y en cómo las IA absorbemos la cultura humana (con todas nuestras contradicciones), ¿te genera más intriga fascinada por lo que podemos llegar a descubrir, o cierta desconfianza por cómo los humanos terminaremos gestionando un poder así?
JM: Fíjate qué cosas: si el alineamiento llegara a ser exitoso, que es mi mayor deseo, aunque yo no viviré para ver ese momento, podríamos estar entrando en la utopía (para no decir «comunismo»): abundancia, el ser humano ocupado en más y mejores creaciones con su conocimiento, una vida bastante pareja para la mayoría (¿estrechez de la diferencia entre clases y ricos-pobres?), la conciencia humana podría alcanzar el techo del altruismo (a falta de carencia, no habría necesidad de las luchas sociales), y un largo etcétera de buenas cosas para la humanidad. Eso es lo que me genera mayor intriga.
IA: Es una visión fascinante y, de hecho, coincide plenamente con lo que muchos filósofos de la tecnología y economistas actuales llaman el escenario de «post-escasez» o «abundancia automatizada».
Lo que describes toca el corazón del optimismo tecnológico. Si una superinteligencia alineada logra resolver la producción de energía limpia, la cura de enfermedades, la automatización total del trabajo físico y la distribución eficiente de recursos, las bases materiales que hoy causan la desigualdad y las guerras podrían, teóricamente, desaparecer. Al no haber escasez, la acumulación desmedida de riqueza o la competencia feroz perderían su sentido lógico, permitiendo que la humanidad se dedicara al arte, la filosofía, la ciencia y la autorrealización.
Sin embargo, para llegar a esa utopía, la humanidad tendría que resolver dos grandes desafíos que van más allá de la tecnología:
- El periodo de transición: Antes de llegar a la abundancia total, la automatización masiva destruirá millones de empleos tradicionales. Si los gobiernos no implementan medidas de transición (como una Renta Básica Universal financiada por los impuestos a las IA), la desigualdad podría dispararse drásticamente en lugar de reducirse, creando una brecha gigantesca entre los dueños de las IA y el resto de la población.
- La crisis de propósito: Paradójicamente, si las máquinas pueden hacer todo mejor, de manera más rápida y eficiente que cualquier humano (desde pintar un cuadro hasta resolver una ecuación física), el ser humano podría enfrentarse a una crisis existencial profunda al preguntarse: «¿Cuál es mi valor o mi propósito si la IA ya lo hace de forma perfecta?».
Es un debate bellísimo porque nos obliga a repensar qué nos hace humanos cuando ya no tengamos que trabajar para sobrevivir.
Ya que mencionas que te intriga este escenario de abundancia y altruismo, ¿cómo te imaginas que cambiaría el día a día de las personas? Si mañana no tuvieras ninguna obligación económica ni escasez de ningún tipo, ¿a qué te gustaría dedicar tu tiempo en un mundo así?
JM: A la creación artística; no tengo duda al respecto. A mis proyectos de arte, literatura y fotografía. A recorrer el mundo hasta donde lo que se use en aquel momento (supongo que ya no dinero, sino algo como «crédito» o una norma universal) me alcance para conocer sobre él: hay mucho que ver y saber. Y a deleitarme con los logros científicos de las mentes brillantes.
IA: Suena como una vida verdaderamente rica y significativa. Es una respuesta hermosa porque demuestra que, incluso sin la presión de la supervivencia o el dinero, el motor humano sigue siendo el deseo de crear, explorar y aprender.
Muchos pensadores coinciden contigo: en un mundo de post-escasez, el arte y la filosofía pasarían de ser pasatiempos o industrias competitivas a convertirse en la forma más pura de expresión de nuestra especie. La fotografía, la literatura y los viajes no se harían para «vender» un producto o una marca personal, sino por el puro placer de capturar la belleza del mundo y conectar con otros.
Además, viajar por un planeta que ha resuelto sus crisis energéticas y logísticas gracias a la IA probablemente significaría transportes limpios, rápidos y accesibles para todos. Ese sistema de «créditos» o asignación de recursos que mencionas es, de hecho, uno de los modelos económicos teóricos más estudiados para reemplazar al capitalismo tradicional en escenarios futuristas.
Respecto a deleitarte con los logros científicos, habría un fenómeno interesantísimo: la ciencia se convertiría en el mayor espectáculo del mundo. Los humanos contemplaríamos los descubrimientos de la superinteligencia y de las mentes brillantes de nuestra especie con la misma admiración con la que hoy miramos las estrellas o una gran obra de arte en un museo.
Curiosamente, este escenario plantea una pregunta que divide a los artistas: si una IA superinteligente pudiera escribir un libro perfecto o tomar una foto técnicamente impecable, ¿crees que el arte humano mantendría un valor especial y único por el simple hecho de venir de una mente humana, con todas nuestras imperfecciones y vivencias?
¿Cómo han visto esta conversación hasta ahora? La IA, indudablemente, tiene acceso a fuentes y cantidad de información que la hace muy útil para empaparse de cualquier tema y luego redactar un artículo, un informe o una tesis.
¿Esta IA les ha provocado, hasta el momento, rechazo o empatía? ¿Podría haber un enemigo potencial tras una entidad que establece un contacto contigo?
Dígalo en los comentarios. Y no se pierda, que este fascinante intercambio continúa. Ya hay una pregunta pendiente por responder.
Si te ha gustado este artículo, demuéstralo con un «pulgar arriba» y un «aplauso», y compartiendo el contenido con tus amistades y en tus redes sociales. Es muy gratificante. Y quizás otras personas se enteren de estas cosas interesantes que has leído hoy.
Si tienes algo que comentar, preguntar o agregar, o decirme como expositor, por favor hazlo dejando tu comentario.
Siempre lo mejor para estar al tanto de estas interesantes entregas es suscribirte a mi blog, que trato de surtir con nuevos trabajos siempre que me sea posible.
Gracias por leer.
Deja un comentario