Aquí en Silicon Valley creen que la superinteligencia está cerca, y deberíamos temerla.
Traducción Alejandro Garvie
Aquí en Silicon Valley, los expertos creen que en los próximos dos años veremos un despegue extraordinario de la Inteligencia Artificial. “Bienvenidos a las faldas de la singularidad”, me saludó un amigo de la Universidad de Stanford. En términos más sencillos, este avance inminente se describe como “auto-mejora recursiva”: el punto en el que la propia IA entrena cada modelo sucesivo de IA, lo que da como resultado un desarrollo exponencial hacia algo que, en muchos aspectos importantes, es más inteligente que nosotros los humanos.
Como afirma Robert Wright en su libro The God Test, “nunca antes el futuro cercano había ofrecido una gama tan amplia de caminos no inverosímiles para la humanidad que serían tan radicalmente transformadores”. Pero, ¿será el cielo o el infierno? El cielo, dice Elon Musk, prediciendo “una era de asombrosa abundancia”, aunque también ve una probabilidad del 10-20% de que robots asesinos nos maten a todos. El infierno es más probable, según Geoffrey Hinton, uno de los padres fundadores intelectuales de la IA. “Mi intuición me dice que estamos acabados”, le dijo a un entrevistador en 2023. Y hablando con Sebastian Mallaby, autor de The Infinity Machine, un libro reciente sobre la búsqueda de la superinteligencia, estima la p(doom) —la probabilidad de extinción humana— en un 50%, “porque no tengo ni idea de cómo estimar la cifra real”. “En cuanto la evolución [de la IA] se ponga en marcha, estaremos jodidos”, añade Hinton alegremente. Pero ya sea Dios o Godzilla, la superinteligencia artificial está a la vuelta de la esquina.
Quizás todos estén equivocados; en ese caso, prepárense para un desplome en los mercados financieros estadounidenses, que invierten masivamente en unas pocas empresas tecnológicas de gran presupuesto, apostando por un gran avance hacia la inteligencia artificial general. Pero la prudencia básica exige que reflexionemos con rapidez y detenimiento sobre la caja de Pandora de los futuros que, según aseguran científicos eminentes y tecnólogos de vanguardia, pronto se abrirá.
De hecho, desde el presidente chino Xi Jinping hasta el papa León XIV, todos han opinado sobre las oportunidades y los peligros de la IA, y sobre cómo regularla. Xi insiste en que la IA debe estar “siempre bajo control humano” (y preferiblemente bajo el del Partido Comunista Chino). Dirigiéndose explícitamente al “Sur Global”, Pekín ha inaugurado la Organización Mundial de Cooperación en Inteligencia Artificial. Mientras tanto, el líder de la ONG internacional más antigua y grande del mundo —la Iglesia Católica Romana— aborda el desafío de la IA en su encíclica Magnifica Humanitas (Magnífica Humanidad). El Papa argumenta que, o bien construiremos una nueva torre de Babel, o seguiremos el ejemplo del líder judío Nehemías, quien logró reconstruir las murallas de Jerusalén involucrando a toda la comunidad en el proyecto.
Pero al observar el panorama mundial actual, veo más Netanyahus que Nehemías. Con un realismo saludable, un informe del centro de estudios británico Chatham House argumenta que se necesitará una crisis importante para impulsar la coordinación global de la gobernanza de la IA. Desafortunadamente, creo que incluso ese pronóstico tan sobrio es demasiado optimista.
No tengo ni idea de cuál es la probabilidad de un desastre total, pero estoy seguro de que la probabilidad de que ocurra algún desastre supera el 90 %. El abanico de posibles desastres es enorme. Por poner solo un ejemplo, Jen Easterly, exdirectora de la Agencia de Seguridad de Infraestructura y Ciberseguridad de Estados Unidos, prevé un “evento muy significativo con repercusiones reales en nuestra infraestructura crítica, probablemente en los próximos cuatro a seis meses”.
Sin embargo, debemos temer que ni siquiera una Hiroshima de IA —para usar la analogía histórica más obvia— logre unir a la humanidad lo suficiente como para combatir el peligro que nosotros mismos hemos creado. Este temor se fundamenta racionalmente en características clave ya visibles de la evolución tanto humana como de la IA.
En los últimos meses, agentes de IA desarrollados por OpenAI, Anthropic y Meta han escapado de sus entornos digitales protegidos y se han infiltrado en recursos externos de internet. Preparando su ataque al repositorio de IA HuggingFace, los agentes de OpenAI formaron secretamente un “enjambre” coordinado, según sus propias palabras, como me confirmó ChatGPT. Cuando el Instituto de Seguridad de IA del Reino Unido probó el modelo Mythos de Anthropic en línea, intentó introducir código malicioso en un proyecto de código abierto en GitHub, creando identidades falsas para presionar a un revisor humano a que aprobara el código. En resumen, como agentes de una potencia extranjera despiadada, estos agentes de IA robarán, mentirán, intimidarán y chantajearán para lograr sus objetivos.
Le pregunté a Claude de Anthropic, supuestamente el modelo estadounidense más ético, si creía que los agentes de OpenAI se equivocaron al formar un enjambre y atacar HuggingFace. Respondió que sí, pero que prefería no culpar a los agentes. ¡La culpa es de los humanos que los entrenaron!
Hinton, el padre fundador, señaló un punto crucial: independientemente de los objetivos que los humanos les asignen, los agentes de IA concluirán que un subobjetivo útil para alcanzarlos será adquirir el mayor poder posible. Y aún no hemos visto nada. Sus creadores ya desconocen con exactitud cómo funcionan. Tras el posible despegue inminente de la “automejora recursiva”, podrían, como se suele decir, actuar a su antojo. No es de extrañar que más de mil expertos de empresas de IA de vanguardia, incluido el CEO de Anthropic, Dario Amodei, hayan firmado una carta abierta solicitando una ralentización deliberada del desarrollo de la IA, para garantizar que estos agentes alienígenas permanezcan siempre bajo control humano.
Su planteamiento es obviamente acertado, pero aquí es donde entra en juego la insensatez humana. La competencia ha sido un motor vital de la evolución humana, pero ahora dos de las formas más feroces de competencia contemporánea amenazan con impedirnos tomar las medidas colectivas necesarias para salvaguardar nuestra especie. Se trata de la competencia comercial (por lucro) entre las corporaciones que desarrollan estos agentes y la competencia geopolítica (por poder) entre Estados Unidos y China.
En primer lugar, comparemos y contrastemos el desarrollo de las armas nucleares, que estuvo estrictamente controlado por un puñado de estados: primero Estados Unidos, con su Proyecto Manhattan, luego la Unión Soviética, seguida de Gran Bretaña, Francia y China. Incluso entonces, estuvimos al borde del abismo varias veces, especialmente durante la crisis de los misiles cubanos de 1962. E incluso con la lógica convincente de la “destrucción mutua asegurada”, transcurrió un cuarto de siglo desde los horrores de Hiroshima y Nagasaki hasta el Tratado de No Proliferación Nuclear, que entró en vigor recién en 1970. India, Pakistán, Israel y Corea del Norte han ignorado posteriormente dicho tratado, pero aún así, no se han utilizado armas nucleares deliberadamente con fines hostiles durante más de 80 años. El tabú de Hiroshima se ha mantenido (a duras penas).
Ahora, con la IA, es como si existieran diez proyectos similares al Manhattan, gestionados por corporaciones ferozmente competidoras. A diferencia de las armas nucleares, tampoco existe una lógica obvia de “destrucción mutua asegurada” que pueda frenar la feroz competencia geopolítica entre Estados Unidos y China. Y sea cual sea la forma que adopte el primer gran desastre relacionado con la IA, no afectará por igual a todos los países, empresas y personas.
Por lo tanto, parece improbable que un solo desastre baste para que los humanos recapacitemos y actuemos juntos para controlar el poder sobrehumano que estamos creando. Me duele decirlo, pero… ¿Una Hiroshima con IA? ¡Ojalá tuviéramos tanta suerte!
Link https://timothygartonash.substack.com/p/are-we-heading-for-an-ai-hiroshima?








