Desde la fundación en 2000 del instituto que hoy se llama MIRI hasta la carta de 2023 firmada por Hinton, Amodei, Hassabis y Altman advirtiendo de riesgo de extinción por IA, el aviso sobre riesgos catastróficos de la inteligencia artificial ha ido ganando firmantes de perfil cada vez más central en la industria. El jefe de alineamiento de Anthropic, Evan Hubinger, ha llegado a citar una probabilidad del 10% de que la IA acabe con la humanidad.

El origen de esta corriente de pensamiento suele situarse en el año **2000**, con la fundación de lo que hoy se conoce como **MIRI (Machine Intelligence Research Institute)**, que reorientó su actividad hacia el riesgo existencial de la IA en torno a 2005. Su preocupación central era que un sistema de inteligencia artificial pudiera superar la capacidad humana de forma descontrolada si no se resolvían antes los problemas de alineamiento entre los objetivos del sistema y los de sus creadores.
En **2009**, el investigador **Eliezer Yudkowsky** contribuyó a fundar la comunidad online **LessWrong**, que combinaba ideas del transhumanismo y del altruismo eficaz con debates sobre el riesgo de una 'singularidad' tecnológica. Durante años, estas ideas circularon en círculos relativamente reducidos y especializados, lejos del debate público general sobre tecnología.
El salto a la visibilidad amplia llegó en **2015**, cuando un manifiesto impulsado por el Future of Life Institute reunió firmas de perfiles como Elon Musk, Demis Hassabis, Geoffrey Hinton, Yann LeCun, Ilya Sutskever, Steve Wozniak y Stephen Hawking, con el mensaje de que los sistemas de IA debían hacer lo que sus diseñadores pretendían que hicieran. Musk donó ese mismo año diez millones de dólares para financiar investigación en seguridad de IA.
Lee también: El debate sobre seguridad de la IA enfrenta controles externos y carrera competitivaEEUU propone a China una línea de aviso para incidentes graves de IA: es un mecanismo de crisis, no un acuerdo tecnológico
Con la irrupción pública de ChatGPT, el ritmo de advertencias se aceleró notablemente. En **marzo de 2023**, una carta abierta impulsada de nuevo por el Future of Life Institute, firmada entre otros por Wozniak, Musk, Jaan Tallinn y Max Tegmark, pidió una pausa de seis meses en el entrenamiento de nuevos modelos de gran tamaño. Dos meses después, en mayo de 2023, una declaración del Center for AI Safety introdujo una frase que se repetiría mucho: mitigar el riesgo de extinción por IA debía tratarse como una prioridad global al mismo nivel que las pandemias o la guerra nuclear, con firmas de Geoffrey Hinton, Dario Amodei, Demis Hassabis y Sam Altman, todos ellos responsables de laboratorios de IA de primer nivel.
La escalada del discurso ha continuado en los últimos años: en 2025, Yudkowsky publicó junto a Nate Soares el libro *If Anyone Builds It, Everyone Dies*, con un planteamiento abiertamente alarmista. Más recientemente, Evan Hubinger, responsable de alineamiento en Anthropic y anteriormente vinculado a MIRI y al Center for AI Safety, ha llegado a citar una probabilidad del **10%** de que la inteligencia artificial termine provocando la extinción humana, una cifra que, viniendo de un responsable interno de una de las principales empresas de IA, tiene un peso distinto al de un manifiesto firmado por observadores externos.
El debate sobre riesgo existencial de la IA se ha entrelazado históricamente con comunidades de pensamiento como el transhumanismo y el altruismo eficaz, antes de convertirse en un tema de debate corporativo y regulatorio.
El cambio de perfil de los firmantes, de investigadores externos a responsables internos de las principales empresas de IA, ha influido en cómo gobiernos y reguladores valoran la necesidad de establecer marcos de seguridad para el desarrollo de modelos avanzados.
Las cartas de 2023 coincidieron con el rápido crecimiento de la adopción pública de modelos de lenguaje como ChatGPT.
Evan Hubinger ocupa actualmente un cargo de responsabilidad en seguridad y alineamiento dentro de Anthropic, una de las principales empresas de desarrollo de modelos de IA.
Fuentes: Xataka — veinte años anticipando el apocalipsis de la IA
El debate sobre seguridad de la IA enfrenta controles externos y carrera competitiva
Por qué importa: Tema compartido: inteligencia artificial · IA.
EEUU propone a China una línea de aviso para incidentes graves de IA: es un mecanismo de crisis, no un acuerdo tecnológico
Por qué importa: Tema compartido: inteligencia artificial.
La banca española invierte hasta 2.400 millones en IA en 2026 y rediseña sus modelos de decisión crediticia
Por qué importa: Tema compartido: inteligencia artificial.
Sánchez plantea un acuerdo social sobre IA antes de la cita de la ONU
Por qué importa: Tema compartido: IA.
La IA ya sostiene parte del crecimiento mundial: qué tendría que fallar para que el boom de inversión se convierta en una burbuja
Por qué importa: Tema compartido: inteligencia artificial.
¿Podría EEUU 'desenchufar' la IA europea? Lo que depende de un interruptor y lo que no
Por qué importa: Tema compartido: inteligencia artificial.
Documentos del pleito del NYT muestran inquietud interna en Microsoft y OpenAI por el uso de prensa para entrenar IA
Por qué importa: Tema compartido: inteligencia artificial.
Trump anuncia una 'AI Force' y un 'zar de la IA', pero todavía no explica qué poderes tendrán
Por qué importa: Tema compartido: inteligencia artificial.