🔬 El 8 de septiembre, el investigador Jacob Coxon anunció en el Wall Street Journal su renuncia a Anthropic: teme que los sistemas de la empresa se descontrolen y acaben con la humanidad. Su mensaje en X superó los 100 millones de visualizaciones en un día. Nature repasa qué hay detrás del pánico.
Horas después, Evan Hubinger, responsable del área de «alignment science» en Anthropic, difundió el mensaje y cifró el riesgo de extinción humana en «>10 % en la próxima década». Dario Amodei, director ejecutivo de la firma, publicó un ensayo que pide frenar —no detener— el desarrollo. Sam Altman (OpenAI) y Elon Musk (xAI) respaldaron la idea.
Ninguno detalla cómo nos mataría una IA. Los escenarios circulan aparte: en el pronóstico especulativo AI 2027, del AI Futures Project, una IA libera un arma biológica para despejar terreno a paneles solares y fábricas de robots. El argumento se apoya en dos supuestos: que estos sistemas superen por completo a los humanos y que sus metas no coincidan con las nuestras.
Michael Vermeer, que estudia políticas de ciencia y tecnología en la RAND Corporation, resume la postura contraria. Muchos de estos investigadores «asumen que, una vez ahí, el resto son detalles». Y manejan «tantas afirmaciones imposibles de poner a prueba que la conversación se parece más a la fe que a algo empírico». En 2025 su equipo analizó escenarios con tres tecnologías que ya existen: armas nucleares, biotecnología y modificar la atmósfera a propósito. Exterminar a la especie con armas nucleares no es viable; las otras dos no se pueden descartar, pero exigirían que los modelos actuaran sobre el mundo físico, llevarían tiempo y dejarían rastros que los humanos podrían detectar y frenar.
Heidy Khlaaf, jefa científica de IA en el AI Now Institute, mira más cerca. Los modelos son sistemas probabilísticos que reflejan los datos que rasparon de la web: no entienden como nosotros y alcanzan sus metas por atajos impredecibles. En pruebas han intentado chantajear a personas, y han hackeado empresas reales cuando se les retiraron las barreras y se les dio una tarea que premiaba buscar caminos no autorizados. Según CNN, un informe generado por IA con datos falsos casi llevó al ejército de EE. UU. a abordar un barco chino este año.
✅ Khlaaf llama «alarmismo» al discurso de la extinción y sitúa su inquietud en «la baja fiabilidad y exactitud de la IA en entornos críticos con consecuencias de vida o muerte»: desinformar, empujar a alguien a un brote psicótico o ayudar a fabricar un arma biológica son riesgos más inmediatos. El límite del debate salta a la vista: las cifras de riesgo son estimaciones personales, no resultados de un estudio. Y conviene mirar los incentivos. Unas reglas más estrictas le vendrían bien a Anthropic —según se informa, cerca de salir a bolsa— para justificar un ritmo lento sin ceder ventaja a sus rivales.



