"Están jugando con nuestras vidas": un investigador de Anthropic cree que hay un 10% de posibilidades de que la IA acabe con la humanidad

Hay un número que se ha vuelto viral en Twitter estos días: más del 10%.  Esa es la probabilidad que Evan Hubinger, un investigador de Anthropic, cree que existe de que la inteligencia artificial acabe con todos los humanos durante la próxima década. El comentario respaldó la decisión de Jacob Coxon, un compañero suyo que acaba de abandonar la compañía denunciando que las empresas de IA están "jugando con nuestras vidas". Ese porcentaje es ciertamente aterrador, pero hay un problema con esa cifra: no significa absolutamente nada.

Miedo a la superinteligencia. Hubinger de hecho aclaraba que consideraba bajo el riesgo que plantean los modelos de IA actuales. Para él lo preocupante es lo que puede estar por venir: una superinteligencia creada por automejora recursiva, o lo que es lo mismo: sistemas de IA que ayuden a crear sistemas de IA mejores aún. para Coxon, que prefirió abandonar su trabajo —como otros antes que él, también en la competencia—, los próximos uno o dos años serán decisivos y pide que tanto OpenAI como Anthropic no se abalancen en esa carrera, algo difícil de lograr cuando la IA ya se está usando para acelerar la investigación en IA.

Captura De Pantalla 2026 09 10 A Las 10 32 14

¿Cómo nos matará la IA? En The Wall Street Journal dividen los escenarios de extinción de los que hablan los expertos en dos grandes familias. Una, más hollywoodiense, es la pérdida de control: un sistema de IA mucho  más inteligente podría tener objetivos incompatibles con los de la humanidad y adquirir la capacidad suficiente para impedir que lo detengamos. La otra es menos llamativa, pero igualmente preocupante: que sigamos controlando la IA, pero alguien la use para crear un virus letal, lanzar ciberataques o atacar infraestructuras críticas. 

El 10% podría ser el 90% igualmente. Para llegar a ese escenario del que habla Hubinger tendrían que encadenarse una serie de eventos decisivos. Tendríamos que crear sistemas de IA muy superiores a nosotros, que éstos pudieran acelerar el desarrollo de sus sucesores, que esa aceleración fuera rápida y que adquieran suficiente autonomía y no podamos detenerlos. El célebre p(doom) (la probabilidad de la extinción) es de momento tan solo una estimación subjetiva que trata de poner números a la incertidumbre. Ese 10% no está medido experimentalmente, y su significado real es nulo porque no hay pruebas ni evidencias de que tenga sentido. Igual que es 10% podría ser 90% o 0%.

La amenaza de la IA a la humanidad es "absurdamente ridícula": lo dice el máximo responsable de IA en Meta
La amenaza de la IA a la humanidad es "absurdamente ridícula": lo dice el máximo responsable de IA en Meta