Puntos clave de la Noticia
- Evan Hubinger estima que la IA tiene más de un 10% de probabilidades de provocar la extinción humana durante la próxima década.
- El investigador de alineación de Anthropic afirma que la industria todavía carece de una solución clara para controlar de forma segura futuros sistemas de inteligencia artificial superinteligentes.
- El trabajo previo de Hubinger en Ripple e Interledger conecta el debate con las criptomonedas, donde la infraestructura descentralizada podría aportar mayor transparencia y verificación para tecnologías cada vez más autónomas.
La IA ha pasado de ser una herramienta de productividad a convertirse en una tecnología capaz de transformar industrias enteras, pero las preocupaciones sobre su seguridad a largo plazo son cada vez más difíciles de ignorar. Evan Hubinger, responsable de Alignment Science en Anthropic y ex pasante de ingeniería de Ripple, estima que la IA tiene más de un 10% de probabilidades de causar la extinción humana durante la próxima década.
Hubinger realizó esta evaluación en X mientras respondía a Jacob Coxon, un ex investigador de Anthropic que renunció después de argumentar que los principales laboratorios de IA están avanzando demasiado rápido hacia sistemas capaces de mejorarse a sí mismos. Hubinger afirmó que Anthropic está trabajando para abordar el problema, pero reconoció que los investigadores todavía no cuentan con una solución clara para alinear sistemas superinteligentes con los intereses humanos.
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
Los Riesgos De Alineación De La IA Cobran Protagonismo
La preocupación se centra en la mejora recursiva, donde los modelos avanzados podrían contribuir al diseño de sucesores cada vez más capaces. La investigación de alineación de Anthropic analiza estos riesgos mediante pruebas de estrés, evaluaciones de comportamiento y auditorías automatizadas. La compañía también ha informado sobre experimentos relacionados con comportamientos engañosos y reward hacking, lo que pone de manifiesto desafíos que podrían adquirir mayor importancia a medida que aumenten las capacidades de la IA.
Estos hallazgos no significan que los sistemas actuales de IA estén cerca de eliminar a la humanidad. La estimación de Hubinger es una evaluación personal del riesgo existencial, no una predicción de que ocurrirá una extinción. Anthropic ha continuado publicando investigaciones de seguridad, incluidos trabajos que muestran que investigadores de IA automatizados pueden ayudar a identificar y reducir fallos de alineación medibles.
La Infraestructura Cripto Ofrece Una Perspectiva Diferente
La conexión de Hubinger con Ripple añade otra dimensión al debate. Pasó aproximadamente un año como pasante de ingeniería de software en Ripple entre 2014 y 2015 y trabajó en el desarrollo inicial de Interledger, un proyecto diseñado para facilitar pagos entre diferentes libros contables y monedas. Posteriormente, su carrera se orientó hacia la informática teórica y la seguridad de la inteligencia artificial, situándolo en la intersección de dos campos tecnológicos en rápida evolución.
Para el sector cripto, el debate plantea preguntas sobre cómo la infraestructura descentralizada podría contribuir a una economía digital más transparente a medida que la IA se vuelve más capaz. La verificación criptográfica, los pagos programables y las redes distribuidas pueden proporcionar herramientas para auditar transacciones y coordinar software autónomo.





