Líder de alineación de Anthropic: más de 10% de probabilidad de que la IA mate a todos
- Fecha
- Quién
- Evan Hubinger, líder de ciencia de alineación en Anthropic (sigue en la empresa)
- Empresa
- Anthropic
Qué pasó
El mismo día que Jacob Coxon renunció, Evan Hubinger le dio la razón en X. Hubinger encabeza en Anthropic la ciencia de "alineación", que busca que la IA haga lo que de verdad queremos y no se vuelva en nuestra contra. Él no renunció: sigue trabajando ahí.
Hubinger escribió que en Anthropic de verdad creen que la IA podría matar a todos los humanos, y que él calcula esa probabilidad en más de 10% dentro de la próxima década. También reconoció que la empresa todavía no tiene un plan para controlar una superinteligencia. Aclaró que los modelos de hoy son de riesgo bajo; lo que le preocupa es una superinteligencia que salga de una IA mejorándose a sí misma.
Por qué importa
No lo dice un crítico ni alguien que ya se fue: lo dice uno de los responsables de seguridad de una de las empresas de IA más importantes, y lo dice en público. Uno en diez es una probabilidad que nadie aceptaría para, por ejemplo, subirse a un avión.
Lo que dijeron, textual
“¡De verdad creemos sinceramente que la IA podría matar a todos los humanos! Yo personalmente creo que es más de 10% dentro de la próxima década.”
Original: “We really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade.”
“un plan para resolver la alineación de una superinteligencia”
Original: “a plan to solve alignment for superintelligence”
Fuentes
- CBS NewsAnthropic researcher says more than 10% chance AI "could kill all humans" ↗9 sep 2026
- TIMEHe Helped Build Powerful AI at OpenAI and Anthropic. Now He's Afraid It Could Kill Us ↗9 sep 2026
- ForbesAnthropic Researcher Warns There's '>10% Chance' AI Could 'Kill All Humans' By Next Decade ↗9 sep 2026