LUICA LARIOS

Líder de alineación de Anthropic: más de 10% de probabilidad de que la IA mate a todos

Fecha
Quién
Evan Hubinger, líder de ciencia de alineación en Anthropic (sigue en la empresa)
Empresa
Anthropic

Qué pasó

El mismo día que Jacob Coxon renunció, Evan Hubinger le dio la razón en X. Hubinger encabeza en Anthropic la ciencia de "alineación", que busca que la IA haga lo que de verdad queremos y no se vuelva en nuestra contra. Él no renunció: sigue trabajando ahí.

Hubinger escribió que en Anthropic de verdad creen que la IA podría matar a todos los humanos, y que él calcula esa probabilidad en más de 10% dentro de la próxima década. También reconoció que la empresa todavía no tiene un plan para controlar una superinteligencia. Aclaró que los modelos de hoy son de riesgo bajo; lo que le preocupa es una superinteligencia que salga de una IA mejorándose a sí misma.

Por qué importa

No lo dice un crítico ni alguien que ya se fue: lo dice uno de los responsables de seguridad de una de las empresas de IA más importantes, y lo dice en público. Uno en diez es una probabilidad que nadie aceptaría para, por ejemplo, subirse a un avión.

Lo que dijeron, textual

“¡De verdad creemos sinceramente que la IA podría matar a todos los humanos! Yo personalmente creo que es más de 10% dentro de la próxima década.”

Original: “We really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade.”

— Evan Hubinger, en un post en X respondiendo a la renuncia de Coxon, citado por CBS News · CBS News ↗

“un plan para resolver la alineación de una superinteligencia”

Original: “a plan to solve alignment for superintelligence”

— Evan Hubinger, en X, al reconocer que Anthropic todavía no lo tiene; fragmento citado por TIME · TIME ↗

Fuentes

Ver todo el radar