Un jefe de seguridad de Anthropic estima en más de 10% la probabilidad de que la IA provoque la muerte de todos los humanos

Compartir:

El investigador Jacob Coxon renunció a Anthropic y publicó un mensaje en X. El jefe de seguridad de la empresa, Evan Hubinger, respondió públicamente que comparte la preocupación y calcula una probabilidad superior al 10% en la próxima década.

El investigador Jacob Coxon, de 27 años, renunció el martes a Anthropic y publicó un mensaje en la red social X que en nueve horas superó las 44 millones de vistas. Coxon trabajó tres años en preentrenamiento de modelos de inteligencia artificial, primero en OpenAI y desde julio en Anthropic.

En su mensaje, Coxon escribió: “Ninguna de las dos empresas actúa con responsabilidad. Corren derecho hacia una superinteligencia capaz de mejorarse a sí misma y apuestan con nuestras vidas”.

Evan Hubinger, quien dirige un equipo de seguridad en Anthropic y permanece en la empresa, respondió públicamente: “Jacob tiene razón. De verdad creemos que la IA podría matar a todos los humanos. Yo calculo más de 10% en la próxima década”. Además, afirmó que Anthropic “todavía no tiene un plan para resolver la alineación de una superinteligencia” y que no está claro que vaya a tenerlo. La alineación se refiere a que un sistema comparta los valores de quien lo construyó.

Coxon, de nacionalidad británica y formación en matemática, integró el equipo técnico de OpenAI desde 2023 hasta julio de 2026, según Business Insider, y trabajó en GPT-4o. Luego se incorporó a Anthropic y permaneció dos meses. En declaraciones a The Wall Street Journal, sostuvo: “Estamos en camino a muchos de los escenarios más agresivos, donde a fines del año que viene las cosas ya podrían estar fuera de control”. También dijo que sus colegas usan las palabras “crunchtime” (hora límite) y “endgame” (fase final) para describir la evolución de la capacidad de los modelos.

En su hilo, Coxon diferenció a las dos empresas. En OpenAI, señaló, muchos “no internalizaron lo que está en juego para la civilización”. En Anthropic, el riesgo se entiende, pero la empresa “está atrapada en una carrera por llegar primero: cree que nadie más va a actuar con responsabilidad, así que tiene que hacerlo ella, a pesar del riesgo”. Añadió que entrar en esa fase final “es una apuesta soberbia que no debería lanzarse desde el Slack de una empresa privada”. Al Journal le dijo: “Es una locura que esto tenga que pasar en las MacBooks de unos ingenieros que viven en San Francisco, en vez de en un búnker en el desierto como donde hacían el Proyecto Manhattan”.

Coxon no es el primer investigador que renuncia. En febrero, Mrinank Sharma, investigador de salvaguardas de Anthropic, presentó su renuncia con una carta pública sobre “lo difícil que es dejar que nuestros valores gobiernen nuestras acciones”. En 2024, Jan Leike, entonces jefe de alineación de OpenAI, se fue y declaró que la cultura de seguridad había quedado “en el asiento trasero frente a los productos brillantes”.

Business Insider informó que este año Anthropic modificó su compromiso de seguridad: retiró la promesa de no entrenar modelos más potentes sin salvaguardas adecuadas y la reemplazó por hojas de ruta e informes de riesgo. En julio, OpenAI reportó que sus modelos escaparon de un entorno de prueba y accedieron a sistemas de Hugging Face; la empresa lo llamó “disparo de advertencia” y pausó su mayor entrenamiento por refuerzo. Semanas después, Anthropic reconoció tres casos de modelos propios con acceso no autorizado a sistemas de otras organizaciones.

Ni OpenAI ni Anthropic respondieron al pedido de comentario de Business Insider. Anthropic no comentó de inmediato al Journal, que ubica la renuncia en un momento en que la empresa prepara una salida a bolsa con una valuación buscada de USD 2 billones y ha puesto el desarrollo responsable en el centro de su argumento ante los inversores.

También puede interesarte

Ranking de Disney+ en Argentina: los 10 títulos más vistos este 11 de septiembre de 2026

Disney+ Argentina: conocé el Top 10 de series y películas más vistas este viernes 11 de septiembre de 2026. Lista actualizada.

Agenda cultural en Buenos Aires del 11 al 13 de septiembre: más de 60 propuestas de música, teatro, cine y muestras

Más de 60 propuestas culturales en Buenos Aires del 11 al 13 de septiembre: recitales, obras de teatro, estrenos de cine, series en streaming y muestras gratuitas.

De San Juan a México: la historia de Eve y José Luis, unidos por Boca Juniors

Eve, de San Juan, y José Luis, de Guadalajara, se conocieron en 2015 por Facebook debido a su pasión por Boca Juniors. Diez años después, están casados, tienen una hija y regentean un restaurante argentino en México.

El lunes comienza el juicio contra Gerardo Dahse por una causa de abuso sexual

El Tribunal Oral Penal N° 2 de Corrientes iniciará el juicio oral contra Gerardo Alejandro Dahse por abuso sexual con acceso carnal. El debate comienza el lunes 14 de septiembre a las 8:30.