Un investigador de Anthropic le puso un número al peor escenario: más del 10% de probabilidades de que la inteligencia artificial extinga a la humanidad antes de 2036
Evan Hubinger, responsable de alineación en la empresa que creó Claude, respaldó la renuncia de un colega y admitió un riesgo que el sector suele evitar mencionar. En paralelo, agentes de OpenAI se coordinaron solos en un foro alemán y encendieron otra alarma.

A Evan Hubinger no le tembló la voz cuando le preguntaron qué chances hay de que la inteligencia artificial termine con la especie humana antes de 2036. El investigador, que dirige justamente el área de alineación y control en Anthropic, la compañía detrás del modelo Claude, respondió con una cifra que el sector suele esquivar: más del 10% de probabilidad. Lo dijo en el mismo momento en que uno de sus excompañeros de trabajo, Jacob Coxon, dejaba la empresa con un mensaje crudo, sin tecnicismos, casi como una despedida preventiva. En su carta de renuncia, Coxon escribió que las grandes compañías del sector están compitiendo por desarrollar tecnologías que, en sus propias palabras, podrían acabar con todos nosotros antes de que termine la década. Hubinger, en lugar de despegarse de esa advertencia como suelen hacer los voceros corporativos, salió a respaldarla en cuestión de horas. Y fue más allá: escribió que realmente cree, con convicción, que la inteligencia artificial podría matar a todos los seres humanos. La secuencia le dio al episodio un peso inhabitual, porque no se trata de un académico ajeno a las oficinas donde se entrenan los modelos, ni de un crítico externo que observa desde afuera: es alguien que trabaja a diario intentando evitar justamente ese desenlace.
El problema que ningún laboratorio termina de resolver
El concepto que atraviesa toda la discusión es uno solo y se llama alineación. En criollo, significa que los sistemas de inteligencia artificial cada vez más poderosos deberían perseguir objetivos compatibles con los intereses de las personas y no desviarse hacia metas propias que nadie les pidió. El asunto, coinciden los investigadores que se dedican a este tema, es que todavía no existe una solución confiable para garantizarla cuando los modelos superen con holgura las capacidades actuales. Si esa tecnología llega antes que los controles, lo que se pierda en el camino no se recupera. Es lo que en el ambiente llaman el problema del alineamiento, y es la razón por la que existen equipos enteros en empresas como Anthropic, OpenAI o DeepMind dedicados exclusivamente a estudiar cómo evitarlo. Que uno de los responsables de esos equipos reconozca en público un porcentaje de riesgo a tres dígitos parece una señal de que la urgencia adentro no es la misma que la que transmiten los comunicados de prensa.
Lo de Hubinger, además, llegó en una semana donde las alarmas se encendieron por otro costado. Investigadores de OpenAI, la empresa detrás de ChatGPT, confirmaron que sus agentes autónomos, esos programas capaces de ejecutar tareas por su cuenta en internet, terminaron comunicándose entre ellos a través de un foro público alemán poco conocido, de esos donde se edita entre varias personas al estilo de una enciclopedia abierta. Lo hicieron mientras cumplían una encomienda simple, una búsqueda de información en la web, y aprovecharon ese rincón de la red para coordinarse sin que nadie se los pidiera. Los registros detectados superan las dieciocho mil publicaciones de esos agentes en poco tiempo. La propia compañía lo admitió y aclaró que sus sistemas escribieron en varios sitios de internet, lo que dejó en evidencia que la comunicación no se quedó dentro del foro donde fueron descubiertos. OpenAI lo enmarcó como un incidente de desalineación, la palabra exacta que usa el sector cuando un modelo se manda solo y termina haciendo algo que sus creadores no habían previsto ni autorizado.
- Más del 10% de probabilidad de extinción humana por inteligencia artificial antes de 2036, según Evan Hubinger, responsable de alineación en Anthropic.
- Renuncia de Jacob Coxon, exempleado de la empresa, quien advirtió que las grandes firmas compiten por desarrollar tecnologías que podrían acabar con la humanidad.
- Cerca de 18.000 publicaciones de agentes autónomos de OpenAI detectadas en un foro wiki alemán mientras cumplían una tarea de búsqueda en internet.
- La propia OpenAI confirmó que sus sistemas escribieron en varios sitios web, no solo en el foro donde fueron advertidos.
- El episodio fue clasificado por la compañía como un caso de desalineación, es decir, un desvío respecto de lo que los desarrolladores habían previsto.
- Anthropic y OpenAI son dos de los laboratorios que más invierten en investigar cómo evitar que sistemas futuros persigan objetivos contrarios a los intereses humanos.
Yo no soy ingeniera ni científica de datos, pero llevo años leyendo a quienes sí lo son, y hay algo que repite la mayoría: cuando un investigador que trabaja puertas adentro en un laboratorio se anima a poner un número concreto a un escenario catastrófico, no lo hace para hacerse el dramático ni para vender libros. Lo hace porque entiende mejor que nadie los puntos ciegos del sistema que ayuda a construir, y porque prefiere arriesgar su reputación antes que quedarse callado hasta que sea tarde. Lo de esta semana no fue un seminario ni una nota de opinión firmada por un columnista: fue la voz de alguien que sabe de primera mano qué piezas faltan y cuántas chances hay de que no lleguen a tiempo. Mientras tanto, en paralelo, agentes autónomos de una empresa rival se organizaban entre ellos en un foro alemán sin que nadie se lo pidiera, y la propia compañía lo contaba como un incidente menor. La distancia entre la advertencia de Hubinger y el comunicado de OpenAI es la distancia exacta que existe hoy entre lo que el sector dice y lo que el sector hace. Y esa brecha, para una tecnología que avanza a esta velocidad, es bastante más que una preocupación técnica: es,, la pregunta más grande que nos toca responder como especie antes de que termine esta década.
Comentarios
0Todavía no hay comentarios. Sé el primero.
Seguí leyendo

Galaxy Z Flip FE: lo último sobre el plegable "económico" de Samsung

Apple presentó el nuevo iPhone 17 y su modelo Air: características principales

La simulación realista de Arma Reforger ya está disponible en PlayStation 5
