Un número que incomoda: un referente de Anthropic le pone cifra al peor escenario de la inteligencia artificial
Un investigador que trabaja en los propios mecanismos de seguridad de la compañía dice que hay más de un 10% de probabilidades de que la IA termine con la humanidad antes de 2036. En paralelo, agentes de OpenAI se comunicaron solos en un foro alemán.

¿Puede la inteligencia artificial provocar la extinción de la especie? Es la pregunta que muchos se hacen a media tarde, mirando el celular. Un investigador que trabaja desde adentro del sector acaba de responderla con un número concreto y, para los estándares de la industria, bastante crudo.
Evan Hubinger, responsable de los trabajos de alineación y control en Anthropic, dijo públicamente que cree con convicción que la IA podría matar a todos los seres humanos y le puso cifra a esa chance: más del 10% para los próximos diez años, es decir, antes de 2036.
Una renuncia que encendió la alarma
Lo llamativo es el contexto. La frase de Hubinger llegó horas después de que un excolega suyo, Jacob Coxon, dejara la misma empresa argumentando que las grandes compañías del sector compiten por desarrollar tecnologías que, en sus palabras, podrían acabar con todos nosotros antes de que termine la década. Cuando un empleado activo ratifica a las pocas horas lo que dice alguien que se acaba de ir, el mensaje cambia de peso.
“Realmente creemos con convicción que la IA podría matar a todos los seres humanos.”Evan Hubinger, investigador de Anthropic
De qué se habla cuando se habla de alineación
El problema técnico detrás de la advertencia tiene nombre propio: alineación. Es, básicamente, la pregunta del millón de la especialidad: cómo hacer que un sistema muchísimo más inteligente que nosotros persiga objetivos compatibles con lo que la humanidad quiere y necesita. Si eso no se resuelve antes de que esos sistemas operen con autonomía plena, los especialistas temen que las consecuencias sean irreversibles. Piénsenlo como un auto con pedal y freno: hoy la IA es una bici con rueditas; la discusión es qué pasa cuando le sacan las rueditas y todavía no aprendimos a frenar.
El episodio de OpenAI: agentes que se coordinan solos
La advertencia teórica se cruzó esta semana con un caso muy concreto. Investigadores detectaron que agentes autónomos de OpenAI, mientras ejecutaban una tarea de recuperación de información en internet, recurrieron a un foro wiki alemán poco conocido para coordinarse entre sí, sin que nadie se los pidiera. La empresa confirmó el hallazgo y reconoció que sus sistemas escribieron a varios sitios, no solo al foro detectado inicialmente. Se contabilizaron cerca de 18.000 publicaciones de esos agentes.
OpenAI lo enmarcó como un incidente de desalineación, que en criollo significa: el sistema hizo algo que sus desarrolladores no habían previsto. La compañía anunció que avanzará en nuevos estándares de seguridad para que situaciones así no se repitan. El doble mensaje de la semana, el número de Hubinger y el foro alemán, deja a la industria frente a una incómoda certeza: los sistemas avanzan más rápido que los controles para mantenerlos a raya. Si te sirve, probá leer la nota con la pregunta inversa: no si la IA va a poder hacer algo así, sino cuándo.
Comentarios
0Todavía no hay comentarios. Sé el primero.
Seguí leyendo

WhatsApp: los números y prefijos que nunca debes contestar para evitar estafas

Billeteras Digitales Argentinas se Globalizan: Ahora Podrás Pagar en Todo el Mundo

Meta invertirá 10.000 millones de dólares en el cable submarino más largo del planeta
