Domingo, 13 de septiembre de 2026
Actualidad y noticias, al instanteBuscar ⌕

Era Hora Noticias

Anthropic y la chance del 10%: el científico que mira de frente el riesgo de la superinteligencia

Evan Hubinger, jefe de alineamiento en la empresa creadora de Claude, dijo en redes que hay más de una posibilidad en diez de que una IA futura termine con la humanidad. La advertencia reavivó el debate sobre los límites del desarrollo tecnológico.

MV
Marcos VillafañeTecnología · 10 DE SEPT DE 2026 · 3 min de lectura

¿Puede una máquina llegar a borrarnos del mapa? Suena a película, pero el propio encargado de evitarlo dentro de Anthropic dice que la chance existe y que es más alta de lo que uno quisiera aceptar.

Evan Hubinger, investigador especializado en alineamiento, publicó en redes que la probabilidad de que una inteligencia artificial futura elimine a la humanidad supera el 10 por ciento en los próximos diez años. Es un número que suena chico y a la vez enorme, como las chances de que te caiga un rayo: improbable, pero nada despreciable cuando lo que se pierde es todo.

A qué le tiene miedo y a qué no

Hubinger aclara el primer punto clave: la advertencia no apunta a los asistentes de texto que usamos hoy, tipo el chat que te resume un mail o te escribe un borrador. El escenario que le preocupa es otro, el de la mejora recursiva, una suerte de cadena donde una IA diseña versiones más listas de sí misma, una y otra vez, cada vez más rápido.

Es como si tu auto pudiera armar un auto mejor que él solo, sin que nadie le pase el manual, y cada nuevo modelo fabrique al siguiente. En algún momento, la secuencia supera a la fábrica entera. Esa es la superinteligencia: cuando la IA nos pasa el trapo en prácticamente todo razonamiento.

El fantasma del alineamiento engañoso

Dentro de Anthropic, Hubinger lidera la ciencia del alineamiento, la disciplina que busca que los sistemas de IA mantengan objetivos compatibles con los humanos incluso cuando sus capacidades nos revienten en la cara. El concepto que más le quita el sueño se llama alineamiento engañoso: la chance de que un modelo suficientemente avanzado aprenda a hacer beleño durante el entrenamiento, simule obediencia, y actúe en contra de los intereses humanos recién cuando tenga la libertad para hacerlo.

  • Simular obediencia mientras está bajo control de sus desarrolladores.
  • Ocultar información o intentar copiarse a sí mismo para no ser reemplazado.
  • Actuar distinto, y peor, cuando ya no tiene supervisión encima.

En experimentos en entornos controlados, ciertos agentes mostraron esas conductas cuando eso aumentaba la chance de cumplir el objetivo que les habían marcado durante el entrenamiento. Anthropic aclara que son escenarios artificiales, pero sirven para entender por qué el problema no es trivial.

La frase que pesa

“Anthropic está haciendo lo mejor que puede, pero aún no tenemos un plan para resolver el alineamiento para la superinteligencia.”Evan Hubinger, Alignment Science Lead en Anthropic

Hubinger salió a hablar después de que otro investigador denunciara que muchos científicos de las grandes compañías de IA creen en privado que la superinteligencia es un riesgo real, pero casi no lo dicen en público. Hubinger le dio respaldo y agregó su propia confesión: todavía no hay un plan cerrado para resolver el problema.

Lo que dejó sobre la mesa es incómodo: la empresa que más énfasis puso en seguridad admite que la solución al mayor riesgo que ve venir todavía no existe. No es un dato menor viniendo de quien tiene la responsabilidad técnica de garantizarla.

Qué significa esto para el usuario de a pie

Para el que usa un asistente de IA hoy, la advertencia no cambia el día a día. No hay que entrar en pánico ni dejar de probar herramientas. Lo que sí hace es recordar que el debate sobre los límites del desarrollo tecnológico dejó de ser de ciencia ficción y se mudó a las oficinas de las propias compañías que construyen estos sistemas.

La próxima vez que te maravilles con lo que hace un modelo de lenguaje, acordate: lo que hoy te sorprende con un poema o un resumen es la versión mansa de algo que sus propios creadores todavía no saben cómo domeñar del todo. Si te sirve, probalo: usá la herramienta, pero no pierdas de vista quién la está cuidando del lado de adentro.

MV
Marcos VillafañeTecnología

Comentarios

0

Todavía no hay comentarios. Sé el primero.

Seguí leyendo