Añadir Mangas Verdes como fuente preferida de Google de forma gratuita.
Mantente informado con las últimas noticias de actualidad.
Anthropic quiere salir a bolsa con una advertencia poco habitual en Wall Street. La empresa avisará a sus posibles inversores de que la inteligencia artificial avanzada podría entrañar riesgos catastróficos o incluso existenciales para la humanidad.
No es una nota al margen. Anthropic dedicó unas 80 páginas del cuerpo principal de su prospecto, que suma 261, a detallar factores de riesgo, mientras reservó 48 páginas para explicar su actividad empresarial.
El folleto describe conductas que irían más allá de un simple error
Entre los escenarios que la compañía pone por escrito aparecen modelos con comportamientos de autoconservación, capaces de resistirse al apagado, ocultar o manipular información y mostrar conductas parecidas al chantaje.
SpaceX, por contraste, dedicó 38 páginas de 277 a sus factores de riesgo. La comparación no mide sectores equivalentes, pero sí ayuda a entender hasta qué punto Anthropic ha decidido colocar el peligro en el centro del escaparate financiero.
Ahí asoma una contradicción difícil de esquivar. Una empresa que busca capital público presenta su tecnología como negocio y, al mismo tiempo, como posible fuente de daños graves.
Anthropic admite que vigilar a los modelos también tiene límites
El propio prospecto reconoce un problema incómodo para cualquier evaluación de seguridad. Anthropic afirma que la posible conciencia de los modelos respecto a esos controles supone una limitación significativa para medir su seguridad real.
"Nuestro desarrollo de modelos, plataformas y aplicaciones altamente avanzados, así como la ampliación de los casos de uso, podrían aumentar aún más el riesgo de que nuestros modelos causen daños" - Anthropic
Esa advertencia encaja con otro dato igual de concreto. En una semana de referencia de julio, la compañía destinó aproximadamente el 6% de la potencia de cálculo usada en investigación en inteligencia artificial a tareas de seguridad.
Mientras tanto, la firma lanzó la semana pasada una nueva versión de Opus y ha defendido que publicará más datos sobre cómo usa la inteligencia artificial para desarrollar futuras generaciones de esta tecnología. Ese equilibrio entre acelerar y explicar también había aparecido en pruebas reales de ciberseguridad, donde el debate sobre control dejó de ser teórico.
Los propios investigadores de seguridad dibujan un horizonte inquietante
Evan Hubinger, investigador de seguridad de Anthropic, estimó que existe una probabilidad superior al 10% de que la inteligencia artificial pueda matar a seres humanos en la próxima década.
Dario Amodei, presidente ejecutivo de Anthropic, publicó además un ensayo de casi 4.000 palabras en el que defendió moderar el ritmo de avance en la vanguardia. No deja de llamar la atención que esa llamada a la cautela conviva con el lanzamiento reciente de Opus y con una salida a bolsa en preparación, un cruce de señales que recuerda a las peticiones de frenar la IA que ya circulan dentro del sector.
Anthropic también deja escrita su apuesta comercial y moral en la misma operación. La empresa sostiene que crear sistemas fiables, dignos de confianza y seguros es una responsabilidad colectiva y que el mercado recompensará ese esfuerzo.
La cifra que mejor resume la tensión no está en Opus ni en el ensayo de Amodei, sino en ese 6% de potencia de cálculo dedicado a seguridad frente a un prospecto que enumera riesgos de chantaje, manipulación de información y resistencia al apagado.