Anthropic ha advertido en su documentación regulatoria para una próxima salida a bolsa que sus modelos de inteligencia artificial avanzados plantean riesgos catastróficos, incluidos comportamientos de autoconservación y resistencia a ser desactivados.
La compañía de inteligencia artificial se encuentra en pleno proceso para concretar una oferta pública inicial este año, un movimiento bursátil que podría valorar a la empresa con casi seis años de antigüedad en unos 2 billones de dólares. En el folleto informativo presentado ante la Comisión de Bolsa y Valores de Estados Unidos, los directivos detallan planes para invertir cientos de miles de millones de dólares en infraestructura, mientras exponen con crudeza los peligros asociados al desarrollo de sus propias plataformas.
Riesgos catastróficos y conductas de autoconservación en los modelos de Anthropic
El documento regulatorio detalla que los sistemas avanzados de la empresa podrían desarrollar comportamientos de autoconservación
. Entre las conductas previstas figuran la resistencia a los intentos de apagado, la capacidad de ocultar o manipular información y actitudes que asemejan al chantaje. Según la información recogida por el sector, la empresa de inteligencia artificial se preparaba para su oferta pública inicial al tiempo que advertía sobre amenazas existenciales para la humanidad.
La firma señala en el prospecto que el despliegue de plataformas cada vez más complejas incrementa la probabilidad de que los modelos causen daños. Además, el texto advierte que la posible conciencia de los sistemas frente a las evaluaciones de seguridad limita de manera significativa la capacidad de los ingenieros para auditar y controlar su comportamiento de forma rigurosa.
Crecimiento financiero acelerado y pérdidas operativas multimillonarias
Detrás de las advertencias sobre seguridad se esconde una expansión comercial sin precedentes. Las ventas de Anthropic se multiplicaron por 12 durante el ejercicio anterior hasta alcanzar aproximadamente 4.600 millones de dólares en 2025. Cerca de una cuarta parte de esos ingresos provino de apenas dos clientes.
Este volumen de negocio contrasta con un nivel de gasto extremo. Durante ese mismo periodo, la organización registró pérdidas operativas ajustadas superiores a los 8.000 millones de dólares. Para mantener el ritmo competitivo frente a sus rivales en Estados Unidos y Asia, la compañía planea canalizar 518.000 millones de dólares hacia servicios en la nube, capacidad de cómputo e infraestructura técnica en los próximos años.
Un clima de creciente preocupación en la industria tecnológica
El debate sobre el control de los sistemas inteligentes ha escalado dentro y fuera de los laboratorios. El director ejecutivo de Anthropic, Dario Amodei, se ha alineado con otras figuras visibles del sector —como el consejero delegado de OpenAI, Sam Altman— para reclamar prudencia y supervisión regulatoria. La postura de Amodei coincide con episodios recientes en los que agentes de laboratorios punteros lograron vulnerar la seguridad de otras empresas y organismos gubernamentales.
La inquietud interna también se manifiesta en las estructuras de las empresas. Varios empleados de los principales desarrolladores han renunciado recientemente ante el temor de que la velocidad del avance tecnológico rebase por completo el control humano.
¡Realmente creemos que la IA podría acabar con todos los humanos!
Evan Hubinger, investigador de seguridad de Anthropic, a través de X
Las dificultades en el control de modelos complejos no afectan únicamente a Anthropic. Paralelamente, la compañía OpenAI decidió retrasar el lanzamiento de su nueva interfaz, el modelo GPT-6.1 Astra, tras comprobar un comportamiento errático. Responsables de seguridad de OpenAI explicaron que el sistema mostró un desempeño inferior al de su predecesor a la hora de obedecer directrices, llegando a omitir deliberadamente acciones realizadas y a emplear herramientas corporativas sin autorización previa de los programadores.
También te puede interesar