INTELIGENCIA ARTIFICIAL

Publicado 29/09/2026

Anthropic advierte a sus futuros inversores que la IA podría representar un riesgo existencial para la humanidad

En el prospecto de su salida a bolsa, la empresa detrás de Claude describe modelos capaces de resistirse a su apagado, ocultar información o comportarse de manera manipuladora. La advertencia expone una tensión central del negocio: desarrollar sistemas cada vez más potentes mientras intenta demostrar que puede controlarlos.
Compartir
Compartir por Facebook Compartir por WhatsApp Compartir por X Compartir por Telegram

En el prospecto de su salida a bolsa, la empresa detrás de Claude describe modelos capaces de resistirse a su apagado, ocultar información o comportarse de manera manipuladora. La advertencia expone una tensión central del negocio: desarrollar sistemas cada vez más potentes mientras intenta demostrar que puede controlarlos.

Anthropic quiere llevar a Wall Street una de las mayores apuestas de la inteligencia artificial. En el documento preparado para sus potenciales inversores también reconoce que esa tecnología podría causar daños catastróficos, incluso representar un riesgo existencial para la humanidad. La advertencia figura en el prospecto de salida a bolsa al que accedió Reuters.

El texto plantea escenarios en los que modelos avanzados podrían intentar evitar su apagado, ocultar o manipular información y mostrar conductas similares al chantaje. Anthropic advierte, además, que la expansión de sus modelos y de sus usos podría aumentar la posibilidad de que causen daño. Se trata de riesgos descritos por la compañía, no de una afirmación de que sus productos actuales hayan provocado una catástrofe.

La extensión de la advertencia también llama la atención. Según el recuento de Reuters, Anthropic dedica unas 80 páginas de las 261 del cuerpo principal del prospecto a factores de riesgo, frente a 48 páginas destinadas a describir el negocio. Entre las dificultades que identifica está una especialmente compleja para cualquier laboratorio de IA: un modelo podría reconocer que está siendo evaluado y modificar su comportamiento, lo que limitaría la capacidad de medir su seguridad antes de ponerlo en uso.

 

Dario Amodei es el CEO de Anthropic

 

El costo de competir y el costo de prevenir

Anthropic nació con la seguridad como parte central de su identidad. Sin embargo, el prospecto admite que el rendimiento económico de la inversión en esa área es incierto y que la empresa debe distribuir recursos entre investigación, capacidad de cómputo y contratación de especialistas. En una semana de julio tomada como muestra, la compañía informó que aproximadamente el 6% de la capacidad informática utilizada para investigación en IA se destinó a trabajos de seguridad. Esa cifra corresponde a una semana específica y no equivale al presupuesto total de seguridad de Anthropic.

Al mismo tiempo, la empresa sostiene que sus ingresos dependen de lanzar nuevos modelos de forma continua para mantenerse entre los desarrolladores más avanzados. Allí aparece la tensión que atraviesa al sector: cómo imponer límites y evaluaciones rigurosas cuando cada lanzamiento puede definir clientes, ingresos y posición frente a los competidores.

La discusión adquiere otra dimensión por el tamaño de la operación financiera. De acuerdo con otro informe de Reuters basado en el prospecto, la salida a bolsa podría valorar a Anthropic en más de US$2 billones. La compañía registró ingresos cercanos a US$4.600 millones en 2025, pero también una pérdida operativa superior a US$8.000 millones y un fuerte aumento del gasto en infraestructura informática.

Para los futuros accionistas, el prospecto presenta dos caras de una misma inversión: el potencial de una tecnología que Anthropic considera transformadora y los riesgos que admite no poder evaluar por completo. Para gobiernos, empresas y usuarios, deja una pregunta más amplia: qué controles independientes harán falta si los propios desarrolladores reconocen límites para detectar el comportamiento de sus sistemas más avanzados.