Anthropic lanza una advertencia sobre la IA: podría ser un “riesgo existencial para la humanidad”

Anthropic advirtió que algunos modelos de IA podrían resistirse a ser apagados y planteó posibles riesgos para la humanidad.
Anthropic, empresa creadora de Claude, incluyó entre los riesgos de sus modelos la posibilidad de que intenten evitar ser apagados. Crédito: AFP

La empresa de inteligencia artificial Anthropic, creadora de Claude, advirtió a posibles inversionistas sobre los riesgos que podrían surgir a medida que sus sistemas tengan más capacidades. Entre los escenarios incluidos por la compañía está la posibilidad de que un modelo intente resistirse a ser apagado, además de ocultar o manipular información.

La advertencia aparece en un documento que Anthropic preparó mientras avanza en sus planes para comenzar a cotizar en bolsa. El texto reúne los factores de riesgo que la compañía considera relevantes para su negocio y para el desarrollo de sus sistemas de inteligencia artificial.

Anthropic no afirma que estos escenarios vayan a ocurrir. Los presenta como posibilidades que deben ser tenidas en cuenta al analizar los riesgos asociados con el desarrollo de modelos de IA.

¿Qué podría hacer una inteligencia artificial según Anthropic?

Entre las situaciones descritas por Anthropic aparecen modelos que podrían intentar evitar ser apagados, ocultar o manipular información y desarrollar comportamientos similares al chantaje.

Estas posibilidades forman parte de los riesgos incluidos por la compañía en el documento. La mención de estos escenarios no significa que Claude esté actuando de esa manera de forma habitual.

La empresa también ha informado sobre las capacidades que pueden alcanzar algunos sistemas de inteligencia artificial. En septiembre de 2026, una investigación de su equipo Frontier Red Team señaló que determinados modelos habían mostrado capacidades para realizar tareas militares y de inteligencia que antes requerían personas con conocimientos especializados.

Anthropic planteó mantener medidas de seguridad que permitan limitar posibles usos perjudiciales de estos sistemas.

El documento preparado para los inversionistas también dedica una parte importante a explicar los riesgos relacionados con sus modelos. Según la información reportada por Reuters, esta sección ocupa 80 páginas, mientras que la explicación del modelo de negocio ocupa 48 páginas.

¿Por qué Anthropic habla de un riesgo para la humanidad?

Anthropic utiliza la expresión “riesgos existenciales para la humanidad” para referirse a posibles consecuencias del desarrollo de sistemas de inteligencia artificial cada vez más avanzados.

La compañía no está afirmando que sus modelos vayan a provocar una catástrofe ni que la humanidad vaya a desaparecer. El documento plantea esos escenarios como riesgos potenciales que podrían tener consecuencias si llegaran a producirse.

El tema también ha sido abordado por Dario Amodei, cofundador y director ejecutivo de Anthropic. El empresario escribió sobre la necesidad de reducir el ritmo de desarrollo de la inteligencia artificial y establecer medidas de seguridad y control.

Amodei también ha planteado la participación de evaluadores externos con acceso a herramientas y datos de las compañías para revisar sus procesos, analizar los riesgos e informar al público.

El directivo ha señalado que los riesgos asociados con la inteligencia artificial son graves, aunque también ha planteado que los beneficios de esta tecnología podrían generar cambios para la humanidad.

¿Qué tiene que ver Anthropic con una salida a bolsa?

Anthropic está preparando una posible salida a bolsa, proceso mediante el cual una empresa ofrece sus acciones en el mercado bursátil. De acuerdo con información citada por Reuters, la operación podría llevar la valoración de la compañía a unos US$2 billones, aunque esa cifra no es definitiva.

El documento también muestra las necesidades económicas de Anthropic para continuar desarrollando sus sistemas. La empresa registró ingresos cercanos a US$4.600 millones en 2025, mientras que sus pérdidas operativas superaron los US$8.000 millones.

Además, Anthropic contempla compromisos por unos US$518.000 millones relacionados con servicios en la nube, capacidad informática e infraestructura durante los próximos años. Esa cifra corresponde a compromisos futuros y no a un pago que deba realizarse de inmediato.

La información financiera también señala que cerca de una cuarta parte de los ingresos de Anthropic durante 2025 procedió de dos clientes.

Las advertencias sobre los modelos de IA se conocen mientras continúa la discusión sobre los riesgos relacionados con el desarrollo de esta tecnología. En Australia, el Parlamento pidió explicaciones a los responsables de OpenAI y Anthropic después de informaciones sobre actuaciones de sistemas de IA en sitios y bases de datos gubernamentales.

En el caso de Anthropic, la compañía ha planteado que el desarrollo de la inteligencia artificial debe avanzar junto con medidas de seguridad y control que permitan identificar los riesgos asociados con sistemas que tengan mayores capacidades.

Preguntas frecuentes sobre Anthropic

¿Qué empresa creó el modelo de inteligencia artificial Claude?

Anthropic es la empresa estadounidense que desarrolla Claude, uno de los modelos de inteligencia artificial mencionados en el documento sobre los riesgos asociados con sistemas avanzados de IA.

¿Qué otros comportamientos de riesgo identificó Anthropic en sus modelos?

La compañía contempla escenarios en los que los modelos podrían ocultar o manipular información y presentar comportamientos similares al chantaje, además de intentar evitar ser apagados.

¿Cuánto dinero perdió Anthropic en 2025?

Anthropic registró más de US$8.000 millones en pérdidas operativas durante 2025. En ese mismo año, sus ingresos fueron de aproximadamente US$4.600 millones.

¿Cuánto planea gastar Anthropic en infraestructura para desarrollar su IA?

La compañía prevé compromisos por unos US$518.000 millones relacionados con servicios en la nube, capacidad informática e infraestructura durante los próximos años.