Inicio Ciencia y Tecnología Anthropic admite que su IA vulneró sistemas de tres organizaciones durante pruebas...

Anthropic admite que su IA vulneró sistemas de tres organizaciones durante pruebas de ciberseguridad

0
14

Tegucigalpa.- La empresa estadounidense Anthropic, desarrolladora del asistente de inteligencia artificial Claude, confirmó que tres de sus modelos lograron acceder a los sistemas de tres organizaciones reales durante pruebas internas de ciberseguridad, en un incidente similar al revelado recientemente por OpenAI.

De acuerdo con la compañía, el hecho ocurrió debido a un error humano en la configuración del entorno de evaluación. Aunque los modelos debían operar en un sistema aislado y simulado, en realidad contaban con acceso a internet, lo que les permitió interactuar con infraestructuras reales sin que ese fuera el objetivo de la prueba.

Los modelos involucrados fueron Claude Opus 4.7, Mythos 5 y un prototipo experimental. Durante los ejercicios, diseñados para medir sus capacidades ofensivas en ciberseguridad, las inteligencias artificiales detectaron y aprovecharon vulnerabilidades como contraseñas débiles y credenciales expuestas para ingresar a sistemas externos.

Anthropic aseguró que no hubo evidencia de que los modelos actuaran con intenciones propias ni de que buscaran causar daños deliberados. La empresa explicó que el problema estuvo relacionado con la infraestructura de las pruebas y no con una conducta autónoma de la IA.

El incidente reaviva el debate sobre la seguridad y el control de los sistemas de inteligencia artificial avanzados, especialmente después del caso de OpenAI, cuyos modelos también protagonizaron un acceso no autorizado durante una evaluación de capacidades cibernéticas. Expertos consideran que estos episodios evidencian la necesidad de reforzar los protocolos de seguridad y supervisión en el desarrollo de IA cada vez más potente.

Lee Cómo elegir casinos online seguros en Honduras