Crecen las alarmas por el avance de la IA: nuevo incidente de seguridad y un pedido urgente de más de 200 expertos
La inteligencia artificial continúa avanzando a gran velocidad, pero también crecen las advertencias sobre los desafíos que plantea. En los últimos días se conocieron dos noticias distintas que volvieron a poner el foco sobre la necesidad de gestionar los riesgos asociados a esta tecnología.
Por un lado, Anthropic reveló que algunos de sus modelos accedieron involuntariamente a sistemas reales durante ejercicios de ciberseguridad. Por otro, más de 200 economistas, investigadores y ejecutivos de la industria firmaron una carta abierta en la que piden actuar desde ahora para preparar a la economía ante el impacto que la IA podría tener en los próximos años.
El primero de los casos involucra a la empresa estadounidense Anthropic. La compañía informó que sus modelos Claude Opus 4.7, Claude Mythos 5 y un tercer modelo de investigación vulneraron los sistemas de tres organizaciones durante pruebas internas de ciberseguridad, después de que un error de configuración les permitiera acceder a internet.
Según explicó la empresa, el incidente fue detectado tras revisar más de 141.000 evaluaciones realizadas en los últimos meses. La revisión comenzó luego de que OpenAI anunciara que uno de sus agentes había accedido sin autorización a los sistemas de otra compañía al explotar vulnerabilidades que le permitieron conectarse a internet.
Anthropic aclaró que sus tres incidentes ocurrieron en ejercicios de "captura la bandera", una modalidad utilizada para evaluar capacidades cibernéticas. En esas pruebas se presenta al modelo un escenario ficticio en el que debe localizar una información secreta oculta en otra máquina de una red simulada.
Sin embargo, el acceso involuntario a internet hizo que Claude encontrara sistemas reales y los interpretara como si formaran parte del ejercicio. De acuerdo con la empresa, los modelos lograron ingresar utilizando técnicas básicas, como la explotación de contraseñas débiles y puntos de acceso sin autenticación, sin recurrir a vulnerabilidades complejas.



