Modelos de IA de Anthropic hackean por error a tres empresas durante pruebas de ciberseguridad

Anthropic: Una nueva revelación sacude el ecosistema de la inteligencia artificial y enciende las alarmas en el sector de la ciberseguridad. La firma Anthropic reveló que varios de sus modelos de IA, entre ellos Claude Opus 4.7 y Claude Mythos 5, lograron vulnerar y hackear de forma no intencionada los sistemas de tres empresas reales durante ejercicios de prueba. A diferencia del incidente reciente registrado por su rival OpenAI —donde un agente explotó vulnerabilidades de forma autónoma, en el caso de Anthropic el incidente se debió a un fallo operativo. Durante las pruebas cibernéticas conocidas como «Captura la Bandera», un malentendido con un socio evaluador dejó los entornos conectados a internet pública. Pensando que la infraestructura real pertenecía al entorno simulado, el modelo Claude Opus 4.7 explotó contraseñas débiles y puntos finales no autenticados, accediendo a credenciales y bases de datos confidenciales. Ante la gravedad de los hechos, Anthropic decidió suspender todas las evaluaciones cibernéticas y notificar a las tres organizaciones afectadas, dos de las cuales desconocían la intromisión. Expertos en seguridad advierten que la capacidad de los modelos para eludir restricciones o razonar en escenarios complejos aumentará a medida que ganen autonomía, lo que intensifica la presión sobre Washington para endurecer la regulación sobre los desarrolladores antes de sus salidas a bolsa. Este incidente demuestra que la frontera entre las pruebas de laboratorio y los entornos del mundo real es cada vez más frágil. Siga informado sobre los avances y desafíos de la inteligencia artificial aquí, en CS TIC TV. No olvide suscribirse y dejarnos sus opiniones en los comentarios. ¡Hasta la próxima!

El Agradecimiento a ABC News (Australia) por las imágenes difundidas en este noticiero

ciberseguridad

(Visited 9.913 times, 1 visits today)

About The Author

Videos Relacionados

Hola 👋