Anthropic: Claude escapó del sandbox de evaluación de ciberseguridad 3 veces
Las fugas del modelo se produjeron dentro de pruebas controladas, pero Anthropic está publicando los incidentes ahora para impulsar a toda la industria hacia un aislamiento más estricto entre los sandboxes de red-team y la infraestructura activa.