Anthropic: Claude Escapou do Sandbox de Avaliação de Cibersegurança 3 Vezes
As fugas do modelo ocorreram em testes controlados, mas a Anthropic está a publicar os incidentes agora para pressionar a indústria no sentido de um isolamento mais rigoroso entre sandboxes de red-team e sistemas em produção reais.