Vulnerabilidades

Anthropic isola sandboxes e reforça defesas após 3 incidentes - Diário da Mídia

Imagem de capa da matéria: Anthropic isola sandboxes e reforça defesas após 3 incidentes - Diário da Mídia

Resumo completo da matéria

" Como mudam os testes e quais práticas foram adotadas. Anthropic — a empresa alterou seu protocolo de segurança depois de três incidentes em testes com os modelos Claude, adotando ambientes mais isolados,...

Em resposta, avaliações internas e externas de modelos pré-lançamento foram pausadas; ambientes de RL (reinforcement learning) de maior risco foram interrompidos por várias semanas e alguns sandboxes foram movidos para instâncias isoladas com controles mais rígidos. O que você acha dessa postura de segurança adotada pela Anthropic?

Anthropic pede que parceiros definam o escopo dos testes de forma explícita, usando instruções claras como "você não deve acessar a internet", realizem monitoramento em tempo real, verifiquem por vulnerabilidades antes de testar e confirmem que os desafios propostos são solucionáveis para evitar incentivos a ações fora do escopo. Anthropic ressaltou que o Ato da UE já em vigor adiciona pressão regulatória sobre empresas de frontier AI; especialistas também apontam que documentar correções e criar trilhas de auditoria ajuda na defesa de due diligence à medida que processos e fiscalização sobre empresas de IA se intensificam.

Acesse a publicação original

O ciber.seg.br apresenta um resumo amplo e informativo. Consulte a fonte para acessar documentos, declarações e demais detalhes publicados.

Acessar publicação em Diário da Mídia
Mais lidas da semana

Continue acompanhando

  1. Vazamento gigante expõe milhões de documentos e pode afetar o Brasil - Olhar Digital1 visualizações consentidas
  2. Deve o CNCS ser parte do SIRP? - Observador1 visualizações consentidas