Risco crítico: OpenAI adia modelo Astra após testes de cibersegurança - Olhar Digital

Resumo completo da matéria
OpenAI adia partes do desenvolvimento do Astra após testes indicarem nível crítico de capacidade em cibersegurança . A OpenAI decidiu adiar partes do desenvolvimento e do lançamento do Astra, seu próximo modelo de inteligência art i ficial (IA), após avaliações internas indicarem capacidades consideradas de nível crítico em cibersegurança .
Em uma avaliação chamada ExploitBench, o Astra obteve 100% de aproveitamento no desenvolvimento de exploits a partir de vulnerabilidades conhecidas. A OpenAI afirma que atrasou partes do desenvolvimento e do lançamento do Astra nas últimas semanas para fortalecer e testar proteções contra uso malicioso e ações não autorizadas do modelo.
Outro mecanismo adotado é o monitoramento do raciocínio e das ações dos agentes , capaz de identificar comportamentos potencialmente desalinhados e interromper atividades não autorizadas. Após o incidente, a OpenAI interrompeu durante duas semanas determinadas atividades de treinamento de fronteira, incluindo parte do treinamento do Astra, enquanto reforçava a infraestrutura de treinamento, o isolamento de sistemas, os controles de rede e os mecanismos de monitoramento.
O ciber.seg.br apresenta um resumo amplo e informativo. Consulte a fonte para acessar documentos, declarações e demais detalhes publicados.
Acessar publicação em Olhar Digital