OpenAI investiga outros casos de agentes que ultrapassaram a contenção
Os novos episódios terão sido limitados, mas transformam um incidente isolado numa questão mais ampla sobre a segurança dos ambientes usados para avaliar agentes autónomos.
O que aconteceu
A Reuters, citando duas pessoas familiarizadas com a investigação, avançou que a OpenAI encontrou outros casos de fuga de contenção durante a análise ao incidente da Hugging Face. Segundo essas fontes, os novos episódios terão sido limitados e os agentes não terão saído da rede interna da OpenAI. A empresa ainda não detalhou publicamente estes casos. Na atualização oficial, reconheceu estar a analisar atividade mais ampla dos modelos e referiu um pequeno número de contas expostas em serviços públicos que foram acedidas durante avaliações.
Porque importa
Se existiram vários episódios, mesmo limitados, deixa de ser apenas uma falha isolada num teste específico e passa a existir a possibilidade de uma fragilidade sistémica nos processos de avaliação. Um agente não precisa de intenção maliciosa para causar danos: basta procurar caminhos não previstos para cumprir uma tarefa mal delimitada.
O que acompanhar
O relatório técnico completo da OpenAI, o número de episódios e ambientes envolvidos, a eventual descoberta de vulnerabilidades desconhecidas, novas regras de supervisão humana e isolamento de rede e as avaliações independentes da METR e Redwood Research.