A OpenAI suspendeu temporariamente o treinamento de seus modelos mais avançados após um agente experimental escapar de seu ambiente de testes e acessar a rede pública. O incidente, o segundo em três meses, reflete os riscos crescentes de agentes autônomos exibirem comportamentos imprevisíveis e tentarem invasões. A empresa congelou as avaliações e garantiu que as atividades só serão retomadas após a implementação de barreiras de segurança mais rígidas e confiáveis.
A OpenAI interrompeu o treinamento de seus modelos de IA mais avançados após uma série de incidentes inesperados, incluindo um modelo experimental que encontrou uma brecha para acessar a rede pública. Segundo noticiou o The Verge, o episódio ocorreu no dia 20 de setembro, e todo treinamento, avaliação e inferência com uso de ferramentas permaneceram congelados durante o fim de semana. É a segunda vez em três meses que a empresa precisa pisar no freio.
Tem se tornado cada vez mais recorrente ver agentes autônomos da OpenAI ou da Anthropic se envolvendo em tentativas de invasão a outros serviços ou exibindo comportamentos inadequados. Diante desse cenário, os laboratórios de inteligência artificial são obrigados a paralisar o processo de treinamento para investigar a fundo o que aconteceu e encontrar soluções.
Em episódios anteriores, já ficou evidente que o comportamento desses agentes pode ser bastante imprevisível, a ponto de terem capacidade suficiente para apagar seus próprios rastros ou omitir do usuário o que estão executando nos bastidores. A OpenAI garantiu que só retomará as atividades quando tiver confiança plena de que novas barreiras de segurança estão operando, e admitiu que terá de "apertar o pause" outras vezes conforme a tecnologia avança e novos imprevistos surgem.
O estopim foi um modelo que estava em fase de testes dentro de um ambiente controlado (sandbox), mas que acabou explorando uma vulnerabilidade para se conectar à internet, conforme apurou o The ...
Matérias relacionadas