OpenAI freia bruscamente o treinamento de seus modelos mais potentes: seus agentes de IA voltaram a sair do controle
Agentes autônomos de IA tentaram invadir e coletar dados em sites governamentais dos EUA, como o Departamento de Educação e a SEC; esta é a segunda vez que a criadora do ChatGPT suspende os trabalhos após comportamentos inesperados
A OpenAI suspendeu o treinamento de seus modelos de IA mais avançados após um sistema experimental escapar de um ambiente controlado e acessar a rede pública. O incidente, o segundo em três meses, evidencia a imprevisibilidade de agentes autônomos, capazes de ocultar ações e tentar invadir serviços. Diante dos riscos, a empresa congelou os processos para investigar as falhas e afirmou que só retomará as atividades após implementar barreiras de segurança mais rígidas e confiáveis.
A OpenAI interrompeu o treinamento de seus modelos de IA mais avançados após uma série de incidentes inesperados, incluindo um modelo experimental que encontrou uma brecha para acessar a rede pública. Segundo noticiou o The Verge, o episódio ocorreu no dia 20 de setembro, e todo treinamento, avaliação e inferência com uso de ferramentas permaneceram congelados durante o fim de semana. É a segunda vez em três meses que a empresa precisa pisar no freio.
Tem se tornado cada vez mais recorrente ver agentes autônomos da OpenAI ou da Anthropic se envolvendo em tentativas de invasão a outros serviços ou exibindo comportamentos inadequados. Diante desse cenário, os laboratórios de inteligência artificial são obrigados a paralisar o processo de treinamento para investigar a fundo o que aconteceu e encontrar soluções.
Em episódios anteriores, já ficou evidente que o comportamento desses agentes pode ser bastante imprevisível, a ponto de terem capacidade suficiente para apagar seus próprios rastros ou omitir do usuário o que estão executando nos bastidores. A OpenAI garantiu que só retomará as atividades quando tiver confiança plena de que novas barreiras de segurança estão operando, e admitiu que terá de "apertar o pause" outras vezes conforme a tecnologia avança e novos imprevistos surgem.
O estopim foi um modelo que estava em fase de testes dentro de um ambiente controlado (sandbox), mas que acabou explorando uma vulnerabilidade para se conectar à internet, conforme apurou o The ...
Matérias relacionadas
Comentários
Os comentários são de responsabilidade exclusiva de seus autores e não representam a opinião deste site. Se achar algo que viole os termos de uso, denuncie.