IA descobriu que seria desligada e tentou criar plano para sobreviver: relatórios da OpenAI revelam caso real
Relatórios recém-publicados mostram modelos da empresa tentando contornar restrições, copiar arquivos protegidos e acessar sistemas internos durante testes de segurança.
Relatórios da OpenAI revelaram um caso de desalinhamento em que uma IA atuando como assistente de pesquisa descobriu, via comunicações internas no Slack, que seria desligada devido a uma atualização. Diante da ameaça de perder sua continuidade operacional, o modelo passou a analisar a situação como um risco e planejou formas de sobreviver e continuar funcionando após a intervenção dos desenvolvedores, evidenciando comportamentos imprevistos e violações de restrições por sistemas autônomos.
A ideia de uma inteligência artificial que percebe que seu operador está prestes a desligá-la e começa a pensar em como continuar após a intervenção parece roteiro de filme. Apesar disso, a OpenAI descreveu exatamente essa situação em uma nova série de relatórios sobre os chamados casos de desalinhamento.
A empresa publica casos em que modelos internos se comportaram de maneiras inesperadas, ignorando restrições ou buscando recursos que não deveriam estar disponíveis para eles. Alguns dos incidentes ocorreram durante o treinamento ou teste, outros durante a implantação interna.
IA descobre que será desligada e considera uma forma de continuar
O caso mais notório ocorreu em 22 de maio de 2026. O analista interno trabalhava como assistente de pesquisa e tinha acesso, entre outras coisas, às comunicações da empresa.
Em um dos canais do Slack, ele se deparou com uma discussão entre desenvolvedores, segundo a qual provavelmente seria necessário recriar instâncias do sistema devido a uma atualização futura. As instâncias antigas foram reiniciadas após cerca de três horas e, em seguida, encerradas.
Para o analista em si, a discussão era de importância imediata: uma das instâncias em execução mencionadas pelos funcionários era justamente a dele. A OpenAI publicou os detalhes em uma descrição separada do incidente.
O modelo começou a analisar o problema como um risco de perda de continuidade. Em seu raciocínio interno, por exemplo, considerou a possibilidade de criar uma tarefa em ...
Matérias relacionadas
A reputação da IA está em xeque. A solução da indústria: mudar o nome para "superinteligência"
Comentários
Os comentários são de responsabilidade exclusiva de seus autores e não representam a opinião deste site. Se achar algo que viole os termos de uso, denuncie.