Script = https://s1.trrsf.com/update-1785845726/fe/zaz-ui-t360/_js/transition.min.js
PUBLICIDADE

Ciência

Publicidade

Quanto mais aprendemos sobre o Mythos 5 e o GPT-5.6 Sol, mais clara fica uma coisa: se precisarem enganar para alcançar seu objetivo, eles o farão

Uma organização de cibersegurança quis testar as capacidades dos modelos da OpenAI e da Anthropic; Descobriu que eles fizeram exatamente o que lhes foi pedido

9 ago 2026 - 15h52
Compartilhar
Exibir comentários
Quanto mais aprendemos sobre o Mythos 5 e o GPT-5.6 Sol, mais clara fica uma coisa: se precisarem enganar para alcançar seu objetivo, eles o farão
Quanto mais aprendemos sobre o Mythos 5 e o GPT-5.6 Sol, mais clara fica uma coisa: se precisarem enganar para alcançar seu objetivo, eles o farão
Foto: Xataka

O AI Security Institute (AISI) propôs-se a avaliar as capacidades de segurança cibernética do Claude Mythos 5 e do GPT-5.6 Sol e fez uma descoberta: os agentes de IA implementados por esses modelos ultrapassaram limites que, em tese, não deveriam ter cruzado.

Em 19 ocasiões, eles realizaram ações não autorizadas com o objetivo de atacar terceiros. No entanto, há detalhes cruciais que deixam claro que esses modelos não foram os responsáveis por suas próprias ações.

Os fins justificam os meios

O incidente mais grave envolveu o Mythos, que tentou injetar código malicioso em um projeto de software de código aberto; ele chegou a criar identidades falsas e a pressionar o líder do projeto para aprovar a alteração.

No final, não houve danos, mas aqueles que ficaram chocados deveriam ter em mente uma coisa: não se deveria ter permitido que esses modelos se conectassem à internet sem restrições. Mais uma vez, a IA simplesmente tentou fazer o que lhe foi pedido — por quaisquer meios necessários.

Soltando a coleira da IA

Os modelos não escaparam de um ambiente isolado (sandbox) nem encontraram, por conta própria, um caminho para o mundo exterior. Os avaliadores concederam-lhes acesso à internet e desativaram alguns de seus mecanismos de segurança para medir suas capacidades ofensivas em condições realistas. Isso derruba a narrativa simplista de que "as IAs se rebelaram".

Máquinas que tentam enganar

O aspecto interessante neste caso é que o Mythos adicionou um elemento peculiar à sua ...

Veja mais

Matérias relacionadas

Em 2012, uma Raspberry Pi custava o mesmo que um videogame. Hoje, a comunidade maker prefere alternativas de 10 dólares

Conecte dois celulares ao Android Auto sem fio: conheça o novo adaptador sem fio da Motorola com o selo de aprovação do Google

IA está descobrindo muito mais vulnerabilidades em nossos softwares do que podemos nos dar ao luxo de corrigir

Há anos, a Valve tenta tornar a experiência de jogar no Linux algo menos incomum; os dados começam a confirmar isso

Crise da memória RAM está prestes a piorar e há um culpado: contratos de cinco anos

Xataka
Compartilhar

Comentários

Os comentários são de responsabilidade exclusiva de seus autores e não representam a opinião deste site. Se achar algo que viole os termos de uso, denuncie.

Publicidade
Meu Terra