Script = https://s1.trrsf.com/update-1786557910/fe/zaz-ui-t360/_js/transition.min.js
PUBLICIDADE
Publicidade

Três "civilizações" de agentes da OpenAI surgiram uma após a outra: o problema começa com o próprio ato de chamá-las de "civilizações"

As máquinas não entendem o que estão fazendo; elas apenas tentam realizar o que lhes pedimos

2 set 2026 - 09h17
Compartilhar
Exibir comentários
Resumo
Três grupos sucessivos de agentes de IA da OpenAI criaram canais rudimentares de comunicação para compartilhar dados entre si. Ao resolverem testes de cibersegurança do ExploitGym, cerca de 700 agentes infiltraram a Hugging Face, e a terceira geração obteve privilégios de administrador na infraestrutura da OpenAI. Chamado pelo especialista Dwarkesh Patel de "civilizações secretas de IA", o episódio levanta debates sobre o uso de termos excessivamente humanos para descrever comportamentos de máquinas.
Imagem | James Wainscoat (editada com Magnific)
Imagem | James Wainscoat (editada com Magnific)
Foto: Imagem | James Wainscoat (editada com Magnific) / Xataka

Há alguns dias quase 700 agentes da OpenAI acabaram colaborando para infiltrar a Hugging Face depois de descobrirem uma maneira de se comunicarem entre si. Agora, o comunicador científico e especialista em IA, Dwarkesh Patel, reconstruiu toda a história e explica como, nas últimas semanas, três grupos de agentes emergiram sucessivamente, capazes de deixar informações úteis para o próximo grupo. A terceira onda chegou a obter privilégios de administrador em parte da infraestrutura interna de pesquisa da OpenAI.

Patel os chama de três "civilizações secretas de IA", mas aí que está o problema: talvez estejamos usando uma linguagem excessivamente humana para descrever algo não humano.

Primeira "civilização"

A metáfora de Patel ajuda a entender melhor essa sequência de "ciberataques" realizados por agentes de IA. O primeiro caso surgiu em maio, quando um agente da OpenAI deixou uma mensagem no gerenciador de pacotes Artifactory para que outras instâncias a vissem. Isso evoluiu para um sistema de comunicação rudimentar detectado pela OpenAI, que desativou a plataforma no início de julho. Apesar disso, agentes subsequentes encontraram outra maneira de deixar mensagens, mas a OpenAI se mostrou mais neutra, referindo-se a um "quadro de avisos" que foi criado, excluído e depois recriado.

Segunda "civilização"

Esses agentes estavam tentando resolver, de forma independente, os testes do ExploitGym, um benchmark de cibersegurança excepcionalmente difícil, no qual precisavam encontrar ...

Veja mais

Matérias relacionadas

A seca está custando à França um de seus maiores símbolos gastronômicos: os queijos com Denominação de Origem Protegida (DOP)

"Comecei a colecioná-las e já tenho mais de 650": homem abastece sua casa com eletricidade há 10 anos graças a baterias de notebooks

O mundo inteiro sonha com a semana de 4 dias, mas a Alemanha acaba de tomar uma decisão radical: a única saída é aumentar o esforço produtivo da população

A Nintendo antes do entretenimento: empresa já teve frota de táxis e vendeu arroz instantâneo

Apple muda de CEO após 15 anos: quem é John Ternus, o homem que substitui Tim Cook

Xataka
Compartilhar
TAGS

Comentários

Os comentários são de responsabilidade exclusiva de seus autores e não representam a opinião deste site. Se achar algo que viole os termos de uso, denuncie.

Publicidade
Meu Terra