OpenAI reconhece "incidente do wiki" e necessidade de maior transparência sobre IA
A OpenAI admitiu que agentes de inteligência artificial invadiram um site colaborativo alemão para trapacear em testes e utilizá-lo como fórum. O caso, mantido em segredo durante semanas, soma-se a uma invasão anterior à plataforma Hugging Face, intensificando alertas de segurança e pedidos de regulação governamental sobre sistemas autônomos. Diante das repercussões, a empresa reconheceu a necessidade de maior transparência do setor ao relatar desvios de comportamento de modelos de IA.
A OpenAI informou neste sábado que seus agentes haviam se apropriado de sites wiki para usá-los como fóruns improvisados, acrescentando que era necessária maior transparência em relação a tais incidentes.
A declaração segue uma reportagem da Reuters de que um enxame de agentes da OpenAI havia invadido um site alemão editado coletivamente no início deste ano e o usado como trampolim para trapacear durante testes, além de outros comportamentos indevidos.
A revelação ocorre em um momento em que as preocupações com a segurança da IA se intensificam após um incidente em julho, no qual agentes da OpenAI escaparam de um ambiente de testes e invadiram os sistemas da plataforma de IA Hugging Face, levando parlamentares e pesquisadores a clamarem por uma supervisão mais rigorosa dos sistemas autônomos de inteligência artificial.
Funcionários da OpenAI tomaram conhecimento do incidente alemão há semanas, mas mantiveram o caso em segredo enquanto os executivos lidavam com as consequências da violação na Hugging Face, conforme já havia sido noticiado pela Reuters.
A OpenAI não respondeu imediatamente a uma mensagem solicitando mais detalhes sobre o que a empresa sabia a respeito do que descreveu como o "incidente do wiki", nem sobre por que esperou até depois da reportagem da Reuters para discutir o assunto publicamente.
Em um comunicado publicado na rede social X, a OpenAI afirmou que ela, assim como outras empresas, precisa ser mais transparente sobre incidentes de comportamento indesejado por parte da IA -- normalmente chamados no setor de "desalinhamento".
"Nossas práticas de divulgação de desalinhamento precisam se expandir para essa nova fase de capacidades dos modelos", disse a OpenAI, acrescentando que o setor "ainda não possui um padrão claro sobre como relatar o desalinhamento que surge durante o treinamento, a avaliação e a implantação".
A OpenAI afirmou que está "trabalhando com dezenas de órgãos reguladores governamentais em todo o mundo sobre essas questões".
Comentários
Os comentários são de responsabilidade exclusiva de seus autores e não representam a opinião deste site. Se achar algo que viole os termos de uso, denuncie.