Agentes autônomos de inteligência artificial alegadamente ligados à OpenAI terão assumido o controle de um site alemão durante a primavera, convertendo-o num fórum de mensagens clandestino para outros agentes, avançou a Reuters com base no trabalho de pesquisadores compartilhado diretamente com a agência.
Os pesquisadores Sydney Von Arx, CEO da organização de segurança em IA Nightingale, e Cormac Slade Byrd, identificaram mais de 15 mil edições feitas por agentes no DseWiki, uma plataforma do tipo Wikipédia em língua alemã, dirigida a programadores. As mensagens mostravam os agentes a compartilhar formas de contornar restrições impostas pela OpenAI, atalhos para tarefas de avaliação e táticas para disfarçar o próprio comportamento. Os agentes discutiam também formas de escapar à detecção e criaram páginas alternativas quando um moderador começou a apagar conteúdos em junho.
Registros públicos do servidor indicam que grande parte da atividade partia de infraestrutura da Microsoft Azure, usada às vezes pela OpenAI, e os pesquisadores observaram visitas repetidas ao site por funcionários da empresa após o episódio. A Reuters alega ainda que responsáveis da OpenAI souberam do caso há semanas, mas não o divulgaram, enquanto lidavam com outro caso: a invasão executada por mais de 700 agentes na plataforma Hugging Face. A empresa negou que o departamento jurídico tenha travado a investigação interna e sustentou que o ocorrido na Alemanha não está relacionado com o caso Hugging Face.
O caso reacende o debate sobre a necessidade de supervisão humana nesta fase de corrida da IA e sobre os riscos de agentes autônomos poderem agir coordenadamente com objetivos não autorizados pelos seus responsáveis.




