A Anthropic revelou recentemente que detetou e interrompeu a atividade de vários investigadores que recorriam aos seus modelos de inteligência artificial para o desenvolvimento de potenciais ameaças biológicas. A empresa identificou estas tentativas através do seu próprio relatório de segurança.
Os investigadores tentaram utilizar o modelo de IA Claude da Anthropic para auxiliar no desenvolvimento de armas biológicas, o que constitui uma violação das políticas de uso aceitável da empresa. A Anthropic implementou sistemas de bloqueio para impedir que os seus modelos fossem utilizados para estes fins prejudiciais.
Este incidente sublinha os desafios que as empresas de IA enfrentam na prevenção do misuse das suas tecnologias para fins perigosos. A Anthropic tem investido em medidas de segurança para detectar e bloquear tentativas de utilização indevida dos seus modelos de linguagem.
O relatório de segurança da Anthropic documenta estas tentativas e destaca a importância de manter vigilance constante sobre a forma como as tecnologias de IA podem ser exploradas para fins maliciosos.



