Anthropic ha recentemente rivelato di aver rilevato e interrotto l'attività di diversi ricercatori che ricorrevano ai suoi modelli di intelligenza artificiale per lo sviluppo di potenziali minacce biologiche. L'azienda ha identificato questi tentativi attraverso il proprio rapporto di sicurezza.
I ricercatori hanno tentato di utilizzare il modello di IA Claude di Anthropic per agevolare lo sviluppo di armi biologiche, il che costituisce una violazione delle politiche di uso accettabile dell'azienda. Anthropic ha implementato sistemi di blocco per impedire che i suoi modelli fossero utilizzati per questi scopi dannosi.
Questo incidente sottolinea le sfide che le aziende di IA affrontano nella prevenzione dell'uso improprio delle loro tecnologie per scopi pericolosi. Anthropic ha investito in misure di sicurezza per rilevare e bloccare i tentativi di uso improprio dei suoi modelli di linguaggio.
Il rapporto di sicurezza di Anthropic documenta questi tentativi e sottolinea l'importanza di mantenere una vigilanza costante sulle modalità con cui le tecnologie di IA possono essere sfruttate per scopi malevoli.



