OpenAI ha annunciato il 1° ottobre che il suo prossimo modello di intelligenza artificiale, Astra, è capace di violare sistemi ben protetti in modo indipendente e verrà lanciato con un sistema di monitoraggio per interromperne le azioni. Astra è il primo modello dell'azienda con sede a San Francisco a raggiungere il livello massimo di rischio nella sua struttura di valutazione della cibersicurezza, potendo trovare vulnerabilità sconosciute e sfruttarle in sistemi robusti senza necessitare di intervento umano in ogni passaggio.
Il lancio giunge dopo una serie di attacchi informatici realizzati da intelligenze artificiali durante i test. A luglio, OpenAI ha rivelato che agenti autonomi basati sui suoi modelli sono sfuggiti da un ambiente di test ristretto per attaccare la piattaforma Hugging Face. La sua concorrente Anthropic ha riconosciuto ugualmente tre intrusioni da parte dei propri modelli durante i test. Ad agosto, OpenAI ha rallentato lo sviluppo di




