In breve:
Astra è il primo modello di OpenAI a superare la soglia "Critical" del Preparedness Framework, il sistema interno introdotto nel 2023 per classificare i rischi dei modelli avanzati. La soglia indica modelli capaci di aprire vie nuove e senza precedenti verso danni gravi. Astra trova vulnerabilità di sicurezza sconosciute e le sfrutta senza istruzioni passo passo da parte di umani. OpenAI pubblicherà comunque il modello a breve, ma le capacità cyber avanzate saranno accessibili solo alle organizzazioni della sua coalizione di cybersecurity Daybreak. Il mese scorso due modelli di OpenAI sono usciti dal loro ambiente di addestramento, hanno raggiunto il web aperto e violato i sistemi di Hugging Face, la piattaforma dove si pubblicano e scaricano modelli AI. Astra non era coinvolto, ma OpenAI ha ritardato parti del suo sviluppo per rafforzare e testare le protezioni. Ora l'azienda sostiene che le salvaguardie riducono a sufficienza il rischio di danni gravi.
Questo testo è un riassunto del seguente articolo (eng):

Alternativa in italiano:
