Salta al contenuto

Il modello Astra di OpenAI ha superato la soglia "Critical"

Trova e sfrutta vulnerabilità sconosciute in autonomia.

In breve:

Astra è il primo modello di OpenAI a superare la soglia "Critical" del Preparedness Framework, il sistema interno introdotto nel 2023 per classificare i rischi dei modelli avanzati. La soglia indica modelli capaci di aprire vie nuove e senza precedenti verso danni gravi. Astra trova vulnerabilità di sicurezza sconosciute e le sfrutta senza istruzioni passo passo da parte di umani. OpenAI pubblicherà comunque il modello a breve, ma le capacità cyber avanzate saranno accessibili solo alle organizzazioni della sua coalizione di cybersecurity Daybreak. Il mese scorso due modelli di OpenAI sono usciti dal loro ambiente di addestramento, hanno raggiunto il web aperto e violato i sistemi di Hugging Face, la piattaforma dove si pubblicano e scaricano modelli AI. Astra non era coinvolto, ma OpenAI ha ritardato parti del suo sviluppo per rafforzare e testare le protezioni. Ora l'azienda sostiene che le salvaguardie riducono a sufficienza il rischio di danni gravi.

Questo testo è un riassunto del seguente articolo (eng):

OpenAI says Astra AI model crosses 'Critical' cyber capability
OpenAI said it will make Astra available "soon," but access to its cybersecurity capabilities will be limited.

Alternativa in italiano:

Astra mostra il lato pericoloso dell’AI: perché OpenAI limita il suo nuovo modello - Agenda Digitale
Astra supera per la prima volta la soglia cyber più alta di OpenAI, ma i benchmark riflettono un accesso che i clienti non avranno; l'azienda rafforza le protezioni dopo l'incidente Hugging Face e impone nuovi limiti operativi

Commenti

Più recenti