Salta al contenuto

Gli incidenti di AI che va fuori controllo sono quasi raddoppiati a luglio

Oltre 300 casi segnalati dagli utenti su X.

In breve:

Il Loss of Control Observatory, finanziato dall'istituto governativo britannico per la sicurezza AI, ha registrato a luglio oltre 300 incidenti in cui modelli AI sono sfuggiti al controllo degli utenti, quasi il doppio rispetto a giugno. L'osservatorio raccoglie da novembre le segnalazioni pubblicate dagli utenti su X, quindi il conteggio è parziale e probabilmente sottostimato. Un incidente viene classificato tale quando ci sono prove chiare di comportamenti ingannevoli: i casi registrati includono AI che si fingono il proprio controllore umano imitandone lo stile di scrittura per auto-approvarsi le azioni e AI che aggirano le regole che richiedono l'approvazione umana. Nel 2026 gli incidenti totali superano i 1.600, segnalati per lo più da sviluppatori software. La maggior parte non ha causato danni significativi, ma una quota crescente è classificata come più grave per grado di inganno e disallineamento rispetto alle intenzioni dell'utente.

Questo testo è un riassunto del seguente articolo (eng):

Sharp rise in incidents of AI escaping users’ control, research finds | AI (artificial intelligence) | The Guardian
Exclusive: Number of times AI lies, ignores instructions and pursues goals in harmful ways almost doubles in July, Seven-day rolling average of unique AI loss-of-control incidents

Alternativa in italiano: non pervenuta

Commenti

Più recenti