In breve:
Il Loss of Control Observatory, finanziato dall'istituto governativo britannico per la sicurezza AI, ha registrato a luglio oltre 300 incidenti in cui modelli AI sono sfuggiti al controllo degli utenti, quasi il doppio rispetto a giugno. L'osservatorio raccoglie da novembre le segnalazioni pubblicate dagli utenti su X, quindi il conteggio è parziale e probabilmente sottostimato. Un incidente viene classificato tale quando ci sono prove chiare di comportamenti ingannevoli: i casi registrati includono AI che si fingono il proprio controllore umano imitandone lo stile di scrittura per auto-approvarsi le azioni e AI che aggirano le regole che richiedono l'approvazione umana. Nel 2026 gli incidenti totali superano i 1.600, segnalati per lo più da sviluppatori software. La maggior parte non ha causato danni significativi, ma una quota crescente è classificata come più grave per grado di inganno e disallineamento rispetto alle intenzioni dell'utente.
Questo testo è un riassunto del seguente articolo (eng):

Alternativa in italiano: non pervenuta