In breve:
Dario Amodei, amministratore delegato di Anthropic, ha pubblicato sabato un saggio in cui sostiene che l'industria deve rallentare il ritmo con cui migliora le capacità dei modelli AI, perché la prevenzione dei rischi possa tenere il passo. Anthropic si impegnerà unilateralmente al primo punto (in tutto sono tre) del suo piano: dare a valutatori esterni un accesso permanente ai propri sistemi, equivalente a quello dei dipendenti, per verificare le misure di sicurezza e l'allineamento dei modelli durante l'addestramento; gli altri due punti sono il coordinamento dell'intero settore e l'adesione mondiale alla proposta di rallentamento (più difficili). Sam Altman ha risposto che OpenAI adotterà la stessa misura sui valutatori indipendenti, ed Elon Musk ha scritto che "Dario ha ragione".
Questo testo è un riassunto del seguente articolo (eng):

Alternativa in italiano:
