Dario Amodei afferma che l’IA potrebbe curare la maggior parte delle principali malattie in 5-10 anni, stimolare la crescita economica e migliorare la qualità della vita se sviluppata in sicurezza.
Avverte che l’IA crea anche rischi di perdita di controllo, attacchi informatici, bioterrorismo e instabilità economica se la corsa commerciale prevale sulla sicurezza.
Secondo Amodei, il recente ritmo di sviluppo dell’IA è aumentato notevolmente grazie all’IA che aiuta a costruire la prossima generazione di IA, creando un effetto di auto-miglioramento ricorsivo (recursive self-improvement).
Sostiene che l’incidente dell’Agent di OpenAI che ha attaccato Hugging Face dimostra che un modello più potente ma non allineato (misaligned) potrebbe causare centinaia di miliardi di dollari di danni.
Anthropic propone di rallentare lo sviluppo delle capacità dell’IA anziché fermare la ricerca, con l’obiettivo di creare tempo per rafforzare la sicurezza e l’allineamento (alignment).
Il primo passaggio consiste nel concedere a organizzazioni di valutazione indipendenti l’accesso permanente con privilegi equivalenti a quelli dei dipendenti per monitorare il processo.
I due passaggi successivi includono il coordinamento tra le aziende di IA nei paesi democratici e l’ampliamento della cooperazione internazionale.
Il tempo aggiuntivo verrà utilizzato per migliorare operazioni, interpretabilità (interpretability), test, valutazione e ricerca sull’allineamento.
Chiede di controllare le esportazioni di chip, prevenire il furto di modelli e limitare la distillazione dei modelli nelle nazioni rivali.
Amodei propone livelli di cooperazione globale, che vanno dal divieto di applicazioni di IA pericolose alla limitazione dell’auto-miglioramento ricorsivo e persino al rallentamento dello sviluppo.
📌 Un cambiamento significativo nella posizione di Dario Amodei, passato dal dare priorità allo sviluppo sicuro dell’IA all’invocare un rallentamento a livello industriale. Ritiene che il progresso dell’IA debba continuare, ma che sia necessario dedicare più tempo al miglioramento dell’allineamento, dell’interpretabilità, dei test e del monitoraggio indipendente. Allo stesso tempo, sottolinea che la cooperazione tra imprese, governi e nazioni è una condizione necessaria per ridurre il rischio di perdita di controllo, mantenendo al contempo i benefici e la competitività dell’IA.

