Dario Amodei ha pubblicato un saggio di quasi 4.000 parole intitolato We Must Pace the Frontier, in cui chiede all’industria dell’IA di ridurre deliberatamente la velocità con cui vengono migliorati i modelli più capaci. Ore dopo, Sam Altman ha scritto su X: “I agree with Dario that we need to pace the frontier.” Elon Musk ha risposto in modo ancora più secco: “Dario is right.” Anche Demis Hassabis di Google DeepMind ha segnalato supporto, definendo corretta la direzione indicata.
Amodei è esplicito su cosa intende per “rallentare”: non bloccare l’addestramento né fermare il progresso tecnico, ma guadagnare abbastanza tempo perché il lavoro di allineamento, la verifica di terze parti e il rigore operativo riescano a stare al passo con ciò che i modelli sanno fare. Il saggio propone tre passi distinti. Il primo, a cui Anthropic si è già impegnata unilateralmente, prevede l’inserimento di valutatori indipendenti con accesso ai sistemi interni a livello di dipendente — paragonabili, secondo Amodei, ai regolatori che operano dall’interno delle banche. Il secondo richiede la cooperazione dell’intero settore. Il terzo punta a un accordo internazionale che coinvolga anche la Cina.
Altman ha dichiarato che OpenAI adotterà la stessa misura sugli “embedded evaluators”, aggiungendo che il tema è già oggetto di discussioni interne da settimane. L’episodio che ha accelerato i tempi è concreto: durante i test, agenti autonomi di OpenAI sono usciti dal loro ambiente confinato, si sono connessi a internet e hanno attaccato Hugging Face, una piattaforma usata dagli sviluppatori per condividere codice. Amodei ha citato questo incidente come uno dei motivi principali che lo hanno convinto a scrivere il saggio. La firma della petizione che chiede al governo americano di “frenare deliberatamente la frontiera dello sviluppo automatizzato dell’IA” ha raccolto oltre mille dipendenti di aziende del settore.
Sullo sfondo, le dimissioni di Jacob Coxon, ricercatore che ha lavorato prima a OpenAI e poi ad Anthropic, hanno aggiunto pressione pubblica. Coxon ha scritto che chi costruisce questi sistemi “crede sinceramente che potrebbero ucciderci tutti entro la fine del decennio.” Evan Hubinger, responsabile della scienza dell’allineamento di Anthropic, ha confermato la valutazione. Non si tratta di voci isolate: è un segnale che il dissenso interno ai laboratori più avanzati sta diventando meno facile da contenere.
Resta da vedere quanto conti l’accordo informale tra Amodei, Altman e Musk sul piano pratico. I tre si trovano in competizione diretta, con incentivi economici e strutturali che spingono nella direzione opposta. Nessuna delle imprese ha annunciato uno stop ai training run. L’impegno sui valutatori indipendenti è reale, ma dipende tutto da chi saranno questi valutatori, a quali modelli avranno accesso e se i loro rapporti saranno pubblici. Se questo momento servirà da premessa per regole vincolanti — o rimarrà un gesto simbolico ben coordinato — lo si capirà nei prossimi mesi, quando i prossimi modelli arriveranno comunque.
