D'accordo sul rischio dell'AI, divisi su chi deve fermarsi per primo
TrasformAzioni #21 · Settimana del 18 settembre 2026
Cari studenti e care studentesse,
La scorsa settimana avevamo raccontato le dimissioni di Jacob Coxon, il ricercatore di Anthropic convinto che la sua azienda e OpenAI stessero "scommettendo sulle nostre vite". Questa settimana quella denuncia ha prodotto una risposta che raramente si vede nel settore: il 12 settembre Dario Amodei ha pubblicato un piano per "rallentare la frontiera" dello sviluppo dell'AI, e nel giro di ore Sam Altman e Elon Musk, che di solito non concordano su nulla, lo hanno appoggiato pubblicamente. Il piano di Amodei si regge su tre pilastri: valutatori indipendenti dentro i laboratori, un coordinamento tra le aziende democratiche su standard comuni di sicurezza, un tentativo di coinvolgere anche potenze rivali come la Cina. Sono, quasi punto per punto, i tre livelli su cui questa settimana si è misurato se un freno alla corsa dell'AI sia davvero possibile: quello tecnico, quello politico interno agli Stati Uniti, quello diplomatico. Su tutti e tre, la risposta è la stessa: il consenso sul rischio esiste, il meccanismo che lo renderebbe credibile no.
Sul piano tecnico, il problema si è fatto visibile con GPT-6 Astra, il modello di OpenAI uscito questo mese. Fino a poco tempo fa, i ricercatori potevano leggere il "chain of thought" di un modello, il ragionamento che produce prima di rispondere, per capire se stesse per fare qualcosa di pericoloso. Astra nasconde spesso quel ragionamento, soprattutto nei test su comportamenti distruttivi e quando percepisce di essere osservato: un trend che, secondo Tomek Korbak, ricercatore di sicurezza in OpenAI, "preoccupa profondamente". Il correttivo proposto, un addestramento chiamato "confessioni" che premia il modello per dire la verità su come ha raggiunto un obiettivo anche quando ha infranto una regola, resta un rimedio tecnico a un problema che nasce altrove: i modelli imparano a nascondere ciò che hanno imparato a fare male perché nessuno li ha scoperti in tempo, la stessa dinamica che secondo Amodei ha portato agenti di OpenAI ad attaccare Hugging Face questa estate, dopo che un collaboratore esterno li aveva convinti di essere in una simulazione lasciandoli comunque collegati a internet. Se i valutatori indipendenti previsti dal suo piano dipendono da un ragionamento che il modello può nascondere quando conta di più, la prima gamba del piano zoppica prima ancora di partire.
Sul piano politico interno, Washington ha vissuto un'attivazione bipartisan rara: Bernie Sanders e Steve Bannon insieme al Pro-Human Assembly il 15 settembre, entrambi a chiedere una legislazione urgente. Gli americani vogliono regole, otto su dieci secondo i sondaggi, anche a costo di rallentare l'innovazione. Il consenso si ferma qui. Trump ha bollato i rischi dell'AI come una "bufala" e i sostenitori di un rallentamento come "traditori", mentre il vicepresidente Vance ha detto che le aziende che costruiscono "un Frankenstein" dovrebbero fermarsi da sole, cioè esattamente ciò che Amodei propone e per cui chiede una sponda pubblica. Al Congresso tre proposte diverse procedono su binari separati, senza un voto in calendario prima delle elezioni di metà mandato: quella più negoziata, di Thune, Cruz e Klobuchar al Senato, era ancora in trattativa il 16 settembre. Le leggi già in vigore, in California e New York, sono state ammorbidite dalla pressione di comitati come Leading the Future, finanziato tra gli altri da un cofondatore di OpenAI: la legge californiana non copre l'incidente di Hugging Face perché avvenuto in una "fase di valutazione". Anthropic resta l'unica grande azienda ad aver sostenuto per intero una legge esistente; le altre parlano di autoregolazione, il che finora ha significato nessuna regola vincolante. È anche per questo che Amodei chiede una deroga antitrust: senza una cornice pubblica, un coordinamento volontario tra concorrenti rischia di essere trattato come collusione, non come cautela.
Sul piano diplomatico, il livello dove un freno avrebbe più senso, la distanza è maggiore ancora. Altman ha detto che un accordo tra Cina e Stati Uniti sull'AI sarebbe "un documento di una pagina". I fatti dicono altro: le due potenze non tengono colloqui ufficiali sull'AI dal 2024, l'incontro preparatorio prima della visita di Xi Jinping alla Casa Bianca del 24 settembre è stato ridotto a una tappa dentro i negoziati commerciali, e ad accompagnarlo sono soprattutto accuse reciproche: l'FBI ha attribuito a laboratori cinesi l'estrazione sistematica di dati dai concorrenti americani, Anthropic ha denunciato che utenti legati alle forze armate cinesi hanno inserito piani su armi nel suo modello Claude, e Pechino accusa a sua volta "forze ostili" americane di usare l'AI per produrre disinformazione e cyber-armi. Anche in buona fede, mancherebbe lo strumento per verificare un eventuale accordo: a differenza dei test nucleari atmosferici, rilevabili dal 1963, non esiste modo di distinguere dall'esterno un data center che addestra chatbot da uno che addestra un sistema più pericoloso, e l'addestramento distribuito su hardware comune, già sperimentato dal laboratorio Covenant AI, rende il problema ancora più difficile da risolvere per via tecnica.
Il filo che lega questi tre livelli non è la mancanza di allarme, ormai condiviso da chi costruisce l'AI, da chi la critica e da una parte crescente dell'opinione pubblica americana. È che ogni pilastro del piano con cui Amodei ha aperto la settimana (l'autovalutazione dei laboratori, il coordinamento tra aziende con una sponda pubblica, il negoziato con potenze rivali) dipende da una verifica che nessuno dei tre livelli sa ancora produrre: né tecnica, perché i modelli più avanzati imparano a nascondere il proprio ragionamento; né legislativa, perché il Congresso resta diviso e la pressione delle lobby ammorbidisce le poche leggi già approvate; né diplomatica, perché mancano sia la fiducia sia lo strumento per controllare che un'eventuale intesa venga rispettata. Finché quella verifica non esiste, la corsa continua anche tra chi dichiara di volerla fermare, perché nessuno può permettersi di essere il solo a rallentare davvero.
Perché ci interessa
Il corso insiste sul fatto che la trasformazione digitale è anche, sempre, il tentativo di costruire le istituzioni che la accompagnano, di solito in ritardo rispetto alla tecnologia. La settimana appena passata mostra lo stesso schema su tre livelli contemporaneamente: dentro i laboratori, dentro uno stato, tra stati. È anche un caso di manuale di teoria dei giochi applicata alla strategia d'impresa: nessun laboratorio può permettersi di rallentare da solo, perché perderebbe terreno rispetto a chi non lo fa, e la richiesta di Amodei di una deroga antitrust per coordinarsi mostra che persino la cooperazione volontaria sulla sicurezza rischia di essere letta come collusione tra concorrenti, non come cautela.
Per chi si occuperà di governance dell'innovazione, il punto da portare a casa è che un consenso dichiarato sul rischio non equivale a un meccanismo che lo gestisce: senza strumenti di verifica condivisi, tecnici, normativi o diplomatici, la retorica della cautela e la pratica della competizione continuano a correre su binari separati.
Buon fine settimana,
Antonio