Stati Uniti e Cina hanno iniziato a discutere una nuova forma di diplomazia: comunicare rapidamente gli incidenti più gravi provocati da sistemi di intelligenza artificiale (AI) che possano diventare questioni di sicurezza nazionale. Dopo i colloqui del 20 settembre a New York tra il vicepremier cinese He Lifeng e il segretario al Tesoro americano Scott Bessen, è stata annunciata la nascita di un “US‑China AI dialogue”. Washington ha proposto un meccanismo di notifica per condividere informazioni su incidenti AI, con l’obiettivo di passare da una situazione di opacità a una maggiore trasparenza tra le due maggiori potenze dell’AI.
Il contesto della nuova diplomazia AI
Il semplice concetto di una linea rossa tra Washington e Pechino nasconde una serie di sfide complesse. I due Paesi competono intensamente su AI, chip e supremazia tecnologica, ma al tempo stesso devono evitare che le proprie vulnerabilità vengano sfruttate dall’avversario. La domanda centrale è: cosa può essere comunicato senza aumentare le capacità dell’altro?
Proposta di una hotline testuale
Lucy Luo, ricercatrice del Technology and International Affairs Program della Carnegie Endowment, ha pubblicato il 18 settembre una proposta dettagliata per una “hotline” USA‑Cina. Contrariamente all’idea tradizionale di una linea telefonica, Luo suggerisce un sistema prevalentemente testuale, perché:
- lascia una traccia verificabile;
- riduce i rischi di errori di traduzione;
- consente a tecnici e decisori di consultare internamente le informazioni prima di rispondere.
I canali di crisi sino‑americani precedenti hanno spesso funzionato male proprio quando erano più necessari, il che rende la soluzione testuale ancora più plausibile.
Livelli di notifica e soglie di gravità
Luo prevede due livelli separati di comunicazione:
- Canale ordinario: scambio di informazioni su incidenti minori, procedure operative e pratiche di sicurezza.
- Canale di emergenza: notifiche riservate a situazioni che superano soglie di gravità predefinite e che possono trasformarsi in incidenti di sicurezza nazionale.
Prima che si verifichi una crisi, Washington e Pechino dovrebbero concordare quali eventi attivano la notifica e quali criteri di gravità determinano il passaggio al canale di emergenza.
Ruolo del personale tecnico
Un elemento cruciale è la presenza di personale tecnico permanente dietro la linea. Un incidente generato da un agente AI che penetra una rete informatica non può essere interpretato solo da diplomatici. Luo propone una rete di esperti interdisciplinari, in grado di scambiare evidenze digitali, inclusi, quando necessario, i log delle attività dei modelli.
Il problema dell’attribuzione
L’attribuzione è al centro del dibattito. Se un agente AI americano entra in un sistema cinese, Pechino deve capire rapidamente se si tratta di un’operazione governativa, di un attacco criminale, di un sistema compromesso o di un comportamento inatteso del modello. Lo stesso vale in direzione opposta: la capacità di distinguere le cause è essenziale per una risposta proporzionata.
Scambio di informazioni sugli attacchi
Kyle Chan, fellow del John L. Thornton China Center della Brookings Institution, va oltre la semplice comunicazione di emergenza. Propone che Stati Uniti e Cina condividano, entro limiti prestabiliti, dati sugli usi malevoli già tentati contro i rispettivi sistemi, tra cui:
- categorie di prompt utilizzati negli attacchi;
- tipi di output prodotti dai modelli;
- schemi di comportamento osservati;
- obiettivi sospetti e categorie di aggressori.
Una raccolta comune di questi elementi consentirebbe di identificare tecniche ricorrenti e di costruire difese prima che lo stesso attacco venga replicato altrove.
Linee guida non vincolanti e “safety arbitrage”
Chan suggerisce inoltre di adottare linee guida non vincolanti sui modelli di frontiera, includendo:
- definizioni condivise degli usi ad alto rischio;
- livelli minimi di protezione contro l’assistenza avanzata in campo cyber, chimico e biologico.
Regole divergenti possono creare “safety arbitrage”, ossia la possibilità per un attore malevolo di scegliere il modello (americano o cinese) con le protezioni più deboli.
AI safety in parallel
Matt Sheehan, responsabile di parte del lavoro della Carnegie Endowment sull’ecosistema cinese dell’AI, definisce questo approccio “AI safety in parallel”. Riconosce che è improbabile che Washington e Pechino accettino a breve un trattato di controllo degli armamenti, ma suggerisce di migliorare separatamente i propri sistemi di sicurezza mantenendo canali di comunicazione per capire le azioni dell’altra parte. Tra gli scambi più utili, secondo Sheehan, vi sono:
- metodi per scoprire nuove capacità pericolose (es. progettazione di patogeni, elusione del controllo umano);
- tecniche di test, sistemi di rilevazione e strategie di mitigazione.
Per evitare di rivelare dettagli che possano facilitare lo sviluppo di capacità pericolose, Sheehan propone di condividere soprattutto tecniche che aumentano la sicurezza ma offrono benefici limitati alle capacità del modello.
Metrologia comune e benchmark
Benjamin Jensen e Yasir Atalan, ricercatori del Futures Lab del Center for Strategic and International Studies, sostengono che i benchmark debbano diventare un elemento della diplomazia sull’AI. Nel settembre 2026 hanno chiesto maggiori investimenti in valutazioni indipendenti e standard comuni, in particolare per applicazioni ad alto rischio come:
- sicurezza nazionale;
- cyber‑attacchi su larga scala;
- bioterrorismo.
Un semplice aggettivo come “più potente” non basta a descrivere la pericolosità di un modello. È necessario conoscere:
- cosa il modello è capace di fare;
- con quale affidabilità;
- quanta autonomia possiede;
- quali protezioni riesce ad aggirare
