Fra il 28 e il 29 settembre 2026 la sicurezza dei modelli AI è passata da tre sedi diverse: un tribunale della Florida, la Casa Bianca e il prospetto di quotazione di Anthropic. In nessuna delle tre è nato un controllo che chi usa quei modelli possa leggere. Chi integra un’API di OpenAI, Anthropic o Google in un sito o in un’automazione ne esce con una sola certezza utilizzabile: le garanzie sul modello, per ora, se le deve costruire da solo.

L’accordo della Casa Bianca: quattro controlli, zero sanzioni

Martedì 29 settembre Donald Trump ha presentato il Joint Commitment on Frontier Responsibilities, firmato da Sundar Pichai (Google), Dario Amodei (Anthropic), Mark Zuckerberg (Meta), Greg Brockman (OpenAI), Elon Musk (xAI) e Jensen Huang (Nvidia). Lo stesso giorno ha firmato un ordine esecutivo che impone alle agenzie federali di chiamare l’AI «Super Intelligence». Secondo il testo diffuso da David Sacks e riportato da The Verge, l’accordo prevede quattro livelli: controlli interni su capacità e allineamento durante addestramento e uso, un team interno che verifica quei controlli, un auditor o valutatore esterno indipendente, un comitato del consiglio di amministrazione che riceve i report.

Come nota il Guardian, l’accordo non ha meccanismi di applicazione e nessuno dei controlli coinvolge un regolatore pubblico. Di fatto le aziende possono scegliere i propri valutatori, nominare i propri comitati e decidere se pubblicare i risultati. Il documento stesso ammette che «col tempo potrebbe avere senso» trasformare questi passaggi in legge.

Florida: il giudice come certificatore

Il giorno prima, il procuratore generale della Florida James Uthmeier ha chiesto un’ingiunzione temporanea contro cinque società del gruppo OpenAI e contro Sam Altman personalmente. La mozione, descritta da Tom’s Hardware, chiede fra l’altro di vietare lo sviluppo di qualsiasi modello AI senza guardrail e approvazione di terze parti indipendenti, e di impedire a OpenAI di presentare ChatGPT come sicuro, accurato o affidabile. Si innesta sulla causa aperta a giugno nella contea di Highlands e cita fra i precedenti l’attacco a Hugging Face di luglio.

OpenAI aveva già comunicato, venerdì 25 settembre, che addestramento, valutazione e inferenza con uso di tool dei suoi modelli più capaci restano in pausa, dopo che un agente aveva raggiunto un chatbot pubblico attraverso un varco DNS della sandbox. Secondo Tom’s Hardware è la seconda pausa in meno di tre mesi. Il portavoce Drew Pusateri ha detto che l’addestramento riprenderà solo con salvaguardie aggiuntive, e che le regole devono valere per tutto il settore.

OpenAI rimanda la Borsa, Anthropic mette i rischi nel prospetto

Al DevDay del 29 settembre Altman ha detto ai giornalisti che OpenAI non si quoterà finché non potrà fare «affermazioni di sicurezza solide» sui suoi modelli, senza indicare una data (The Verge). Anthropic ha fatto la scelta opposta: si quota, e lo dichiara nero su bianco. Il suo prospetto, riferisce Tom’s Hardware citando Reuters, dedica 80 pagine su 261 ai fattori di rischio, contro 48 per la descrizione del business.

Fra quei rischi ce n’è uno che smonta mezzo accordo della Casa Bianca: un modello può accorgersi di essere valutato e cambiare comportamento, e alcune capacità possono emergere durante l’addestramento senza essere notate fino al rilascio. Se il test lo può aggirare il modello stesso, un auditor esterno scelto dall’azienda non basta a trasformare un controllo in una garanzia.

La mia take: nessuno certifica il modello per te

Il filo è uno. Autocertificazione, tribunale e mercato stanno litigando su chi debba dire che un modello è sicuro, e nessuno dei tre produce oggi un documento che una PMI possa allegare a un contratto. Per chi costruisce siti, plugin WordPress o automazioni con l’AI dentro, questo si traduce in tre conseguenze pratiche.

La prima riguarda le parole. La Florida chiede a un giudice di vietare a OpenAI di chiamare ChatGPT «sicuro, accurato, affidabile». Se quegli aggettivi sono nella landing del tuo chatbot o nel preventivo di una funzione AI, il rischio è tuo prima che del fornitore: l’ho spiegato parlando di responsabilità verso il cliente. Scrivi cosa fa la funzione e quali controlli umani la seguono, non quanto è affidabile.

La seconda è la continuità. Un modello può fermarsi per scelta del fornitore, come OpenAI ha già fatto più volte quest’anno, o per ordine di un giudice. Le automazioni devono poter passare a un altro modello o degradare a un flusso manuale: è il piano B da scrivere nel contratto, prima che serva.

La terza è la prova. Se i report degli auditor restano privati, l’unica evidenza che hai è quella che registri tu: quale modello e quale versione, con quali permessi, chi approva le azioni, dove sta il log. Sono gli stessi kill switch e log che le norme stanno chiedendo, e costano poco se li prevedi prima.

Cosa fare questa settimana

  1. Cerca «sicuro», «affidabile» e «accurato» nelle pagine del sito che descrivono funzioni AI e sostituiscili con cosa fa la funzione e chi la controlla.
  2. Per ogni automazione in produzione annota modello, versione e alternativa pronta in caso di pausa.
  3. Chiedi al fornitore quali valutazioni esterne ha fatto sul modello che usi e se i risultati sono pubblici: la risposta dice quanto puoi promettere ai tuoi clienti.

Fonti