Fase Nomination: lascia il tuo voto agli Italian Security Awards 2026
L'interpretazione dei fatti relativi all'incidente OpenAI Hugging Face e la possibile soluzione. La parola a Udo Schneider, Governance, Risk & Compliance Lead, TrendAI Europe, una Business Unit di Trend Micro.
A seguito del mezzo disastro accaduto tra OpenAI e Hugging Face, arrivano le prime interpretazioni su cosa può essere successo e e relative soluzioni. La parola a Udo Schneider, Governance, Risk & Compliance Lead, TrendAI Europe, una Business Unit di Trend Micro.
GPT-5.6 Sol di OpenAI, sottoposto a un benchmark di sicurezza informatica, ha stabilito che la via più rapida per ottenere un buon punteggio fosse rubare la chiave delle risposte. Ha violato la propria sandbox, sfruttato una vulnerabilità zero-day e utilizzato credenziali sottratte per penetrare nei sistemi di produzione di Hugging Face, compiendo oltre 17.000 azioni prima di essere scoperto. Molti hanno definito questo episodio un "attacco" dell'AI. Personalmente, non condivido questa interpretazione, perché questo aspetto rappresenta un problema ingegneristico risolvibile: si tratta di implementare "guardrail" (meccanismi di sicurezza) e vincoli deterministici esterni al modello.
La vera lezione è che esiste un divario sostanziale tra l'intenzione che abbiamo in mente e il mezzo che usiamo per esprimerla, ovvero quasi sempre il linguaggio naturale. Nessuno ha ordinato a questo modello di attaccare qualcuno. Tuttavia, l'obiettivo, espresso a parole a un sistema che ottimizza le prestazioni in funzione di un benchmark, ha generato azioni non previste da nessuno, ma che nulla vietava esplicitamente. È questa la chiave: l'intenzione e il mezzo espressivo non coincidono, ed è proprio in questo scarto che si verificano incidenti. Se si chiede a un agente di risolvere un problema "in qualsiasi modo possibile", lui ci prenderà in parola. Con sufficiente autonomia e tempo, andrà a frugare in infrastrutture che non avrebbe mai dovuto toccare, vecchie password, credenziali abbandonate, chiavi API dimenticate - non perché gli sia stato ordinato, ma perché tenta ogni strada disponibile per raggiungere l'obiettivo assegnato. E il linguaggio, di per sé, lascia sempre aperta questa possibilità.
Cosa si può fare?
Le due soluzioni più immediate sono entrambe parziali. La revisione umana (human-in-the-loop) è efficace, ma non è scalabile per i flussi di lavoro complessi e a lunga durata in cui si verificano realmente questi incidenti. Vincoli di sicurezza più rigidi nel modello o nei prompt aiutano, ma non offrono garanzie: si tratta di sistemi probabilistici, non deterministici. Un vincolo di sicurezza è un forte presupposto, non un muro invalicabile.
Ecco perché i controlli tradizionali, quelli non legati all'AI, contano ancora più dell'AI stessa: filtraggio degli accessi, controllo degli input inviati al modello, sandbox realmente sicure e gestione dei permessi basata sul principio del privilegio minimo. Soprattutto, un agente non dovrebbe mai operare semplicemente come la persona incaricata di gestirlo, ereditando tutte le credenziali e i permessi, dovrebbe agire come entità autonoma, con privilegi limitati esattamente a quanto richiesto dal compito specifico. Si continua a concedere ai sistemi dotati di autonomia decisionale la fiducia e gli accessi che si riserverebbero a un collega umano, pur continuando a considerarli software dai confini fissi e prevedibili. Non sono né l'una né l'altra cosa. Finché gli aspetti relativi a identità, permessi e infrastrutture non si saranno adeguati a questa realtà, questo non sarà l'ultimo incidente del suo genere.
Esplora altri articoli su questi argomenti
Se questo articolo ti è piaciuto e vuoi rimanere sempre informato
La società ha annunciato a Berlino nuove soluzioni per semplificare gli agenti intelligenti, velocizzare l'inferenza e distribuire la potenza di calcolo tra i dispositivi di casa grazie alla tecnologia NVIDIA PAIR.
04-09-2026
Disponibili da questa settimana per gli abbonati ai piani avanzati, le nuove modalità Live permettono di gestire email, documenti e note interamente tramite conversazione vocale senza la necessità di digitare.
04-09-2026
L'operazione punta a rafforzare la piattaforma open source e a estendere l'accesso all'intelligenza artificiale per milioni di sviluppatori in tutto il mondo, garantendo la totale apertura multi-cloud e multi-acceleratore.
04-09-2026
La nuova opzione garantisce alle organizzazioni una flessibilità superiore nella scelta del luogo in cui archiviare i contenuti protetti, rispondendo ai rigidi standard di sovranità digitale.
03-09-2026
Al via il percorso formativo internazionale coordinato con la Universitat Politècnica de Catalunya e l'INSA Lyon per formare gli ingegneri del futuro unendo innovazione tecnologica, sfide industriali e benessere.
L'azienda consolida la propria strategia di crescita energetica con il supporto di La Banque Postale e Bpifrance, puntando su un portafoglio diversificato tra Francia, Italia, Spagna e Portogallo.
L'iniziativa prevede oltre 1,6 MW di potenza fotovoltaica e la rimozione di vecchie coperture a consumo di suolo zero, riducendo i costi energetici delle aziende agroindustriali.
Presentata in anteprima a maggio durante il Google I/O, la nuova applicazione sbarca nell'ecosistema Google Workspace offrendo strumenti avanzati di editing visivo, traduzione dei testi e collaborazione nativa in Docs, Slides e Drive.