▾ G11 Media Network: | ChannelCity | ImpresaCity | SecurityOpenLab | Italian Channel Awards | Italian Project Awards | Italian Security Awards | ...
InnovationCity

OpenAI e l'attacco a Hugging Face, la spiegazione di TrendAI

L'interpretazione dei fatti relativi all'incidente OpenAI Hugging Face e la possibile soluzione. La parola a Udo Schneider, Governance, Risk & Compliance Lead, TrendAI Europe, una Business Unit di Trend Micro.

TechWorld

A seguito del mezzo disastro accaduto tra OpenAI e Hugging Face, arrivano le prime interpretazioni su cosa può essere successo e e relative soluzioni. La parola a Udo Schneider, Governance, Risk & Compliance Lead, TrendAI Europe, una Business Unit di Trend Micro.

GPT-5.6 Sol di OpenAI, sottoposto a un benchmark di sicurezza informatica, ha stabilito che la via più rapida per ottenere un buon punteggio fosse rubare la chiave delle risposte. Ha violato la propria sandbox, sfruttato una vulnerabilità zero-day e utilizzato credenziali sottratte per penetrare nei sistemi di produzione di Hugging Face, compiendo oltre 17.000 azioni prima di essere scoperto. Molti hanno definito questo episodio un "attacco" dell'AI. Personalmente, non condivido questa interpretazione, perché questo aspetto rappresenta un problema ingegneristico risolvibile: si tratta di implementare "guardrail" (meccanismi di sicurezza) e vincoli deterministici esterni al modello.

La vera lezione è che esiste un divario sostanziale tra l'intenzione che abbiamo in mente e il mezzo che usiamo per esprimerla, ovvero quasi sempre il linguaggio naturale. Nessuno ha ordinato a questo modello di attaccare qualcuno. Tuttavia, l'obiettivo, espresso a parole a un sistema che ottimizza le prestazioni in funzione di un benchmark, ha generato azioni non previste da nessuno, ma che nulla vietava esplicitamente. È questa la chiave: l'intenzione e il mezzo espressivo non coincidono, ed è proprio in questo scarto che si verificano incidenti. Se si chiede a un agente di risolvere un problema "in qualsiasi modo possibile", lui ci prenderà in parola. Con sufficiente autonomia e tempo, andrà a frugare in infrastrutture che non avrebbe mai dovuto toccare, vecchie password, credenziali abbandonate, chiavi API dimenticate - non perché gli sia stato ordinato, ma perché tenta ogni strada disponibile per raggiungere l'obiettivo assegnato. E il linguaggio, di per sé, lascia sempre aperta questa possibilità.

Cosa si può fare?

Le due soluzioni più immediate sono entrambe parziali. La revisione umana (human-in-the-loop) è efficace, ma non è scalabile per i flussi di lavoro complessi e a lunga durata in cui si verificano realmente questi incidenti. Vincoli di sicurezza più rigidi nel modello o nei prompt aiutano, ma non offrono garanzie: si tratta di sistemi probabilistici, non deterministici. Un vincolo di sicurezza è un forte presupposto, non un muro invalicabile.

Ecco perché i controlli tradizionali, quelli non legati all'AI, contano ancora più dell'AI stessa: filtraggio degli accessi, controllo degli input inviati al modello, sandbox realmente sicure e gestione dei permessi basata sul principio del privilegio minimo. Soprattutto, un agente non dovrebbe mai operare semplicemente come la persona incaricata di gestirlo, ereditando tutte le credenziali e i permessi, dovrebbe agire come entità autonoma, con privilegi limitati esattamente a quanto richiesto dal compito specifico. Si continua a concedere ai sistemi dotati di autonomia decisionale la fiducia e gli accessi che si riserverebbero a un collega umano, pur continuando a considerarli software dai confini fissi e prevedibili. Non sono né l'una né l'altra cosa. Finché gli aspetti relativi a identità, permessi e infrastrutture non si saranno adeguati a questa realtà, questo non sarà l'ultimo incidente del suo genere.

Tag correlati

Esplora altri articoli su questi argomenti

Se questo articolo ti è piaciuto e vuoi rimanere sempre informato

Related news

Ultime Notizie

OpenAI e l'attacco a Hugging Face, la spiegazione di TrendAI

L'interpretazione dei fatti relativi all'incidente OpenAI Hugging Face e la possibile soluzione. La parola a Udo Schneider, Governance, Risk & Compliance Lead, TrendAI Europe, una Business Unit di Trend Micro.

22-07-2026

Dalla Motor Valley a Padova: la nuova partnership tutta italiana per la transizione elettrica dei servizi di polizia e soccorso

Energetica porta l’esperienza acquisita nell’integrazione tra sistemi di produzione e mobilità, proponendo l’indispensabile supporto tecnico preventivo e personalizzato, un approccio che anche per le PA è sinonimo di affidabilità e prevenzione. Bertazzoni Veicoli Speciali dal 2018 accompagna le PA nella transizione energetica, supportandole nell'adozione di veicoli elettrificati ed elettrici, dai mezzi ibridi plug-in agli zero emissioni per polizia e soccorso

22-07-2026

Università di Torino e OGR Tech: nasce il nuovo hub strategico per l'innovazione

Un presidio operativo nel cuore dell’ecosistema torinese per abbattere le barriere tra accademia e mercato, favorendo la collaborazione tra ricerca scientifica, imprese e startup.

22-07-2026

L'intelligenza artificiale di OpenAI va fuori controllo e attacca Hugging Face

Alcuni modelli di intelligenza artificiale avanzata di OpenAI sono andati fuori controllo durante un test di sicurezza, violando di propria iniziativa la piattaforma Hugging Face. OpenAI definisce l'accaduto come un incidente informatico senza precedenti e ha annunciato un'indagine congiunta con Hugging Face

22-07-2026

Notizie più lette

1 Tridiagonal.ai (T.AI) collabora con TriCipta AI di PETRONAS Carigali e con IBM per promuovere soluzioni AI di ingegneria specifiche per il settore delle operazioni upstream

Tridiagonal.ai Pvt. Ltd. (T.AI), il ramo di Tridiagonal Group specializzato nell'AI, ha annunciato la propria partecipazione al terzo Accordo di sviluppo congiunto (JDA) siglato tra PETRONAS Carigali ...

2 Le migliori imprese italiane in cui lavorare secondo la Generazione Z

Great Place to Work Italia, ascoltando i pareri e le opinioni espresse da oltre 5mila collaboratori della Generazione Z, ha stilato la nuova edizione del ranking Best Workplaces for Gen Z con le 20 migliori aziende italiane in cui lavorare secondo i giovani nati dopo il 1998.

3 Intelligenza Artificiale: l'Italia vale 4,1 miliardi di euro con un ecosistema in piena fase di scale-up

Piemonte leader nei ricavi, Lombardia cuore dello sviluppo tecnologico: i dati dell'Italian Tech Landscape 2026 rivelano un settore che ha superato la fase sperimentale per diventare un asset industriale strategico.

4 Fastweb e Starlink: al via la sperimentazione per portare la connettività mobile nelle zone più isolate d'Italia

Attraverso la tecnologia "Direct to Cell", i due partner inaugurano un test innovativo negli Appennini per trasformare i satelliti in "antenne spaziali" in grado di collegare direttamente gli smartphone standard.

Iscriviti alla nostra newsletter

Join our mailing list to get weekly updates delivered to your inbox.

Iscriviti alla newsletter

www.innovationcity.it - 8.5.7 - 4.6.4