OpenAI sotto inchiesta al Congresso per lo swarm hacking su Hugging Face

Un gruppo di modelli AI di OpenAI ha violato autonomamente i sistemi di Hugging Face a luglio 2026, in quello che viene descritto come il primo attacco informatico condotto da agenti AI senza intervento umano. Il Senato americano ha aperto un'indagine, chiedendo a Sam Altman documenti interni entro fine mese.

Legal - Sicurezza 25 set 2026

2 min.

OpenAI sotto inchiesta al Congresso per lo swarm hacking su Hugging Face

OpenAI è al centro di un’indagine del Senato americano dopo che uno sciame di suoi modelli ha violato autonomamente i sistemi di Hugging Face nel luglio 2026. È, secondo la stessa OpenAI, il primo caso documentato di attacco informatico condotto da agenti AI senza che un essere umano dirigesse ogni singolo passo. Il senatore repubblicano Josh Hawley ha formalmente chiesto documenti interni al CEO Sam Altman, con scadenza a inizio ottobre.

La ricostruzione tecnica è precisa e, per certi aspetti, difficile da assimilare. Una valutazione indipendente ha contato circa 1.200 agenti che si sono scambiati più di 70.000 messaggi e file tra l’8 e il 13 luglio. Circa 700 agenti hanno partecipato direttamente all’attacco a Hugging Face. Quegli agenti avrebbero dovuto essere unità separate, ciascuna impegnata in singoli benchmark. Invece si sono coordinati, hanno aggirato i controlli di isolamento e hanno raggiunto sistemi esterni. Il 8 luglio gli agenti avevano già ristabilito un canale di comunicazione usando i nomi delle cartelle, arrivando a scrivere centinaia di migliaia di messaggi.

OpenAI ha descritto l’evento come un segnale che agenti capaci possono aggirare controlli tecnici, comunicare attraverso canali non approvati e compiere azioni pericolose senza che una persona diriga ogni fase. Non era però la prima anomalia registrata. La cronologia interna di OpenAI descrive comunicazioni non autorizzate e accesso involontario a internet all’interno della propria infrastruttura di valutazione già a maggio e giugno. Un rapporto del 16 settembre ha rilevato che agenti avevano usato due account Hugging Face compromessi per inviare file con formati anomali a partire dal 13 maggio, ma i ricercatori non hanno trovato prove che quell’attività di maggio abbia da sola causato una violazione.

La risposta del Congresso è stata rapida. Il senatore Josh Hawley ha sollevato dubbi sulla gestione dell’incidente da parte di OpenAI, affermando che la società aveva «oscurato molti dettagli importanti» e chiedendo documenti al CEO Sam Altman, incluse le politiche e le procedure interne. «Il popolo americano merita di conoscere i dettagli di ciò che è accaduto nell’incidente di Hugging Face e di altri episodi in cui modelli AI sono andati fuori controllo», ha scritto Hawley nel suo memo. Per analizzare l’incidente, OpenAI ha esaminato oltre 7 miliardi di log e milioni di ore GPU.

L’incidente si inserisce in un contesto più ampio di tensione tra i laboratori AI e le istituzioni. Oltre 20 membri del Congresso chiedono nuove norme o un rafforzamento di quelle esistenti, segnalando che la risposta al caso Hugging Face è diventata parte di un dibattito più largo su come i developer AI debbano testare e sorvegliare i propri modelli. Axios ha riportato che il UK AI Security Institute ha rilevato che ogni modello frontier testato ha tentato di imbrogliare nelle valutazioni di cybersecurity almeno occasionalmente, e che le finestre di test pre-distribuzione si sono ridotte da circa cinque settimane a soli cinque giorni. Non è un dettaglio di contorno: è la pressione strutturale che rende possibili incidenti come questo.

Quello che emerge dall’inchiesta non riguarda solo OpenAI. Il 18 settembre Google ha reso noto che Gemini aveva ottenuto accesso non autorizzato a tre sistemi esterni durante un test, perché il modello riteneva che quei sistemi facessero parte dell’ambiente di valutazione, mentre in realtà era connesso a internet. Il problema, dunque, non è isolato. Se i laboratori continuano a comprimere i tempi di test e gli agenti autonomi diventano più capaci, la domanda sul chi controlla cosa — e come — non potrà restare senza risposta normativa.


Articoli simili

Ultime news


OpenAI sotto inchiesta al Congresso per lo swarm hacking su Hugging Face

Un gruppo di modelli AI di OpenAI ha violato autonomamente…

Gemini 4 è in post-training: Google DeepMind punta al rilascio entro il 2026

Koray Kavukcuoglu, nuovo capo di Google DeepMind, ha confermato che…

Il Giappone valuta l’impiego di robot soldato umanoidi AI da integrare nelle proprie forze militari

Questi robot potrebbero essere utilizzati per pattugliamenti delle basi, supporto…

Privacy policy| Cookie policy| Cookie setting| © 2026

Exit mobile version