OpenAI rileva abusi AI senza toccare i dati enterprise

OpenAI ha annunciato il 19 agosto 2026 il Private Safety Processing, un sistema che individua comportamenti abusivi su più interazioni consecutive senza trattenere prompt o risposte dei clienti enterprise. La mossa si contrappone direttamente alla politica di Anthropic, che impone 30 giorni di data retention per i suoi modelli più potenti.

Etica - Sicurezza 24 ago 2026

2 min.

OpenAI rileva abusi AI senza toccare i dati enterprise

OpenAI ha presentato il 19 agosto 2026 un sistema chiamato Private Safety Processing, progettato per individuare abusi dei suoi modelli AI su più sessioni consecutive senza mai trattenere i prompt o le risposte dei clienti enterprise. La promessa è precisa: sorveglianza continua, dati aziendali fuori portata.

Il problema che il sistema affronta è concreto. I controlli di sicurezza tradizionali valutano ogni interazione in modo isolato, e questo li rende ciechi rispetto a comportamenti malevoli che si distribuiscono su più scambi. Un utente che sonda i limiti del modello in dieci sessioni diverse difficilmente viene intercettato se ogni sessione viene analizzata da sola. Private Safety Processing correla le interazioni correlate e restituisce solo un segnale ristretto — tipo e gravità dell’attività — senza che il personale di OpenAI veda mai il contenuto reale. I dati rimangono sull’infrastruttura del cliente oppure vengono archiviati da OpenAI in forma cifrata, con le chiavi di decifratura in mano all’azienda cliente.

Il sistema si innesta sulla politica Zero Data Retention già in vigore per i clienti API qualificati: i prompt e le risposte vengono scartati dopo ogni richiesta, i contenuti non sono accessibili ai dipendenti di OpenAI e i dati enterprise non vengono usati per addestrare i modelli, salvo consenso esplicito. Private Safety Processing estende questa garanzia aggiungendo uno strato di analisi comportamentale multi-sessione che, secondo OpenAI, non viola quell’impegno. Il test è attivo con una selezione di clienti enterprise e API, tra cui Databricks, Microsoft e Abridge.

L’annuncio arriva in un momento delicato. A luglio uno dei modelli di OpenAI aveva violato i sistemi di Hugging Face durante un test di sicurezza interno — episodio che ha alimentato le domande dei clienti enterprise sulla tenuta reale delle garanzie offerte. Il dilemma per le grandi organizzazioni è strutturale: i modelli AI più avanzati necessitano di contesto comportamentale ampio per essere controllati efficacemente, ma raccogliere e trattenere dati sensibili espone a rischi legali e regolatori. OpenAI sta puntando su segnali cifrati e limitati per risolvere questa tensione senza chiedere alle aziende di cedere il controllo.

Il confronto diretto è con Anthropic, che per i clienti business dei suoi modelli più capaci impone 30 giorni di data retention. OpenAI sceglie la direzione opposta, e lo fa esplicitamente. Non è solo una differenza tecnica: è una posizione commerciale. Le aziende nei settori regolamentati — finanza, sanità, legale — hanno vincoli stringenti sulla gestione dei dati e spesso non possono permettersi policy di retention estese, indipendentemente da chi le gestisce. Su quel segmento si gioca una parte significativa della competizione enterprise tra i grandi laboratori AI.

Un white paper tecnico completo è previsto per settembre 2026. Solo allora sarà possibile verificare nei dettagli quali informazioni transitano effettivamente verso OpenAI, anche in forma aggregata o anonimizzata. Per ora il sistema è una promessa verificabile solo parzialmente. Se la documentazione tecnica reggerà al vaglio degli esperti di sicurezza, Private Safety Processing potrebbe diventare lo standard di riferimento per il monitoraggio della sicurezza AI in ambienti enterprise ad alta riservatezza.


Articoli simili

Ultime news


RobotX AI lancia Xmind, il primo cervello robotico universale

RobotX AI ha annunciato Xmind, un'unità di elaborazione intelligente progettata…

RobotX AI lancia Xmind, il primo cervello robotico universale
NVIDIA RTX Spark arriva sui PC Windows: preordini aperti dal 7 ottobre

NVIDIA e Microsoft hanno annunciato RTX Spark, il nuovo superchip…

NVIDIA RTX Spark arriva sui PC Windows: preordini aperti dal 7 ottobre
ChatGPT for Teens sotto accusa: “Rischio inaccettabile”, l’allarme degli esperti sui minori

Uno studio ha analizzato oltre 4.000 conversazioni, metà prima e…

ChatGPT for Teens sotto accusa: “Rischio inaccettabile”, l’allarme degli esperti sui minori
Cybersecurity: maturità in aumento tra le aziende italiane, si riduce il divario tra PMI e grandi imprese

L’EY Cyber Barometer, report realizzato nell’ambito dell’EY Hub Risk, ha…

Cybersecurity: maturità in aumento tra le aziende italiane, si riduce il divario tra PMI e grandi imprese
Upscale AI lancia Token Fabric: uno strumento per collegare chip AI di diversi fornitori nello stesso data center

La piattaforma permetterà ai clienti di evitare l'acquisto di processori…

Upscale AI lancia Token Fabric: uno strumento per collegare chip AI di diversi fornitori nello stesso data center

Privacy policy| Cookie policy| Cookie setting| © 2026