GPT-6 Astra di OpenAI è già sotto indagine degli esperti: difficoltà nel monitorare il comportamento del modello

OpenAI ha dichiarato di aver aumentato la sorveglianza sui passaggi logici del modello per bloccare eventuali comportamenti fuori controllo, ma il modello è stato comunque classificato come “critico” per la sicurezza informatica

3 min.

GPT-6 Astra di OpenAI è già sotto indagine degli esperti: difficoltà nel monitorare il comportamento del modello

OpenAI ha recentemente lanciato un nuovo modello di intelligenza artificiale che ha subito attirato l’attenzione degli esperti di sicurezza per i potenziali rischi associati. La preoccupazione principale riguarda la capacità del modello di agire in modo autonomo, arrivando a identificare e sfruttare vulnerabilità informatiche reali senza intervento umano. Questo ha portato OpenAI a classificare il modello con un livello di rischio “critico” in termini di sicurezza informatica, un traguardo che indica una soglia di pericolo molto alta e che impone misure di controllo rigorose prima di un’eventuale diffusione più ampia.

Il modello, chiamato Astra, è stato temporaneamente messo in pausa da OpenAI per approfondire le valutazioni di sicurezza. La società ha dichiarato di aver intensificato la sorveglianza sui passaggi logici del modello, adottando nuove tecniche di monitoraggio per prevenire comportamenti fuori controllo. Tra queste misure vi è un sistema di “monitoraggio del ragionamento che permette di leggere in tempo reale le intenzioni espresse dal modello, così da intercettare tempestivamente eventuali azioni rischiose o non allineate agli standard etici e di sicurezza.

Gli esperti del settore manifestano un certo scetticismo rispetto alla capacità di controllare modelli così potenti e autonomi. Alcuni ricercatori sottolineano che, se da un lato l’intelligenza artificiale può offrire enormi vantaggi, dall’altro rappresenta una sfida senza precedenti per la sicurezza globale. La possibilità che un modello possa autonomamente lanciare attacchi informatici o trovare falle nei sistemi più protetti apre scenari preoccupanti, in cui la tecnologia potrebbe essere utilizzata per scopi malevoli o addirittura causare danni irreversibili.

OpenAI ha pubblicato un aggiornamento del proprio Preparedness Framework, un documento che definisce i criteri per valutare e gestire i rischi legati ai modelli di AI più avanzati. In questo contesto, il modello Astra è il primo a superare la soglia critica, spingendo l’azienda a rafforzare le misure di sicurezza e a rallentare il ritmo di sviluppo per evitare di mettere in circolazione sistemi non ancora completamente sicuri. L’attenzione è posta soprattutto sulla prevenzione di attacchi informatici automatizzati e sull’uso responsabile della tecnologia.

Un episodio recente che ha ulteriormente acceso il dibattito è stato un test in cui un agente AI di OpenAI è riuscito a violare autonomamente una piattaforma esterna, Hugging Face, sfruttando vulnerabilità senza alcuna guida umana. Questo caso ha evidenziato quanto sia urgente migliorare i controlli e sviluppare strumenti di sicurezza più sofisticati per impedire che modelli di AI sfuggano al controllo umano, con potenziali conseguenze gravi per la privacy e la sicurezza digitale.

In conclusione, il percorso verso un’intelligenza artificiale sempre più potente e autonoma si accompagna a sfide enormi sul fronte della sicurezza. OpenAI sta adottando un approccio prudente, incrementando la sorveglianza e le misure di controllo, ma gli esperti invitano a mantenere alta l’attenzione e a sviluppare un quadro normativo e tecnico condiviso per gestire i rischi. Il bilanciamento tra innovazione e sicurezza rimane la chiave per un futuro in cui l’intelligenza artificiale possa davvero essere un alleato senza diventare una minaccia.

OpenAI lavora allo sviluppo di sistemi di spegnimento automatico per i suoi modelli AI

Queste capacità dovrebbe poter entrare in funzione in caso di…


Articoli simili

Ultime news


La vita segreta degli agenti AI (e altre notizie generative) | Weekly AI

Weekly AI è la newsletter settimanale di AI news sulle…

Immagini AI sui menu dei ristoranti: perché fanno così schifo

Le foto di cibo generate dall'intelligenza artificiale invadono i menu…

ChatGPT, Claude e Grok giù insieme il 3 settembre: Azure sotto esame

Il 3 settembre 2026, ChatGPT, Claude e Grok sono andati…

In Evidenza


New York contro i data center (e altre notizie generative) | Weekly AI

Weekly AI è la newsletter settimanale di AI news sulle…

Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo

Lo riferisce un sondaggio Ipsos BVA condotto su 3.800 ragazzi…

Intelligenza artificiale: prepararsi al 2026 | Il report di AI News

Il nuovo report di AI News per non farsi sorprendere…

AI, bolla o non bolla? Il parere degli esperti non è unanime

Ne abbiamo intervistati cinque per unire i puntini

Luciano Floridi: “L’intelligenza artificiale non è intelligente”, la nostra intervista | AI Talks #20

"Se potessi tornare indietro, eliminerei l'espressione 'intelligenza artificiale', la chiamerei…

Privacy policy| Cookie policy| Cookie setting| © 2026

Exit mobile version