Per la prima volta OpenAI e Anthropic hanno collaborato sulla sicurezza dell’AI

I test hanno evidenziato due approcci diversi alla sicurezza da parte delle due startup

1 min.

Per la prima volta OpenAI e Anthropic hanno collaborato sulla sicurezza dell’AI

Due delle principali startup mondiali di intelligenza artificiale, OpenAI e Anthropic, hanno collaborato per la prima volta sulla sicurezza dei propri modelli. Il 27 agosto le due aziende hanno condotto dei test incrociati sui rispettivi sistemi effettuando una revisione completa negli ambiti dove il rischio è maggiore e pubblicando poi i risultati in contemporanea.

Il test ha coperto quattro aspetti fondamentali dei modelli: la capacità di seguire gli ordini, la resistenza agli attacchi informatici, la frequenza con cui vengono prodotte risposte false ed eventuali segni di intenti nascosti e pericolosi. I risultati nel loro complesso hanno evidenziato che le due aziende basano la loro sicurezza su approcci diversi. Anthropic punta più sulla cautela e sulla prevenzione del rischio, anche se questo può talvolta comportare la rinuncia ad alcune risposte. OpenAI invece accetta un margine di rischio maggiore puntando su un utilizzo sempre più ampio.

Si tratta di un esperimento nuovo che può creare un importante precedente nella ricerca di sicurezza delle startup di AI. Le due aziende inoltre collaborano già con l’AI Safety Institute statunitense, un consorzio che coinvolge numerose aziende, università e altri enti per sviluppare linee guida, strumenti, metodi di valutazione, standard tecnici e ambienti di test per garantire misurabilità, sicurezza e affidabilità dei modelli AI.

Dopo il suicidio di un adolescente, OpenAI aumenterà i propri livelli di sicurezza

Prima di togliersi la vita, il sedicenne Adam Raine aveva…


Articoli simili

Ultime news


Uno studio collega l’uso quotidiano dell’intelligenza artificiale a un rischio maggiore di depressione e ansia

Il dato più significativo riguarda le probabilità di depressione moderata,…

Uno studio collega l’uso quotidiano dell’intelligenza artificiale a un rischio maggiore di depressione e ansia
CoreWeave entra nel Magic Quadrant di Gartner: l’AI cloud sfida i giganti

Gartner ha inserito CoreWeave tra i "Visionari" del Magic Quadrant…

CoreWeave entra nel Magic Quadrant di Gartner: l’AI cloud sfida i giganti
OpenAI perde la sua numero 2: Fidji Simo lascia per malattia

Fidji Simo, CEO dell'AGI Deployment di OpenAI e seconda figura…

OpenAI perde la sua numero 2: Fidji Simo lascia per malattia
Il Garante italiano sanziona Character.AI, multa da 158mila euro per la scarsa tutela dei minori

Il Garante contesta a Character Technologies di non aver fornito…

Il Garante italiano sanziona Character.AI, multa da 158mila euro per la scarsa tutela dei minori

In Evidenza


Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo

Lo riferisce un sondaggio Ipsos BVA condotto su 3.800 ragazzi…

Più del 50% dei giovani europei usa l’AI per cercare supporto emotivo
Intelligenza artificiale: prepararsi al 2026 | Il report di AI News

Il nuovo report di AI News per non farsi sorprendere…

Intelligenza artificiale: prepararsi al 2026 | Il report di AI News
AI, bolla o non bolla? Il parere degli esperti non è unanime

Ne abbiamo intervistati cinque per unire i puntini

AI, bolla o non bolla? Il parere degli esperti non è unanime

Privacy policy| Cookie policy| Cookie setting| © 2026