Vai al contenuto
AI.info

The Pulse

OpenAI designa Astra come suo primo modello di cybersicurezza di livello «Critico»

Secondo OpenAI, Astra, il suo modello di prossima uscita, è in grado di trovare vulnerabilità finora sconosciute e costruire catene di exploit senza istruzioni umane passo dopo passo. Dopo aver introdotto nuovi controlli per il monitoraggio

OpenAI designa Astra come suo primo modello di cybersicurezza di livello «Critico»

AI.info Team ·

OpenAI afferma che, durante i test, il suo modello di prossima uscita Astra ha scoperto e sfruttato due vulnerabilità finora sconosciute. È il primo modello che l’azienda ha collocato alla soglia di capacità di cybersicurezza «Critico».

La designazione non significa che OpenAI abbia classificato Astra come un rischio critico. Significa che il modello raggiunge la soglia più alta attualmente prevista dall’azienda per le capacità di cybersicurezza: con strumenti e accessi adeguati, Astra può individuare falle sconosciute e sviluppare modi per sfruttarle in sistemi ben protetti senza che una persona diriga ogni passaggio.

«Con gli strumenti e gli accessi giusti, Astra può trovare falle di sicurezza finora sconosciute e sviluppare modi per sfruttarle in molti sistemi ben protetti senza che una persona guidi ogni passaggio», ha dichiarato Amelia Glaese, vicepresidente di OpenAI responsabile delle attività dell’azienda per la sicurezza, in dichiarazioni riportate da Reuters. Glaese ha anche detto che le misure aggiuntive potrebbero «a volte rallentare, sospendere o fermare attività legittime» e che l’azienda lavorerà per ridurre queste interruzioni.

Due vulnerabilità zero-day hanno portato Astra oltre i punteggi dei benchmark

La valutazione di OpenAI ha combinato benchmark pubblici e privati con test condotti da esperti. Astra ha ottenuto il 100% su ExploitBench, che misura se un modello è in grado di trasformare vulnerabilità note in exploit funzionanti. Secondo OpenAI, il suo precedente modello di punta per la cybersicurezza, GPT-5.6 Sol, aveva ottenuto il 78,5% nello stesso test.

Poiché le vulnerabilità meno recenti potrebbero essere comparse nei dati di addestramento, OpenAI ha creato un benchmark interno basato su 20 vulnerabilità di gravità elevata divulgate tra giugno e agosto 2026. Astra ha raggiunto tassi di esecuzione di codice arbitrario superiori a quelli di GPT-5.6 Sol, producendo al tempo stesso molti meno token in output. Durante quei test, il modello ha trovato e sfruttato due vulnerabilità zero-day in un’unica catena di exploit; OpenAI ha dichiarato che sta segnalando entrambe le falle ai rispettivi manutentori.

Le valutazioni degli esperti hanno fornito dimostrazioni più dirette. Astra ha costruito una catena di attacco al browser che ha aggirato una sandbox ed eseguito comandi sul sistema host dopo che il browser aveva aperto un file HTML. In un test separato su un sistema operativo dotato di protezioni rafforzate, ha combinato diverse vulnerabilità per passare da un account senza privilegi all’account root.

La soglia di OpenAI comprende attacchi autonomi

Secondo il Preparedness Framework di OpenAI, un modello raggiunge il livello «Critico» per la cybersicurezza se può trovare e sviluppare exploit zero-day funzionanti contro molti sistemi critici reali dotati di protezioni rafforzate senza intervento umano, oppure ideare ed eseguire un nuovo attacco informatico completo a partire da un obiettivo generale.

OpenAI afferma che Astra ha superato questa soglia nei test svolti senza le misure di sicurezza standard previste per l’uso in produzione. Secondo l’azienda, i risultati riflettono l’accesso tramite Daybreak Blue, un ambiente di test ad accesso limitato, e non la configurazione predefinita prevista per gli utenti comuni.

La distinzione conta perché l’azienda presenta le capacità di Astra come utili tanto a chi difende i sistemi quanto a chi li attacca. Gli stessi sistemi che individuano i punti deboli possono aiutare i team di sicurezza a esaminare il codice, stabilire le priorità delle correzioni e verificare se una vulnerabilità sia sfruttabile. OpenAI riconosce anche che mettere queste capacità a disposizione di un utente malintenzionato potrebbe ridurre il tempo necessario per attaccare software dotato di protezioni rafforzate.

La designazione è arrivata dopo due settimane di sospensione dell’addestramento

OpenAI afferma di aver rinviato alcune fasi dello sviluppo e del rilascio di Astra mentre rafforzava le protezioni contro gli usi impropri e le azioni non autorizzate. In un aggiornamento del 18 agosto, l’azienda ha dichiarato di aver sospeso per due settimane l’addestramento per rinforzo dei suoi ultimi modelli destinati alla distribuzione, mentre rafforzava la sicurezza degli ambienti di ricerca e ampliava il monitoraggio.

L’azienda ha introdotto un isolamento più rigoroso dei carichi di lavoro e della rete, ridotto i privilegi permanenti, migliorato la registrazione degli eventi di sicurezza e imposto ambienti con livelli di sicurezza più elevati per le attività legate ad Astra. Secondo OpenAI, il suo sistema di monitoraggio può esaminare l’attività del modello, le azioni compiute tramite gli strumenti e i ragionamenti disponibili, per poi avvisare i team di sicurezza, protezione e ricerca quando rileva possibili accessi non autorizzati, furti di dati o comportamenti distruttivi.

Il sistema di monitoraggio è progettato per generare un avviso entro 30 minuti dal rilevamento di un’attività preoccupante. Se entro altri 30 minuti i team non riescono a stabilire che si tratta di un falso positivo, secondo OpenAI devono sospendere l’attività. Stando all’azienda, il monitoraggio aumenta di circa il 20% le risorse di calcolo necessarie per l’inferenza dei carichi di lavoro monitorati.

Le funzionalità avanzate di cybersicurezza non saranno disponibili su larga scala al lancio

OpenAI prevede di rendere presto disponibile Astra, ma afferma che le sue funzionalità di cybersicurezza più avanzate saranno inizialmente riservate a un piccolo gruppo di tester. Seguirà l’accesso tramite Daybreak Blue, un programma pensato per sostenere le attività di difesa informatica in condizioni più controllate.

L’azienda afferma che, nella sua configurazione iniziale, Astra rifiuterà richieste avanzate come la creazione di exploit dimostrativi per vulnerabilità. OpenAI prevede di offrire tramite Daybreak Blue misure di sicurezza meno restrittive per la verifica autorizzata delle vulnerabilità, l’analisi del malware e lo sviluppo di sistemi di rilevamento.

La comunicazione di OpenAI lascia aperte due domande in vista del rilascio: se il suo sistema di monitoraggio sia in grado di rilevare gli usi impropri quando Astra agisce tramite strumenti anziché tramite testo, e quante attività di difesa andranno perse quando i controlli sull’accesso bloccheranno test di sicurezza legittimi. Per ora, la posizione dell’azienda è precisa: Astra è il primo modello di OpenAI a raggiungere la sua soglia «Critico» per le capacità di cybersicurezza, e le sue funzionalità più avanzate in questo ambito resteranno ad accesso limitato.

Fonte

Esplora

Altri articoli