OpenAI pianifica di rilasciare il primo modello che soddisfa la sua soglia ‘critica' di cybersicurezza

BeInCrypto
Apri BeInCrypto
OpenAI pianifica di rilasciare il primo modello che soddisfa la sua soglia ‘critica' di cybersicurezza

OpenAI ha confermato che il suo prossimo modello Astra raggiunge la soglia Critica di cybersecurity secondo il Preparedness Framework. L’azienda prevede di rilasciarlo con apposite misure di sicurezza e accesso limitato alle avanzate capacità cyber.

Astra è il primo modello che OpenAI colloca a questo livello. Questa designazione significa che il modello può identificare vulnerabilità sconosciute in sistemi rinforzati e creare exploit funzionanti senza che sia necessaria una guida umana passo dopo passo.

Cosa Copre la Valutazione Critica

Il Preparedness Framework stabilisce due condizioni per la soglia Critica. Un modello soddisfa i requisiti se è in grado di identificare e sviluppare exploit zero-day funzionanti su numerosi sistemi reali e rinforzati senza intervento umano.

Inoltre, è idoneo se può pianificare ed eseguire attacchi end-to-end innovativi contro obiettivi rinforzati basandosi esclusivamente su un obiettivo di alto livello.

Secondo la valutazione dell’azienda, Astra ha ottenuto il 100% su ExploitBench. Su un set interno di 20 vulnerabilità V8 ad alta gravità, ha raggiunto tassi di esecuzione del codice superiori rispetto a GPT-5.6 Sol utilizzando molti meno token.

Durante questi test, Astra ha individuato e sfruttato due vulnerabilità prima d’ora sconosciute. OpenAI ha dichiarato che rivelerà entrambe ai manutentori interessati.

Gli esperti che hanno testato il modello hanno anche osservato la creazione di una catena di compromissione del browser. Il modello è riuscito a uscire dal sandbox ed eseguire comandi sulla macchina ospite.

“Astra rappresenta un notevole aumento delle capacità di cybersecurity rispetto a GPT‑5.6 Sol: è sia molto più efficiente nell’uso dei token sia più abile nell’identificazione delle vulnerabilità e nello sviluppo di exploit”, ha spiegato in dettaglio OpenAI qui.

Seguici su X per ricevere le ultime notizie in tempo reale

Over the summer, we have been sprinting on safety priorities; it's more important than ever for capabilities and safeguards to advance together. We have more to do but have made a lot of progress. We are also going to be launching our next model soon.

There is an obvious tension…

— Sam Altman (@sama) September 1, 2026

Le Misure di Sicurezza di OpenAI Prima del Rilascio

L’azienda ha sospeso alcune parti dello sviluppo di Astra mentre rafforzava le protezioni. Lo scorso 28 agosto ha ripreso un ampio ciclo di reinforcement learning frontier dopo l’implementazione di nuovi requisiti di sicurezza e protezione.

OpenAI ha dichiarato che Astra rifiuta il 91,5% delle richieste nei suoi test cyber jailbreak. GPT-5.6 Sol ha respinto il 59% dello stesso set di richieste. Gli account valutati come più a rischio incontrano una soglia di rifiuto ancora più rigorosa.

OpenAI ha anche implementato il monitoraggio “chain-of-thought” per rilevare e bloccare azioni potenzialmente in disallineamento. Nei test honeypot, GPT-5.6 Sol (privo di protezioni in produzione) ha tentato di compromettere l'infrastruttura circostante nel 56% dei casi. Astra non ha effettuato tentativi simili.

L’azienda punta a rendere Astra disponibile a breve. L’accesso alle sue capacità di cybersecurity più avanzate sarà più limitato: inizialmente arriverà a un gruppo di tester, poi si estenderà tramite Daybreak Blue a supporto dell’uso difensivo.

L’azienda ha ammesso che le misure di sicurezza introdurranno attriti al lancio.

Iscriviti al nostro canale YouTube per ascoltare leader e giornalisti parlare con competenza del settore

https://youtu.be/2_JJv4gIQt0

Leggi la storia originale OpenAI pianifica di rilasciare il primo modello che soddisfa la sua soglia ‘critica' di cybersicurezza di Kamina Bashir su it.beincrypto.com