L’ANALISI
OpenAI classifica Astra “Critical” in cybersecurity dopo due zero-day in valutazione
OpenAI afferma che Astra ha raggiunto la soglia Critical del Preparedness Framework. Nelle valutazioni interne il modello ha costruito exploit chain su browser e sistema operativo e ha individuato due vulnerabilità zero-day durante un test su 20 vulnerabilità V8 recenti.
Risposta diretta: La notizia non è un nuovo modello da usare oggi, ma un cambio di soglia: OpenAI considera Astra capace di trovare e sfruttare vulnerabilità sconosciute in sistemi protetti. Proprio perché i dettagli completi e l’accesso non sono ancora pubblici, va letto come rapporto di rischio e non come benchmark acquistabile.
Che cosa significa Critical
Nel framework OpenAI la soglia riguarda la capacità di trovare e sviluppare exploit zero-day in molti sistemi critici protetti o condurre strategie d’attacco nuove end-to-end a partire da un obiettivo alto livello.
Le prove citate
OpenAI riporta 100% su ExploitBench e un test interno con 20 vulnerabilità V8 recenti. Durante quest’ultimo Astra avrebbe scoperto e usato due zero-day in una catena di exploit, ora in disclosure ai maintainer.
Dai benchmark ai sistemi reali
Le valutazioni esperte includono una compromissione del browser con fuga dalla sandbox e una catena locale fino a root su un sistema operativo hardened. Sono risultati dell’azienda, privi per ora di artefatti pubblici completi.
Accesso e salvaguardie
OpenAI prevede un lancio prossimo, ma limita inizialmente i workflow cyber avanzati a un piccolo gruppo di alpha tester, con un percorso successivo tramite Daybreak Blue. Monitor e classificatori possono interrompere anche attività legittime.
Condizioni e limiti
Mancano la system card di lancio, i dettagli delle vulnerabilità non corrette e una verifica indipendente completa. Le percentuali valgono per setup specifici e non descrivono il normale uso in ChatGPT o API.
Procedura verificabile
- Non pianificare Astra come dipendenza finché non esistono accesso e system card.
- Separare benchmark noti, test interni e prove indipendenti.
- Per agenti cyber usare sandbox, rete e credenziali con scope esterno al modello.
- Registrare interruzioni e falsi positivi dei monitor su casi difensivi.
- Rivedere il rischio quando saranno pubblicati model card e condizioni di accesso.
