Vai al contenuto

OpenAI afferma che Astra ha raggiunto la soglia Critical del Preparedness Framework. Nelle valutazioni interne il modello ha costruito exploit chain su browser e sistema operativo e ha individuato due vulnerabilità zero-day durante un test su 20 vulnerabilità V8 recenti.

L’ANALISI

OpenAI classifica Astra “Critical” in cybersecurity dopo due zero-day in valutazione

OpenAI afferma che Astra ha raggiunto la soglia Critical del Preparedness Framework. Nelle valutazioni interne il modello ha costruito exploit chain su browser e sistema operativo e ha individuato due vulnerabilità zero-day durante un test su 20 vulnerabilità V8 recenti.

2 min di letturaFatti, limiti e fonti primarie
OpenAI, rapporto Path to Astra sulle capacità cyber e sulle salvaguardie prima del lancio
OpenAI, rapporto Path to Astra sulle capacità cyber e sulle salvaguardie prima del lancio ↗

Risposta diretta: La notizia non è un nuovo modello da usare oggi, ma un cambio di soglia: OpenAI considera Astra capace di trovare e sfruttare vulnerabilità sconosciute in sistemi protetti. Proprio perché i dettagli completi e l’accesso non sono ancora pubblici, va letto come rapporto di rischio e non come benchmark acquistabile.

Che cosa significa Critical

Nel framework OpenAI la soglia riguarda la capacità di trovare e sviluppare exploit zero-day in molti sistemi critici protetti o condurre strategie d’attacco nuove end-to-end a partire da un obiettivo alto livello.

Le prove citate

OpenAI riporta 100% su ExploitBench e un test interno con 20 vulnerabilità V8 recenti. Durante quest’ultimo Astra avrebbe scoperto e usato due zero-day in una catena di exploit, ora in disclosure ai maintainer.

Dai benchmark ai sistemi reali

Le valutazioni esperte includono una compromissione del browser con fuga dalla sandbox e una catena locale fino a root su un sistema operativo hardened. Sono risultati dell’azienda, privi per ora di artefatti pubblici completi.

Accesso e salvaguardie

OpenAI prevede un lancio prossimo, ma limita inizialmente i workflow cyber avanzati a un piccolo gruppo di alpha tester, con un percorso successivo tramite Daybreak Blue. Monitor e classificatori possono interrompere anche attività legittime.

Condizioni e limiti

Mancano la system card di lancio, i dettagli delle vulnerabilità non corrette e una verifica indipendente completa. Le percentuali valgono per setup specifici e non descrivono il normale uso in ChatGPT o API.

Procedura verificabile

  1. Non pianificare Astra come dipendenza finché non esistono accesso e system card.
  2. Separare benchmark noti, test interni e prove indipendenti.
  3. Per agenti cyber usare sandbox, rete e credenziali con scope esterno al modello.
  4. Registrare interruzioni e falsi positivi dei monitor su casi difensivi.
  5. Rivedere il rischio quando saranno pubblicati model card e condizioni di accesso.

Fonti primarie

Apri la fonte primaria ufficiale ↗
Radar AI · a cura di Francesco Gruner

Il sito, in una chat.

Servizi, guide e idee da approfondire

Sono l’assistente AI di questo sito. Ti aiuto a orientarti tra il lavoro di Francesco, il blog, Radar AI e i video, con i link alle fonti.

Risposte AI da verificare nelle fonti. 16 messaggi al giorno per rete.