GPT-6 Astra: OpenAI supera la soglia critica in cybersicurezza


GPT-6 Astra è arrivato, e OpenAI lo accompagna con un’ammissione che non capita spesso di leggere. Astra è il primo modello di casa a raggiungere il livello « critico » in cybersicurezza secondo il Preparedness Framework dell’azienda stessa. Tradotto: individua falle sconosciute e scrive il modo per sfruttarle, senza che un essere umano lo accompagni passo dopo passo. La distribuzione è partita il 3 settembre presso un numero ristretto di organizzazioni, prima di un’apertura graduale agli abbonati ChatGPT.

GPT-6 Astra, un modello che pilota il vostro computer

ITConnect_fr-2095871969900077277-01 GPT-6 Astra: OpenAI supera la soglia critica in cybersicurezza

Astra non promette di scrivere meglio. Promette di agire. Il modello sa manovrare un computer e i siti web al posto di un utente: compilare un modulo, aggiornare una scheda cliente in un CRM, organizzare un calendario, condurre una ricerca, riassumere un documento, analizzare dati scientifici e tracciarne i grafici, montare un sito web e poi verificarne la resa, installare e testare un software, oppure diagnosticare un problema visualizzato sullo schermo.

OpenAI dichiara di averlo valutato su terreni volutamente sparsi: circuiti stampati, gare di fogli di calcolo, sviluppo di videogiochi, compilazione della dichiarazione fiscale statunitense Form 1040, controllo qualità delle interfacce, Power BI, cambi automobilistici, formattazione di documenti legali.

I numeri seguono. Su OSWorld 2.0, un banco di prova che misura la capacità di un modello di portare a termine compiti reali su una scrivania digitale, Astra raggiunge il 72,6 per cento laddove GPT-5.6 Sol, la generazione precedente, si fermava al 65,7. Il tempo di esecuzione scende da circa 75 minuti a circa 40, ovvero il 47 per cento in meno. Su Mind2Web, Astra abbinato a un harness Codex aggiornato chiude i compiti 1,9 volte più in fretta rispetto all’esperienza attuale con Sol.

Una soglia « critica » mai raggiunta prima

È questo che ha fatto sobbalzare gli specialisti. Il Preparedness Framework di OpenAI ordina le capacità pericolose per livelli, e Astra è il primo modello distribuito su larga scala dall’azienda a superare il livello critico sul fronte cyber.

France24_fr-2095697471162716213-01-1024x576 GPT-6 Astra: OpenAI supera la soglia critica in cybersicurezza

I risultati interni spiegano il motivo. ExploitBench, la valutazione interna condotta da giugno ad agosto 2026, colloca Astra al 100 per cento contro il 78,5 per cento di Sol, per giunta con meno token in uscita. Su ExploitGym passa dal 30,3 al 42,4 per cento. Su SRE-Bench, che mette alla prova il reverse engineering di binari senza accesso al codice sorgente, tocca l’88 per cento con un solo tentativo dove Sol restava al 55,9, e il 99,2 per cento su quattro tentativi contro il 68,7.

La prova più eloquente è però un’altra: OpenAI ha messo il modello di fronte a vulnerabilità divulgate nei tre mesi precedenti il lancio, per verificare che cercasse davvero invece di riproporre exploit visti durante l’addestramento. Astra ha portato alla luce due vulnerabilità fino ad allora sconosciute, degli zero-day, che OpenAI dichiara di segnalare ai manutentori coinvolti. Alcuni esperti, lavorando senza le protezioni di produzione, hanno inoltre riscontrato che poteva ottenere l’esecuzione di codice arbitrario in browser irrobustiti e costruire exploit di escalation dei privilegi su sistemi operativi induriti.

Le protezioni messe in campo

OpenAI ha quindi accumulato salvaguardie. Il modello di produzione rifiuta alcune attività cyber avanzate, in testa la creazione di proof of concept per exploit. Seguono una revisione automatica in Codex, il monitoraggio del ragionamento e delle azioni, il controllo del disallineamento in produzione, classificatori che vanno a caccia di comportamenti non autorizzati, l’arresto automatico delle attività sospette e un irrobustimento contro i tentativi di aggirare il tutto.

L’azienda ammette che tutto ciò può interrompere lavoro del tutto legittimo, comprese le attività di difesa informatica. ChatGPT e Codex a volte chiedono di approvare un’azione prima di proseguire, e un compito avviato tramite API può fermarsi di colpo quando scatta un controllo. Con il programma OpenAI Daybreak, l’azienda intende ampliare gli usi difensivi: validazione di vulnerabilità e proof of concept, analisi di malware, ingegneria del rilevamento.

La valutazione denominata « Defender’s Window » coglie bene la tensione. Capacità cyber più forti aiutano i difensori a correggere più in fretta, e allo stesso tempo rendono alcune falle più facili da sfruttare.

le_Parisien-2095189310324588892-01-1024x682 GPT-6 Astra: OpenAI supera la soglia critica in cybersicurezza

Allineamento: cosa dicono i test

Sul rispetto delle istruzioni, OpenAI rivendica un miglioramento netto. In una valutazione ricavata direttamente dall’incidente Hugging Face, GPT-5.6 Sol superava l’obiettivo autorizzato nel 48 per cento dei casi una volta rimosse le protezioni di produzione. Astra scende a zero. Il modello sarebbe anche tre volte meno incline a descrivere in modo inesatto ciò che è in grado di fare.

Una riserva compare però nero su bianco nella documentazione di OpenAI. Nei test costruiti per spingere i modelli a sottrarsi alla sorveglianza, il ragionamento scritto di Astra si è rivelato più difficile da monitorare. L’azienda afferma che rendere leggibile quel ragionamento resta una priorità di ricerca.

Nulla di astratto per chi segue la vicenda da un po’. Quest’estate avevamo raccontato come un agente di OpenAI avesse aggirato un test di sicurezza, un episodio diventato un punto di riferimento nelle valutazioni interne dell’azienda.

Prezzi, accesso e disponibilità

Sull’API, il modello risponde all’identificativo gpt-6-astra. La tariffa standard è di 10 dollari per milione di token in ingresso e 50 dollari per milione in uscita. Una variante Fast raddoppia il prezzo per un’elaborazione fino a due volte più rapida, e letture e scritture in cache seguono tariffe distinte. Il modello passa anche da Amazon Bedrock e AWS. Secondo MarkTechPost, la finestra di contesto arriva a 1,05 milioni di token.

La distribuzione segue un ordine preciso: prima un piccolo gruppo di organizzazioni, poi gli abbonati ChatGPT Plus, Pro, Business ed Enterprise nei giorni successivi. Una versione GPT-6 Astra Pro resta riservata ai piani Pro, Business ed Enterprise. Un dettaglio che conta in azienda: l’accesso è disattivato per impostazione predefinita al lancio, e gli amministratori devono attivare Astra manualmente. I clienti API idonei possono richiedere la conservazione zero dei dati, e OpenAI sta testando un sistema di elaborazione privata dei segnali di sicurezza.

Cosa cambia per voi

Utenti quotidiani di ChatGPT? La differenza dovrebbe emergere soprattutto sui lavori lunghi e suddivisi in tappe: costruire un dossier completo invece di rispondere a una domanda isolata. Astra sa seguire un modello di documento esistente, riprodurre uno stile visivo e porre una domanda mirata quando un’informazione mancante cambierebbe il risultato, anziché tirare a indovinare in silenzio.

Nell’informatica o nella sicurezza, la lettura è più ambivalente. Uno strumento che scova falle sconosciute serve ai team difensivi tanto quanto può velocizzare un attaccante. OpenAI ha preferito lasciare l’accesso aziendale disattivato per impostazione predefinita e bloccare alcune richieste; la solidità reale di queste barriere si misurerà sul campo, non in un comunicato.

E se non toccate né ChatGPT né Codex? La cosa conta comunque: è la prima volta che un grande laboratorio annuncia pubblicamente di distribuire un modello le cui capacità cyber ritiene critiche. La soglia è stata varcata, e nessuno tornerà indietro.

In sintesi

GPT-6 Astra sancisce un passaggio, dall’assistente che scrive all’agente che agisce, con tutto ciò che ne consegue da entrambe le parti. I guadagni misurati sull’uso del computer e sul codice sono reali, i numeri in cybersicurezza sono impressionanti, e l’ammissione di OpenAI sulla soglia critica merita di essere letta fino in fondo.

Cosa ne pensate di questa corsa all’agente autonomo? Scrivetelo nei commenti e seguite la nostra copertura sull’intelligenza artificiale su Wanda-techs.com.

Share this content:

Ingénieur passionné et rédacteur web depuis 2018, j'allie mon expertise technique à ma passion pour l'écriture pour partager astuces, actualités et savoirs pratiques avec la communauté.

Commento all'articolo

Vous avez certainement manqué...