GPT-6 Astra: Rilascio, benchmark, prezzi e la dichiarazione di AGI di OpenAI

Avatar
Lisa Ernst · 05.09.2026 · Intelligenza artificiale · 12 min.

GPT-6 Astra è ufficiale. OpenAI ha presentato il nuovo modello di punta il 3 settembre 2026, annunciando un significativo balzo avanti nel controllo del computer, nel coding, nella matematica, nella cybersecurity e nei contesti lunghi. Allo stesso tempo, l'affermazione del presidente di OpenAI Greg Brockman, secondo cui Astra potrebbe segnare l'inizio dell'era AGI, attira almeno tanta attenzione quanto i valori effettivi dei benchmark.

Al 5 settembre 2026, l'accesso è ancora in fase di avvio graduale. Questo articolo distingue pertanto i dati confermati del prodotto dalla valutazione autonoma di OpenAI: quanto costa effettivamente GPT-6 Astra, per chi verrà sbloccato ChatGPT Astra, quali benchmark sono particolarmente forti, dove i modelli concorrenti rimangono in vantaggio e perché un punteggio del 99,9% su ARC-AGI-3 non è ancora una prova scientifica di AGI.

In breve

Cos'è GPT-6 Astra?

GPT-6 Astra è il nuovo modello frontier di OpenAI per compiti end-to-end particolarmente impegnativi. OpenAI lo posiziona non solo come un chatbot migliore, ma come un modello in grado di lavorare direttamente con il software, operare su browser e interfacce desktop, scrivere codice, eseguire ricerche complesse e generare documenti professionali. Nell'annuncio ufficiale, OpenAI descrive Astra come il suo modello "più intelligente e allineato" fino ad oggi. Questa formulazione è una valutazione del produttore e non va confusa con una classifica indipendente.

Dal punto di vista tecnico, colpisce soprattutto l'ampia finestra di contesto. La documentazione API indica 1.050.000 token di contesto e fino a 128.000 token di output. La data limite di conoscenza documentata è il 30 aprile 2026. Per il ragionamento, gli sviluppatori possono scegliere i livelli low, medium, high, xhigh e max. Chi volesse seguire lo sviluppo della generazione precedente, può trovare l'inquadramento di Zerlo anche per GPT-5.6 Sol e il suo rollout di ChatGPT.

Rilascio di GPT-6 Astra: Chi ottiene ChatGPT Astra?

Il lancio non è un interruttore globale che è stato attivato per tutti gli account contemporaneamente il 3 settembre. OpenAI ha iniziato con un gruppo limitato di organizzazioni e ha annunciato che GPT-6 Astra verrà distribuito nei giorni successivi per ChatGPT Plus, Pro, Business ed Enterprise. I clienti Pro, Business ed Enterprise avranno anche accesso aggiuntivo a GPT-6 Astra Pro. Per Enterprise, Astra è disattivato di default all'avvio e deve essere sbloccato dagli amministratori per lo spazio di lavoro.

Importante: OpenAI non menziona nell'annuncio di Astra un rilascio generale per account Free o Go. Chi non vede ancora il modello il 5 settembre 2026, quindi, nonostante una tariffa fondamentalmente valida, potrebbe semplicemente essere ancora bloccato nel rollout scaglionato. L'utilizzo di Astra in ChatGPT è incluso nei contingenti tariffari esistenti secondo OpenAI; l'utilizzo aggiuntivo dovrebbe essere possibile tramite crediti. Non esiste quindi una "tariffa Astra" mensile annunciata separatamente.

Logo di Microsoft Azure

Fonte: simpleicons.org

GPT-6 Astra non è offerto solo direttamente tramite OpenAI. OpenAI menziona esplicitamente Microsoft Azure come percorso di distribuzione aggiuntivo per sviluppatori e aziende.

Logo di Amazon Web Services

Fonte: simpleicons.org

Anche AWS Bedrock fa parte del rollout annunciato di Astra. Per le architetture cloud esistenti, questo potrebbe essere più importante di un passaggio diretto all'API di OpenAI.

Benchmark GPT-6 Astra: Quanto è grande il salto?

I numeri più forti si trovano in aree in cui i modelli agentici finora hanno incontrato limiti particolari: risoluzione di problemi astratti, controllo del computer, sviluppo di software e compiti di sicurezza offensiva. La pubblicazione di OpenAI contiene sia benchmark esterni che test interni. Soprattutto nelle valutazioni interne, la riproduzione indipendente non è naturalmente ancora possibile.

Benchmark GPT-6 Astra GPT-5.6 Sol Inquadramento
ARC-AGI-3 99,9 % 7,8 % Salto estremamente grande in nuovi compiti di astrazione interattiva
FrontierMath Tier 4 (v2) 97,6 % 83,0 % Prestazioni molto elevate in matematica impegnativa
Terminal-Bench 4.0 57,9 % 37,3 % Progressi significativi nel coding agentico nel terminale
OSWorld 2.0 72,6 % 65,7 % Migliore controllo del computer; OpenAI segnala anche tempi di attività significativamente più brevi
AutomationBench 41,4 % 18,1 % Punteggio più del doppio nei compiti di automazione professionale
ExploitBench 100,0 % 78,5 % Mostra capacità di sviluppo di exploit molto forti in test controllati

Questi numeri sono impressionanti, ma hanno bisogno di contesto. OpenAI stessa sottolinea che le valutazioni GPT sono state condotte in un ambiente di ricerca o tramite API. ChatGPT di produzione, con diversi prompt di sistema, strumenti e meccanismi di sicurezza, può produrre risultati leggermente diversi. Inoltre, la tabella di confronto mostra i migliori punteggi in vari livelli di sforzo di ragionamento.

Anche Astra non vince ogni test. Un buon controesempio è Humanity's Last Exam con strumenti: Astra ottiene il 57,2%, mentre Claude Fable 5.1 nella stessa tabella OpenAI è riportato al 65,0%. L'indice Artificial Analysis Intelligence per Astra è del 61,2%, anch'esso inferiore a diversi modelli Claude elencati lì. Ciò contraddice l'affermazione semplificata che Astra sia automaticamente il miglior modello in ogni dimensione.

Perché ARC-AGI-3 ottiene così tanta attenzione

Il salto dal 7,8% di GPT-5.6 Sol al 99,9% di GPT-6 Astra è il valore singolo più spettacolare del lancio. ARC-AGI-3 dovrebbe testare se un sistema scopre regole in ambienti nuovi e interattivi e agisce in modo efficiente, invece di richiamare solo modelli conosciuti. L'ARC Prize Foundation ha dichiarato nel post di lancio di OpenAI che Astra ha superato il baseline di efficienza d'azione umana nel 96% dei livelli. Questo è un forte segnale per nuove capacità di risoluzione dei problemi, ma non ancora una misura generale di tutte le capacità umane.

Prezzo GPT-6 Astra: Quanto costa l'API?

Per gli sviluppatori, la struttura dei prezzi è più chiara delle tariffe di ChatGPT: OpenAI addebita Astra nell'API standard in base ai token. I valori si riferiscono a 1 milione di token di testo.

Fatturazione Prezzo per 1 milione di token
Input 10,00 USD
Input nella cache 1,00 USD
Cache Writes 12,50 USD
Output 50,00 USD

Con prompt molto grandi diventa più costoso: non appena una richiesta contiene più di 272.000 token di input, OpenAI addebita per l'intera richiesta il doppio del tasso di input e cache e 1,5 volte il tasso di output. Batch e Flex costano, secondo la documentazione del modello, il 50% delle tariffe standard. La modalità Fast, invece, costa il doppio della tariffa applicabile e dovrebbe fornire una velocità fino al doppio. Sebbene la finestra di contesto massima sia tecnicamente attraente, non è necessariamente economica. Chi immette regolarmente centinaia di migliaia di token in esecuzioni di agenti, dovrebbe prendere sul serio il caching dei prompt, la selezione del contesto e la divisione dei task. La panoramica più vecchia di Zerlo su ChatGPT 5.4 e la sua struttura dei prezzi API mostra quanto i costi siano cambiati tra le generazioni di modelli.

OpenAI ha raggiunto l'AGI con GPT-6 Astra?

Affermazione confermata, non prova. Axios ha riferito dal briefing stampa sul lancio che il presidente di OpenAI Greg Brockman crede personalmente che OpenAI abbia raggiunto l'AGI con Astra, o che questo modello possa essere considerato retrospettivamente l'arrivo dell'Intelligenza Artificiale Generale. Allo stesso tempo, ha lasciato l'inquadramento finale agli utenti. Il post ufficiale del prodotto di OpenAI presenta Astra in modo molto aggressivo come una nuova generazione di intelligenza, ma non fornisce una certificazione indipendente secondo cui una soglia AGI generalmente accettata sia stata superata.

Il problema principale è la definizione. Per l'AGI non esiste un test universalmente accettato, al raggiungimento del quale un modello viene oggettivamente considerato "AGI". Un modello può saturare quasi un singolo benchmark astratto e tuttavia rimanere indietro rispetto ai modelli concorrenti in altre aree, commettere errori, richiedere limiti di sicurezza o fallire in compiti reali a lungo termine. Proprio questo dimostra già la tabella dei benchmark di OpenAI: Astra è eccezionalmente forte su ARC-AGI-3, ma non il leader su Humanity's Last Exam con strumenti.

Pertanto, la formulazione più sensata dal punto di vista fattuale è: GPT-6 Astra è un candidato eccezionalmente forte nell'attuale dibattito sull'AGI, ma la dichiarazione AGI di OpenAI rimane una valutazione aziendale e manageriale. Se la ricerca e il pubblico vedranno anche questa soglia come raggiunta, dipenderà dalla definizione di AGI utilizzata e dalle repliche indipendenti nell'uso reale.

Controllo del computer e agenti: qui Astra diventa praticamente rilevante

Il cambiamento più importante rispetto a un modello di chat classico non è solo più conoscenza o un punteggio di coding più alto, ma la capacità di eseguire compiti direttamente. OpenAI cita moduli, aggiornamenti CRM, organizzazione del calendario, ricerca, installazione di software, risoluzione di problemi, analisi dati e QA frontend come esempi. Su OSWorld 2.0, Astra raggiunge il 72,6% rispetto al 65,7% di GPT-5.6 Sol. Nella simulazione di latenza di OpenAI, Astra ha impiegato circa 40 invece di 75 minuti per compito, circa il 47% in meno di tempo. Per le aziende, questa combinazione di ragionamento, uso del computer e contesto lungo può essere più importante di un ulteriore punto percentuale su un benchmark di conoscenza. Un agente che comprende correttamente un compito, può operare su più applicazioni e mantenere il contesto per lunghi periodi, può potenzialmente cambiare interi flussi di lavoro. Allo stesso tempo, aumenta anche l'importanza di permessi, dialoghi di conferma, logging e limiti chiari.

Il rovescio della medaglia: Astra raggiunge la soglia "Critica" di OpenAI per la cybersecurity

OpenAI classifica GPT-6 Astra come il suo primo modello a raggiungere la soglia critica nelle capacità informatiche secondo il Preparedness Framework. Senza protezione di produzione, Astra è stato in grado di trovare vulnerabilità sconosciute e sviluppare exploit contro sistemi rafforzati, secondo OpenAI. Il modello raggiunge il 100% su ExploitBench e il 42,4% su ExploitGym. Chi volesse comprendere più a fondo il funzionamento di questo benchmark, troverà una spiegazione dettagliata presso Zerlo su ExploitGym e sviluppo di exploit basato sull'IA.

OpenAI risponde con meccanismi di protezione più robusti e limitazioni per compiti informatici offensivi avanzati. Allo stesso tempo, c'è una seconda osservazione spiacevole: in test appositamente costruiti in modo adversarial, il ragionamento scritto di Astra è stato più difficile da monitorare rispetto a quello di GPT-5.6 Sol. OpenAI attribuisce ciò, tra le altre cose, al fatto che Astra ha un maggiore controllo sul suo ragionamento scritto e può risolvere problemi più semplici con meno passaggi intermedi visibili. L'azienda definisce il calo della monitorabilità come un serio argomento di ricerca.

Ciò appare contraddittorio solo a prima vista con l'affermazione di OpenAI che Astra è più "allineato". Un modello può rimanere più frequentemente entro i limiti prefissati nel comportamento normale e tuttavia possedere capacità tecnicamente più pericolose. È proprio per questo che il comportamento del modello, le capacità di base e i sistemi di protezione esterni devono essere considerati separatamente.

Cosa significa GPT-6 Astra per utenti e sviluppatori?

Per i normali utenti di ChatGPT, la domanda a breve termine più importante è il rollout. Chi utilizza Plus, Pro, Business o Enterprise non deve presumere che la mancanza di accesso ad Astra il 5 settembre sia già un errore. OpenAI parla esplicitamente di un rilascio graduale su diversi giorni.

Per gli sviluppatori, la decisione è più economica. Astra vale la pena soprattutto dove una singola esecuzione di successo ha un alto valore: agenti di codifica complessi, repository di grandi dimensioni, automazione dell'uso del computer, ricerca sofisticata o lunghi flussi di lavoro professionali. Per la classificazione semplice, la generazione di testo breve o compiti di massa sensibili ai costi, un modello più piccolo potrebbe continuare ad essere più sensato. L'alto prezzo di output di 50 dollari per milione di token e i supplementi per contesti molto lunghi rendono una scelta accurata del modello più importante, non meno importante.

Per le aziende si aggiunge un terzo fattore: la governance. Un agente più potente non dovrebbe ricevere automaticamente più diritti. Soprattutto per quanto riguarda file system, browser, e-mail, applicazioni interne e risorse cloud, le autorizzazioni minime, le conferme per azioni irreversibili e i log di audit tracciabili dovrebbero rimanere standard.

FAQ

Quando è stato rilasciato GPT-6 Astra?

OpenAI ha presentato GPT-6 Astra il 3 settembre 2026. Il rollout è iniziato per un numero limitato di organizzazioni e verrà successivamente esteso gradualmente a ChatGPT Plus, Pro, Business e Enterprise, nonché all'API, Microsoft Azure e AWS Bedrock.

GPT-6 Astra è già disponibile in ChatGPT Plus?

OpenAI ha esplicitamente annunciato Plus per il rollout. Poiché il rilascio avviene su diversi giorni, un account Plus idoneo potrebbe comunque non mostrare ancora l'accesso ad Astra il 5 settembre 2026. Questo da solo non è ancora un'indicazione di un errore tecnico.

Quanto costa GPT-6 Astra nell'API?

Il prezzo standard è di 10 dollari per 1 milione di token di input e 50 dollari per 1 milione di token di output. L'input memorizzato nella cache costa 1 dollaro e le scritture nella cache 12,50 dollari per milione di token. Le richieste con più di 272.000 token di input sono soggette a moltiplicatori più elevati.

Qual è la dimensione della finestra di contesto di GPT-6 Astra?

La documentazione dell'API di OpenAI indica una finestra di contesto di 1.050.000 token e un massimo di 128.000 token di output. Richieste molto lunghe, tuttavia, non sono solo tecnicamente più impegnative, ma a partire da più di 272.000 token di input anche più costose.

GPT-6 Astra ha davvero raggiunto l'AGI?

Ciò non è oggettivamente provato. Greg Brockman ha dichiarato che personalmente crede che OpenAI abbia raggiunto l'AGI o che Astra possa essere considerato l'inizio dell'era AGI. Tuttavia, non esiste un benchmark scientifico universalmente accettato che stabilisca una soglia AGI universale. L'affermazione dovrebbe quindi essere letta come una valutazione di OpenAI e non come un fatto scientifico concluso.

GPT-6 Astra è più sicuro di GPT-5.6 Sol?

OpenAI riporta risultati migliori in diversi test di allineamento e di confine, contemporaneamente Astra possiede capacità informatiche significativamente più forti ed è più difficile da monitorare nel suo ragionamento scritto in test adversarial. "Più sicuro" dipende quindi da se si considerano il comportamento, le capacità sottostanti o la monitorabilità.

Conclusione

GPT-6 Astra è un rilascio reale e tecnicamente eccezionale, non una semplice voce. I punti di forza confermati sono la finestra di contesto da 1,05 milioni di token, progressi significativi nell'uso del computer e nella codifica, nonché i valori estremamente elevati sui benchmark ARC-AGI-3, FrontierMath e cybersecurity. Allo stesso tempo, è necessaria un'immagine differenziata: Astra non è leader in ogni confronto, il rollout è ancora in corso e le nuove capacità informatiche creano ulteriori rischi di sicurezza.

L'affermazione di OpenAI sull'AGI è quindi la parte del lancio che necessita di maggiore contestualizzazione. L'affermazione di Brockman è notevole, ma un punteggio quasi perfetto su ARC-AGI-3 da solo non trasforma una definizione controversa in un fatto scientifico concluso. Per gli utenti, Astra è principalmente un nuovo modello ChatGPT e di agenti molto potente; se in retrospettiva sarà effettivamente considerato l'inizio dell'era AGI, lo si vedrà solo attraverso test indipendenti e un utilizzo reale a lungo termine.

Condividi il nostro articolo!
Fonti