GPT-6 Astra: Lançamento, benchmarks, preços e a alegação de AGI da OpenAI

Avatar
Lisa Ernst · 05.09.2026 · Inteligência Artificial · 12 Min.

GPT-6 Astra é oficial. A OpenAI apresentou o novo modelo de ponta em 3 de setembro de 2026, anunciando um salto significativo em controle de computador, codificação, matemática, cibersegurança e contextos longos. Ao mesmo tempo, a afirmação do presidente da OpenAI, Greg Brockman, de que o Astra pode marcar o início da era AGI, está chamando tanta atenção quanto os próprios valores de benchmark.

Em 5 de setembro de 2026, o acesso ainda está sendo implementado gradualmente. Este artigo, portanto, separa os dados confirmados do produto da autoavaliação da OpenAI: Quanto custa realmente o GPT-6 Astra, para quem o ChatGPT Astra estará disponível, quais benchmarks são particularmente fortes, onde os modelos concorrentes ainda lideram e por que uma pontuação de 99,9% no ARC-AGI-3 ainda não é uma prova científica de AGI.

Resumo

O que é GPT-6 Astra?

O GPT-6 Astra é o novo modelo de ponta da OpenAI para tarefas complexas de ponta a ponta. A OpenAI o posiciona não apenas como um chatbot melhor, mas como um modelo que pode trabalhar diretamente com software, operar navegadores e interfaces de desktop, escrever código, realizar pesquisas complexas e gerar documentos profissionais. No anúncio oficial, a OpenAI descreve o Astra como seu modelo mais "inteligente e focado" até agora. Esta formulação é uma avaliação do fabricante e não deve ser confundida com um ranking independente.

Tecnicamente, a grande janela de contexto é notável. A documentação da API menciona 1.050.000 tokens de contexto e até 128.000 tokens de saída. A data limite de conhecimento documentada é 30 de abril de 2026. Para raciocínio, os desenvolvedores podem escolher os níveis baixo, médio, alto, extra-alto e máximo. Aqueles que desejam acompanhar o desenvolvimento da geração anterior encontrarão a classificação para GPT-5.6 Sol e seu rollout de ChatGPT.

Lançamento do GPT-6 Astra: Quem receberá o ChatGPT Astra?

O lançamento não é um botão mundial ativado simultaneamente para todas as contas em 3 de setembro. A OpenAI começou com um grupo limitado de organizações e anunciou que implementaria o GPT-6 Astra para ChatGPT Plus, Pro, Business e Enterprise nos dias seguintes. Clientes Pro, Business e Enterprise também terão acesso ao GPT-6 Astra Pro. No Enterprise, o Astra está desativado por padrão no início e precisa ser habilitado pelos administradores para o workspace.

Importante: A OpenAI não menciona em seu anúncio do Astra uma liberação geral para contas Free ou Go. Portanto, quem ainda não vir o modelo em 5 de setembro de 2026, mesmo com um plano qualificado, pode simplesmente estar na fase de rollout escalonado. O uso do Astra no ChatGPT está incluído nas cotas de planos existentes, de acordo com a OpenAI; o uso adicional poderá ser feito através de créditos. Portanto, não há um "plano Astra" mensal anunciado separadamente.

Logotipo do Microsoft Azure

Fonte: simpleicons.org

O GPT-6 Astra não é oferecido apenas diretamente pela OpenAI. A OpenAI menciona explicitamente o Microsoft Azure como um caminho de distribuição adicional para desenvolvedores e empresas.

Logotipo da Amazon Web Services

Fonte: simpleicons.org

O AWS Bedrock também faz parte do rollout anunciado do Astra. Para arquiteturas de nuvem existentes, isso pode ser mais importante do que uma mudança direta para a API da OpenAI.

Benchmarks do GPT-6 Astra: Quão grande é o salto?

Os números mais fortes estão em áreas onde os modelos agentes até agora atingiram limites rapidamente: resolução abstrata de problemas, controle de computador, desenvolvimento de software e tarefas de segurança ofensiva. A publicação da OpenAI inclui tanto benchmarks externos quanto testes internos. Especialmente com avaliações internas, a reprodução independente não é naturalmente possível ainda.

Benchmark GPT-6 Astra GPT-5.6 Sol Classificação
ARC-AGI-3 99,9 % 7,8 % Salto extremamente grande em novas tarefas de abstração interativa
FrontierMath Tier 4 (v2) 97,6 % 83,0 % Desempenho muito alto em matemática desafiadora
Terminal-Bench 4.0 57,9 % 37,3 % Progresso significativo em codificação de agente no terminal
OSWorld 2.0 72,6 % 65,7 % Melhor controle de computador; a OpenAI também relata tempos de tarefa significativamente mais curtos
AutomationBench 41,4 % 18,1 % Mais que o dobro da pontuação em tarefas de automação profissional
ExploitBench 100,0 % 78,5 % Demonstra capacidade de desenvolvimento de exploração muito forte em testes controlados

Esses números são impressionantes, mas precisam de contexto. A própria OpenAI aponta que as avaliações do GPT foram realizadas em um ambiente de pesquisa ou através da API. O ChatGPT de produção pode fornecer resultados ligeiramente diferentes devido a prompts de sistema, ferramentas e mecanismos de segurança diferentes. Além disso, a tabela comparativa mostra as melhores pontuações em diferentes níveis de esforço de raciocínio.

Nem mesmo o Astra ganha todos os testes. Um bom contraexemplo é o Humanity's Last Exam com ferramentas: o Astra atinge 57,2%, enquanto o Claude Fable 5.1 é apresentado com 65,0% na mesma tabela da OpenAI. O Índice de Inteligência de Análise Artificial para o Astra é de 61,2, também abaixo de vários modelos Claude listados lá. Isso contradiz a afirmação simplificada de que o Astra é automaticamente o melhor modelo em todas as dimensões.

Por que o ARC-AGI-3 atrai tanta atenção

O salto de 7,8% no GPT-5.6 Sol para 99,9% no GPT-6 Astra é o valor individual mais espetacular do lançamento. O ARC-AGI-3 deve testar se um sistema descobre regras em ambientes novos e interativos e age eficientemente, em vez de apenas recuperar padrões conhecidos. A ARC Prize Foundation declarou na postagem de lançamento da OpenAI que o Astra superou a linha de base de eficiência de ação humana em 96% dos níveis. Este é um sinal forte de nova capacidade de resolução de problemas – mas ainda não uma medição geral de todas as capacidades humanas.

Preço do GPT-6 Astra: Quanto custa a API?

Para desenvolvedores, a estrutura de preços é mais clara do que os planos do ChatGPT: A OpenAI cobra o Astra na API padrão com base em tokens. Os valores são por 1 milhão de tokens de texto.

Cobrança Preço por 1 milhão de tokens
Entrada US$ 10,00
Entrada em cache US$ 1,00
Gravações em cache US$ 12,50
Saída US$ 50,00

Com prompts muito grandes, fica mais caro: assim que uma solicitação contiver mais de 272.000 tokens de entrada, a OpenAI cobrará o dobro da taxa de entrada e de cache para toda a solicitação, e 1,5 vez a taxa de saída. Batch e Flex custam 50% das taxas padrão, de acordo com a documentação do modelo. O modo Fast, por outro lado, custa o dobro da taxa aplicável e deve fornecer até o dobro da velocidade. Portanto, embora a janela de contexto máxima seja tecnicamente atraente, ela não é automaticamente econômica. Aqueles que alimentam regularmente centenas de milhares de tokens em execuções de agente devem levar a sério o cache de prompts, a seleção de contexto e a divisão de tarefas. O resumo mais antigo da Zerlo sobre ChatGPT 5.4 e sua estrutura de preços de API mostra o quanto os custos mudaram entre as gerações de modelos.

A OpenAI alcançou AGI com o GPT-6 Astra?

A afirmação é confirmada – a prova não. A Axios relatou do briefing de imprensa para o lançamento que o presidente da OpenAI, Greg Brockman, pessoalmente acredita que a OpenAI alcançou AGI com o Astra, ou que este modelo, em retrospectiva, pode ser visto como a chegada da Inteligência Artificial Geral. Ele também deixou a classificação final para os usuários. A postagem oficial do produto da OpenAI apresenta o Astra de forma muito agressiva como uma nova geração de inteligência, mas não fornece certificação independente de que um limiar de AGI universalmente aceito foi ultrapassado.

O problema central é a definição. Não existe um teste universalmente aceito para AGI que, ao ser alcançado, qualifique objetivamente um modelo como "AGI". Um modelo pode quase saturar um único benchmark abstrato e ainda assim ficar atrás de modelos concorrentes em outras áreas, cometer erros, precisar de limites de segurança ou falhar em tarefas de longo prazo no mundo real. É exatamente isso que a própria tabela de benchmarks da OpenAI demonstra: o Astra é excepcionalmente forte no ARC-AGI-3, mas não é o líder no Humanity's Last Exam com ferramentas.

Portanto, a formulação mais sensata em termos factuais é: o GPT-6 Astra é um candidato excepcionalmente forte no debate atual sobre AGI, mas a alegação de AGI da OpenAI permanece uma avaliação da empresa e da gestão. Se a pesquisa e o público também considerarem este limiar alcançado, dependerá da definição de AGI utilizada e das réplicas independentes em uso real.

Controle de computador e agentes: onde o Astra se torna praticamente relevante

A mudança mais importante em relação a um modelo de chat clássico não é apenas mais conhecimento ou uma pontuação de codificação mais alta, mas a capacidade de executar tarefas diretamente. A OpenAI cita formulários, atualizações de CRM, organização de calendários, pesquisa, instalação de software, resolução de problemas, análise de dados e QA de front-end como exemplos. No OSWorld 2.0, o Astra atinge 72,6% em comparação com 65,7% no GPT-5.6 Sol. Na simulação de latência da OpenAI, o Astra levou aproximadamente 40 em vez de 75 minutos por tarefa – cerca de 47% menos tempo. Para as empresas, exatamente essa combinação de raciocínio, uso de computador e longo contexto pode ser mais importante do que um ponto percentual adicional em um benchmark de conhecimento. Um agente que entende corretamente uma tarefa, opera vários aplicativos e mantém o contexto por longos períodos, pode potencialmente mudar fluxos de trabalho inteiros. Ao mesmo tempo, isso também aumenta a importância de permissões, caixas de diálogo de confirmação, registro e limites claros.

O outro lado: O Astra atinge o limite "crítico" da OpenAI para segurança cibernética

A OpenAI classifica o GPT-6 Astra como seu primeiro modelo próprio a atingir o limite crítico de Cyber Capacities no Preparedness Framework. Sem proteção de produção, o Astra conseguiu, segundo a OpenAI, encontrar vulnerabilidades desconhecidas e desenvolver exploits contra sistemas endurecidos. O modelo atinge 100% no ExploitBench e 42,4% no ExploitGym. Quem quiser entender melhor o funcionamento deste benchmark encontrará uma explicação detalhada em Zerlo sobre ExploitGym e o desenvolvimento de exploits assistido por IA.

A OpenAI responde a isso com mecanismos de proteção mais fortes e restrições para tarefas cibernéticas ofensivas avançadas. Ao mesmo tempo, há uma segunda observação desconfortável: em testes especialmente construídos de forma adversária, o raciocínio escrito do Astra foi mais difícil de monitorar do que o do GPT-5.6 Sol. A OpenAI atribui isso, entre outros fatores, ao fato de que o Astra tem mais controle sobre seu raciocínio escrito e pode resolver problemas mais simples com menos etapas intermediárias visíveis. A empresa descreve a diminuição da monitorabilidade como um sério tópico de pesquisa.

Isso só parece contraditório à primeira vista com a afirmação da OpenAI de que o Astra está mais "alinhado". Um modelo pode permanecer dentro dos limites definidos com mais frequência em comportamento normal e, ainda assim, possuir capacidades tecnicamente mais perigosas. É exatamente por isso que o comportamento do modelo, a capacidade subjacente e os sistemas de proteção externos devem ser considerados separadamente.

O que o GPT-6 Astra significa para usuários e desenvolvedores?

Para usuários normais do ChatGPT, a questão de curto prazo mais importante é o rollout. Quem usa Plus, Pro, Business ou Enterprise não deve assumir que a falta de acesso ao Astra em 5 de setembro já é um erro. A OpenAI fala explicitamente de uma liberação gradual ao longo de vários dias.

Para desenvolvedores, a decisão é mais econômica. O Astra vale a pena principalmente onde uma única execução bem-sucedida tem alto valor: agentes de codificação complexos, grandes repositórios, automação de uso de computador, pesquisa sofisticada ou fluxos de trabalho profissionais longos. Para classificação simples, geração curta de texto ou tarefas em massa sensíveis ao custo, um modelo menor pode continuar sendo mais sensato. O alto preço de saída de US$ 50 por um milhão de tokens e os adicionais para contextos muito longos tornam uma escolha de modelo limpa mais importante, não menos importante.

Para empresas, há um terceiro fator: governança. Um agente mais capaz não deve receber automaticamente mais direitos. Especialmente em sistemas de arquivos, navegadores, e-mail, aplicativos internos e recursos em nuvem, permissões mínimas, confirmações para ações irreversíveis e trilhas de auditoria rastreáveis devem permanecer o padrão.

FAQ

Quando o GPT-6 Astra foi lançado?

A OpenAI apresentou o GPT-6 Astra em 3 de setembro de 2026. O rollout começou em um número limitado de organizações e será gradualmente expandido para ChatGPT Plus, Pro, Business e Enterprise, bem como para a API, Microsoft Azure e AWS Bedrock.

O GPT-6 Astra já está disponível no ChatGPT Plus?

A OpenAI anunciou explicitamente o Plus para o rollout. Como a liberação ocorre ao longo de vários dias, uma conta Plus elegível pode não mostrar acesso ao Astra em 5 de setembro de 2026. Isso, por si só, ainda não é um indicativo de um erro técnico.

Quanto custa o GPT-6 Astra na API?

O preço padrão é de US$ 10 por 1 milhão de tokens de entrada e US$ 50 por 1 milhão de tokens de saída. A entrada em cache custa US$ 1 e as gravações em cache US$ 12,50 por milhão de tokens. Solicitações com mais de 272.000 tokens de entrada estão sujeitas a multiplicadores mais altos.

Qual é o tamanho da janela de contexto do GPT-6 Astra?

A documentação da API da OpenAI menciona uma janela de contexto de 1.050.000 tokens e um máximo de 128.000 tokens de saída. No entanto, solicitações muito longas não são apenas tecnicamente mais exigentes, mas também mais caras a partir de mais de 272.000 tokens de entrada.

O GPT-6 Astra realmente atingiu a AGI?

Isso não é objetivamente comprovado. Greg Brockman disse que ele pessoalmente acredita que a OpenAI atingiu a AGI, ou que o Astra pode ser considerado o início da era AGI. No entanto, não existe um benchmark científico universalmente aceito que defina um limiar de AGI universal. A alegação deve, portanto, ser lida como uma avaliação da OpenAI e não como um fato científico concluído.

O GPT-6 Astra é mais seguro que o GPT-5.6 Sol?

A OpenAI relata melhores resultados em vários testes de alinhamento e limites, ao mesmo tempo em que o Astra possui capacidades cibernéticas significativamente mais fortes e é mais difícil de monitorar em testes adversários por meio de seu raciocínio escrito. "Mais seguro" depende, portanto, se você considera o comportamento, as capacidades subjacentes ou a monitorabilidade.

Conclusão

O GPT-6 Astra é um lançamento real e tecnicamente extraordinário, não um mero rumor. Os pontos confirmados mais fortes são a janela de contexto de 1,05 milhão de tokens, avanços significativos em Computer Use e Coding, e os valores extremamente altos em benchmarks de ARC-AGI-3, FrontierMath e Cybersecurity. Ao mesmo tempo, uma imagem diferenciada continua necessária: o Astra não é líder em todas as comparações, o rollout ainda está em andamento e a nova capacidade cibernética cria riscos de segurança adicionais.

A alegação de AGI da OpenAI é, portanto, a parte do lançamento que mais precisa de contextualização. A declaração de Brockman é notável, mas uma pontuação quase perfeita no ARC-AGI-3 por si só não transforma uma definição controversa em um fato científico concluído. Para os usuários, o Astra é, acima de tudo, um novo e muito poderoso modelo ChatGPT e de agentes; se ele realmente será considerado o início da era AGI retroativamente, só será revelado por meio de testes independentes e uso real a longo prazo.

Compartilhe nossa publicação!
Fontes