GPT-6 Astra: Релиз, бенчмарки, цены и заявление OpenAI о AGI
GPT-6 Astra официально вышел. OpenAI представила новую флагманскую модель 3 сентября 2026 года, объявив о значительном скачке в управлении компьютером, программировании, математике, кибербезопасности и работе с длинными контекстами. Одновременно заявление президента OpenAI Грега Брокмана о том, что Astra может ознаменовать начало эры AGI, привлекает не меньше внимания, чем сами показатели бенчмарков.
По состоянию на 5 сентября 2026 года доступ еще предоставляется поэтапно. Поэтому в данной статье мы разделим подтвержденные данные о продукте и самооценку OpenAI: сколько на самом деле стоит GPT-6 Astra, кому будет доступен ChatGPT Astra, какие бенчмарки особенно сильны, где конкурентные модели по-прежнему лидируют, и почему 99,9% оценка на ARC-AGI-3 еще не является научным доказательством AGI.
Кратко и ясно
- Релиз: OpenAI представила GPT-6 Astra 3 сентября 2026 года. Развертывание началось с ограниченного числа организаций, после чего планируется охватить Plus, Pro, Business и Enterprise.
- API: Модель называется gpt-6-astra и также будет доступна через Microsoft Azure и AWS Bedrock.
- Цена: В стандартном API 1 миллион входных токенов стоит 10 долларов США, а 1 миллион выходных токенов — 50 долларов США. Кэшированный ввод стоит 1 доллар США за миллион токенов.
- Бенчмарки: Особенно выделяются 99,9% на ARC-AGI-3, 97,6% на FrontierMath Tier 4, 100% на ExploitBench и 72,6% на OSWorld 2.0.
- Не везде номер один: На Humanity's Last Exam с инструментами Astra показывает 57,2%, в то время как Claude Fable 5.1 достигает 65,0% в собственной сравнительной таблице OpenAI.
- AGI: Грег Брокман заявил, что лично он верит, что OpenAI достигла AGI. Это интерпретация менеджера OpenAI, а не независимо установленный научный факт.
Что такое GPT-6 Astra?
GPT-6 Astra — это новая флагманская модель OpenAI для особенно сложных комплексных задач. OpenAI позиционирует ее не просто как улучшенный чат-бот, а как модель, способную напрямую работать с программным обеспечением, управлять браузерами и настольными интерфейсами, писать код, проводить сложные исследования и генерировать профессиональные документы. В официальном анонсе OpenAI называет Astra своей самой «интеллектуальной и сфокусированной» моделью на сегодняшний день. Эта формулировка является оценкой производителя и не должна путаться с независимым рейтингом.
Технически особенно заметно большое контекстное окно. В документации API указано 1 050 000 токенов контекста и до 128 000 выходных токенов. Документированная дата среза знаний — 30 апреля 2026 года. Для рассуждений разработчики могут выбирать уровни low, medium, high, xhigh и max. Те, кто хочет проследить развитие предыдущего поколения, найдут на Zerlo также информацию о GPT-5.6 Sol и его развертывание ChatGPT.
Релиз GPT-6 Astra: кто получит ChatGPT Astra?
Запуск — это не глобальный переключатель, который был активирован для всех учетных записей одновременно 3 сентября. OpenAI начала с ограниченной группы организаций и объявила, что в последующие дни GPT-6 Astra будет развернут для ChatGPT Plus, Pro, Business и Enterprise. Клиентам Pro, Business и Enterprise также будет предоставлен доступ к GPT-6 Astra Pro. Для Enterprise Astra по умолчанию отключен при запуске и должен быть активирован администраторами для рабочей области.
Важно: OpenAI не указывает в анонсе Astra на общее предоставление доступа для бесплатных или Go-аккаунтов. Поэтому те, кто не видит модель 5 сентября 2026 года, могут просто еще находиться в процессе поэтапного развертывания, несмотря на то, что их тарифный план, в принципе, дает право на доступ. Использование Astra в ChatGPT, согласно OpenAI, включено в существующие тарифные квоты; дополнительное использование должно быть возможно через кредиты. Таким образом, отдельно анонсированного ежемесячного «тарифа Astra» нет.

Источник: simpleicons.org
GPT-6 Astra предлагается не только напрямую через OpenAI. OpenAI явно называет Microsoft Azure дополнительным путем предоставления для разработчиков и компаний.

Источник: simpleicons.org
AWS Bedrock также входит в объявленное развертывание Astra. Для существующих облачных архитектур это может быть важнее, чем прямой переход на API OpenAI.
Бенчмарки GPT-6 Astra: насколько велик скачок?
Самые сильные показатели находятся в областях, где агентные модели до сих пор быстро упирались в пределы: абстрактное решение проблем, управление компьютером, разработка программного обеспечения и задачи в области наступательной безопасности. В публикации OpenAI представлены как внешние бенчмарки, так и внутренние тесты. Особенно во внутренних оценках независимое воспроизведение, естественно, пока невозможно.
| Бенчмарк | GPT-6 Astra | GPT-5.6 Sol | Оценка |
|---|---|---|---|
| ARC-AGI-3 | 99,9 % | 7,8 % | Экстремально большой скачок в новых интерактивных задачах абстрагирования |
| FrontierMath Tier 4 (v2) | 97,6 % | 83,0 % | Очень высокая производительность в сложной математике |
| Terminal-Bench 4.0 | 57,9 % | 37,3 % | Значительный прогресс в агентном кодировании в терминале |
| OSWorld 2.0 | 72,6 % | 65,7 % | Лучшее управление компьютером; OpenAI также сообщает о значительном сокращении времени выполнения задач |
| AutomationBench | 41,4 % | 18,1 % | Более чем в два раза более высокий балл в задачах профессиональной автоматизации |
| ExploitBench | 100,0 % | 78,5 % | Демонстрирует очень сильную способность к разработке эксплойтов в контролируемых тестах |
Эти цифры впечатляют, но им нужен контекст. OpenAI сама указывает, что оценки GPT проводились в исследовательской среде или через API. Производственный ChatGPT может давать немного другие результаты из-за других системных промтов, инструментов и механизмов безопасности. Кроме того, в сравнительной таблице показаны наилучшие результаты для различных уровней сложности рассуждений.
Астра также не выигрывает каждый тест. Хорошим примером противоположного является Humanity's Last Exam с инструментами: Astra достигает 57,2%, в то время как Claude Fable 5.1 в той же таблице OpenAI указан с 65,0%. Индекс искусственного аналитического интеллекта (Artificial Analysis Intelligence Index) у Astra составляет 61,2, также ниже нескольких моделей Claude, перечисленных там. Это противоречит упрощенному утверждению, что Astra автоматически является лучшей моделью в каждом измерении.
Почему ARC-AGI-3 вызывает такой интерес
Скачок с 7,8% у GPT-5.6 Sol до 99,9% у GPT-6 Astra — это самый впечатляющий единичный показатель запуска. ARC-AGI-3 предназначен для проверки того, обнаруживает ли система правила в новых, интерактивных средах и действует ли она эффективно, а не просто извлекает известные шаблоны. ARC Prize Foundation заявила в посте о запуске OpenAI, что Astra превзошла базовый уровень человеческой эффективности действий на 96% уровней. Это сильный сигнал о новых возможностях решения проблем — но еще не общая мера всех человеческих способностей.
Цена GPT-6 Astra: сколько стоит API?
Для разработчиков структура ценообразования яснее, чем тарифы ChatGPT: OpenAI тарифицирует Astra в стандартном API на основе токенов. Значения указаны за 1 миллион текстовых токенов.
| Тарификация | Цена за 1 млн токенов |
|---|---|
| Входные | 10,00 долларов США |
| Кэшированный вход | 1,00 долларов США |
| Запись кэша | 12,50 долларов США |
| Выходные | 50,00 долларов США |
При очень больших промтах становится дороже: как только запрос содержит более 272 000 входных токенов, OpenAI рассчитывает для всего запроса двойную ставку для входных и кэшированных токенов, а также 1,5-кратную ставку для выходных токенов. Batch и Flex, согласно документации модели, стоят 50% от стандартных тарифов. Режим Fast, напротив, стоит в два раза больше соответствующего применимого тарифа и должен обеспечивать до двукратной скорости. Таким образом, максимальное контекстное окно технически привлекательно, но не обязательно экономически. Те, кто регулярно отправляет сотни тысяч токенов в агентных циклах, должны серьезно относиться к кэшированию промтов, выбору контекста и разделению задач. Более старый обзор Zerlo по ChatGPT 5.4 и его структура цен API показывает, насколько сильно сместились расходы между поколениями моделей.
Достигла ли OpenAI AGI с GPT-6 Astra?
Утверждение подтверждено — доказательство нет. Axios сообщил с брифинга для прессы после запуска, что президент OpenAI Грег Брокман лично считает, что OpenAI достигла AGI с Astra, или что эта модель может рассматриваться ретроспективно как прибытие Artificial General Intelligence. Одновременно он предоставил окончательную оценку пользователям. Официальный пост продукта OpenAI очень активно представляет Astra как новое поколение интеллекта, но не предоставляет независимой сертификации, согласно которой был бы превышен общепринятый порог AGI.
Основная проблема — определение. Для AGI не существует всемирно принятого теста, достижение которого автоматически делает модель «AGI». Модель может почти насытить один абстрактный бенчмарк и при этом отставать от конкурентных моделей в других областях, совершать ошибки, требовать пределов безопасности или терпеть неудачу в реальных долгосрочных задачах. Именно это и показывает собственная таблица бенчмарков OpenAI: Astra исключительно сильна на ARC-AGI-3, но не лидирует на Humanity's Last Exam с инструментами.
Поэтому наиболее фактически обоснованной формулировкой является: GPT-6 Astra — это исключительно сильный кандидат в текущей дискуссии об AGI, но заявление OpenAI об AGI остается оценкой компании и руководства. Будут ли исследования и общественность также считать этот порог достигнутым, зависит от используемого определения AGI и от независимых репликаций в реальном использовании.
Управление компьютером и агенты: здесь Astra становится практически релевантной
Самое важное изменение по сравнению с классической моделью чата — это не просто больше знаний или более высокий балл по кодированию, а способность выполнять задачи напрямую. OpenAI приводит в пример формы, обновления CRM, организацию календаря, исследования, установку программного обеспечения, устранение неполадок, анализ данных и QA пользовательского интерфейса. На OSWorld 2.0 Astra достигает 72,6% против 65,7% у GPT-5.6 Sol. В симуляции задержки OpenAI Astra потребовалось около 40 минут на задачу вместо 75 минут — примерно на 47% меньше времени. Для компаний именно это сочетание рассуждений, использования компьютера и длительного контекста может быть важнее, чем еще один процентный пункт на бенчмарке знаний. Агент, который правильно понимает задачу, может управлять несколькими приложениями и сохранять контекст на протяжении длительных процессов, потенциально меняет рабочие процессы. В то же время возрастает и важность разрешений, диалогов подтверждения, логирования и четких границ.
Обратная сторона: Astra достигает «критического» порога OpenAI в области кибербезопасности
OpenAI классифицирует GPT-6 Astra как свою первую собственную модель, достигшую порога критической важности в области кибервозможностей в рамках Preparedness Framework. По данным OpenAI, Astra смог находить неизвестные уязвимости и разрабатывать эксплойты против защищенных систем без производственной защиты. На ExploitBench модель достигает 100%, а на ExploitGym — 42,4%. Те, кто хочет лучше понять, как работает этот бенчмарк, найдут подробное объяснение Zerlo ExploitGym и разработка эксплойтов с использованием ИИ.
OpenAI реагирует на это усилением защитных механизмов и ограничений для продвинутых задач в области кибербезопасности. В то же время существует неприятное второе наблюдение: в специально созданных для противодействия тестах письменные рассуждения Astra было труднее отслеживать, чем у GPT-5.6 Sol. OpenAI частично объясняет это тем, что Astra имеет больший контроль над своими письменными рассуждениями и может решать более простые задачи с меньшим количеством видимых промежуточных шагов. Компания считает снижение мониторинговых возможностей само по себе серьезной исследовательской проблемой.
Это кажется противоречивым заявлению OpenAI о том, что Astra более «согласована», только на первый взгляд. Модель может чаще оставаться в пределах заданных ограничений в обычном поведении и при этом обладать технически более опасными возможностями. Именно поэтому поведение модели, базовые возможности и внешние системы защиты должны рассматриваться отдельно.
Что означает GPT-6 Astra для пользователей и разработчиков?
Для обычных пользователей ChatGPT самый важный краткосрочный вопрос — развертывание. Те, кто использует Plus, Pro, Business или Enterprise, не должны предполагать, что отсутствие доступа к Astra 5 сентября является ошибкой. OpenAI прямо говорит о поэтапном предоставлении доступа в течение нескольких дней.
Для разработчиков решение имеет более экономический характер. Astra особенно полезна там, где один успешный запуск имеет высокую ценность: сложные кодирующие агенты, большие репозитории, автоматизация использования компьютеров, требовательные исследования или длительные профессиональные рабочие процессы. Для простой классификации, короткой генерации текста или чувствительных к затратам массовых задач меньшая модель может по-прежнему быть более целесообразной. Высокая цена вывода в 50 долларов за миллион токенов и надбавки за очень длинный контекст делают правильный выбор модели более важным, а не менее важным.
Для компаний добавляется третий фактор: управление. Более мощный агент не должен автоматически получать больше прав. Особенно в отношении файловых систем, браузеров, электронной почты, внутренних приложений и облачных ресурсов, минимальные права доступа, подтверждения необратимых действий и отслеживаемые журналы аудита должны оставаться стандартом.
FAQ
Когда был выпущен GPT-6 Astra?
OpenAI представила GPT-6 Astra 3 сентября 2026 года. Развертывание началось в ограниченном числе организаций, а затем будет постепенно расширяться на ChatGPT Plus, Pro, Business и Enterprise, а также на API, Microsoft Azure и AWS Bedrock.
Доступен ли GPT-6 Astra уже в ChatGPT Plus?
OpenAI явно объявила о развертывании для Plus. Поскольку предоставление доступа осуществляется в течение нескольких дней, у авторизованной учетной записи Plus может по-прежнему не отображаться доступ к Astra 5 сентября 2026 года. Это само по себе не является признаком технической ошибки.
Сколько стоит GPT-6 Astra в API?
Стандартная цена составляет 10 долларов США за 1 миллион входных токенов и 50 долларов США за 1 миллион выходных токенов. Кэшированный ввод стоит 1 доллар США, а кэшированный вывод — 12,50 доллара США за миллион токенов. Запросы с более чем 272 000 входных токенов подлежат более высоким множителям.
Каково контекстное окно GPT-6 Astra?
В документации API OpenAI указано контекстное окно в 1 050 000 токенов и максимум 128 000 выходных токенов. Однако очень длинные запросы не только более требовательны технически, но и стоят дороже при более чем 272 000 входных токенов.
Действительно ли GPT-6 Astra достиг AGI?
Это не доказано объективно. Грег Брокман сказал, что лично считает, что OpenAI достигла AGI, или, скорее, Astra может считаться началом эры AGI. Однако не существует общепринятого научного бенчмарка, устанавливающего универсальный порог AGI. Поэтому это заявление следует рассматривать как оценку OpenAI, а не как окончательный научный факт.
Является ли GPT-6 Astra более безопасным, чем GPT-5.6 Sol?
OpenAI сообщает о лучших результатах в нескольких тестах на согласованность и граничные условия, но в то же время Astra обладает значительно более сильными кибервозможностями и ее труднее отслеживать в adversarial-тестах через письменные рассуждения. Поэтому «безопаснее» зависит от того, рассматриваете ли вы поведение, базовые возможности или отслеживаемость.
Заключение
GPT-6 Astra — это реальный и технически выдающийся релиз, а не просто слух. Наиболее подтвержденными моментами являются контекстное окно в 1,05 миллиона токенов, значительный прогресс в использовании компьютеров и кодировании, а также чрезвычайно высокие показатели на бенчмарках ARC-AGI-3, FrontierMath и кибербезопасности. В то же время требуется дифференцированный взгляд: Astra не является лидером в каждом сравнении, развертывание все еще продолжается, а новая киберпроизводительность создает дополнительные риски безопасности.
Заявление OpenAI о AGI поэтому является частью запуска, которая требует наибольшего пояснения. Заявление Брокмана примечательно, но почти идеальный результат ARC-AGI-3 сам по себе не превращает спорное определение в научно завершенный факт. Для пользователей Astra — это прежде всего очень мощная новая модель ChatGPT и агента; будет ли она в ретроспективе действительно считаться началом эры AGI, покажет только независимое тестирование и реальное долгосрочное использование.