- GPT-6 Astra — флагманская reasoning-модель OpenAI от 3 сентября 2026, для самых тяжёлых сквозных задач: сложное рассуждение, код, Computer Use, исследования и длинные документы
- ID модели в API —
gpt-6-astra, с 4 сентября; стандартная цена вход $10 / выход $50 (за миллион токенов); бесплатный уровень API не поддерживается - В ChatGPT Plus не кладёт Astra в обычный селектор Chat; вход — в Work и Codex. GPT-6 Pro в стандартном Chat — для Pro / Business / Enterprise
- Она примерно в 2,5 раза дороже GPT-5.6 Sol. Повседневный цикл оставляйте на Sol; сложные кейсы, длинные агенты и Computer Use — повышать. Длинные прогоны требуют Cloud Mac, который не засыпает
OpenAI 3 сентября 2026 объявила GPT-6 Astra и на следующий день положила API-модель gpt-6-astra в документацию для разработчиков. Официальная фраза: «Наша самая сильная модель, построенная для самых трудных сквозных работ.» Разработчику нужен не слоган, а ответы: чем она отличается от GPT-5.6 Sol, сколько стоит, какой вход в ChatGPT кликается и стоит ли менять маршрутизацию по умолчанию.
Текст собран по странице модели OpenAI, странице цен и справочному центру ChatGPT. Цены и входы — по документации, видимой 8 сентября 2026. Пока идёт поэтапный релиз, ориентир — селектор модели в продукте.
Что такое GPT-6 Astra
GPT-6 Astra — самый сильный текстовый флагман OpenAI из публичных, а не очередная модель «чуть плавнее болтает». Документация ставит её на самые трудные сквозные работы: сложное рассуждение, программная инженерия, Computer Use, исследования и работа с документами. На входе текст и изображение, на выходе текст; аудио и видео в модальности не входят.
По сравнению с предыдущей ступенью GPT-5.6 Sol скачок сидит в длительности задачи и инструментальном цикле: Astra рассчитана на то, чтобы в одном запросе связать код на уровне репозитория, работу с рабочим столом, поиск и письмо — а не чтобы вы каждые две минуты жали «продолжить». Это та же отраслевая линия, что и у Claude Fable 5, которая вывела длинных агентов на первый план — конкуренция уходит от одиночного ответа к работе, которую доводят без присмотра.
Отсечка знаний официально — 30 апреля 2026. Нужны более свежие факты — идите через Web search и похожие инструменты; не считайте, что она знает мир после мая.
Дата выхода и график запуска
| Дата (2026) | Что произошло | Чем можно пользоваться |
|---|---|---|
| 3 сентября | OpenAI объявляет GPT-6 Astra | Сначала видят доверенные предприятия Daybreak; справочный центр пишет про «ближайшие дни» для платных тарифов |
| 4 сентября | API-модель gpt-6-astra в проде |
Платные API-аккаунты могут вызывать; бесплатный уровень явно не поддерживается |
| С 4 сентября | ChatGPT Plus / Business раскатывают в Work и Codex | Обычный селектор Chat для Plus по-прежнему не главный вход в Astra |
| День текста (8 сентября) | Поэтапный релиз ещё идёт | Один аккаунт на разных поверхностях может расходиться; Enterprise по умолчанию выключен |
OpenAI также упоминает последующую выдачу через Azure и AWS Bedrock. Пока карточек на маркетплейсе нет, не прошивайте эти ID в продакшен-маршруты заранее. На стороне Codex параллельно идёт эксперимент «заметки через несколько окон контекста»: длинные сессии больше не сжимают в одно резюме каждый раз, старые окна остаются доступны для поиска. Это продуктовый сигнал для длинного кода, не SLA.
Функции: уровни рассуждения, инструменты и Computer Use
Список способностей Astra сжимается в три слоя: думать глубже, уметь инструменты, держать длинный контекст.
- Уровни рассуждения:
reasoning.effortподдерживаетlow,medium,high,xhigh,max. Шлюзы часто по умолчанию ставятlow. Сложные кейсы поднимайте, не крутите каждый запрос наmax. - Спеки: около 1,05 млн токенов контекста, не больше 128 000 выходных токенов. Очень длинный промпт включает правило надбавки в следующем разделе.
- Структурированные возможности: стриминг, вызов функций и Structured Outputs доступны; донастройка не поддерживается.
- Инструменты Responses API: Web search, File search, генерация изображений, Code interpreter, Hosted shell, Apply patch, Skills, Computer Use, MCP, Tool search.
Для разработчиков iOS / macOS по-настоящему новое — Computer Use + Hosted shell + Apply patch в одной сессии: править файлы, гонять команды, смотреть результат. Как только модель стала сильнее, узкое место сразу уезжает в среду исполнения, которая засыпает на полпути — ноутбук закрыли, агент оборвался.
OpenAI опубликовала часть собственных оценок (без единой сторонней проверки): Terminal-Bench 4 около 57,7, DeepSWE около 74,1, GPQA около 96,0, BrowseComp около 91,5. Считайте это «сигналом направления», не пунктом приёмки в договоре. Как и в рейтинге инструментов для кода: бенчмарк говорит «более жёсткие репозитории по зубам», а не «ваш монорепозиторий сольётся за ночь».
Как соотносятся GPT-5.6 и GPT-6 Pro
В сентябрьской волне легче всего запутаться в именах. Astra — флагман под капотом; GPT-6 Pro — продуктовое имя на поверхности Chat.
| Что видно в интерфейсе | Фактическая модель | Кто может пользоваться |
|---|---|---|
| GPT-6 Astra | Сам флагман | API; ChatGPT Work / Codex (платные тарифы в раскатке) |
| GPT-6 Pro | Высокий ярус Chat на Astra | Стандартный Chat у Pro, Business, Enterprise |
| GPT-5.6 Sol | Рабочая лошадка предыдущей ступени | Дефолт платного Chat; в API по-прежнему повседневный высокочастотный контур |
| GPT-5.6 Terra / Luna | Средний / лёгкий | Work, Codex, API; в обычном Chat чаще недоступны. Free и Go обычно видят Luna |
Если пользователь Plus не находит Astra в обычном диалоге, это не значит «не открыли». OpenAI кладёт Astra для Plus в Work (делать работу) и Codex (писать код), а GPT-6 Pro в стандартном Chat оставляет более высоким тарифам. Пространства Enterprise по умолчанию выключены — админ должен открыть права на модель.
API: ID модели, эндпоинты и нюансы вызова
Стабильный ID для конфига — gpt-6-astra. Снимочные алиасы сейчас указывают на ту же строку; если нужно зафиксировать версию, смотрите таблицу Snapshots на странице модели — не выдумывайте суффикс с датой.
В документации как основные эндпоинты указаны Chat Completions (v1/chat/completions) и Responses (v1/responses). Инструментальный цикл, Computer Use и MCP идут через Responses. RPM/TPM бесплатного уровня — «не поддерживается»; квота появляется с Tier 1 и растёт вместе со ступенью использования.
Поставьте model в gpt-6-astra и управляйте глубиной мысли через reasoning.effort. По умолчанию low для проверки маршрута, затем high / xhigh, если задача того стоит. Search, Computer Use и другие инструменты тарифицируются отдельно — не смотрите только на цену токена.
const response = await client.responses.create({
model: "gpt-6-astra",
reasoning: { effort: "high" },
input: "Найди в репозитории таймаут оплаты, дай минимальный diff исправления и укажи команду проверки."
});
Для продакшена: Sol остаётся циклом по умолчанию, Astra — повышением. Триггер — оценки или ручная выборка, не каждое предложение пользователя на max. Смена модели — тот же harness; тот же принцип, что в сравнении цен и производительности LLM.
Цены: стандарт, кэш, длинный контекст, Fast / Batch
Ниже — цифры со страницы цен OpenAI на день текста: доллары за миллион токенов. Вызовы инструментов (поиск, Computer Use и т. д.) считаются отдельно.
| Ступень | Вход | Кэшированный вход | Запись в кэш | Выход |
|---|---|---|---|---|
| Astra Standard · короткий контекст | $10 | $1 | $12.50 | $50 |
| Astra Standard · длинный контекст (>272K входа) | $20 | $2 | $25 | $75 |
| Astra Batch / Flex | 50% стандартной цены | |||
| Astra Fast | 2× применимой ступени (официально около 2,5× быстрее) | |||
| Акция GPT-5.6 Sol (как минимум до 21 ноября) | $4 | $0.40 | $5 | $20 |
- 272K — выключатель на весь заказ. Как только вход перешёл черту, длинный контекст применяется ко всему запросу, а не только к хвосту.
- Запись в кэш стоит 1,25× незакэшированного входа. Первый залив большого репозитория недёшев; тариф $1 начинается с последующих попаданий.
- Fast удваивает счёт. Нормально для интерактивного ожидания; ночные пакеты оставляйте на Standard или Batch/Flex.
- Квота подписки ChatGPT ≠ штучная цена API. Акция Sol снижает измеряемый расход, но не дарит Plus лишнюю треть сообщений.
Грубая оценка: те же 1 млн входа + 100 тыс. выхода в акции Sol около $6, Astra Standard около $15, Fast Astra около $30. Агентские циклы умножают на число кругов. Более полный каркас «API vs облачный хост vs локально» — в недавнем сравнении стоимости вычислений для AI Agent.
Как пользоваться в ChatGPT (по тарифу)
В день релиза самая частая путаница: «Официально Plus может — почему в Chat не выбирается?» Ответ — другая поверхность (surface), а не сломанный аккаунт.
Plus: через Work и Codex
- Откройте ChatGPT Desktop (Work в вебе / на телефоне крутится в облаке; Codex в основном десктоп).
- Вверху слева переключитесь с Chat на Work или откройте вид Codex.
- В переключателе этой поверхности выберите GPT-6 Astra.
- Пользователям CLI поднимите Codex CLI до 0.153.0 или новее и обновите Desktop. Старый CLI просто прячет Astra.
Квоты Work и Codex считаются отдельно от обычного Chat. Длинные задачи списывают по «сколько работы сделано», а не по «сколько сообщений». Квота кончилась — перейдите на Sol / Terra или ждите сброса; прыжки по поверхностям чашку не доливают. Про недельные лимиты см. что делать, когда недельный лимит Codex исчерпан.
Pro / Business / Enterprise
GPT-6 Pro (на Astra) стоит в стандартном Chat для Pro, Business и Enterprise. Квота сообщений Pro у Business общая с GPT-5.6 Sol Pro: переключение туда-сюда вторую порцию не даёт. Enterprise при старте выключен — админ пространства должен открыть доступ к модели.
Free и Go: в стандартном Chat первая линия по-прежнему GPT-5.6 Luna — без Astra / GPT-6 Pro.
Когда переключаться на Astra
- Оставаться на Sol: повседневный парный режим, короткие diff, высокочастотные инструментальные циклы, пакетное извлечение с чувствительной ценой. Акция держится как минимум до 21 ноября — по-прежнему рабочая лошадка по умолчанию.
- Поднимать на Astra: межмодульный рефакторинг, модель сама гоняет тесты и правит, Computer Use за рабочим столом, длинный документ за один заход, исследовательский обход. Бюджет считайте в «человеко-днях инженера», не в сообщениях чата.
- Не повышать из-за имени: скопировать ту же фразу из Chat в Work Plus умнее не сделает — только быстрее сожжёт квоту.
- Против Claude / Gemini фиксируйте harness: тот же репозиторий, те же тесты, тот же таймаут. Оценку моделей не ставьте на тот же компьютер, что повседневную разработку.
Почему длинные задачи нужно держать на Cloud Mac
Computer Use, Hosted shell и длинные сессии Codex у Astra требуют той же жёсткости, что и Fable 5: сессия не должна рваться, нужна настоящая toolchain macOS, диск и память должны хватать, лучше та же машина, что и CI.
- Без засыпания: часовые и ночные задачи не переживают сон ноутбука. Локальный desktop Work может синхронизировать контекст в облако, но
xcodebuildи симулятор принимаются только на Mac. - Настоящая toolchain: после Apply patch в Swift тесты должны бежать на той же машине; холодный старт macOS у GitHub-hosted растягивает цикл агента.
- Сравнительные оценки: Astra vs Sol vs Fable 5 должны параллельно гонять один и тот же набор скриптов — история с GPU/RAM ноутбука взрывается первой.
ID модели в следующем году снова могут сменить, хост и workflow ломать не обязательно. Положите циклы Codex / Agent на Vuncloud Cloud Mac, ноутбук пусть только читает diff — это общая физическая прослойка флагманских моделей 2026 года, а не придаток одной компании.
FAQ
Что такое GPT-6 Astra?
Флагманская reasoning-модель OpenAI от 3 сентября 2026 для сложного рассуждения, кода, Computer Use, исследований и длинных документов. ID API: gpt-6-astra.
Когда вышла?
Анонс 3 сентября, API 4 сентября. Тарифы ChatGPT раскатываются по поверхностям; ориентир — справочный центр и селектор в продукте.
Сколько стоит API?
Стандарт, короткий контекст: $10 вход / $1 кэшированный вход / $12.50 запись в кэш / $50 выход (за миллион токенов). Вход свыше 272K — весь заказ по цене длинного контекста. Batch/Flex половина, Fast вдвое. Бесплатный уровень API не поддерживается.
Plus может?
Да, но в Work и Codex, не в обычном селекторе Chat. GPT-6 Pro в стандартном Chat — для более высоких тарифов.
Astra и GPT-6 Pro — одно и то же?
Один флагман под капотом. Chat показывает GPT-6 Pro; Work, Codex и API используют Astra / gpt-6-astra.
Насколько длинный контекст?
Около 1,05 млн токенов контекста, не больше 128 000 выхода; отсечка знаний 2026-04-30. Вход свыше 272K дороже.
Заключение
Три фразы в финале: Astra — флагман OpenAI сентября 2026; дорого стоит длинный инструментальный цикл, не тон чата; пользователям Plus нужно идти в Work / Codex, а не ждать в обычном Chat. Маршрут по умолчанию оставляйте Sol, сложные кейсы повышайте. Сначала посчитайте выключатель 272K и множитель Fast — потом решайте, отдавать ли репозиторий на всю ночь.
Модели снова сменят имена. Готовить нужно среду исполнения, которая не рвётся, и правило повышения, написанное ясно.
Чтобы Astra всю ночь правила репозиторий, нужен Mac, который не засыпает
Положите Codex / Computer Use на Cloud Mac: длинный прогон в tmux, xcodebuild на той же машине, DerivedData на месте. Ноутбук только читает diff.
Ещё по теме
- Как выгоднее приобрести вычислительные ресурсы для AI Agent в 2026 году? Сравнение облака, API и локальной среды
- Цены, конфиг, производительность и аудитории LLM 2026—полный разбор
- Исчерпан недельный лимит Codex? 7 решений, механика квот и альтернативные API (2026)
- От Opus 4.8 к Fable 5: что на самом деле изменилось в апгрейде Anthropic
- Лучшие AI-инструменты для программирования в 2026: Claude, Cursor, GitHub Copilot, Codex, Gemini