Vuncloud Блог
← Вернуться к заметкам разработчика

Как выбрать GPT-5.6 Sol, Terra или Luna? Сравнение производительности, цены и скорости (2026)

Позиционирование и цены · Выбор в три шага · Рассуждение max / ultra · Явное кэширование · Отличия от GPT-5.5 · Оптимизация затрат~11 мин чтения

Команда разработчиков обсуждает выбор AI-модели, символизируя сравнение и решение между GPT-5.6 Sol, Terra и Luna

«Чем отличаются Sol, Terra и Luna? Какую модель использовать для повседневного кодинга? max и ultra — это одно и то же?»

После запуска GPT-5.6 первый вопрос разработчиков часто не «стоит ли обновляться», а как маршрутизировать три уровня. OpenAI изменил правила именования: цифра обозначает поколение модели, Sol / Terra / Luna — стабильные уровни возможностей между поколениями — скоро вы увидите комбинации вроде «GPT-5.7 Sol» или «GPT-6 Terra». Выбирайте по уровню, а не учите новые имена при каждом релизе.

Эта статья сосредоточена на сравнении и выборе: чем отличаются три уровня, какой подходит для какого сценария, как настроить рассуждение, как новое кэширование экономит деньги. О фоне запуска и проверке правительством см. полный обзор GPT-5.6.

Terra
Стандарт на каждый день: производительность близка к GPT-5.5, цена вдвое ниже
$1–$5
Диапазон цен ввода трёх уровней (за миллион токенов)
5+1
Уровни рассуждения (minimal→xhigh) + эксклюзивный max для Sol

1. Три модели: позиционирование и цены

Сначала цены и позиционирование рядом. Единица: за 1 миллион токенов, ввод и вывод считаются отдельно — запомните: вывод всегда в 5–6 раз дороже ввода. Экономить — значит меньше выводить и выбирать правильный уровень.

Модель Model ID Позиционирование Ввод (/1M) Вывод (/1M)
Sol gpt-5.6-sol Флагман: сильнейшая модель на сегодня; скачок в коде / биологии / кибербезопасности; рассуждение max и суб-агенты ultra $5.00 $30.00
Terra gpt-5.6-terra Баланс на каждый день: производительность сопоставима с GPT-5.5, стоимость вдвое ниже $2.50 $15.00
Luna gpt-5.6-luna Быстро и экономично: самый дешёвый уровень OpenAI; Luna тоже значительно усилена благодаря улучшенным уровням рассуждения в кибербезопасности $1.00 $6.00

Новое правило именования: поколение × уровень

Цитата OpenAI: «В новой системе именования, представленной с GPT-5.6, цифра обозначает поколение модели, а Sol, Terra и Luna — стабильные уровни возможностей, развивающиеся каждый в своём темпе.» Короче: Terra — стандарт ($2,50/$15), Sol — для сложных задач ($5/$30), Luna — для лёгкой работы ($1/$6) — названия уровней стабильны между поколениями.

2. Выбор по сценарию (метод трёх шагов)

Главный принцип одной фразой: по умолчанию Terra — OpenAI называет это «производительность сопоставима с GPT-5.5, стоимость вдвое ниже», sweet spot цены и качества. Sol — для критических задач, с которыми Terra не справляется; Luna — для явно простой работы.

Модель Позиционирование Типичные задачи
Terra Стандарт на каждый день Обычный код, работа с знаниями, поддержка, общие agentic-задачи — в сомнительных случаях этот
Sol Сложные задачи Сложный код (Terminal-Bench 2.1 SOTA), биологические workflow, исследование уязвимостей, долгосрочное планирование
Luna Лёгкий уровень Классификация, суммаризация, пакетная обработка, массовая дешёвая инференция, простые задачи с низкой задержкой

Метод трёх шагов (просто следуйте):

  1. По умолчанию Terra — не раздумывайте, основные задачи сразу Terra.
  2. Явно простая работа / большой объём / чувствительность к задержке? Классификация, суммаризация, форматирование, миллионы записей в batch → переходите на Luna.
  3. Terra не справился / долгосрочная сложная agentic-задача? Тогда Sol, с уровнем max или режимом ultra.

Не «пробуй от дешёвого к дорогому»

Основные задачи сразу Terra — переделка через Luna часто обходится дороже. Sol только если Terra не хватает — та же логика, что «Opus на каждый день, Fable для сложного» у Claude. Если вы уже знакомы с выбором моделей Claude, перенесите подход.

3. Что изменилось по сравнению с GPT-5.5

Если вы мигрируете с GPT-5.5, вот пять ключевых изменений:

Измерение GPT-5.5 GPT-5.6
Правило именования Единое имя GPT-5.5 Цифра (поколение) + Sol/Terra/Luna (уровни), стабильны между поколениями
Цена на каждый день Полная цена GPT-5.5 ($5/$30) Terra примерно вдвое дешевле ($2,50/$15), сопоставимая производительность
Уровни рассуждения low / medium / high / xhigh Sol добавляет max — максимальное время рассуждения для самых сложных задач
Режим совместной работы Один агент Режим ultra — суб-агенты параллельно, ускоряет сложную работу
Кэш prompt Неявный кэш, непредсказуемое поведение Явные точки кэширования + минимум 30 мин; запись 1,25×, чтение 0,10×

Официальные highlights бенчмарков (уровень Sol):

  • Terminal-Bench 2.1 (командные workflow: планирование / итерация / координация инструментов) — Sol новый SOTA
  • GeneBench v1 (долгосрочная геномика и количественная биология) — Sol обходит GPT-5.5 с меньшим числом токенов
  • ExploitBench (исследование уязвимостей в кибербезопасности) — Sol конкурирует с Mythos Preview при ~1/3 токенов вывода
  • ExploitGym (UC Berkeley + OpenAI) — Sol / Terra / Luna все значительно усилены с ростом интенсивности рассуждения
Разработчики в совместном программировании, символизируя выбор между GPT-5.6 Terra как стандартом и Sol для сложных задач
Повседневный код: Terra по умолчанию; Sol + max только для задач уровня Terminal-Bench

4. Уровни рассуждения & режим ultra

GPT-5.6 сохраняет уровни интенсивности рассуждения серии GPT-5; Sol добавляет max — их часто путают:

Уровень Применение Тенденция по стоимости
minimal Минимальный уровень в Codex CLI, почти без размышлений, прямой ответ Очень экономично
low Классификация, простые запросы, чувствительность к задержке, низкая интеллектуальная нагрузка Самый экономичный
medium Обычные запросы с балансом стоимости и качества Сбалансированно, скорее экономично
high Рекомендуется — sweet spot для большинства интеллектуальных задач Рекомендуется
xhigh Сложный код / длинные agentic-задачи Ориентация на качество
max НОВЫЙ · Sol Самые сложные задачи; точность >> стоимость Самый дорогой

Частая путаница: max ≠ ultra

  • max — уровень интенсивности рассуждения: один агент думает дольше, подходит для глубокой инференции без параллелизации.
  • ultra — режим совместной работы: суб-агенты параллельно ускоряют сложную работу, подходит для разложимых многопутевых задач (мультиугольный review, параллельное исследование).
  • Официальные данные: Sol Ultra набирает 91,9% на Terminal-Bench 2.1 против 88,8% у базового Sol.

Параметры — в документации OpenAI API. Повседневная конфигурация Codex CLI:

  • Сложные задачи: codex -m gpt-5.6-sol -c model_reasoning_effort="max"
  • Повседневно: в ~/.codex/config.toml model = "gpt-5.6-terra" + model_reasoning_effort = "high", затем просто codex

5. Новые правила кэширования prompt

Для GPT-5.6 и всех новых моделей изменились тарификация и поведение кэша. Три пункта:

Пункт Правило
Явные точки кэширования Явная разметка в prompt вместо неявного поведения — вы контролируете, какой фрагмент попадает в кэш
Срок жизни кэша Минимум 30 минут — больше не инвалидируется через секунды
Цена записи Запись в кэш стоит 1,25× тарифа некэшированного ввода
Цена чтения Чтение из кэша даёт скидку 90% (10% от тарифа)

Пример расчёта при вводе Terra $2,50/M:

  • Некэшированный ввод (первый вызов): $2,50
  • Запись в кэш (первый вызов с точкой): $2,50 × 1,25 = $3,125
  • Чтение из кэша (hit за 30 мин): $2,50 × 10% = $0,25

Вывод: если длинный prompt (system prompt, справочные документы, codebase) попадает в кэш ≥ 3 раза за 30 минут — это выгодно: запись на 25% дороже, чтение всего 10%. Чем длиннее контекст (RAG, длинные agent-сессии), тем больше эффект.

6. Способы доступа: API / Codex / ChatGPT

Канал Текущий статус Переключение модели
API Постепенное открытие с 9 июля В теле запроса model: "gpt-5.6-terra" и т.д.
Codex CLI Открывается параллельно Селектор /model · codex -m gpt-5.6-sol · config.toml
ChatGPT Постепенный rollout, не всё сразу Селектор покажет Sol / Terra / Luna (зависит от аккаунта)
Cerebras Fast Июль, избранные клиенты Sol до 750 токенов/с, подходит для низкой задержки

Если в ChatGPT вы ещё не видите три уровня — это нормально, OpenAI раскатывает постепенно. Следите за меню моделей или официальными объявлениями.

7. Оптимизация затрат — краткий справочник

Три главных рычага экономии с GPT-5.6:

Рычаг Действие Экономия
Правильный уровень Terra по умолчанию, Luna для простого, Sol только при необходимости Без переразмерения
Явное кэширование Точки кэширования для длинного system prompt / документов / codebase На стороне ввода
Снизить рассуждение Низкая интеллектуальная нагрузка: low / medium; max только если точность >> стоимость На стороне вывода
Сжать вывод Структурированный вывод (JSON schema), «только вывод / только код», лимит слов На стороне вывода
Batch API Задачи с допустимой задержкой через Batch API (50% скидка в долгосрочной политике) Все токены −50%

Три приёма экономии

  • Terra по умолчанию, не повышать до Sol
  • Точки кэширования для длинных prompt
  • Рассуждение с high, а не max

Это главные рычаги. Более системный подход — руководство по ценам LLM и оптимизация затрат Claude Code.

FAQ

Sol, Terra или Luna в повседневной работе?

По умолчанию Terra. В сомнительных случаях Terra; простые задачи / большой объём → Luna; Terra не хватает → Sol.

max и ultra — одно и то же?

Нет. max — глубокая инференция одного агента; ultra — параллельная работа суб-агентов. Разные измерения, комбинируются.

Сколько стоят три уровня?

Sol $5/$30, Terra $2,50/$15, Luna $1/$6 (за миллион токенов, ввод/вывод).

Когда явное кэширование становится выгодным?

Длинный prompt, попадающий в кэш ≥3 раза за 30 мин, обычно окупается. Чтение кэша Terra — всего $0,25/M.

Как переключить модель в Codex?

/model, codex -m gpt-5.6-terra или постоянная настройка в ~/.codex/config.toml.

Заключение

Как выбрать GPT-5.6 Sol, Terra или Luna? Одной фразой: Terra по умолчанию, Sol для сложного, Luna для простого — выбирайте по уровню возможностей, цифра лишь маркер поколения.

Повседневная работа начинается с Terra (половина цены GPT-5.5, сопоставимая производительность); Sol — только для самых сложных задач (с рассуждением max или суб-агентами ultra); Luna — для явно простой работы. Не пробуйте уровень за уровнем — отдавать основные задачи сразу Terra в 2026 году самая спокойная стратегия выбора GPT-5.6.

Agent GPT-5.6 для iOS / macOS сборок? Стабильный Cloud Mac

Ultra-субзадачи Sol с Xcode или TestFlight требуют стабильного узла выполнения macOS. Vuncloud предлагает выделенный Mac mini M4, помесячная аренда — сборки agent всю ночь без обрывов.

Посмотреть тарифы Cloud Mac · Полный обзор GPT-5.6

Цены и функции согласно официальной статье OpenAI, странице тарифов и документации Codex. Последнее обновление: 10 июля 2026.

Заметки разработчика · Выбор AI

GPT-5.6 Terra по умолчанию · Sol для сложного · Cloud Mac

Выбор трёх уровней · Маршрутизация Codex / API · Стабильные agent-узлы

Посмотреть тарифы Cloud Mac
Ограниченное предложение Посмотреть тарифы