«Чем отличаются Sol, Terra и Luna? Какую модель использовать для повседневного кодинга? max и ultra — это одно и то же?»
После запуска GPT-5.6 первый вопрос разработчиков часто не «стоит ли обновляться», а как маршрутизировать три уровня. OpenAI изменил правила именования: цифра обозначает поколение модели, Sol / Terra / Luna — стабильные уровни возможностей между поколениями — скоро вы увидите комбинации вроде «GPT-5.7 Sol» или «GPT-6 Terra». Выбирайте по уровню, а не учите новые имена при каждом релизе.
Эта статья сосредоточена на сравнении и выборе: чем отличаются три уровня, какой подходит для какого сценария, как настроить рассуждение, как новое кэширование экономит деньги. О фоне запуска и проверке правительством см. полный обзор GPT-5.6.
1. Три модели: позиционирование и цены
Сначала цены и позиционирование рядом. Единица: за 1 миллион токенов, ввод и вывод считаются отдельно — запомните: вывод всегда в 5–6 раз дороже ввода. Экономить — значит меньше выводить и выбирать правильный уровень.
| Модель | Model ID | Позиционирование | Ввод (/1M) | Вывод (/1M) |
|---|---|---|---|---|
| Sol | gpt-5.6-sol |
Флагман: сильнейшая модель на сегодня; скачок в коде / биологии / кибербезопасности; рассуждение max и суб-агенты ultra | $5.00 | $30.00 |
| Terra | gpt-5.6-terra |
Баланс на каждый день: производительность сопоставима с GPT-5.5, стоимость вдвое ниже | $2.50 | $15.00 |
| Luna | gpt-5.6-luna |
Быстро и экономично: самый дешёвый уровень OpenAI; Luna тоже значительно усилена благодаря улучшенным уровням рассуждения в кибербезопасности | $1.00 | $6.00 |
Новое правило именования: поколение × уровень
Цитата OpenAI: «В новой системе именования, представленной с GPT-5.6, цифра обозначает поколение модели, а Sol, Terra и Luna — стабильные уровни возможностей, развивающиеся каждый в своём темпе.» Короче: Terra — стандарт ($2,50/$15), Sol — для сложных задач ($5/$30), Luna — для лёгкой работы ($1/$6) — названия уровней стабильны между поколениями.
2. Выбор по сценарию (метод трёх шагов)
Главный принцип одной фразой: по умолчанию Terra — OpenAI называет это «производительность сопоставима с GPT-5.5, стоимость вдвое ниже», sweet spot цены и качества. Sol — для критических задач, с которыми Terra не справляется; Luna — для явно простой работы.
| Модель | Позиционирование | Типичные задачи |
|---|---|---|
| Terra | Стандарт на каждый день | Обычный код, работа с знаниями, поддержка, общие agentic-задачи — в сомнительных случаях этот |
| Sol | Сложные задачи | Сложный код (Terminal-Bench 2.1 SOTA), биологические workflow, исследование уязвимостей, долгосрочное планирование |
| Luna | Лёгкий уровень | Классификация, суммаризация, пакетная обработка, массовая дешёвая инференция, простые задачи с низкой задержкой |
Метод трёх шагов (просто следуйте):
- По умолчанию Terra — не раздумывайте, основные задачи сразу Terra.
- Явно простая работа / большой объём / чувствительность к задержке? Классификация, суммаризация, форматирование, миллионы записей в batch → переходите на Luna.
- Terra не справился / долгосрочная сложная agentic-задача? Тогда Sol, с уровнем
maxили режимомultra.
Не «пробуй от дешёвого к дорогому»
Основные задачи сразу Terra — переделка через Luna часто обходится дороже. Sol только если Terra не хватает — та же логика, что «Opus на каждый день, Fable для сложного» у Claude. Если вы уже знакомы с выбором моделей Claude, перенесите подход.
3. Что изменилось по сравнению с GPT-5.5
Если вы мигрируете с GPT-5.5, вот пять ключевых изменений:
| Измерение | GPT-5.5 | GPT-5.6 |
|---|---|---|
| Правило именования | Единое имя GPT-5.5 | Цифра (поколение) + Sol/Terra/Luna (уровни), стабильны между поколениями |
| Цена на каждый день | Полная цена GPT-5.5 ($5/$30) | Terra примерно вдвое дешевле ($2,50/$15), сопоставимая производительность |
| Уровни рассуждения | low / medium / high / xhigh | Sol добавляет max — максимальное время рассуждения для самых сложных задач |
| Режим совместной работы | Один агент | Режим ultra — суб-агенты параллельно, ускоряет сложную работу |
| Кэш prompt | Неявный кэш, непредсказуемое поведение | Явные точки кэширования + минимум 30 мин; запись 1,25×, чтение 0,10× |
Официальные highlights бенчмарков (уровень Sol):
- Terminal-Bench 2.1 (командные workflow: планирование / итерация / координация инструментов) — Sol новый SOTA
- GeneBench v1 (долгосрочная геномика и количественная биология) — Sol обходит GPT-5.5 с меньшим числом токенов
- ExploitBench (исследование уязвимостей в кибербезопасности) — Sol конкурирует с Mythos Preview при ~1/3 токенов вывода
- ExploitGym (UC Berkeley + OpenAI) — Sol / Terra / Luna все значительно усилены с ростом интенсивности рассуждения
4. Уровни рассуждения & режим ultra
GPT-5.6 сохраняет уровни интенсивности рассуждения серии GPT-5; Sol добавляет max — их часто путают:
| Уровень | Применение | Тенденция по стоимости |
|---|---|---|
minimal |
Минимальный уровень в Codex CLI, почти без размышлений, прямой ответ | Очень экономично |
low |
Классификация, простые запросы, чувствительность к задержке, низкая интеллектуальная нагрузка | Самый экономичный |
medium |
Обычные запросы с балансом стоимости и качества | Сбалансированно, скорее экономично |
high |
Рекомендуется — sweet spot для большинства интеллектуальных задач | Рекомендуется |
xhigh |
Сложный код / длинные agentic-задачи | Ориентация на качество |
max НОВЫЙ · Sol |
Самые сложные задачи; точность >> стоимость | Самый дорогой |
Частая путаница: max ≠ ultra
- max — уровень интенсивности рассуждения: один агент думает дольше, подходит для глубокой инференции без параллелизации.
- ultra — режим совместной работы: суб-агенты параллельно ускоряют сложную работу, подходит для разложимых многопутевых задач (мультиугольный review, параллельное исследование).
- Официальные данные: Sol Ultra набирает 91,9% на Terminal-Bench 2.1 против 88,8% у базового Sol.
Параметры — в документации OpenAI API. Повседневная конфигурация Codex CLI:
- Сложные задачи:
codex -m gpt-5.6-sol -c model_reasoning_effort="max" - Повседневно: в
~/.codex/config.tomlmodel = "gpt-5.6-terra"+model_reasoning_effort = "high", затем простоcodex
5. Новые правила кэширования prompt
Для GPT-5.6 и всех новых моделей изменились тарификация и поведение кэша. Три пункта:
| Пункт | Правило |
|---|---|
| Явные точки кэширования | Явная разметка в prompt вместо неявного поведения — вы контролируете, какой фрагмент попадает в кэш |
| Срок жизни кэша | Минимум 30 минут — больше не инвалидируется через секунды |
| Цена записи | Запись в кэш стоит 1,25× тарифа некэшированного ввода |
| Цена чтения | Чтение из кэша даёт скидку 90% (10% от тарифа) |
Пример расчёта при вводе Terra $2,50/M:
- Некэшированный ввод (первый вызов): $2,50
- Запись в кэш (первый вызов с точкой): $2,50 × 1,25 = $3,125
- Чтение из кэша (hit за 30 мин): $2,50 × 10% = $0,25
Вывод: если длинный prompt (system prompt, справочные документы, codebase) попадает в кэш ≥ 3 раза за 30 минут — это выгодно: запись на 25% дороже, чтение всего 10%. Чем длиннее контекст (RAG, длинные agent-сессии), тем больше эффект.
6. Способы доступа: API / Codex / ChatGPT
| Канал | Текущий статус | Переключение модели |
|---|---|---|
| API | Постепенное открытие с 9 июля | В теле запроса model: "gpt-5.6-terra" и т.д. |
| Codex CLI | Открывается параллельно | Селектор /model · codex -m gpt-5.6-sol · config.toml |
| ChatGPT | Постепенный rollout, не всё сразу | Селектор покажет Sol / Terra / Luna (зависит от аккаунта) |
| Cerebras Fast | Июль, избранные клиенты | Sol до 750 токенов/с, подходит для низкой задержки |
Если в ChatGPT вы ещё не видите три уровня — это нормально, OpenAI раскатывает постепенно. Следите за меню моделей или официальными объявлениями.
7. Оптимизация затрат — краткий справочник
Три главных рычага экономии с GPT-5.6:
| Рычаг | Действие | Экономия |
|---|---|---|
| Правильный уровень | Terra по умолчанию, Luna для простого, Sol только при необходимости | Без переразмерения |
| Явное кэширование | Точки кэширования для длинного system prompt / документов / codebase | На стороне ввода |
| Снизить рассуждение | Низкая интеллектуальная нагрузка: low / medium; max только если точность >> стоимость | На стороне вывода |
| Сжать вывод | Структурированный вывод (JSON schema), «только вывод / только код», лимит слов | На стороне вывода |
| Batch API | Задачи с допустимой задержкой через Batch API (50% скидка в долгосрочной политике) | Все токены −50% |
Три приёма экономии
- Terra по умолчанию, не повышать до Sol
- Точки кэширования для длинных prompt
- Рассуждение с high, а не max
Это главные рычаги. Более системный подход — руководство по ценам LLM и оптимизация затрат Claude Code.
FAQ
Sol, Terra или Luna в повседневной работе?
По умолчанию Terra. В сомнительных случаях Terra; простые задачи / большой объём → Luna; Terra не хватает → Sol.
max и ultra — одно и то же?
Нет. max — глубокая инференция одного агента; ultra — параллельная работа суб-агентов. Разные измерения, комбинируются.
Сколько стоят три уровня?
Sol $5/$30, Terra $2,50/$15, Luna $1/$6 (за миллион токенов, ввод/вывод).
Когда явное кэширование становится выгодным?
Длинный prompt, попадающий в кэш ≥3 раза за 30 мин, обычно окупается. Чтение кэша Terra — всего $0,25/M.
Как переключить модель в Codex?
/model, codex -m gpt-5.6-terra или постоянная настройка в ~/.codex/config.toml.
Заключение
Как выбрать GPT-5.6 Sol, Terra или Luna? Одной фразой: Terra по умолчанию, Sol для сложного, Luna для простого — выбирайте по уровню возможностей, цифра лишь маркер поколения.
Повседневная работа начинается с Terra (половина цены GPT-5.5, сопоставимая производительность); Sol — только для самых сложных задач (с рассуждением max или суб-агентами ultra); Luna — для явно простой работы. Не пробуйте уровень за уровнем — отдавать основные задачи сразу Terra в 2026 году самая спокойная стратегия выбора GPT-5.6.
Agent GPT-5.6 для iOS / macOS сборок? Стабильный Cloud Mac
Ultra-субзадачи Sol с Xcode или TestFlight требуют стабильного узла выполнения macOS. Vuncloud предлагает выделенный Mac mini M4, помесячная аренда — сборки agent всю ночь без обрывов.
Похожие материалы
- Что такое GPT-5.6? Sol, Terra, Luna — цены и запуск (2026)
- Руководство по ценам, спецификациям и производительности API LLM (2026)
- Claude Code: с $800 до $150 — оптимизация затрат (2026)
- Недельный лимит Codex исчерпан — решения и альтернативы (2026)
Цены и функции согласно официальной статье OpenAI, странице тарифов и документации Codex. Последнее обновление: 10 июля 2026.