GPT-5.6 Sol, Terra, Luna в 2026: какую модель OpenAI выбрать под задачу
Автор: Silvana · Дата: 31.07.2026 · Verified: 01.09.2026 · Reading time: 9 минут · Prerequisite: 002, 011
GPT-5.6 — семейство OpenAI из трёх моделей одной архитектуры: Sol ($5/$30 за 1M токенов) для сложных задач, Terra ($2/$12) как дефолт для продукта и Luna ($0.20/$1.20) для массовых операций. Все три — с контекстом 1 050 000 токенов, датой актуальности знаний 16 февраля 2026 и мультимодальностью на вход (текст + изображение). Ниже разбор, какая из трёх окупается под какую задачу и как она стоит против Claude Sonnet 5 и Gemini 3.5.
- OpenAI выпустила семейство GPT-5.6 9 июля 2026 года. Три модели одной архитектуры, три уровня цены и «глубины мышления»: Sol, Terra, Luna.
- GPT-5.6 Sol — флагман. $5 за миллион входных токенов, $30 за миллион выходных. Для сложной работы, где ошибка стоит дорого.
- GPT-5.6 Terra — баланс. $2 / $12 за миллион токенов. Дефолт для большинства продуктовых задач.
- GPT-5.6 Luna — бюджет. $0.20 / $1.20 за миллион токенов. Для массовых операций, где нужен объём, а не гений.
- Все три модели имеют одинаковое контекстное окно 1 050 000 токенов, 128 000 токенов на выход, обрыв знаний 16 февраля 2026 года.
- 30 июля 2026 OpenAI снизила цены на Luna на 80% и на Terra на 20% (это цены выше).
- Модальности: текст на вход и выход, изображения только на вход. Аудио и видео не поддерживаются напрямую (для голоса — отдельные модели Realtime).
Что это и зачем
Заголовок раздела «Что это и зачем»Если раньше вы выбирали между «умной, но дорогой» и «дешёвой, но глупой» моделями от разных семейств — теперь OpenAI даёт три модели одного семейства, чтобы вы не гадали, а собирали воронку под свой продукт.
Мысленный образ: три одинаковые машины, одна с двигателем V12, другая с V6, третья с турбированной четвёркой. Одна аэродинамика, одна панель, одинаковые ремни. Разный расход, разная максимальная скорость. Вы выбираете под задачу, а не под бренд.
Для маркетолога это значит одно: не надо строить архитектуру на «двух разных API у двух разных вендоров, чтобы экономить». Один OpenAI, три модели, один код. Меньше switching cost, меньше багов на стыке.
Основной разбор
Заголовок раздела «Основной разбор»Обзор семейства GPT-5.6
Заголовок раздела «Обзор семейства GPT-5.6»Семейство вышло 9 июля 2026 года как единый релиз (OpenAI Changelog, Jul 9). Три модели заменили прежние gpt-5.5 / gpt-5.5-mini / gpt-5.5-nano в качестве рекомендованных для продакшна.
Что нового в GPT-5.6 по сравнению с GPT-5.5:
- Programmatic Tool Calling — модель сама вызывает инструменты и API по коду.
- Persisted reasoning — состояние рассуждения сохраняется между запросами (для агентских цепочек).
- Max reasoning effort — шесть уровней «глубины мышления»: none, low, medium, high, xhigh, max.
- Pro mode — режим для сложных задач с расширенным reasoning-бюджетом.
- Multi-agent orchestration — оркестрация нескольких агентов, пока в beta для Responses API.
- Изображения в оригинальных размерах — на вход теперь можно давать картинки без ресайза.
30 июля 2026 OpenAI выпустила обновление: Luna подешевела на 80%, Terra подешевела на 20%. Одновременно ввели Fast mode — для GPT-5.6 Sol это до 2,5× быстрее стандартной обработки за двойную цену. Fast mode заменил прежнюю «Priority Processing».
GPT-5.6 Sol (флагман)
Заголовок раздела «GPT-5.6 Sol (флагман)»Это модель для того, чтобы «не думать про цену, если ответ должен быть правильным».
Verified specs из developers.openai.com/api/docs/models/gpt-5.6-sol (проверено 31.07.2026):
| Параметр | Значение |
|---|---|
| Model ID | gpt-5.6-sol |
| Alias | gpt-5.6 (по умолчанию) |
| Контекст | 1 050 000 токенов (около 800 тыс. слов русского) |
| Максимум выхода | 128 000 токенов |
| Обрыв знаний | 16 февраля 2026 |
| Reasoning | 6 уровней: none, low, medium, high, xhigh, max |
| Цена input | $5.00 за 1M токенов |
| Cached input | $0.50 за 1M токенов |
| Цена output | $30.00 за 1M токенов |
| Модальности вход | Текст, изображение |
| Модальности выход | Текст |
| Аудио, видео | Не поддерживается |
| Инструменты | Functions, Web search, File search, Computer use |
| Endpoints | Chat Completions, Responses, Realtime, Batch, Assistants |
Важная особенность цен: если промпт больше 272 000 входных токенов — цена удваивается на входе и умножается на 1.5 на выходе для всего запроса. Это OpenAI зовёт «long context surcharge». Cache writes стоят в 1,25× дороже uncached input.
Когда брать Sol: сложный код с логикой в 20+ файлов, юридические разборы длинных документов, финансовые расчёты, где важна каждая цифра, агенты с длинной цепочкой рассуждения. Если задача проще — вы переплачиваете в 2.5–25 раз.
GPT-5.6 Terra (баланс)
Заголовок раздела «GPT-5.6 Terra (баланс)»Terra — рабочая лошадка для 80% продуктовых задач. OpenAI сама позиционирует её как «designed for workloads that balance intelligence and cost» и указывает, что Terra roughly corresponds to the mini model tier used in earlier GPT-5 families.
Verified specs из developers.openai.com/api/docs/models/gpt-5.6-terra:
| Параметр | Значение |
|---|---|
| Model ID | gpt-5.6-terra |
| Контекст | 1 050 000 токенов |
| Максимум выхода | 128 000 токенов |
| Обрыв знаний | 16 февраля 2026 |
| Reasoning | 6 уровней: none, low, medium, high, xhigh, max |
| Цена input | $2.00 за 1M токенов |
| Cached input | $0.20 за 1M токенов |
| Цена output | $12.00 за 1M токенов |
| Модальности вход | Текст, изображение |
| Модальности выход | Текст |
Terra в 2.5 раза дешевле Sol на входе и в 2.5 раза дешевле на выходе. При этом контекст, лимит выхода и обрыв знаний идентичны. То есть если вы не давите модель на «предел рассуждения», разница может быть незаметна на глаз.
Когда брать Terra: генерация карточек, e-commerce описаний, ответы бота поддержке, суммаризация длинных документов, персонализация писем, регулярный контент. Terra — это «дефолт», от которого имеет смысл отталкиваться, а Sol брать только когда Terra ощутимо не справляется.
GPT-5.6 Luna (бюджет)
Заголовок раздела «GPT-5.6 Luna (бюджет)»Luna — модель для «дешёвого масштаба». OpenAI её описывает как «designed for cost-sensitive, high-volume workloads» и указывает, что она roughly corresponds to the nano model tier used in earlier GPT-5 families.
После снижения цен 30 июля 2026 Luna стала дешевле в 5 раз:
Verified specs из developers.openai.com/api/docs/models/gpt-5.6-luna:
| Параметр | Значение |
|---|---|
| Model ID | gpt-5.6-luna |
| Контекст | 1 050 000 токенов |
| Максимум выхода | 128 000 токенов |
| Обрыв знаний | 16 февраля 2026 |
| Reasoning | 6 уровней: none, low, medium, high, xhigh, max |
| Цена input | $0.20 за 1M токенов |
| Cached input | $0.02 за 1M токенов |
| Цена output | $1.20 за 1M токенов |
| Модальности вход | Текст, изображение |
| Модальности выход | Текст |
Разница с Sol на выходе — в 25 раз. С Terra — в 10 раз. Это модель для операций, где на одну задачу приходятся десятки тысяч однотипных запросов: классификация писем, теги для карточек, скоринг лидов, разметка комментов, простые «если A → B» решения.
Когда брать Luna: любой массовый батч. Тегирование, классификация, короткие завершения, roblox-стайл персонажи в игре, автоответчики первой линии, парсинг структурированного текста. Если у вас 10 миллионов запросов в месяц и качество Sol не нужно — Luna даст экономию в 25 раз.
Сравнительная таблица (verified specs)
Заголовок раздела «Сравнительная таблица (verified specs)»Все цифры проверены на developers.openai.com/api/docs/models 31.07.2026:
| Параметр | Sol | Terra | Luna |
|---|---|---|---|
| Model ID | gpt-5.6-sol | gpt-5.6-terra | gpt-5.6-luna |
| Alias | gpt-5.6 | — | — |
| Reasoning | 6 уровней | 6 уровней | 6 уровней |
| Скорость (по OpenAI) | Fast | Fast | Fast |
| Позиция | Frontier | Balance | High-volume |
| Input $/1M | $5.00 | $2.00 | $0.20 |
| Cached input $/1M | $0.50 | $0.20 | $0.02 |
| Output $/1M | $30.00 | $12.00 | $1.20 |
| Контекст | 1 050 000 | 1 050 000 | 1 050 000 |
| Max output | 128 000 | 128 000 | 128 000 |
| Обрыв знаний | 16.02.2026 | 16.02.2026 | 16.02.2026 |
| Вход | Text, Image | Text, Image | Text, Image |
| Выход | Text | Text | Text |
| Аудио | Не поддерживается | Не поддерживается | Не поддерживается |
| Видео | Не поддерживается | Не поддерживается | Не поддерживается |
Rate limits идут по общей схеме tiers (проверено на странице моделей): Tier 1 стартует с 500 RPM и 500 000 TPM, растёт автоматически по мере накопленных расходов до Tier 5 (15 000 RPM, 40M TPM). Batch queue лимиты в разы больше — от 1.5M на Tier 1 до 200M на Tier 4.
Как выбирать модель под задачу
Заголовок раздела «Как выбирать модель под задачу»Возьмите за нулевую точку Terra. Это baseline. Дальше три вопроса:
- Задача даёт ощутимо худший результат на Terra? — берите Sol. Если после 20–30 тестов ответ Terra всё ещё «сойдёт, но не блеск», а Sol заметно чище — переплатить в 2.5 раза оправдано.
- Задача типовая, много одинаковых запросов, качество не критично? — берите Luna. Скоринг лидов, классификация тикетов, теги, короткие завершения.
- Задача требует «максимальной глубины»? — Sol с reasoning=max или Sol Fast mode. Это уже премиум-цена, зато потолок качества выше.
Практическая эвристика: Sol для reasoning, Terra для контента, Luna для операций. Reasoning здесь — не в смысле маркетингового термина, а в смысле «модель должна долго думать, разбирать многошаговую задачу». Контент — обычные тексты и описания. Операции — рутина.
GPT-5.6 vs Claude Sonnet 5 / Opus 5
Заголовок раздела «GPT-5.6 vs Claude Sonnet 5 / Opus 5»Verified numbers cross-ref с «Claude Sonnet 4.6 для российского пользователя» (артикул 019) и «Claude Sonnet 5» (артикул 020):
| Модель | Input $/1M | Output $/1M | Контекст | Обрыв знаний |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | 1.05M | Feb 2026 |
| GPT-5.6 Terra | $2.00 | $12.00 | 1.05M | Feb 2026 |
| GPT-5.6 Luna | $0.20 | $1.20 | 1.05M | Feb 2026 |
| Claude Sonnet 5 | по прайсу claude.com/pricing | по прайсу | зависит от версии | см. article 020 |
Ключевое отличие подхода: у OpenAI одна архитектура на трёх ценах — единый API, одинаковый контекст 1.05M на всех трёх, одинаковый обрыв знаний. У Anthropic Claude Sonnet 5 и Opus 5 — разные архитектуры, разные окна, разные обрывы.
Если ваш продукт уже на Claude — не бегите переезжать ради «числа побольше в контексте». Разница в качестве на конкретной вашей задаче важнее, чем разница в спеке. Прогоняйте оба на своих реальных запросах в течение недели.
GPT-5.6 vs Gemini 3.5/3.6
Заголовок раздела «GPT-5.6 vs Gemini 3.5/3.6»Cross-ref с Gemini 3.5/3.6 линейка Flash/Pro/Ultra. Gemini исторически сильнее в мультимодальности (аудио, видео, live-стрим) и слабее в кодинге. GPT-5.6 сильнее в reasoning и агентах, аудио и видео отдаёт отдельным моделям (Realtime, GPT Image 2, Videos).
Три сценария:
- Голос и видео на входе — Gemini или отдельные Realtime-модели OpenAI. GPT-5.6 напрямую видео не принимает.
- Длинный код и агентские цепочки — GPT-5.6 Sol с Programmatic Tool Calling часто оказывается впереди.
- Массовые операции с текстом на русском — Terra и Luna работают на нём хорошо, но всегда прогоняйте на своей задаче.
RU-специфика доступа
Заголовок раздела «RU-специфика доступа»Ключевая проблема российского пользователя: прямая оплата OpenAI из РФ не работает. Российские карты не проходят. Полный разбор путей — как оплачивать AI-подписки из РФ.
Что работает по состоянию на 31 июля 2026:
- Международный посредник для API. Российские SaaS-агрегаторы принимают рубли, отдают доступ к OpenAI API через свой прокси-endpoint. Ищите тех, кто прямо указывает GPT-5.6 в списке поддерживаемых моделей и кто держит SLA (не «завтра сломается»).
- Зарубежная банковская карта. Работает, если есть карта иностранного банка и адрес выставления счёта в поддерживаемой стране. Технически всё легально, вопрос — есть ли у вас такая карта.
- Оплата в криптовалюте через посредника. Часть агрегаторов принимает USDT / BTC и выдаёт баланс на OpenAI.
- Корпоративный доступ через юрлицо в дружественной юрисдикции. Для команд с оборотом — самый устойчивый путь.
Прямой чат ChatGPT-приложение из России блокируется на уровне логина. Многие пользуются приложением через сторонние клиенты или ChatGPT-like сервисы, встроенные в российские платформы, — но это не API GPT-5.6 напрямую.
Для агентов и продуктов в РФ практический сетап: API-ключ через посредника + свой backend + оплата в рублях по курсу USD агрегатора. Свои данные к OpenAI обычно не улетают, если посредник не мультиплексит запросы через свой ключ.
Практика (5 сценариев)
Заголовок раздела «Практика (5 сценариев)»Сценарий 1. Тегирование 100 000 карточек Wildberries. Задача типовая, тегов до 30 на карточку, вход — короткое описание. Возьмите Luna. Один запрос примерно 300 входных токенов + 200 выходных. На 100 000 карточек это 30M input + 20M output = $6 + $24 = $30 за весь батч. На Sol это стоило бы $750. Разница в 25 раз.
Сценарий 2. Юрист разбирает договор на 40 страниц. Задача редкая, ошибка стоит миллионы. Возьмите Sol с reasoning=max. 40 страниц ≈ 30 000 токенов входа + 5 000 токенов ответа = $0.15 + $0.15 = $0.30 за разбор. Если разборов 20 в месяц — $6/месяц. Экономить на такой задаче Luna не имеет смысла.
Сценарий 3. E-commerce сайт генерирует SEO-описания. Средняя задача, 500 генераций в день, каждое описание 800 токенов на выход. Возьмите Terra. День = 400 000 output токенов = $4.80. Месяц ≈ $144. На Luna это стоило бы $14, на Sol — $360. Terra попадает в баланс.
Сценарий 4. Support-бот банка отвечает на входящие 24/7. Первая линия — простые вопросы про баланс, реквизиты, тарифы. Ответы короткие. Возьмите Luna для первой линии, Terra для эскалации на сложные вопросы (переводы, споры). Sol не нужен, если у вас не банк с private banking сегмента $1M+.
Сценарий 5. Агент, который читает 300 PDF-договоров и находит пункты риска. Длинный контекст. Возьмите Sol с reasoning=xhigh. Промпт больше 272K токенов = долгий контекстный сюрчардж (2× input, 1,5× output). Ориентировочно: 300 договоров × 40K токенов = 12M входа = $60 за один прогон, зато вы получаете качество вместо человеко-недель работы юриста.
Что означают названия Sol, Terra, Luna?
OpenAI не даёт официального объяснения. По смыслу — Sol это «солнце» (флагман, ярче всех), Terra — «земля» (баланс, дом), Luna — «луна» (спутник, дешевле, легче). Это внутренний нейминг OpenAI без семантики про модель. Alias gpt-5.6 по умолчанию ведёт на Sol.
Обрыв знаний везде 16 февраля 2026 — это плохо или хорошо? Это нормально для линейки, выпущенной в июле 2026. Знания «свежие», но в реальности любая LLM устаревает уже через месяц-два. Для задач про свежие новости, законы, курсы — всегда докидывайте свежий контекст в промпт, не полагайтесь на память модели.
Почему у всех трёх контекст 1 050 000 токенов, а не 1 000 000? Это сознательный маркетинговый ход. OpenAI даёт «1M+ токенов» с запасом на технические токены (роль, инструменты, системные подсказки). Реально пользователь может залить около миллиона своих. После 272K действует «long context surcharge»: цена входа × 2, цена выхода × 1.5.
В чём разница между gpt-5.6 и gpt-5.6-sol в коде?
Технически они одинаковы. gpt-5.6 — это alias, который всегда указывает на текущую версию Sol. Если вы хотите привязку к конкретному снапшоту (для reproducibility), пишите gpt-5.6-sol. Для скорости разработки используйте gpt-5.6.
Fast mode стоит вдвое дороже — когда он оправдан? Оправдан для интерактивных пользовательских сценариев: чаты, live-агенты, торговые бот, где latency видимо влияет на UX. Не оправдан для батчей и фоновых задач — там платите обычную цену, ждёте штатно.
Можно ли использовать GPT-5.6 для генерации изображений или голоса? Нет напрямую. Sol / Terra / Luna принимают изображения на вход, но отдают только текст. Для генерации изображений — отдельная модель GPT Image 2. Для голоса — Realtime модели или GPT-Realtime-2.1. Все они управляются через тот же OpenAI API.
Что дальше
Заголовок раздела «Что дальше»- Артикул 023 — «GPT-5.6 vs GPT-5.5: стоит ли переходить прямо сейчас».
- Артикул 024 — «Fast mode и Programmatic Tool Calling: практика для агентов».
- Артикул 025 — «Batch API: как удешевить массовые операции в 2 раза».
- Артикул 011 — big-3 сравнение Claude / GPT / Gemini в единой таблице.
- Артикул 019 / 020 — Claude Sonnet 4.6 и Sonnet 5 разборы для контекста.
Sources
Заголовок раздела «Sources»Все ссылки проверены 31.07.2026. Модельные страницы и changelog — первоисточник OpenAI Developer Docs.
- Overview: OpenAI Models — сводная таблица моделей, характеристик и цен. Проверено 31.07.2026.
- GPT-5.6 Sol model card — цены, контекст, обрыв знаний, endpoints, rate limits. Проверено 31.07.2026.
- GPT-5.6 Terra model card — то же для Terra. Проверено 31.07.2026.
- GPT-5.6 Luna model card — то же для Luna. Проверено 31.07.2026.
- OpenAI API Changelog — 9 июля 2026 релиз GPT-5.6 family; 30 июля 2026 снижение цен + Fast mode. Проверено 31.07.2026.
- OpenAI Pricing — сводный прайс со всеми моделями. Проверено 31.07.2026.
- OpenAI Docs: Prompt caching — про cached input и cache writes. Проверено 31.07.2026.
- OpenAI Docs: Batch API — про batch queue limits в tiers. Проверено 31.07.2026.
Актуальность
Заголовок раздела «Актуальность»Актуально на 31.07.2026. Модели, цены и условия доступа меняются часто. Перед бизнес-решением всегда сверяйся с первоисточником — все ссылки в разделе Sources выше. Цены на Luna и Terra были снижены 30 июля 2026; следующие обновления OpenAI публикует в Changelog. RU-специфика (посредники, оплата) может измениться быстрее, чем прайс, — сверяйся отдельно перед оплатой.