Перейти к содержимому

GPT-5.6 Sol, Terra, Luna в 2026: какую модель OpenAI выбрать под задачу

Автор: Silvana · Дата: 31.07.2026 · Verified: 01.09.2026 · Reading time: 9 минут · Prerequisite: 002, 011

GPT-5.6 — семейство OpenAI из трёх моделей одной архитектуры: Sol ($5/$30 за 1M токенов) для сложных задач, Terra ($2/$12) как дефолт для продукта и Luna ($0.20/$1.20) для массовых операций. Все три — с контекстом 1 050 000 токенов, датой актуальности знаний 16 февраля 2026 и мультимодальностью на вход (текст + изображение). Ниже разбор, какая из трёх окупается под какую задачу и как она стоит против Claude Sonnet 5 и Gemini 3.5.

  • OpenAI выпустила семейство GPT-5.6 9 июля 2026 года. Три модели одной архитектуры, три уровня цены и «глубины мышления»: Sol, Terra, Luna.
  • GPT-5.6 Sol — флагман. $5 за миллион входных токенов, $30 за миллион выходных. Для сложной работы, где ошибка стоит дорого.
  • GPT-5.6 Terra — баланс. $2 / $12 за миллион токенов. Дефолт для большинства продуктовых задач.
  • GPT-5.6 Luna — бюджет. $0.20 / $1.20 за миллион токенов. Для массовых операций, где нужен объём, а не гений.
  • Все три модели имеют одинаковое контекстное окно 1 050 000 токенов, 128 000 токенов на выход, обрыв знаний 16 февраля 2026 года.
  • 30 июля 2026 OpenAI снизила цены на Luna на 80% и на Terra на 20% (это цены выше).
  • Модальности: текст на вход и выход, изображения только на вход. Аудио и видео не поддерживаются напрямую (для голоса — отдельные модели Realtime).

Если раньше вы выбирали между «умной, но дорогой» и «дешёвой, но глупой» моделями от разных семейств — теперь OpenAI даёт три модели одного семейства, чтобы вы не гадали, а собирали воронку под свой продукт.

Мысленный образ: три одинаковые машины, одна с двигателем V12, другая с V6, третья с турбированной четвёркой. Одна аэродинамика, одна панель, одинаковые ремни. Разный расход, разная максимальная скорость. Вы выбираете под задачу, а не под бренд.

Для маркетолога это значит одно: не надо строить архитектуру на «двух разных API у двух разных вендоров, чтобы экономить». Один OpenAI, три модели, один код. Меньше switching cost, меньше багов на стыке.

Семейство вышло 9 июля 2026 года как единый релиз (OpenAI Changelog, Jul 9). Три модели заменили прежние gpt-5.5 / gpt-5.5-mini / gpt-5.5-nano в качестве рекомендованных для продакшна.

Что нового в GPT-5.6 по сравнению с GPT-5.5:

  • Programmatic Tool Calling — модель сама вызывает инструменты и API по коду.
  • Persisted reasoning — состояние рассуждения сохраняется между запросами (для агентских цепочек).
  • Max reasoning effort — шесть уровней «глубины мышления»: none, low, medium, high, xhigh, max.
  • Pro mode — режим для сложных задач с расширенным reasoning-бюджетом.
  • Multi-agent orchestration — оркестрация нескольких агентов, пока в beta для Responses API.
  • Изображения в оригинальных размерах — на вход теперь можно давать картинки без ресайза.

30 июля 2026 OpenAI выпустила обновление: Luna подешевела на 80%, Terra подешевела на 20%. Одновременно ввели Fast mode — для GPT-5.6 Sol это до 2,5× быстрее стандартной обработки за двойную цену. Fast mode заменил прежнюю «Priority Processing».

Это модель для того, чтобы «не думать про цену, если ответ должен быть правильным».

Verified specs из developers.openai.com/api/docs/models/gpt-5.6-sol (проверено 31.07.2026):

ПараметрЗначение
Model IDgpt-5.6-sol
Aliasgpt-5.6 (по умолчанию)
Контекст1 050 000 токенов (около 800 тыс. слов русского)
Максимум выхода128 000 токенов
Обрыв знаний16 февраля 2026
Reasoning6 уровней: none, low, medium, high, xhigh, max
Цена input$5.00 за 1M токенов
Cached input$0.50 за 1M токенов
Цена output$30.00 за 1M токенов
Модальности входТекст, изображение
Модальности выходТекст
Аудио, видеоНе поддерживается
ИнструментыFunctions, Web search, File search, Computer use
EndpointsChat Completions, Responses, Realtime, Batch, Assistants

Важная особенность цен: если промпт больше 272 000 входных токенов — цена удваивается на входе и умножается на 1.5 на выходе для всего запроса. Это OpenAI зовёт «long context surcharge». Cache writes стоят в 1,25× дороже uncached input.

Когда брать Sol: сложный код с логикой в 20+ файлов, юридические разборы длинных документов, финансовые расчёты, где важна каждая цифра, агенты с длинной цепочкой рассуждения. Если задача проще — вы переплачиваете в 2.5–25 раз.

Terra — рабочая лошадка для 80% продуктовых задач. OpenAI сама позиционирует её как «designed for workloads that balance intelligence and cost» и указывает, что Terra roughly corresponds to the mini model tier used in earlier GPT-5 families.

Verified specs из developers.openai.com/api/docs/models/gpt-5.6-terra:

ПараметрЗначение
Model IDgpt-5.6-terra
Контекст1 050 000 токенов
Максимум выхода128 000 токенов
Обрыв знаний16 февраля 2026
Reasoning6 уровней: none, low, medium, high, xhigh, max
Цена input$2.00 за 1M токенов
Cached input$0.20 за 1M токенов
Цена output$12.00 за 1M токенов
Модальности входТекст, изображение
Модальности выходТекст

Terra в 2.5 раза дешевле Sol на входе и в 2.5 раза дешевле на выходе. При этом контекст, лимит выхода и обрыв знаний идентичны. То есть если вы не давите модель на «предел рассуждения», разница может быть незаметна на глаз.

Когда брать Terra: генерация карточек, e-commerce описаний, ответы бота поддержке, суммаризация длинных документов, персонализация писем, регулярный контент. Terra — это «дефолт», от которого имеет смысл отталкиваться, а Sol брать только когда Terra ощутимо не справляется.

Luna — модель для «дешёвого масштаба». OpenAI её описывает как «designed for cost-sensitive, high-volume workloads» и указывает, что она roughly corresponds to the nano model tier used in earlier GPT-5 families.

После снижения цен 30 июля 2026 Luna стала дешевле в 5 раз:

Verified specs из developers.openai.com/api/docs/models/gpt-5.6-luna:

ПараметрЗначение
Model IDgpt-5.6-luna
Контекст1 050 000 токенов
Максимум выхода128 000 токенов
Обрыв знаний16 февраля 2026
Reasoning6 уровней: none, low, medium, high, xhigh, max
Цена input$0.20 за 1M токенов
Cached input$0.02 за 1M токенов
Цена output$1.20 за 1M токенов
Модальности входТекст, изображение
Модальности выходТекст

Разница с Sol на выходе — в 25 раз. С Terra — в 10 раз. Это модель для операций, где на одну задачу приходятся десятки тысяч однотипных запросов: классификация писем, теги для карточек, скоринг лидов, разметка комментов, простые «если A → B» решения.

Когда брать Luna: любой массовый батч. Тегирование, классификация, короткие завершения, roblox-стайл персонажи в игре, автоответчики первой линии, парсинг структурированного текста. Если у вас 10 миллионов запросов в месяц и качество Sol не нужно — Luna даст экономию в 25 раз.

Все цифры проверены на developers.openai.com/api/docs/models 31.07.2026:

ПараметрSolTerraLuna
Model IDgpt-5.6-solgpt-5.6-terragpt-5.6-luna
Aliasgpt-5.6
Reasoning6 уровней6 уровней6 уровней
Скорость (по OpenAI)FastFastFast
ПозицияFrontierBalanceHigh-volume
Input $/1M$5.00$2.00$0.20
Cached input $/1M$0.50$0.20$0.02
Output $/1M$30.00$12.00$1.20
Контекст1 050 0001 050 0001 050 000
Max output128 000128 000128 000
Обрыв знаний16.02.202616.02.202616.02.2026
ВходText, ImageText, ImageText, Image
ВыходTextTextText
АудиоНе поддерживаетсяНе поддерживаетсяНе поддерживается
ВидеоНе поддерживаетсяНе поддерживаетсяНе поддерживается

Rate limits идут по общей схеме tiers (проверено на странице моделей): Tier 1 стартует с 500 RPM и 500 000 TPM, растёт автоматически по мере накопленных расходов до Tier 5 (15 000 RPM, 40M TPM). Batch queue лимиты в разы больше — от 1.5M на Tier 1 до 200M на Tier 4.

Возьмите за нулевую точку Terra. Это baseline. Дальше три вопроса:

  1. Задача даёт ощутимо худший результат на Terra? — берите Sol. Если после 20–30 тестов ответ Terra всё ещё «сойдёт, но не блеск», а Sol заметно чище — переплатить в 2.5 раза оправдано.
  2. Задача типовая, много одинаковых запросов, качество не критично? — берите Luna. Скоринг лидов, классификация тикетов, теги, короткие завершения.
  3. Задача требует «максимальной глубины»? — Sol с reasoning=max или Sol Fast mode. Это уже премиум-цена, зато потолок качества выше.

Практическая эвристика: Sol для reasoning, Terra для контента, Luna для операций. Reasoning здесь — не в смысле маркетингового термина, а в смысле «модель должна долго думать, разбирать многошаговую задачу». Контент — обычные тексты и описания. Операции — рутина.

Verified numbers cross-ref с «Claude Sonnet 4.6 для российского пользователя» (артикул 019) и «Claude Sonnet 5» (артикул 020):

МодельInput $/1MOutput $/1MКонтекстОбрыв знаний
GPT-5.6 Sol$5.00$30.001.05MFeb 2026
GPT-5.6 Terra$2.00$12.001.05MFeb 2026
GPT-5.6 Luna$0.20$1.201.05MFeb 2026
Claude Sonnet 5по прайсу claude.com/pricingпо прайсузависит от версиисм. article 020

Ключевое отличие подхода: у OpenAI одна архитектура на трёх ценах — единый API, одинаковый контекст 1.05M на всех трёх, одинаковый обрыв знаний. У Anthropic Claude Sonnet 5 и Opus 5 — разные архитектуры, разные окна, разные обрывы.

Если ваш продукт уже на Claude — не бегите переезжать ради «числа побольше в контексте». Разница в качестве на конкретной вашей задаче важнее, чем разница в спеке. Прогоняйте оба на своих реальных запросах в течение недели.

Cross-ref с Gemini 3.5/3.6 линейка Flash/Pro/Ultra. Gemini исторически сильнее в мультимодальности (аудио, видео, live-стрим) и слабее в кодинге. GPT-5.6 сильнее в reasoning и агентах, аудио и видео отдаёт отдельным моделям (Realtime, GPT Image 2, Videos).

Три сценария:

  • Голос и видео на входе — Gemini или отдельные Realtime-модели OpenAI. GPT-5.6 напрямую видео не принимает.
  • Длинный код и агентские цепочки — GPT-5.6 Sol с Programmatic Tool Calling часто оказывается впереди.
  • Массовые операции с текстом на русском — Terra и Luna работают на нём хорошо, но всегда прогоняйте на своей задаче.

Ключевая проблема российского пользователя: прямая оплата OpenAI из РФ не работает. Российские карты не проходят. Полный разбор путей — как оплачивать AI-подписки из РФ.

Что работает по состоянию на 31 июля 2026:

  1. Международный посредник для API. Российские SaaS-агрегаторы принимают рубли, отдают доступ к OpenAI API через свой прокси-endpoint. Ищите тех, кто прямо указывает GPT-5.6 в списке поддерживаемых моделей и кто держит SLA (не «завтра сломается»).
  2. Зарубежная банковская карта. Работает, если есть карта иностранного банка и адрес выставления счёта в поддерживаемой стране. Технически всё легально, вопрос — есть ли у вас такая карта.
  3. Оплата в криптовалюте через посредника. Часть агрегаторов принимает USDT / BTC и выдаёт баланс на OpenAI.
  4. Корпоративный доступ через юрлицо в дружественной юрисдикции. Для команд с оборотом — самый устойчивый путь.

Прямой чат ChatGPT-приложение из России блокируется на уровне логина. Многие пользуются приложением через сторонние клиенты или ChatGPT-like сервисы, встроенные в российские платформы, — но это не API GPT-5.6 напрямую.

Для агентов и продуктов в РФ практический сетап: API-ключ через посредника + свой backend + оплата в рублях по курсу USD агрегатора. Свои данные к OpenAI обычно не улетают, если посредник не мультиплексит запросы через свой ключ.

Сценарий 1. Тегирование 100 000 карточек Wildberries. Задача типовая, тегов до 30 на карточку, вход — короткое описание. Возьмите Luna. Один запрос примерно 300 входных токенов + 200 выходных. На 100 000 карточек это 30M input + 20M output = $6 + $24 = $30 за весь батч. На Sol это стоило бы $750. Разница в 25 раз.

Сценарий 2. Юрист разбирает договор на 40 страниц. Задача редкая, ошибка стоит миллионы. Возьмите Sol с reasoning=max. 40 страниц ≈ 30 000 токенов входа + 5 000 токенов ответа = $0.15 + $0.15 = $0.30 за разбор. Если разборов 20 в месяц — $6/месяц. Экономить на такой задаче Luna не имеет смысла.

Сценарий 3. E-commerce сайт генерирует SEO-описания. Средняя задача, 500 генераций в день, каждое описание 800 токенов на выход. Возьмите Terra. День = 400 000 output токенов = $4.80. Месяц ≈ $144. На Luna это стоило бы $14, на Sol — $360. Terra попадает в баланс.

Сценарий 4. Support-бот банка отвечает на входящие 24/7. Первая линия — простые вопросы про баланс, реквизиты, тарифы. Ответы короткие. Возьмите Luna для первой линии, Terra для эскалации на сложные вопросы (переводы, споры). Sol не нужен, если у вас не банк с private banking сегмента $1M+.

Сценарий 5. Агент, который читает 300 PDF-договоров и находит пункты риска. Длинный контекст. Возьмите Sol с reasoning=xhigh. Промпт больше 272K токенов = долгий контекстный сюрчардж (2× input, 1,5× output). Ориентировочно: 300 договоров × 40K токенов = 12M входа = $60 за один прогон, зато вы получаете качество вместо человеко-недель работы юриста.

Что означают названия Sol, Terra, Luna? OpenAI не даёт официального объяснения. По смыслу — Sol это «солнце» (флагман, ярче всех), Terra — «земля» (баланс, дом), Luna — «луна» (спутник, дешевле, легче). Это внутренний нейминг OpenAI без семантики про модель. Alias gpt-5.6 по умолчанию ведёт на Sol.

Обрыв знаний везде 16 февраля 2026 — это плохо или хорошо? Это нормально для линейки, выпущенной в июле 2026. Знания «свежие», но в реальности любая LLM устаревает уже через месяц-два. Для задач про свежие новости, законы, курсы — всегда докидывайте свежий контекст в промпт, не полагайтесь на память модели.

Почему у всех трёх контекст 1 050 000 токенов, а не 1 000 000? Это сознательный маркетинговый ход. OpenAI даёт «1M+ токенов» с запасом на технические токены (роль, инструменты, системные подсказки). Реально пользователь может залить около миллиона своих. После 272K действует «long context surcharge»: цена входа × 2, цена выхода × 1.5.

В чём разница между gpt-5.6 и gpt-5.6-sol в коде? Технически они одинаковы. gpt-5.6 — это alias, который всегда указывает на текущую версию Sol. Если вы хотите привязку к конкретному снапшоту (для reproducibility), пишите gpt-5.6-sol. Для скорости разработки используйте gpt-5.6.

Fast mode стоит вдвое дороже — когда он оправдан? Оправдан для интерактивных пользовательских сценариев: чаты, live-агенты, торговые бот, где latency видимо влияет на UX. Не оправдан для батчей и фоновых задач — там платите обычную цену, ждёте штатно.

Можно ли использовать GPT-5.6 для генерации изображений или голоса? Нет напрямую. Sol / Terra / Luna принимают изображения на вход, но отдают только текст. Для генерации изображений — отдельная модель GPT Image 2. Для голоса — Realtime модели или GPT-Realtime-2.1. Все они управляются через тот же OpenAI API.

  • Артикул 023 — «GPT-5.6 vs GPT-5.5: стоит ли переходить прямо сейчас».
  • Артикул 024 — «Fast mode и Programmatic Tool Calling: практика для агентов».
  • Артикул 025 — «Batch API: как удешевить массовые операции в 2 раза».
  • Артикул 011 — big-3 сравнение Claude / GPT / Gemini в единой таблице.
  • Артикул 019 / 020 — Claude Sonnet 4.6 и Sonnet 5 разборы для контекста.

Все ссылки проверены 31.07.2026. Модельные страницы и changelog — первоисточник OpenAI Developer Docs.

  1. Overview: OpenAI Models — сводная таблица моделей, характеристик и цен. Проверено 31.07.2026.
  2. GPT-5.6 Sol model card — цены, контекст, обрыв знаний, endpoints, rate limits. Проверено 31.07.2026.
  3. GPT-5.6 Terra model card — то же для Terra. Проверено 31.07.2026.
  4. GPT-5.6 Luna model card — то же для Luna. Проверено 31.07.2026.
  5. OpenAI API Changelog — 9 июля 2026 релиз GPT-5.6 family; 30 июля 2026 снижение цен + Fast mode. Проверено 31.07.2026.
  6. OpenAI Pricing — сводный прайс со всеми моделями. Проверено 31.07.2026.
  7. OpenAI Docs: Prompt caching — про cached input и cache writes. Проверено 31.07.2026.
  8. OpenAI Docs: Batch API — про batch queue limits в tiers. Проверено 31.07.2026.

Актуально на 31.07.2026. Модели, цены и условия доступа меняются часто. Перед бизнес-решением всегда сверяйся с первоисточником — все ссылки в разделе Sources выше. Цены на Luna и Terra были снижены 30 июля 2026; следующие обновления OpenAI публикует в Changelog. RU-специфика (посредники, оплата) может измениться быстрее, чем прайс, — сверяйся отдельно перед оплатой.