ChatGPT 5.6 API: полный разбор семейства моделей Sol, Terra и Luna

Разбираемся в API ChatGPT 5.6: чем отличаются модели Sol, Terra и Luna, как выбрать подходящую, какие лимиты и цены, как использовать reasoning effort, мультиагентный режим и инструменты.

Что такое GPT-5.6 и почему это семейство моделей

GPT-5.6 — это не одна модель, а целое семейство из трёх уровней, предназначенных для разных сценариев использования. OpenAI выпустила их в общую доступность 9 июля 2026 года. В семейство входят:

  • GPT-5.6 Sol — флагманская модель с максимальной производительностью для сложных задач.
  • GPT-5.6 Terra — сбалансированная модель, сочетающая качество и стоимость.
  • GPT-5.6 Luna — самая быстрая и экономичная модель для высоконагруженных сценариев.

Такое разделение позволяет разработчикам выбирать оптимальный баланс между качеством, скоростью и ценой для каждой конкретной задачи. Число 5.6 обозначает поколение, а названия Sol, Terra и Luna — это устойчивые уровни возможностей, которые могут развиваться независимо.

Основной сдвиг по сравнению с предыдущими версиями — переход от простых ответов на вопросы к выполнению длительных многошаговых рабочих процессов. Модель теперь умеет не только генерировать текст, но и координировать инструменты, фильтровать промежуточные данные, отслеживать прогресс и создавать законченные артефакты. Это особенно важно для задач, где промежуточных данных гораздо больше, чем итогового результата.

Ключевые отличия GPT-5.6 от предыдущих версий

По сравнению с GPT-5.5, в GPT-5.6 произошли значительные улучшения в пяти ключевых областях.

1. Эффективность длинных рабочих процессов. Модель научилась писать и запускать лёгкие программы, которые координируют инструменты, фильтруют промежуточные данные и выбирают следующий шаг. Это снижает количество отдельных обращений к API и уменьшает общее число токенов.

2. Улучшенная работа с кодом и терминалом. Sol показала 80 баллов в Artificial Analysis Coding Agent Index (против 76,4 у GPT-5.5) и 88,8% на Terminal-Bench 2.1. Режим Ultra достиг 91,9%. Однако важно понимать, что бенчмарки не гарантируют идеальный результат в продакшене — многое зависит от контекста репозитория, тестов и дисциплины код-ревью.

3. Дизайн и компьютерное использование. Модель теперь может проверять отрендеренный результат, находить визуальные или функциональные дефекты и дорабатывать их. Это касается не только интерфейсов, но и презентаций, документов и таблиц.

4. Профессиональная работа со знаниями. GPT-5.6 умеет собирать контекст из Slack, Notion, Microsoft 365 и Google Drive, а затем создавать отчёты, прогнозы и аналитические документы.

5. Расширенный диапазон рассуждений. Появились режимы max и ultra. max даёт модели больше времени на исследование и проверку, а ultra запускает четыре параллельных агента для независимых подзадач.

Как выбрать между Sol, Terra и Luna

Выбор модели должен основываться на профиле нагрузки и стоимости ошибки, а не на престиже. Вот практические рекомендации:

  • Sol — для неоднозначных, многоэтапных задач, где ошибка дорого обходится: архитектурные решения, сложный код, глубокий research, финансовые или юридические документы, научный анализ.
  • Terra — для повседневной профессиональной работы: операционный анализ, бизнес-процессы, production-агенты с понятными инструментами, документные пайплайны. Для многих команд Terra может стать разумным дефолтом.
  • Luna — для высоконагруженных и чувствительных к задержкам задач: классификация, извлечение данных, нормализация, маршрутизация, черновики, метаданные. Но не забывайте про валидацию — дешёвая ошибка на большом объёме может обойтись дороже.

Вместо одного глобального дефолта лучше настроить политику маршрутизации:

  • Низкорисковые структурированные задачи → Luna.
  • Обычная профессиональная работа → Terra.
  • Неоднозначные или высоковлиятельные задачи → Sol.
  • Режим max — только когда дополнительное рассуждение измеримо улучшает результат.
  • Режим ultra — только когда параллельные потоки можно проверить и согласовать.

Режимы рассуждений max и ultra: когда они нужны

Режим max — это высокий уровень усилий рассуждения. Он позволяет модели больше исследовать, проверять и пересматривать решения, чем стандартные настройки. Подходит для одного сложного рабочего потока, где точность важнее скорости.

Режим ultra — это не просто «думай дольше». Это мультиагентный режим, который по умолчанию координирует четыре параллельных агента. В API разработчики могут создавать аналогичные сценарии через multi-agent beta в Responses API. Параллельные агенты могут сократить общее время выполнения, если подзадачи действительно независимы, но общее количество токенов при этом увеличивается.

Хорошие задачи для ultra:

  • Research, который делится по источникам, рынкам или гипотезам.
  • Исследование большой кодовой базы по подсистемам.
  • Due diligence с продуктовыми, техническими, безопасностными и финансовыми треками.
  • Отчёты, где независимым разделам нужны разные компетенции.
  • Сравнительный анализ, которому полезны независимые оценки перед синтезом.

Плохие задачи для ultra:

  • Короткий рерайт.
  • Простой фактологический вопрос.
  • Строго последовательная операция.
  • Работа без чёткого стандарта проверки.

Параллельные агенты могут повторить одну и ту же ошибку или создать лишние накладные расходы на согласование.

Доступность GPT-5.6 в ChatGPT, Codex и API

GPT-5.6 разворачивается в трёх основных продуктах: ChatGPT, Codex и API. Доступность моделей зависит от плана и продукта.

В ChatGPT:

  • Пользователи Free и Go получают GPT-5.6 Luna как модель по умолчанию. Режим «Думать» также использует Luna.
  • Пользователи Plus, Pro, Business и Enterprise могут выбирать Sol, Terra и Luna в режиме «Работа» и Codex.
  • В стандартных разговорах ChatGPT доступна только Sol (для платных планов) и Luna (для Free/Go). Terra и Luna нельзя выбрать в обычном чате.
  • Уровни рассуждений «Средний», «Высокий» и «Очень высокий» используют Sol, а уровень «Pro» — Sol Pro.

В Codex:

  • Free и Go получают Terra.
  • Plus, Pro, Business и Enterprise могут выбирать Sol, Terra и Luna.

В API:

  • Все три модели доступны разработчикам.
  • Luna оптимизирована для cost-sensitive workloads и соответствует уровню nano из предыдущих семейств.

Важно: rollout происходит постепенно, поэтому модель может появиться не сразу на каждом аккаунте или в рабочей области. Если вы не видите GPT-5.6 Sol в переключателе моделей, возможно, она ещё не доступна для вашего региона или плана.

Лимиты использования и тарификация API

Лимиты использования зависят от плана и уровня аккаунта. Для API действуют rate limits, которые автоматически повышаются с ростом вашего usage tier.

Для GPT-5.6 Luna в API установлены следующие лимиты:

  • Tier 1: 500 RPM, 500 000 TPM, batch queue 5 000 000.
  • Tier 2: 5 000 RPM, 2 000 000 TPM, batch queue 20 000 000.
  • Tier 3: 5 000 RPM, 4 000 000 TPM, batch queue 40 000 000.
  • Tier 4: 10 000 RPM, 10 000 000 TPM, batch queue 1 000 000 000.
  • Tier 5: 30 000 RPM, 180 000 000 TPM, batch queue 15 000 000 000.

Цены на токены зависят от модели и объёма. Для запросов с более чем 272 000 входных токенов действует повышающий коэффициент 2x на вход и 1.5x на выход. Записи в кэш тарифицируются в 1.25x от обычной ставки входных токенов.

В ChatGPT лимиты на рассуждения зависят от плана. Пользователи Free и Go имеют безлимитные обычные текстовые чаты, но для файлов, изображений, голосового режима и других инструментов действуют отдельные лимиты. Если вы исчерпали лимит на рассуждения, ChatGPT может автоматически переключиться на другую модель.

Инструменты и возможности Responses API

GPT-5.6 поддерживает широкий набор инструментов через Responses API. Это позволяет создавать сложных агентов, которые могут взаимодействовать с внешними системами.

Основные возможности:

  • Programmatic Tool Calling — модель может программно вызывать инструменты, не дожидаясь ответа пользователя.
  • Multi-agent execution — через beta-версию Responses API можно создавать сценарии с несколькими агентами.
  • Prompt caching — кэширование запросов для снижения стоимости повторных вызовов.
  • Structured output — генерация ответов в заданном формате (JSON, схемы).
  • Web search и file search — поиск информации в интернете и в загруженных файлах.
  • Computer use — управление компьютером (клики, ввод текста, навигация).
  • Code interpreter — выполнение кода в песочнице.
  • Realtime API — голосовые и аудио-агенты.

Для каждого инструмента может взиматься отдельная плата за вызов. Например, для поиска и computer use есть fee per tool call. Это важно учитывать при расчёте бюджета.

Практические рекомендации по интеграции и оптимизации

Чтобы получить максимальную отдачу от GPT-5.6 API, следуйте этим рекомендациям:

1. Начинайте с малого. Не пытайтесь сразу использовать Sol с max reasoning для всех задач. Начните с Terra или Luna и постепенно повышайте уровень, если качество не устраивает.

2. Используйте кэширование. Prompt caching может значительно снизить стоимость, если вы часто отправляете одинаковые системные промпты или большие контексты.

3. Настраивайте reasoning effort. Для простых задач используйте none или low, для средних — medium, для сложных — high или max. Не тратьте compute на то, что не требует глубокого анализа.

4. Тестируйте на своих данных. Не полагайтесь на бенчмарки. Создайте собственный eval-набор с одинаковыми входными данными, инструментами и критериями приёмки. Сравнивайте модели по стоимости, задержке и качеству.

5. Используйте batch API для некритичных задач. Если вам не нужен ответ в реальном времени, отправляйте запросы в batch-режиме — это дешевле.

6. Мониторьте лимиты. Следите за RPM и TPM, особенно при масштабировании. Используйте автоматическое повышение tier по мере роста расходов.

7. Внедряйте валидацию. Даже самая умная модель может ошибаться. Для production-систем обязательно добавьте проверку результатов, особенно для задач с высокой стоимостью ошибки.

Региональная доступность и ограничения

GPT-5.6 не имеет отдельного списка стран — доступность определяется общими списками поддерживаемых стран для ChatGPT и OpenAI API. Пользователи в ЕЭЗ, Швейцарии, Великобритании и ОАЭ могут использовать GPT-5.6, если он доступен для их плана.

Однако есть важное ограничение: GPT-5.6 не поддерживается для рабочих нагрузок, настроенных на использование резидентности инференса в ОАЭ. Это не мешает пользователям в ОАЭ использовать модель без такой настройки.

Также стоит учитывать, что в управляемых рабочих областях (Business, Enterprise) администраторы могут ограничивать доступ к определённым моделям. Если вы не видите GPT-5.6 Sol, обратитесь к администратору.

Для API разработчикам следует проверять актуальный список поддерживаемых стран, так как он может меняться.

Частые вопросы о GPT-5.6 API

Вопрос: Можно ли использовать GPT-5.6 Terra в обычном ChatGPT?

Нет, Terra и Luna нельзя выбрать в стандартных разговорах ChatGPT. Они доступны в режиме «Работа» и Codex для платных планов, а также через API.

Вопрос: Чем отличается GPT-5.6 Sol Pro от обычной Sol?

Sol Pro — это самый мощный вариант GPT-5.6, доступный на уровне рассуждений «Pro» в ChatGPT. Он предназначен для сложных задач и длительных рабочих процессов. В API Sol Pro может быть доступен отдельно.

Вопрос: Какой режим рассуждений выбрать для простых задач?

Для простых задач используйте none или low. Это снизит задержку и стоимость. Например, для классификации или извлечения данных Luna с low effort будет оптимальна.

Вопрос: Что делать, если я исчерпал лимит на рассуждения?

ChatGPT может автоматически переключиться на другую модель рассуждений. Вы также можете дождаться сброса лимита или выбрать другую модель вручную.

Вопрос: Как работает мультиагентный режим ultra?

Ultra запускает четыре параллельных агента, которые работают над независимыми подзадачами. Это сокращает общее время выполнения, но увеличивает общее количество токенов. Используйте его только для задач, которые действительно можно распараллелить.

Вопрос: Есть ли отдельная плата за инструменты в API?

Да, для некоторых инструментов, таких как web search и computer use, взимается плата за вызов. Уточняйте актуальные цены на странице pricing.

Вопрос: Можно ли использовать GPT-5.6 для голосовых агентов?

Да, через Realtime API вы можете создавать голосовых агентов на базе GPT-5.6. Это позволяет строить интерактивные голосовые интерфейсы с естественным диалогом.

Вопросы и ответы

Можно ли использовать GPT-5.6 Terra в обычном ChatGPT?

Нет, Terra и Luna нельзя выбрать в стандартных разговорах ChatGPT. Они доступны в режиме «Работа» и Codex для платных планов, а также через API.

Чем отличается GPT-5.6 Sol Pro от обычной Sol?

Sol Pro — это самый мощный вариант GPT-5.6, доступный на уровне рассуждений «Pro» в ChatGPT. Он предназначен для сложных задач и длительных рабочих процессов. В API Sol Pro может быть доступен отдельно.

Какой режим рассуждений выбрать для простых задач?

Для простых задач используйте none или low. Это снизит задержку и стоимость. Например, для классификации или извлечения данных Luna с low effort будет оптимальна.

Что делать, если я исчерпал лимит на рассуждения?

ChatGPT может автоматически переключиться на другую модель рассуждений. Вы также можете дождаться сброса лимита или выбрать другую модель вручную.

Как работает мультиагентный режим ultra?

Ultra запускает четыре параллельных агента, которые работают над независимыми подзадачами. Это сокращает общее время выполнения, но увеличивает общее количество токенов. Используйте его только для задач, которые действительно можно распараллелить.

Есть ли отдельная плата за инструменты в API?

Да, для некоторых инструментов, таких как web search и computer use, взимается плата за вызов. Уточняйте актуальные цены на странице pricing.

Можно ли использовать GPT-5.6 для голосовых агентов?

Да, через Realtime API вы можете создавать голосовых агентов на базе GPT-5.6. Это позволяет строить интерактивные голосовые интерфейсы с естественным диалогом.