OpenAI GPT-5.6 официально:
Sol, Terra, Luna — полный разбор (2026)

Для разработчиков и руководителей AI-команд, которые опираются на Codex, Cursor или собственные Agent-воркфлоу, серия GPT-5.6, выпущенная 26 июня 2026 года (флагман Sol, сбалансированный Terra, лёгкий Luna), меняет выбор моделей для программирования и исследований в области безопасности: Sol набрал 91,9% на TerminalBench 2.1 и 96,7% в CTF. Из-за требований правительства США preview доступен только примерно 20 одобренным партнёрам. В статье — цены, режимы Max/Ultra, все бенчмарк-данные, спор о госпроверке, сравнение с Claude Mythos 5, Cerebras 750 token/s в июле и чеклист из 6 шагов. Инфраструктура: страница цен.

GPT-5.6 — ключевые параметры (2026-06-27)
Модель Позиционирование Цена input Цена output Ключевой показатель
GPT-5.6 Sol Флагман / максимум $5 / 1M Token $30 / 1M Token TerminalBench 2.1 #1 в мире (91,9%)
GPT-5.6 Terra Баланс / workhorse $2,50 / 1M Token $15 / 1M Token Близко к GPT-5.5, на 50% дешевле
GPT-5.6 Luna Лёгкий / быстрый $1 / 1M Token $6 / 1M Token Высокочастотные задачи, ~80% дешевле Sol

27 июня 2026 года OpenAI впервые ввела солнечную номенклатуру — Sol (Солнце), Terra (Земля), Luna (Луна) — для флагмана, баланса и лёгкого уровня. Это самый важный семейный релиз с GPT-5.5 и первая линейка, где все три модели активируют уровень киберриска «High» у OpenAI.

  • Ограниченный доступ: под влиянием исполнительного указа Трампа от 2 июня preview доступен только ~20 одобренным партнёрам. Обычные пользователи пока не могут использовать GPT-5.6 в ChatGPT; широкий rollout ожидается в течение нескольких недель.
  • Отраслевой прецедент: впервые правительство США требует госбезопасностную проверку перед широким релизом. CEO Sam Altman сотрудничает, но публично выступает против долгосрочной нормализации.
  • Июньский застой Big Three: OpenAI GPT-5.6 (ограничен), Anthropic Claude Fable 5 / Mythos 5 (offline с 12 июня, экспортный контроль), Google Gemini 3.5 Pro (перенос на июль).
  • Контекстное окно: все три модели заявляют ~1,5M Token (~50% больше, чем 1M у GPT-5.5). Перепроверить после полной System Card.
  • Конкурентный вакуум: Claude Mythos 5 удерживал лидерство TerminalBench (88,0%) всего 17 дней (пик 9 июня), пока Sol с 91,9% не обошёл его.

«Мы не считаем, что эта модель госодобрения должна стать долгосрочной отраслевой нормой по умолчанию. Она отдаляет лучшие инструменты от пользователей, разработчиков, компаний и глобальных партнёров, которым они нужнее всего.» — Sam Altman, CEO OpenAI

GPT-5.6 Sol — сильнейшая модель OpenAI на сегодня, для сложного программирования, длинных цепочек кибербезопасности и многошаговых автономных Agent-воркфлоу. Цена как у GPT-5.5 ($5 / $30 за MTok), возможности существенно выше.

  • Режим Max: больше времени на инференс, скорость жертвуется ради точности — для сценариев с максимальными требованиями к accuracy.
  • Режим Ultra: multi-agent архитектура — Sol декомпозирует сложные задачи, распределяет параллельным sub-agent'ам и синтезирует результат. Основа рекорда TerminalBench 91,9% (стандартный режим: 88,8%).

GPT-5.6 Terra — enterprise workhorse для поддержки, внутренних инструментов и анализа документов в масштабе. Производительность близка к GPT-5.5, стоимость на 50% ниже — лучший price/performance при массовом деплое ($2,50 / $15 за MTok).

GPT-5.6 Luna оптимизирован для высокой частоты и низкой latency: резюме, черновики, ежедневная автоматизация. Luna — первая не-флагманская модель с High-оценкой и в кибербезопасности, и в биологии ($1 / $6 за MTok).

Рекомендации по use case для GPT-5.6
Задача Рекомендуемая модель
Сложная генерация кода, отладка, многошаговые Agent-задачи Sol (режим Ultra)
Enterprise-анализ документов, поддержка, массовые API-вызовы Terra
Высокочастотные резюме, черновики, ежедневная автоматизация Luna
Ограниченный бюджет, но нужен уровень GPT-5.5 Terra (та же производительность, на 50% дешевле)
Latency-критичные realtime-приложения (с июля) Sol on Cerebras (до 750 token/s)

TerminalBench 2.1 (89 сложных задач CLI-планирования, тест multi-step tool calling и координации):

Рейтинг TerminalBench 2.1 — programming agents
Модель Score Режим
GPT-5.6 Sol 91,9% Ultra (multi-agent)
GPT-5.6 Sol 88,8% Стандартный
Claude Mythos 5 88,0% Стандартный
GPT-5.5 83,4% Стандартный
Gemini 3.1 Pro Preview 70,7% Стандартный

Agent's Last Exam (завершение длинных профессиональных задач, code mode): Sol 50,9% — единственная модель выше 50%. Luna чуть выше GPT-5.5.

CTF hit rate (кибербезопасность): Sol 96,7%, Terra 91,84%, Luna 85,19%. GPT-5.6 — первая серия OpenAI, где все три модели активируют High по кибербезопасности.

ExploitBench: Sol почти сравним с Anthropic Mythos Preview, но потребляет только около трети output Token, существенно снижая стоимость enterprise security research. Red team OpenAI: Sol находит уязвимости и примитивы в кодовых базах Chromium и Firefox, но не может автономно построить полностью рабочие exploit chains — ниже порога «Cyber Critical».

Life sciences: GeneBench v1 — Sol с меньшим числом Token достигает уровня GPT-5.5 или выше. HealthBench Professional: 60,5, на 8,7 балла выше GPT-5.5.

GPT-5.6 Sol vs Claude Mythos 5 — прямое сравнение
Параметр GPT-5.6 Sol Claude Mythos 5
TerminalBench 2.1 91,9% (Ultra) / 88,8% 88,0%
ExploitBench Как Mythos Preview, ~1/3 Token Данные не опубликованы
Цена input $5 / M ранее $10/M (сейчас offline)
Доступность Ограниченный preview, широкий rollout через недели Offline (экспортный контроль)
Контекстное окно ~1,5M Token 200K Token

Sol обходит Mythos 5 в программировании и кибербезопасности при половине цены для сопоставимых security research задач. Fable 5 по-прежнему лидирует в SWE-bench Pro; полное сравнение после System Card.

Регуляторный контекст: 2 июня Трамп подписал executive order, дающий правительству до 30 дней доступа до публичного релиза для security review. 26 июня при координации OSTP и ONCD OpenAI согласилась ограничить первый релиз ~20 предварительно одобренными «trusted partners».

Июнь 2026 — Big Three заблокированы
Компания Модель Статус
OpenAI GPT-5.6 Sol/Terra/Luna Preview только ~20 партнёров
Anthropic Claude Fable 5 / Mythos 5 Offline с 12 июня (экспортный контроль)
Google Gemini 3.5 Pro Перенос на июль, планировался на июнь

Ускорение Cerebras в июле: GPT-5.6 Sol будет развёрнут через платформу Cerebras для enterprise-клиентов — до 750 token/s. Ориентир: большинство флагманов выдают 50–150 token/s; 750 token/s может сократить latency до 1/5–1/15.

Текущая фаза (июнь 2026): только ~20 trusted partners с госодобрением через API и Codex; обычные пользователи пока не в ChatGPT.

Скоро (ожидается июль 2026): широкий rollout ChatGPT (Plus/Pro в приоритете), публичный API, Cerebras Sol для enterprise (до 750 token/s). Polymarket оценивает вероятность полного релиза до 31 июля в 87%.

Слои безопасности OpenAI для GPT-5.6: realtime abuse classifiers, account-level review чувствительных workflow, 700 000 A100-эквивалентных GPU-часов automated red teaming, generic jailbreak tests, dedicated large inference filter при сбое основной защиты; все три модели протестированы внешними org до релиза.

  1. Проверить доступность: platform.openai.com и настройки ChatGPT — аккаунт в whitelist ~20 партнёров? Иначе GPT-5.5 или Gemini 3.5 Pro как production fallback.
  2. Externalize model routing: LiteLLM или env vars для gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna — без hardcode неопубликованных slug.
  3. Выбор по сценарию: сложные Agent и программирование → Sol Ultra; массовые API → Terra; резюме и классификация → Luna.
  4. Зарезервировать Token budget: Ultra multi-agent существенно увеличивает расход — daily limits для Sol и auto-downgrade Terra/Luna в cost panel.
  5. Release-day checklist: ChatGPT доступен ≠ API доступен — buffer 24–48 ч для API; следить за openai.com/blog и Deployment Safety System Card.
  6. Зафиксировать Agent execution environment: Codex CLI, Cursor Cloud Agent и multi-model прогоны на стабильном Mac-хосте 7×24 — избегать sleep ноутбука и прерываний в окне госпроверки.

  • Рекорд TerminalBench 2.1: GPT-5.6 Sol Ultra 91,9%, стандарт 88,8%; Claude Mythos 5 на вершине только 17 дней (9 июня — 26 июня).
  • CTF triple: Sol 96,7%, Terra 91,84%, Luna 85,19% — первая линейка OpenAI с High cyber по всей серии.
  • Cerebras throughput: Sol до 750 token/s с июля — в 5–15 раз быстрее 50–150 token/s у текущих флагманов.
  • HealthBench Professional: Sol 60,5, на 8,7 балла выше GPT-5.5; Token на ExploitBench ~1/3 от конкурентов.

FAQ:

  • Можно ли использовать GPT-5.6 в ChatGPT сейчас? Обычным пользователям — нет; ~20 trusted partners, широкий rollout ожидается в июле.
  • Sol лучше Claude Fable 5 для программирования? TerminalBench: Sol 91,9% vs Mythos 5 88,0%; Fable 5 лидирует в SWE-bench Pro — полное сравнение после System Card.
  • Что такое режим Ultra? Параллельные sub-agent'ы для подзадач, синтезированный итог — существенно выше performance на сложных задачах, существенно больше Token.
  • Почему GPT-5.6 ограничен? White House / OSTP / ONCD в рамках EO Трампа от 2 июня — OpenAI сотрудничает, но против нормализации.
  • Насколько быстр Cerebras? До 750 token/s, с июля 2026 для selected enterprise.
  • Размер контекстного окна? Заявлено ~1,5M Token — перепроверить после полной System Card.

Серия GPT-5.6 — прорыв OpenAI в capability (Ultra multi-agent, вершина TerminalBench), efficiency (security research при 1/3 Token) и speed (Cerebras 750 token/s), а также исторический прецедент вмешательства правительства США в релизы AI-моделей.

Основные источники — перепроверить после обновления релиза или политики:

OpenAI Official: Previewing GPT-5.6 Sol

OpenAI Deployment Safety System Card

VentureBeat: GPT-5.6 Launch Coverage

SiliconAngle: GPT-5.6 vs Claude Mythos 5

TechTimes: Government Lock Analysis

Запуск Codex, Ultra multi-agent прогонов и multi-model routing на ноутбуке в режиме sleep в окне ограниченного preview GPT-5.6 съедает даже 91,9% TerminalBench через прерывания задач, истёкший OAuth и переполненный диск — cloud API alone не заменяет стабильный execution layer 7×24.

Если до широкого rollout Sol нужны 7×24 Agent прогоны, фиксированный SSH и предсказуемая мощность Apple Silicon, перенос Cursor Cloud Agent, batch Codex и LiteLLM routing на dedicated bare-metal сервер обычно дешевле, чем постоянное firefighting. NOVAKVM предлагает гибкую аренду Mac Mini M4 / M4 Pro в нескольких регионах с фиксированной полосой и SSH по умолчанию — подходит для iOS CI/CD и AI Agent automation на одном хосте с Xcode. Цены: страница цен, заказ: оформить заказ, деплой: центр помощи.