Для разработчиков и руководителей AI-команд, которые опираются на Codex, Cursor или собственные Agent-воркфлоу, серия GPT-5.6, выпущенная 26 июня 2026 года (флагман Sol, сбалансированный Terra, лёгкий Luna), меняет выбор моделей для программирования и исследований в области безопасности: Sol набрал 91,9% на TerminalBench 2.1 и 96,7% в CTF. Из-за требований правительства США preview доступен только примерно 20 одобренным партнёрам. В статье — цены, режимы Max/Ultra, все бенчмарк-данные, спор о госпроверке, сравнение с Claude Mythos 5, Cerebras 750 token/s в июле и чеклист из 6 шагов. Инфраструктура: страница цен.
[ SECTION_01 ] // OVERVIEW GPT-5.6: краткий обзор, цены и ограниченный госрелиз
| Модель | Позиционирование | Цена input | Цена output | Ключевой показатель |
|---|---|---|---|---|
| GPT-5.6 Sol | Флагман / максимум | $5 / 1M Token | $30 / 1M Token | TerminalBench 2.1 #1 в мире (91,9%) |
| GPT-5.6 Terra | Баланс / workhorse | $2,50 / 1M Token | $15 / 1M Token | Близко к GPT-5.5, на 50% дешевле |
| GPT-5.6 Luna | Лёгкий / быстрый | $1 / 1M Token | $6 / 1M Token | Высокочастотные задачи, ~80% дешевле Sol |
27 июня 2026 года OpenAI впервые ввела солнечную номенклатуру — Sol (Солнце), Terra (Земля), Luna (Луна) — для флагмана, баланса и лёгкого уровня. Это самый важный семейный релиз с GPT-5.5 и первая линейка, где все три модели активируют уровень киберриска «High» у OpenAI.
- Ограниченный доступ: под влиянием исполнительного указа Трампа от 2 июня preview доступен только ~20 одобренным партнёрам. Обычные пользователи пока не могут использовать GPT-5.6 в ChatGPT; широкий rollout ожидается в течение нескольких недель.
- Отраслевой прецедент: впервые правительство США требует госбезопасностную проверку перед широким релизом. CEO Sam Altman сотрудничает, но публично выступает против долгосрочной нормализации.
- Июньский застой Big Three: OpenAI GPT-5.6 (ограничен), Anthropic Claude Fable 5 / Mythos 5 (offline с 12 июня, экспортный контроль), Google Gemini 3.5 Pro (перенос на июль).
- Контекстное окно: все три модели заявляют ~1,5M Token (~50% больше, чем 1M у GPT-5.5). Перепроверить после полной System Card.
- Конкурентный вакуум: Claude Mythos 5 удерживал лидерство TerminalBench (88,0%) всего 17 дней (пик 9 июня), пока Sol с 91,9% не обошёл его.
«Мы не считаем, что эта модель госодобрения должна стать долгосрочной отраслевой нормой по умолчанию. Она отдаляет лучшие инструменты от пользователей, разработчиков, компаний и глобальных партнёров, которым они нужнее всего.» — Sam Altman, CEO OpenAI
[ SECTION_02 ] // MODELS GPT-5.6 Sol, Terra, Luna: режимы Max и Ultra multi-agent
GPT-5.6 Sol — сильнейшая модель OpenAI на сегодня, для сложного программирования, длинных цепочек кибербезопасности и многошаговых автономных Agent-воркфлоу. Цена как у GPT-5.5 ($5 / $30 за MTok), возможности существенно выше.
- Режим Max: больше времени на инференс, скорость жертвуется ради точности — для сценариев с максимальными требованиями к accuracy.
- Режим Ultra: multi-agent архитектура — Sol декомпозирует сложные задачи, распределяет параллельным sub-agent'ам и синтезирует результат. Основа рекорда TerminalBench 91,9% (стандартный режим: 88,8%).
GPT-5.6 Terra — enterprise workhorse для поддержки, внутренних инструментов и анализа документов в масштабе. Производительность близка к GPT-5.5, стоимость на 50% ниже — лучший price/performance при массовом деплое ($2,50 / $15 за MTok).
GPT-5.6 Luna оптимизирован для высокой частоты и низкой latency: резюме, черновики, ежедневная автоматизация. Luna — первая не-флагманская модель с High-оценкой и в кибербезопасности, и в биологии ($1 / $6 за MTok).
| Задача | Рекомендуемая модель |
|---|---|
| Сложная генерация кода, отладка, многошаговые Agent-задачи | Sol (режим Ultra) |
| Enterprise-анализ документов, поддержка, массовые API-вызовы | Terra |
| Высокочастотные резюме, черновики, ежедневная автоматизация | Luna |
| Ограниченный бюджет, но нужен уровень GPT-5.5 | Terra (та же производительность, на 50% дешевле) |
| Latency-критичные realtime-приложения (с июля) | Sol on Cerebras (до 750 token/s) |
[ SECTION_03 ] // BENCHMARKS Бенчмарки GPT-5.6: TerminalBench, CTF, Agent's Last Exam, life sciences
TerminalBench 2.1 (89 сложных задач CLI-планирования, тест multi-step tool calling и координации):
| Модель | Score | Режим |
|---|---|---|
| GPT-5.6 Sol | 91,9% | Ultra (multi-agent) |
| GPT-5.6 Sol | 88,8% | Стандартный |
| Claude Mythos 5 | 88,0% | Стандартный |
| GPT-5.5 | 83,4% | Стандартный |
| Gemini 3.1 Pro Preview | 70,7% | Стандартный |
Agent's Last Exam (завершение длинных профессиональных задач, code mode): Sol 50,9% — единственная модель выше 50%. Luna чуть выше GPT-5.5.
CTF hit rate (кибербезопасность): Sol 96,7%, Terra 91,84%, Luna 85,19%. GPT-5.6 — первая серия OpenAI, где все три модели активируют High по кибербезопасности.
ExploitBench: Sol почти сравним с Anthropic Mythos Preview, но потребляет только около трети output Token, существенно снижая стоимость enterprise security research. Red team OpenAI: Sol находит уязвимости и примитивы в кодовых базах Chromium и Firefox, но не может автономно построить полностью рабочие exploit chains — ниже порога «Cyber Critical».
Life sciences: GeneBench v1 — Sol с меньшим числом Token достигает уровня GPT-5.5 или выше. HealthBench Professional: 60,5, на 8,7 балла выше GPT-5.5.
[ SECTION_04 ] // COMPARE GPT-5.6 Sol vs Claude Mythos 5: программирование и регуляторный контекст
| Параметр | GPT-5.6 Sol | Claude Mythos 5 |
|---|---|---|
| TerminalBench 2.1 | 91,9% (Ultra) / 88,8% | 88,0% |
| ExploitBench | Как Mythos Preview, ~1/3 Token | Данные не опубликованы |
| Цена input | $5 / M | ранее $10/M (сейчас offline) |
| Доступность | Ограниченный preview, широкий rollout через недели | Offline (экспортный контроль) |
| Контекстное окно | ~1,5M Token | 200K Token |
Sol обходит Mythos 5 в программировании и кибербезопасности при половине цены для сопоставимых security research задач. Fable 5 по-прежнему лидирует в SWE-bench Pro; полное сравнение после System Card.
Регуляторный контекст: 2 июня Трамп подписал executive order, дающий правительству до 30 дней доступа до публичного релиза для security review. 26 июня при координации OSTP и ONCD OpenAI согласилась ограничить первый релиз ~20 предварительно одобренными «trusted partners».
| Компания | Модель | Статус |
|---|---|---|
| OpenAI | GPT-5.6 Sol/Terra/Luna | Preview только ~20 партнёров |
| Anthropic | Claude Fable 5 / Mythos 5 | Offline с 12 июня (экспортный контроль) |
| Gemini 3.5 Pro | Перенос на июль, планировался на июнь |
Ускорение Cerebras в июле: GPT-5.6 Sol будет развёрнут через платформу Cerebras для enterprise-клиентов — до 750 token/s. Ориентир: большинство флагманов выдают 50–150 token/s; 750 token/s может сократить latency до 1/5–1/15.
[ SECTION_05 ] // ACCESS Доступ к GPT-5.6: чеклист внедрения из 6 шагов
Текущая фаза (июнь 2026): только ~20 trusted partners с госодобрением через API и Codex; обычные пользователи пока не в ChatGPT.
Скоро (ожидается июль 2026): широкий rollout ChatGPT (Plus/Pro в приоритете), публичный API, Cerebras Sol для enterprise (до 750 token/s). Polymarket оценивает вероятность полного релиза до 31 июля в 87%.
Слои безопасности OpenAI для GPT-5.6: realtime abuse classifiers, account-level review чувствительных workflow, 700 000 A100-эквивалентных GPU-часов automated red teaming, generic jailbreak tests, dedicated large inference filter при сбое основной защиты; все три модели протестированы внешними org до релиза.
- Проверить доступность: platform.openai.com и настройки ChatGPT — аккаунт в whitelist ~20 партнёров? Иначе GPT-5.5 или Gemini 3.5 Pro как production fallback.
- Externalize model routing: LiteLLM или env vars для
gpt-5.6-sol,gpt-5.6-terra,gpt-5.6-luna— без hardcode неопубликованных slug. - Выбор по сценарию: сложные Agent и программирование → Sol Ultra; массовые API → Terra; резюме и классификация → Luna.
- Зарезервировать Token budget: Ultra multi-agent существенно увеличивает расход — daily limits для Sol и auto-downgrade Terra/Luna в cost panel.
- Release-day checklist: ChatGPT доступен ≠ API доступен — buffer 24–48 ч для API; следить за openai.com/blog и Deployment Safety System Card.
- Зафиксировать Agent execution environment: Codex CLI, Cursor Cloud Agent и multi-model прогоны на стабильном Mac-хосте 7×24 — избегать sleep ноутбука и прерываний в окне госпроверки.
[ SECTION_06 ] // DATA Цитируемые технические данные, FAQ и итог
- Рекорд TerminalBench 2.1: GPT-5.6 Sol Ultra 91,9%, стандарт 88,8%; Claude Mythos 5 на вершине только 17 дней (9 июня — 26 июня).
- CTF triple: Sol 96,7%, Terra 91,84%, Luna 85,19% — первая линейка OpenAI с High cyber по всей серии.
- Cerebras throughput: Sol до 750 token/s с июля — в 5–15 раз быстрее 50–150 token/s у текущих флагманов.
- HealthBench Professional: Sol 60,5, на 8,7 балла выше GPT-5.5; Token на ExploitBench ~1/3 от конкурентов.
FAQ:
- Можно ли использовать GPT-5.6 в ChatGPT сейчас? Обычным пользователям — нет; ~20 trusted partners, широкий rollout ожидается в июле.
- Sol лучше Claude Fable 5 для программирования? TerminalBench: Sol 91,9% vs Mythos 5 88,0%; Fable 5 лидирует в SWE-bench Pro — полное сравнение после System Card.
- Что такое режим Ultra? Параллельные sub-agent'ы для подзадач, синтезированный итог — существенно выше performance на сложных задачах, существенно больше Token.
- Почему GPT-5.6 ограничен? White House / OSTP / ONCD в рамках EO Трампа от 2 июня — OpenAI сотрудничает, но против нормализации.
- Насколько быстр Cerebras? До 750 token/s, с июля 2026 для selected enterprise.
- Размер контекстного окна? Заявлено ~1,5M Token — перепроверить после полной System Card.
Серия GPT-5.6 — прорыв OpenAI в capability (Ultra multi-agent, вершина TerminalBench), efficiency (security research при 1/3 Token) и speed (Cerebras 750 token/s), а также исторический прецедент вмешательства правительства США в релизы AI-моделей.
Основные источники — перепроверить после обновления релиза или политики:
OpenAI Official: Previewing GPT-5.6 Sol
OpenAI Deployment Safety System Card
VentureBeat: GPT-5.6 Launch Coverage
SiliconAngle: GPT-5.6 vs Claude Mythos 5
TechTimes: Government Lock Analysis
Запуск Codex, Ultra multi-agent прогонов и multi-model routing на ноутбуке в режиме sleep в окне ограниченного preview GPT-5.6 съедает даже 91,9% TerminalBench через прерывания задач, истёкший OAuth и переполненный диск — cloud API alone не заменяет стабильный execution layer 7×24.
Если до широкого rollout Sol нужны 7×24 Agent прогоны, фиксированный SSH и предсказуемая мощность Apple Silicon, перенос Cursor Cloud Agent, batch Codex и LiteLLM routing на dedicated bare-metal сервер обычно дешевле, чем постоянное firefighting. NOVAKVM предлагает гибкую аренду Mac Mini M4 / M4 Pro в нескольких регионах с фиксированной полосой и SSH по умолчанию — подходит для iOS CI/CD и AI Agent automation на одном хосте с Xcode. Цены: страница цен, заказ: оформить заказ, деплой: центр помощи.