Дополнение от 29 сентября 2026 г.: эта статья посвящена выходу GPT-5.6 (Luna / Terra / Sol), общедоступного с июля 2026 года. С тех пор OpenAI выпустила GPT-6 Astra (3 сентября), а 22 сентября (по времени США) — GPT-6 Sol и GPT-6 Luna, которые переносят названия Sol и Luna в следующее поколение. По состоянию на 30 сентября 2026 года список моделей API советует начинать с Astra, если вы не уверены в выборе, брать GPT-6.1 Sol (вышла 29 сентября; в ChatGPT доступна в Work и Codex, но не в чате) для баланса интеллекта и стоимости ($2 за вход / $10 за выход на миллион токенов) и GPT-6 Luna для больших объёмов работы, где важна цена ($0.10 / $0.50); модели GPT-5.6 среди рекомендаций больше не значатся (по справке ChatGPT, GPT-5.6 Sol, Terra и Luna остаются доступными на переходный период). Anthropic также выпустила Claude Opus 5 (24 июля), Claude Fable 5.1 (1 сентября) и Claude Opus 5.5 (22 сентября). О стоимости см. наше сравнение Astra на low и GPT-5.6 Sol на high по замерам. Слова «флагман», «первое место» и значения бенчмарков ниже приведены на момент написания. 22 сентября мы также уточнили, что соотношение цены и результата Luna в DeepSWE (около 24 баллов на доллар) — это расчёт третьей стороны на основе данных OpenAI, и указали источник.
Содержание
- 1. Обзор релиза — дата, доступность, характеристики
- 2. Luna / Terra / Sol — различия трёх моделей и как выбрать
- 3. Цены — обратите внимание на Terra
- 4. Бенчмарки — прямое сравнение с Claude
- 5. Что нового — 5 ключевых моментов
- 6. Доступность по тарифам ChatGPT
- 7. Сравнение с Claude (Fable 5 / Opus 4.8)
- 8. На что обратить внимание — скрытые бенчмарки и слабость в кодинге
- 9. Рекомендации по задачам — какую модель выбрать
- FAQ
9 июля 2026 г. OpenAI открыла общий доступ к новому семейству моделей «GPT-5.6» (официальный анонс OpenAI, официальный релиз после ограниченного превью 26 июня). Главная особенность — отказ от прежней двухуровневой схемы «базовая + Pro» в пользу трёхмодельной структуры: Luna (быстрая, недорогая) / Terra (сбалансированная) / Sol (флагман).
Флагманская Sol заняла первое место в Artificial Analysis Coding Agent Index с результатом 80 — показателе производительности кодинг-агентов, а в Agents' Last Exam, измеряющем длительные рабочие процессы, набрала 53.6, опередив Claude Fable 5 (40.5) на 13.1 пункта (данные, опубликованные OpenAI, в сводке Vellum). При этом в SWE-Bench Pro — кодинге производственного уровня — Claude Fable 5 набрал 80.0%, а Sol лишь 64.6%, так что остаются области, где Sol явно уступает Claude (оба значения взяты из оценочной таблицы OpenAI; по системной карте Anthropic у Fable 5 тоже 80.0%; 80.3% в таблице анонса Anthropic — большее из двух значений в общей колонке, то есть результат Mythos 5).
В этой статье на основе официального анонса OpenAI и нескольких независимых отчётов о бенчмарках мы разбираем различия трёх моделей, цены, бенчмарки, новые функции, доступность по тарифам ChatGPT, сравнение с Claude и выбор модели под задачу — исходя только из подтверждённых данных.
Релиз GPT-5.6
Общий доступ с 9 июля 2026 г. / трёхмодельная структура
1. Обзор релиза — дата, доступность, характеристики
| Параметр | Значение |
|---|---|
| Название семейства | GPT-5.6 |
| Начало общего доступа | 9 июля 2026 г. (ограниченное превью — 26 июня) |
| Разработчик | OpenAI |
| Предыдущее поколение | GPT-5.5 |
| Состав моделей | Luna (быстрая, недорогая) / Terra (баланс) / Sol (флагман) — три модели |
| Контекстное окно | около 1 млн токенов (1,050,000) — общее для трёх моделей |
| Максимальный вывод | 128,000 токенов |
| Порог знаний | 16 февраля 2026 г. |
| Цена API (Sol) | $5 (ввод) / $30 (вывод) per 1M tokens |
| Цена API (Terra) | $2 (ввод) / $12 (вывод) per 1M tokens |
| Цена API (Luna) | $0.20 (ввод) / $1.20 (вывод) per 1M tokens |
| Уровни reasoning effort | none / low / medium / high / xhigh / max — 6 уровней |
| Каналы доступа | ChatGPT / ChatGPT Work / Codex / OpenAI API |
| Одновременный анонс | ChatGPT Work (бизнес-агент), новое десктоп-приложение со встроенным Codex, голосовая модель GPT-Live |
Ключевой момент: все три модели делят одинаковый контекст около 1 млн токенов и максимальный вывод 128K. Различаются они «умом», «скоростью» и «ценой», а объём документов, который можно обработать, у них одинаковый. Выбор идёт по вертикали — по задаче и стоимости.
2. Luna / Terra / Sol — различия трёх моделей и как выбрать
Главное изменение в GPT-5.6 — переход от двух уровней (базовый/Pro) к трём. Разберём позиционирование каждой.
Самая дешёвая и быстрая модель. Оптимальна для простой классификации, суммаризации, чата и массовой пакетной обработки. По баллам DeepSWE v1.1 и оценкам стоимости API из графиков OpenAI Trilogy AI Center of Excellence (10 июля 2026 года) подсчитал, что на пиковом результате Luna даёт около 24 баллов на каждый оценочный доллар API — намного больше, чем 3.2 у Claude Fable 5 (стоимость — это оценки OpenAI, полученные моделированием).
Подходит для: частых недорогих задач, внутренних инструментов
«Фаворит на каждый день»: производительность на уровне прошлого поколения GPT-5.5 — но заметно дешевле. В TerminalBench 2.1 набирает 87.4%, вплотную приближаясь к Sol, а её тариф составляет 40% от тарифа Sol (после снижения цен 30 июля 2026 г.). Считается, что для большинства практических нагрузок Terra более чем достаточно.
Подходит для: повседневного кодинга, текстов, агентов
Самая умная модель семейства GPT-5.6. Высший уровень в общей агентной силе, длительных задачах и безопасности. По данным OpenAI, эффективность токенов в кодинге выросла на 54%, обеспечивая «фронтирную производительность при меньшем числе токенов».
Подходит для: сложных агентов, длительных автономных задач
Принцип выбора прост. Сначала возьмите Terra по умолчанию, если точности не хватает — поднимитесь до Sol, а если в приоритете стоимость и скорость — опуститесь до Luna. Такой подход «от Terra» помогает легче балансировать между стоимостью и качеством.
3. Цены — обратите внимание на Terra
| Модель | Ввод / 1M tokens | Вывод / 1M tokens | Позиционирование |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | максимум производительности |
| GPT-5.6 Terra | $2.00 | $12.00 | уровень GPT-5.5 за 40% тарифа Sol |
| GPT-5.6 Luna | $0.20 | $1.20 | самая дешёвая и быстрая |
Внимания заслуживает соотношение цены и производительности у Terra. OpenAI поясняет: «Terra обеспечивает производительность, сопоставимую с прошлым поколением GPT-5.5, примерно за полцены». То есть многие задачи, для которых раньше требовалась Sol (аналог прежней базовой модели), теперь можно выполнять за половину стоимости.
При этом цена Sol $5/$30 совпадает по вводу с Claude Opus 4.8 ($5/$25), а по выводу чуть выше. Стоимость флагманов у разных компаний почти выравнивается, и разница теперь проявляется в «производительности» и «эффективности токенов».
4. Бенчмарки — прямое сравнение с Claude
Бенчмарки GPT-5.6 (4 ключевых показателя)
Sol / Terra / Luna vs Claude Fable 5
Источник: оценочная таблица анонса GPT-5.6 от OpenAI (Coding Agent Index — Artificial Analysis; Agents' Last Exam для Sol — из текста анонса). Значения Claude Fable 5 тоже из таблицы OpenAI; в собственном анонсе Anthropic указаны SWE-Bench Pro 80.3% и TerminalBench 2.1 88.0% (в обоих случаях большее из двух значений в общей с Mythos 5 колонке; по системной карте у одной Fable 5 — 80.0% и 84.3%)
| Бенчмарк | Sol | Terra | Luna | Claude Fable 5 |
|---|---|---|---|---|
| TerminalBench 2.1 | 88.8% | 87.4% | 84.7% | 83.1% |
| SWE-Bench Pro | 64.6% | 63.4% | 62.7% | 80.0% |
| Agents' Last Exam | 53.6 | 50.4 | 50.3 | 40.5 |
| Coding Agent Index | 80 | 77.4 | 74.6 | 77.2 |
| MRCR (запоминание длинного контекста) | 91.5% | 89.6% | 41.3% | — |
Вывод: в агентах сильна, но в кодинге производственного уровня выше Claude
GPT-5.6 Sol заняла первое место в общей агентной силе (Agents' Last Exam) и в индексе кодинг-агентов. В TerminalBench, по таблице OpenAI, она также опережает Claude Fable 5 (83.1%). Однако в SWE-Bench Pro (исправление багов производственного уровня в реальных репозиториях) Claude Fable 5 набрал 80.0%, а Sol — 64.6% (Terra — 63.4%, Luna — 62.7%), проиграв более чем на 15 пунктов. Откровенное прочтение таково: «способность автономно действовать как агент» и «способность точно править реальную кодовую базу» — это разные вещи.
Кроме того, запоминание длинного контекста у Luna (MRCR) — 41.3%, что сильно ниже Sol/Terra. Даже имея окно в 1 млн токенов, Luna плохо подходит для точной работы со сверхдлинными текстами. Для длинных текстов выбирайте Terra или выше.
5. Что нового — 5 ключевых моментов
① От двух уровней к трёхмодельной структуре
Главное изменение. Прежняя схема «базовая + дорогая Pro» переформирована в три уровня: Luna / Terra / Sol. Особенно Terra с её соотношением цена/качество «уровень GPT-5.5 за 40% тарифа Sol» становится главной в проектировании расходов.
② Улучшение эффективности токенов (в кодинге на 54%)
CEO OpenAI Сэм Альтман заявил, что Sol на 54% экономнее расходует токены в агентных задачах кодинга (в интервью CNBC; база сравнения не названа). Если при одной и той же работе расходуется меньше токенов, общая стоимость снижается даже при неизменной цене за токен. Именно поэтому сравнивать нужно не только по прайсу, но и по «реальной стоимости одной задачи».
③ Programmatic Tool Calling (Responses API)
В качестве новой функции для разработчиков в Responses API добавлен «Programmatic Tool Calling» — модель генерирует и выполняет JavaScript, оркестрируя вызовы инструментов (разбор Саймона Уиллисона). Это позволяет запускать сложных агентов, охватывающих несколько инструментов, за меньшее число обращений. Reasoning effort имеет 6 уровней: none / low / medium / high / xhigh / max.
④ ChatGPT Work и новое десктоп-приложение
Одновременно с GPT-5.6 были представлены бизнес-агент «ChatGPT Work», новое десктоп-приложение со встроенным Codex и хостинг-сервис для клиентов. Это движение по расширению ChatGPT от «просто чата» к «платформе, выполняющей рабочие задачи».
⑤ Голосовая модель GPT-Live (полнодуплексный разговор)
В голосовой сфере появилась новая серия GPT-Live. Вместо прежнего пошагового режима (ответ после того, как собеседник договорит) она обеспечивает полнодуплексный разговор, в котором можно перебивать и поддакивать, как человек. Платным пользователям доступна GPT-Live-1, бесплатным — GPT-Live-1 mini.
6. Доступность по тарифам ChatGPT
| Тариф | Ориентир в месяц | Использование GPT-5.6 | Выбор модели |
|---|---|---|---|
| Free | $0 | △ только Terra в ChatGPT Work / Codex | нет (только Terra) |
| Go | $8/мес | △ только Terra в ChatGPT Work / Codex | нет (только Terra) |
| Plus | $20/мес | ✅ Sol / Terra / Luna | да (можно задать и effort) |
| Pro | $100–$200/мес | ✅ Sol / Terra / Luna | да (можно задать и effort) |
| Business | от $25/место | ✅ Sol / Terra / Luna | да (можно задать и effort) |
| Enterprise | по запросу | ✅ Sol / Terra / Luna | да (можно задать и effort) |
Особенность в том, что пользователи Free / Go тоже могут использовать Terra внутри ChatGPT Work и Codex. Однако свободно выбирать модель и регулировать reasoning effort можно только на Plus и выше. Голосовую GPT-Live даже на бесплатном тарифе можно использовать в версии mini. (Состав тарифов и цены — на основе различных сообщений на момент выхода. Актуальные данные смотрите на официальной странице тарифов ChatGPT.)
7. Сравнение с Claude (Fable 5 / Opus 4.8)
GPT-5.6 Sol vs Claude Fable 5 vs Claude Opus 4.8
Как выбирать между флагманами
Если обобщить — для «широкого автономного использования как агента» подойдёт GPT-5.6 Sol, а для «точных правок реальной кодовой базы и длительного кодинга» — Claude. По цене Claude Opus 4.8 ($5/$25) дешевле Sol ($5/$30) по выводу и при этом выше по качеству кодинга, поэтому для задач кодинга линейка Claude выигрывает по соотношению цена/качество.
8. На что обратить внимание — скрытые бенчмарки и слабость в кодинге
① Есть бенчмарки, которые OpenAI не публикует
Независимый анализ (Vellum) сразу после запуска отметил, что OpenAI не опубликовала SWE-bench Verified, GPQA Diamond, AIME, MMLU, ARC-AGI-2 и FrontierMath. Однако в оценочной таблице на странице анонса OpenAI, проверенной 22 сентября 2026 года, есть GPQA Diamond (Sol — 94.6%) и FrontierMath (89% на уровнях 1–3 и 83% на уровне 4). SWE-bench Verified, AIME и MMLU в ней нет, а значение Sol в ARC-AGI-2 (92.5%) впервые появилось в сравнительной таблице анонса GPT-6 Astra 3 сентября. Акцент сделан на агентных показателях, а сравнительных значений по универсальному рассуждению и математике мало — это стоит учитывать при оценке. Читать нужно с поправкой на то, что могут быть выставлены лишь хорошие цифры.
② Кодинг производственного уровня слаб даже у Sol
Как отмечено выше, в SWE-Bench Pro у Sol 64.6% против 80.0% у Claude Fable 5 (оба значения из оценочной таблицы OpenAI). Если главная цель — исправление багов и создание PR в реальных репозиториях, стоит рассмотреть Claude, а не GPT-5.6. Заметим, что, включив это значение в таблицу, OpenAI отдельно опубликовала анализ, по которому около 30% задач SWE-Bench Pro содержат дефекты (на это указывает Vellum).
③ Luna плохо справляется с длинными текстами
Luna дешёвая и быстрая, но её запоминание длинного контекста (MRCR) резко ниже — 41.3%. Не передавайте Luna целиком длинные спецификации, логи и кодовые базы, а длинные тексты доверяйте Terra и выше.
④ Порог знаний — 16 февраля 2026 г.
События после этой даты не входят в обучение. Для задач, где нужна свежая информация, обязательно совместное использование инструмента веб-поиска.
9. Рекомендации по задачам — какую модель выбрать
- повседневный кодинг, тексты, суммаризация
- упор на баланс стоимости и качества
- «машина по умолчанию» для начала
- эксплуатация сложных автономных агентов
- длительные задачи, работа с безопасностью
- случаи, где точность важнее стоимости
- частая массовая обработка по низкой цене
- классификация, извлечение, короткий чат
- упор на короткие тексты (длинных избегать)
- исправление багов и PR в реальных репозиториях
- длительный автономный кодинг
- точность и безопасность в приоритете
FAQ
Q1. С какого момента можно пользоваться GPT-5.6?
Общий доступ начался 9 июля 2026 г. (ограниченное превью — 26 июня). Модель доступна в ChatGPT, ChatGPT Work, Codex и OpenAI API.
Q2. Чем различаются Luna / Terra / Sol?
Это модели, выстроенные по вертикали в трёх измерениях: ум, скорость и цена. Luna — самая дешёвая и быстрая, Terra — баланс (уровень GPT-5.5 за 40% тарифа Sol), Sol — максимум производительности. Контекст (около 1 млн токенов) и максимальный вывод (128K) у всех трёх одинаковы. Рекомендуем сначала взять Terra по умолчанию и по необходимости переходить к Sol/Luna.
Q3. Можно ли использовать GPT-5.6 на бесплатном тарифе?
В обычном чате — нет, но внутри ChatGPT Work и Codex даже на Free / Go доступна Terra. Чтобы свободно выбирать модель и регулировать reasoning effort, нужен Plus ($20/мес) или выше. Голосовую GPT-Live даже на бесплатном тарифе можно использовать в версии mini.
Q4. Кто сильнее в кодинге — GPT-5.6 или Claude?
Зависит от показателя. В работе с терминалом (TerminalBench 2.1) Sol с 88.8% опережает Claude Fable 5 (83.1%), но в SWE-Bench Pro производственного уровня Claude Fable 5 набрал 80.0%, а Sol — 64.6%, так что Claude сильно впереди (все значения из оценочной таблицы OpenAI; в системной карте Anthropic у Fable 5 в SWE-Bench Pro — тоже 80.0%). Если главная цель — исправление багов в реальных репозиториях, разумнее взять Claude, а для широких автономных агентов — Sol.
Q5. Какие цены?
За 1M токенов: Sol $5/$30, Terra $2/$12, Luna $0.20/$1.20 (ввод/вывод) — по состоянию на август 2026 г. 30 июля 2026 г. Luna подешевела на 80%, а Terra — на 20%, цена Sol осталась прежней. Terra позиционируется как модель, дающая производительность уровня GPT-5.5 примерно за 40% тарифа Sol, и становится главной в проектировании расходов. Отметим, что с 21 августа 2026 г. Sol перешла на промоцену (ввод $4 / вывод $20, по анонсу — на три месяца). Выйдет ли это дешевле, чем GPT-6 Astra, сравнивается по замерам в статье Действительно ли GPT-6 Astra на low дешевле?
Q6. Каковы контекстное окно и порог знаний?
Все три модели имеют контекст около 1 млн токенов (1,050,000) и максимальный вывод 128K. Порог знаний — 16 февраля 2026 г.
Q7. Есть ли новые функции для разработчиков?
В Responses API добавлен Programmatic Tool Calling (функция, при которой модель генерирует JavaScript и выстраивает вызовы инструментов). Reasoning effort управляется 6 уровнями: none / low / medium / high / xhigh / max.
Q8. Что такое GPT-Live?
Это новая серия голосовых моделей, представленная одновременно с GPT-5.6. Вместо пошагового режима она работает в полном дуплексе, обеспечивая естественный разговор с перебиваниями и поддакиванием. Платным пользователям доступна GPT-Live-1, бесплатным — GPT-Live-1 mini.
Q9. Есть ли бенчмарки, которые OpenAI не публикует?
Да. В оценочной таблице анонса нет SWE-bench Verified, AIME и MMLU. Независимый анализ (Vellum) сразу после запуска сообщал, что нет и GPQA Diamond с FrontierMath, но в таблице, проверенной 22 сентября 2026 года, GPQA Diamond (Sol — 94.6%) и FrontierMath есть. Поскольку акцент сделан на агентных показателях, реальные способности в универсальном рассуждении и математике нужно оценивать отдельно.
Q10. Будут ли существующие GPT-приложения работать как есть?
API в целом совместимо, и для перехода достаточно сменить ID модели. Однако, поскольку теперь три модели, стоит заново спроектировать, какой задаче назначить Luna/Terra/Sol — это оптимизирует стоимость и качество. Во многих случаях эффективен старт с Terra.
Итог: наступает эпоха «выбора по вертикали» с тремя моделями
GPT-5.6 вышла не как единственная витринная модель, а как трёхуровневая структура Luna / Terra / Sol. Роли ясны: Sol на первом месте в общей агентной силе и индексе кодинг-агентов, Terra благодаря соотношению цена/качество «уровень GPT-5.5 за 40% тарифа Sol» становится главной для практики, а Luna — экономичной моделью для массовой обработки.
С другой стороны, есть и факторы, из-за которых её нельзя назвать безусловно лучшей: в кодинге производственного уровня (SWE-Bench Pro) она сильно уступает Claude, в оценочной таблице OpenAI мало сравнительных значений по универсальному рассуждению и математике, а у Luna слабая обработка длинных текстов.
Умная эксплуатация в 2026 году — это всё же «использовать три модели GPT-5.6 и Claude в зависимости от задачи». Повседневность — Terra, сложные агенты — Sol, массовая обработка — Luna, боевой кодинг — Claude. Оптимизируйте стоимость и качество, изначально исходя из мультимодельного подхода.
Связанные статьи
- GPT-6 Astra: полный обзор релиза — флагман-преемник GPT-5.6
- GPT-5.5: полный обзор релиза — подробности прошлого поколения GPT-5.5
- Claude Opus 4.8: полный обзор релиза — прямой конкурент
- Claude Fable 5: полный обзор релиза — модель-лидер SWE-Bench Pro
- Claude vs ChatGPT: сравнение цен — структура тарифов обеих
- Что такое ChatGPT Work? Рабочий агент GPT-5.6 — рабочий агент, который создаёт документы, таблицы и слайды
- GPT-5.6 vs GPT-5.5: от одного флагмана к трём моделям — Terra за 40% цены
- Что такое Kimi K3? Модель на 2,8 трлн параметров и её «третье место» — цена, открытые веса и влияние на рынок