GPT 5.6 API
Принимает переписку списком сообщений и изображения, возвращает текст. Контекст 1 050 000 токенов, ответ до 128 000, знания до 16 февраля 2026 года. Модель OpenAI.
Принимает переписку списком сообщений и изображения, возвращает текст. Контекст 1 050 000 токенов, ответ до 128 000, знания до 16 февраля 2026 года. Модель OpenAI.
Принимает переписку списком сообщений и изображения, возвращает текст. Контекст 1 050 000 токенов, ответ до 128 000, знания до 16 февраля 2026 года. Модель OpenAI.
GPT 5.6 API работает в России без VPN: один API ключ GEN202, оплата рублями с российской карты, цена до 10% ниже официальной.
Цена: за миллион токенов, вход — 92 кр. (46 ₽ · $0.46), выход — 554 кр. (277 ₽ · $2.77).
Цена: за миллион токенов, вход — 923 кр. (461,5 ₽ · $4.615), выход — 5539 кр. (2769,5 ₽ · $27.695).
Цена: за миллион токенов, вход — 923 кр. (461,5 ₽ · $4.615), выход — 5400 кр. (2700 ₽ · $27).
кр. — кредиты, покупаются за рубли.
работает
работает
работает
Песочница
Потолок ответа — предел выбранной модели. Списывается фактический расход, а не потолок. Меньшее значение обрывает ответ на полуслове: у рассуждающих моделей тысяча токенов уходит на размышление, и текста ответа не остаётся вовсе.
Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.
Нажмите «Запустить» — ответ модели появится здесь
{ }
Цена GPT 5.6
GPT 5.6 Luna.
Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля
usage ответа: сколько токенов ушло в запрос и сколько модель
вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит
денег само по себе, независимо от длины запроса.
| Токены | Наша цена |
|---|---|
| Вход | 92 кр. $0.4646 ₽ |
| Выход | 554 кр. $2.77277 ₽ |
кр. — кредиты, покупаются за рубли.
Длинный запрос. У GPT 5.6 Luna он считается по второй цене: как только на вход уходит от 272 000 токенов, дороже становится весь запрос целиком — и вход, и выход.
| Токены | Наша цена |
|---|---|
| Вход | 185 кр. $0.92592,5 ₽ |
| Выход | 831 кр. $4.155415,5 ₽ |
GPT 5.6 Terra.
Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля
usage ответа: сколько токенов ушло в запрос и сколько модель
вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит
денег само по себе, независимо от длины запроса.
| Токены | Наша цена |
|---|---|
| Вход | 923 кр. $4.615461,5 ₽ |
| Выход | 5539 кр. $27.6952769,5 ₽ |
кр. — кредиты, покупаются за рубли.
Длинный запрос. У GPT 5.6 Terra он считается по второй цене: как только на вход уходит от 272 000 токенов, дороже становится весь запрос целиком — и вход, и выход.
| Токены | Наша цена |
|---|---|
| Вход | 1846 кр. $9.23923 ₽ |
| Выход | 8309 кр. $41.5454154,5 ₽ |
GPT 5.6 Sol.
Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля
usage ответа: сколько токенов ушло в запрос и сколько модель
вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит
денег само по себе, независимо от длины запроса.
| Токены | Скидка от официальной цены | Наша цена |
|---|---|---|
| Вход | $5 −7,7% | 923 кр. $4.615461,5 ₽ |
| Выход | $30 −10% | 5400 кр. $272700 ₽ |
На 8,8% ниже официальной цены поставщика. кр. — кредиты, покупаются за рубли.
Длинный запрос. У GPT 5.6 Sol он считается по второй цене: как только на вход уходит от 272 000 токенов, дороже становится весь запрос целиком — и вход, и выход.
| Токены | Скидка от официальной цены | Наша цена |
|---|---|---|
| Вход | $10 −7,7% | 1846 кр. $9.23923 ₽ |
| Выход | $45 −10% | 8100 кр. $40.54050 ₽ |
Вызов через API
Адрес один, и ответ приходит на этот же запрос: задачу ставить и опрашивать не нужно — этим текст и
отличается от картинок. Ключ передаётся заголовком
Authorization: Bearer sk-… и выпускается
в кабинете. На один ключ шлюз пропускает
60 запросов в минуту.
Счёт идёт по токенам из поля usage ответа: вход и выход по своим
ставкам. Кредиты списываются после ответа, по факту — заранее ничего не удерживается, поэтому
короткий вопрос стоит ровно столько, сколько стоит, и не занимает баланс под будущий ответ.
Сколько списано, приходит в самом ответе полем credits_consumed.
Перед вызовом проверяется одно: на балансе есть деньги. Запрос, не дошедший до ответа, не
тарифицируется вовсе.
Поля запроса
Все три лежат в корне тела запроса — вложенного input у текста нет.
Остальные поля формата OpenAI — temperature,
top_p, stop,
seed, response_format,
reasoning_effort и прочие — шлюз передаёт поставщику, проверив
значение: temperature от 0 до 2 (у Claude до 1),
top_p от 0 до 1, штрафы от −2 до 2,
reasoning_effort — minimal, low, medium или high (у GPT 6 Astra — low, medium или high), стоп-слов не
больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего:
поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого
семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо
на её странице.
stream работает: ответ приходит событиями, как это принято у Chat
Completions, и заканчивается строкой data: [DONE]. У поставщика ответ
при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена
вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём
стоят на последнем событии, рядом с признаком конца.
tools передаётся всем моделям каталога.
n и
best_of не передаются: несколько вариантов ответа умножают расход, а
перед вызовом проверено, что денег хватает на один.
| Поле | Тип | Обяз. | Допустимые значения |
|---|---|---|---|
| model | текст | обязательное | gpt/5-6-luna либо другое имя из каталога текстовых моделей |
| messages | массив | обязательное |
Непустой список сообщений с ролями system,
user, assistant. Пустой список
или не массив — отказ 400
|
| max_tokens | целое | опц. |
От 1 до 128000; вне границ — отказ 400.
Синоним — max_completion_tokens
· без него шлюз подставит 1024
|
Вызов
Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.
curl https://api.gen202.com/v1/chat/completions \
-H "Authorization: Bearer sk-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt/5-6-luna",
"messages": [{"role": "user", "content": "Привет"}],
"max_tokens": 200
}'
from openai import OpenAI
client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")
answer = client.chat.completions.create(
model="gpt/5-6-luna",
messages=[{"role": "user", "content": "Привет"}],
max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage) # по нему выставлен счёт
Вызов
Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.
curl https://api.gen202.com/v1/chat/completions \
-H "Authorization: Bearer sk-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt/5-6-terra",
"messages": [{"role": "user", "content": "Привет"}],
"max_tokens": 200
}'
from openai import OpenAI
client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")
answer = client.chat.completions.create(
model="gpt/5-6-terra",
messages=[{"role": "user", "content": "Привет"}],
max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage) # по нему выставлен счёт
Вызов
Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.
curl https://api.gen202.com/v1/chat/completions \
-H "Authorization: Bearer sk-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt/5-6-sol",
"messages": [{"role": "user", "content": "Привет"}],
"max_tokens": 200
}'
from openai import OpenAI
client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")
answer = client.chat.completions.create(
model="gpt/5-6-sol",
messages=[{"role": "user", "content": "Привет"}],
max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage) # по нему выставлен счёт
Ответ
Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.
{
"choices": [
{
"index": 0,
"message": { "role": "assistant", "content": "…" },
"finish_reason": "stop"
}
],
"usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}
Текст лежит в choices[0].message.content, причина остановки — в
finish_reason (stop или
length). По usage выставляется счёт, так
что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI
(id, created,
object) шлюз не добавляет.
Отказы
Тело отказа — объект error, как у OpenAI:
{"error":{"message":…,"type":…,"code":…,"param":null}}. Ни один из этих отказов не тарифицируется:
деньги списываются только после ответа модели, и возвращать после отказа нечего.
| Код | code | Когда |
|---|---|---|
| 400 | model_not_found | Имени из поля model нет среди текстовых моделей. В сообщении перечислено, что принимается. |
| 400 | invalid_messages | Поле messages не передано, пустое или не массив. |
| 400 | invalid_max_tokens | Поле max_tokens не целое число либо вне границ от 1 до 128000. |
| 400 | invalid_setting | Настройка запроса с негодным значением: temperature вне границ от 0 до 2 (у Claude до 1), top_p вне границ от 0 до 1, штраф вне границ от −2 до 2, reasoning_effort не из списка minimal, low, medium, high, пустое стоп-слово или больше четырёх стоп-слов. В сообщении назван сам параметр. |
| 400 | key_required | Названный заголовком учёта ключ не принадлежит аккаунту или отключён. При вызове по ключу Bearer такого отказа не бывает. |
| 400 | — | Тело запроса не разобралось как JSON. Проверьте, что отправляете правильно составленный объект. |
| 401 | invalid_api_key | Ключа нет в заголовке Authorization, либо он неверный или отключён. |
| 402 | insufficient_credits | На балансе не осталось свободных кредитов. Перед вызовом шлюз проверяет только это — сумма списывается после ответа, по факту. |
| 403 | forbidden | Аккаунт заблокирован: вызовы модели, пополнение и загрузка файлов ему закрыты. Ключи при этом не отключены — запрет лежит на аккаунте. |
| 413 | — | Тело запроса больше предела в 512 КиБ. |
| 415 | — | Не тот тип содержимого. Заголовок Content-Type должен быть application/json. |
| 429 | — | Больше 60 запросов в минуту на один ключ. |
| 502 | upstream_error | Поставщик не ответил или ответил ошибкой. Запрос не тарифицируется: списывать нечего, ответа не было. |
| 503 | service_overloaded | Поставщик перегружен или отбил запрос по своему лимиту. Запрос не тарифицируется, повторить можно через несколько секунд — срок назван в заголовке Retry-After. |
| 503 | upstream_error | Модель временно недоступна у поставщика. Запрос не тарифицируется. |
Что OpenAI говорит про GPT 5.6
GPT 5.6 предложена под самую трудную профессиональную работу, и областей названо сразу четыре: код, работа со знаниями, кибербезопасность и наука.
Отдельно названо оформление интерфейсов: получив одно общее указание вместо подробного задания, модель собирает опрятный, удобный и работающий экран.
Названа и обычная канцелярская работа: у GPT 5.6 Sol презентации, документы и таблицы стали аккуратнее и точнее.
На вход идут текст и картинки, а ответ приходит только текстом.
Дата выхода GPT 5.6 — 9 июля 2026 года. В тот же день OpenAI открыла её в ChatGPT, в Codex и в своём API.
В разговоре её называют просто чат GPT 5.6, а в каталоге OpenAI она стоит под именем GPT 5.6. Модель за обоими написаниями одна.
Дословно поколение представлено в руководстве OpenAI по последним моделям: «GPT-5.6 sets a new quality and efficiency baseline for complex production workflows. GPT-5.6 is especially token-efficient and improves frontend aesthetics, including layout, visual hierarchy, and design judgment». Перевод наш: «GPT-5.6 задаёт новую планку качества и экономичности для сложных производственных работ. Она особенно экономна по токенам и лучше делает внешний вид интерфейсов: вёрстку, зрительную иерархию и выбор в оформлении».
Там же объяснён и новый порядок имён: «GPT-5.6 also introduces a new naming scheme. The `gpt-5.6` alias routes requests to `gpt-5.6-sol`, the model for flagship capability. Use `gpt-5.6-terra` for strong performance at a lower price and `gpt-5.6-luna` for efficient, high-volume workloads». Перевод наш: «GPT-5.6 вводит новый порядок именования. Псевдоним `gpt-5.6` ведёт на `gpt-5.6-sol` — модель флагманского уровня. `gpt-5.6-terra` берут ради сильной отдачи по меньшей цене, `gpt-5.6-luna` — ради экономичной работы с большим потоком».
Что у всех нынешних моделей одинаково, разработчик пишет в списке моделей: «All latest OpenAI models support text and image input, text output, multilingual capabilities, and vision. Models are available via the Responses API and our Client SDKs». Перевод наш: «Все новые модели OpenAI принимают текст и картинку, отвечают текстом, работают с разными языками и видят изображения. Они доступны через Responses API и наши библиотеки».
Что пришло в API вместе с поколением, сказано в журнале изменений: «GPT-5.6 adds Programmatic Tool Calling, explicit prompt caching controls, persisted reasoning, `max` reasoning effort, and Pro mode, and Multi-agent orchestration in beta for the Responses API. GPT-5.6 also accepts images at their original dimensions with `original` or `auto` image detail». Перевод наш: «GPT-5.6 добавляет программный вызов средств, явное управление кэшем запроса, сохраняемое рассуждение, уровень усилия `max` и режим Pro, а также согласование нескольких агентов в пробном виде для Responses API. Ещё GPT-5.6 принимает картинки в их исходном размере при значении `original` или `auto`».
Сколько ступеней обдумывания принимает поколение, сказано в карточках всех трёх уровней одной строкой: «Reasoning.effort supports: none, low, medium (default), high, xhigh, and max». Перевод наш: «Поле `reasoning.effort` принимает значения `none`, `low`, `medium` (по умолчанию), `high`, `xhigh` и `max`». Через GEN202 это поле называется reasoning_effort, как в формате Chat Completions, а его значения и остальные поля перечислены в разделе о вызове через API выше.
Слова OpenAI о GPT 5.6 приведены по его документации на 15 сентября 2026 года.
Чем отличаются GPT 5.6 Sol, Terra и Luna
Все три модели GPT 5.6 — уровни одного поколения, и разница между ними зависит от задачи. На рутинной работе с кодом она почти исчезает.
GPT 5.6 Sol соответствует модели без приставки в прошлых поколениях GPT-5, GPT 5.6 Terra — уровню mini, GPT 5.6 Luna — уровню nano.
На задачах из настоящих репозиториев три уровня укладываются в два пункта: 64,6 процента решённых задач у Sol, 63,4 у Terra и 62,7 у Luna.
На трудной математике картина другая: 83 процента у Sol, 68,3 у Terra и 58,5 у Luna. Там, где правило приходится угадывать, Sol набирает 7,78 процента, а Luna — 0,18.
GPT 5.6 Terra назван моделью, сравнимой с прошлой флагманской GPT-5.5, и числа подтверждают это неровно: на длительных профессиональных задачах он выше — 50,4 процента против 46,9, — а на научных вопросах ниже, 92,9 против 93,6.
Сравнение уровней GPT 5.6 на своей задаче — в песочнице выше: запрос там уходит на выбранный уровень целиком.
Про старший уровень сказано в его карточке у OpenAI сказано: «GPT-5.6 Sol is our flagship model for complex professional work. It roughly corresponds to the unsuffixed model tier used in earlier GPT-5 families. The `gpt-5.6` alias routes requests to GPT-5.6 Sol». Перевод наш: «GPT-5.6 Sol — наш флагман для сложной профессиональной работы. Он примерно соответствует уровню без суффикса в прежних семействах GPT-5. Псевдоним `gpt-5.6` ведёт запросы на GPT-5.6 Sol».
Про средний — в его карточке: «GPT-5.6 Terra is designed for workloads that balance intelligence and cost. It roughly corresponds to the mini model tier used in earlier GPT-5 families». Перевод наш: «GPT-5.6 Terra сделан для задач, где ум уравновешен ценой. Он примерно соответствует уровню mini в прежних семействах GPT-5».
Про младший — в карточке Luna: «GPT-5.6 Luna is designed for cost-sensitive, high-volume workloads. It roughly corresponds to the nano model tier used in earlier GPT-5 families». Перевод наш: «GPT-5.6 Luna сделан для чувствительных к расходам задач с большим потоком. Он примерно соответствует уровню nano в прежних семействах GPT-5». Больше о разнице между тремя уровнями разработчик словами не говорит нигде: остальное у него сказано числами замеров.
Выпуски ряда GPT: что вышло до GPT 5.6 и после
Каждый выпуск OpenAI объявляет строкой в журнале изменений, и день стоит внутри раздела месяца. Ниже — объявления поколений, начиная с первого в ряду.
| Имя у OpenAI | Дата по журналу изменений | Что названо при выпуске |
|---|---|---|
| GPT-5 | 7 августа 2025 | Первое поколение ряда: самостоятельная работа, код и управляемость |
| GPT-5.1 | 13 ноября 2025 | Режим рассуждения none и подстройка расхода под сложность запроса |
| GPT-5.2 | 11 декабря 2025 | Ступень усилия xhigh, короткие сводки рассуждения, уплотнение |
| GPT-5.3 | 3 марта 2026 | Издание для ChatGPT: снимок, который стоит в самом приложении |
| GPT-5.4 | 5 марта 2026 | Окно в миллион токенов и отложенный набор средств |
| GPT-5.5 | 24 апреля 2026 | Новое семейство, под которое настраиваются заново |
| GPT-5.6: Sol, Terra, Luna | 9 июля 2026 | Три уровня под одним номером и новый порядок имён |
| GPT-6 Astra | 3 сентября 2026 | Следующее поколение: работа за компьютером, просмотр сети, наука |
Старые снимки ряда разработчик отключает, и на замену им назначены уровни этого поколения. На странице снятия с поддержки сказано: «On June 11, 2026, we notified developers using older GPT-5 and o3 model snapshots of their deprecation and removal from the API on December 11, 2026». Перевод наш: «11 июня 2026 года мы предупредили разработчиков, работающих со старыми снимками GPT-5 и o3, о снятии этих моделей и удалении их из API 11 декабря 2026 года». В таблице замен той же страницы `gpt-5-2025-08-07` заменяет `gpt-5.6-sol`, `gpt-5-mini-2025-08-07` — `gpt-5.6-terra`, `gpt-5-nano-2025-08-07` — `gpt-5.6-luna`.
Сроки предупреждения разработчик обещает там же: «Generally available models: At least 6 months. Specialized variants of generally available models: At least 3 months… Preview models, identified by `preview` in the model name, may be retired with much shorter notice, such as 2 weeks». Перевод наш: «Модели общего доступа — не меньше шести месяцев. Особые издания таких моделей — не меньше трёх месяцев… Пробные модели, у которых в имени стоит `preview`, могут сниматься гораздо быстрее, например за две недели».
Следующее поколение из таблицы есть в каталоге GEN202 и разобрано на своей странице — GPT 6 Astra.
Характеристики GPT 5.6: что у трёх уровней общее
GPT 5.6 — это три языковые модели OpenAI под одним номером поколения. Различаются они ценой и тем, насколько уверенно отвечают на трудной задаче.
Всё остальное у них совпадает до числа. Разное только имя, которое уходит в запрос, и цена за миллион токенов.
| Характеристика | Sol | Terra | Luna |
|---|---|---|---|
| Имя для поля model | gpt/5-6-sol | gpt/5-6-terra | gpt/5-6-luna |
| Окно контекста | 1 050 000 токенов | 1 050 000 токенов | 1 050 000 токенов |
| Предел одного ответа | 128 000 токенов | 128 000 токенов | 128 000 токенов |
| Что берёт на вход | текст и картинки | текст и картинки | текст и картинки |
| Чем отвечает | текстом | текстом | текстом |
Цена у каждого уровня своя, и она разобрана в таблице цен выше по этой же странице.
Как выбрать уровень GPT 5.6 под свою задачу
Уровень выбирают не по описанию, а прогнав свою настоящую задачу. Как это сделать — по шагам ниже.
- Возьмите свою задачу. Не пример из документации, а тот запрос, который пойдёт в работу. На простом вопросе три уровня отвечают одинаково, и выбирать будет не из чего.
- Начните с младшего. Прогоните запрос на уровне Luna: он самый дешёвый из трёх. На рутинной работе с кодом уровни и без того стоят почти вровень.
- Повторите тот же запрос. Отправьте одну и ту же формулировку несколько раз подряд. Ответ от попытки к попытке расходится, и по одной попытке выбирать нельзя.
- Проверьте длинный материал отдельно. Если в запрос уходит большой документ или архив переписки, прогоните его и на Sol. Именно на длине уровни расходятся сильнее всего.
- Сверьтесь с ценой. Цену уровня за миллион токенов показывает таблица выше. Сопоставьте её с тем, насколько ответы разошлись на вашей задаче.
Имя выбранного уровня подставляется в поле model. Как выглядит готовый запрос целиком, показано в разделе «Вызов через API».
Для чего OpenAI предлагает GPT 5.6
Первым названо превращение разрозненного материала в готовый документ: модель берёт содержимое рабочих переписок и файловых хранилищ — Slack, Notion, Microsoft 365, Google Drive — и собирает из него связный текст, которым можно поделиться.
В Microsoft 365 Copilot GPT 5.6 стала предпочтительной моделью.
Среди компаний, названных при выпуске, — Cursor, Notion, Shopify, Canva и Figma.
Длинный контекст GPT 5.6: окно одно, а результат разный
Все версии GPT 5.6 держат одно и то же окно — 1 050 000 токенов.
Находят они в нём по-разному. На тексте длиной от 256 до 512 тысяч токенов модель GPT 5.6 Sol даёт 91,5 процента, Terra — 89,6, Luna — 41,3.
На ещё большей длине, от 512 тысяч до миллиона токенов, оседают и старшие: 73,8 процента у Sol, 72,5 у Terra и те же 41,3 у Luna.
Сколько токенов уходит на ответ GPT 5.6
Перед ответом модель обдумывает задачу, и обдумывание тоже состоит из токенов. В самом ответе их не видно, а в счёт они попадают наравне с написанным текстом.
Отсюда следствие, заметное только по счёту: короткий ответ на трудную задачу может обойтись дороже длинного ответа на простую. Платят не за длину ответа, а за всю работу модели.
По той же причине один и тот же запрос, отправленный дважды, обходится по-разному. Сколько модель продумает, заранее не знает никто.
Длина одного ответа при этом ограничена: у всех трёх уровней предел — 128 000 токенов.
У цены есть и вторая ступень. Как только во вход уходит больше 272 000 токенов, по повышенной ставке считается весь запрос, а не одна его дальняя часть. Обе ставки стоят в таблице цен выше.
Рубли в этой таблице выставляет GEN202 — сервис, через который поколение вызывается из России. Собственные ставки OpenAI меняются отдельно от наших и на этой странице словами не пересказываются. Что такое кредит и какими пакетами он покупается, разобрано на странице цен.
Что показали независимые проверки GPT 5.6
Как расходятся уровни и поколения ряда в слепых сравнениях живых людей, видно на текстовой арене LMArena, где человеку показывают два ответа без имён. На снимке от 13 сентября 2026 года у строки `gpt-5.6-sol-xhigh` 1483 очка при 27 069 голосах, у `gpt-5.6-terra-xhigh` — 1466 при 28 119, у `gpt-5.6-luna-xhigh` — 1452 при 28 547.
Рядом стоит прошлое поколение, и разрыв между поколениями там меньше, чем между уровнями одного: у `gpt-5.5-high` 1482 очка — на один пункт ниже старшего уровня нынешнего поколения и выше среднего. У следующего поколения, строки `gpt-6-astra-max`, 1480 очков, но голосов за ней всего 2 693, то есть выборка в десять раз меньше.
Про скорость ряда писал Matthias Bastian в The Decoder 14 августа 2026 года: «OpenAI is launching a preview of its new “Ultrafast” mode, which delivers up to 750 output tokens per second from its flagship model, GPT-5.6 Sol». Перевод наш: «OpenAI запускает пробу нового режима Ultrafast, который выдаёт до 750 выходных токенов в секунду на флагманской модели GPT-5.6 Sol». Кому он достанется, сказано там же: «The service will initially be available only through the OpenAI API for GPT-5.6 Sol and limited to select customers». Перевод наш: «Сначала услуга будет только через API OpenAI для GPT-5.6 Sol и только для отобранных заказчиков».
Как читать замеры этого поколения, разбирал тот же автор 30 июля 2026 года, пересказывая слова соучредителя ARC Prize Франсуа Шолле: «Harnesses “custom-made to solve the benchmark or that contain knowledge about the benchmark format” are off limits, he said. General-purpose API settings “that were not developed for ARC-AGI-3 and that are available to all API users” are fair game». Перевод наш: «Обвязки, сделанные специально под этот замер или знающие его формат, использовать нельзя, сказал он. Обычные настройки API, которые не разрабатывались под ARC-AGI-3 и доступны всем пользователям API, допустимы».
Оговорку о сопоставимости он добавляет сразу: «Different providers using different settings does create “a potential parity issue,” Chollet said, but he considers that acceptable “as long as the settings and the cost are clearly reported”». Перевод наш: «Разные настройки у разных поставщиков действительно создают возможную проблему равенства условий, говорит Шолле, но он считает это приемлемым, пока настройки и стоимость ясно указаны».
По-русски поколение разбирали на одной трудной математической задаче — разбор на Хабре от 14 июля 2026 года. Что было до этого поколения, автор описывает так: «Но дальше начался неприятный этап: GPT-5, 5.2 и 5.4 выдавали сложные, уверенные и неизменно ошибочные решения, на проверку которых уходили часы».
Сколько времени ушло у нынешнего поколения, там же: «А вышедшая на прошлой неделе GPT-5.6 Sol в Pro-режиме сделала то же самое с первой попытки за 80 минут, а затем за 88 минут в один заход получила верхнюю оценку 2.31^n». Оговорки автора снимать нельзя, и они стоят у него рядом: «Результат пока не прошел рецензирование, нет и машинной проверки доказательства в Lean — корректность пока держится на слове узкого круга математиков, прочитавших текст. Сам Бубек — бывший вице-президент Microsoft по ИИ-исследованиям, а ныне сотрудник OpenAI, то есть рассказывает об успехах модели своего работодателя».
Четыре источника о GPT 5.6 приведены на 15 сентября 2026 года. Скорость у OpenAI названа кратностью и потолком токенов в секунду, а 80 и 88 минут в русском разборе — это время решения задачи, а не задержка вызова.
Что встречают в работе с GPT 5.6
Описание модели говорит, что она умеет. В работе всплывает другое — то, что заметно только на своей задаче и на нескольких попытках подряд.
- Один и тот же запрос, повторённый несколько раз, даёт разный результат: чаще всего верный, иногда с одной ошибкой.
- Расход токенов и время ответа на одной и той же задаче тоже гуляют от попытки к попытке.
- Свежий код на распространённых библиотеках выходит без замечаний, а на редкой библиотеке модель путает её же правила.
- Ошибка всплывает там, где условие сформулировано неточно или где у задачи много крайних случаев.
- На очень длинном материале младший уровень переходит с точных цитат на пересказ задолго до конца окна, а средний пропускает то, что лежит в дальней части запроса.
- Там, где результат видно глазами — экран, движение, оформление, — с первой попытки он выходит редко, и его доводят несколькими заходами.
Отсюда простое правило работы: сравнивать уровни между собой имеет смысл на нескольких попытках, а не на одной.
Что GPT 5.6 знает о мире
Дальше 16 февраля 2026 года знания поколения не идут.
Граница общая для уровней: Luna и Sol остановились на одной дате.
Ни одного события следующих месяцев модель не застала.
Что OpenAI называет слабым местом GPT 5.6
В кибербезопасности модель находит уязвимости и куски готовых нападений, но провести нападение на защищённую цель от начала до конца самостоятельно у неё не вышло.
GPT 5.6 Luna по сводному показателю уступает прошлой флагманской GPT-5.5 — 51,2 против 54,8, — и по показателю кодового агента тоже: 74,6 против 76,4.
Числа о скорости и о расходе получены расчётом на стороне разработчика, а не замером живой работы, и на своих задачах результат может заметно отличаться.
Как купить доступ к GPT 5.6 в России и сколько стоит миллион токенов
Купить GPT 5.6 по API из России можно здесь, и все три уровня приходят с одним ключом: войдите, положите деньги на баланс и создайте ключ в кабинете. Ни счёта у OpenAI, ни VPN для этого не нужно — GPT 5.6 отвечает по адресу GEN202.
- Вход. Счёт заводится по письму или через Яндекс, и на нём сразу 50 приветственных кредитов: у GPT 5.6 Luna они превращаются в 90 тысяч токенов ответа, у GPT 5.6 Sol — в 9 тысяч токенов.
- Пополнение. Нижний пакет за 500 ₽ приносит 1 000 кредитов: это 1,8 миллиона токенов ответа GPT 5.6 Luna, 180 тысяч токенов у GPT 5.6 Terra или 185 тысяч токенов у GPT 5.6 Sol.
- Ключ. Один ключ подходит ко всем трём уровням GPT 5.6; какой из них отвечает, задаёт значение поля model — gpt/5-6-luna, gpt/5-6-terra и gpt/5-6-sol.
Миллион токенов ответа стоит у GPT 5.6 Luna 277 ₽, у GPT 5.6 Terra — 2769,5 ₽, у GPT 5.6 Sol — 2700 ₽; вход у каждого уровня дешевле ответа, и все ставки стоят в таблице цен. Тысяча токенов ответа GPT 5.6 Luna — около 500 слов по-русски — обходится в 0,28 ₽.
Теми же кредитами оплачиваются Gemini, Grok и Claude, картинки и видео из каталога GEN202, а поговорить с моделями GPT 5.6 без ключа можно в чате GPT. Подробный порядок покупки для всего семейства и то, что в нём даётся бесплатно, — на странице GPT API.