Документация

GPT API

Модели семейства GPT вызываются одним запросом и различаются в нём именем в поле model. Общие у них адрес, форма ответа, счёт по токенам и поля запроса, кроме reasoning_effort: у GPT 6 Astra оно принимает low, medium или high. Поставщик — OpenAI.

Модели семейства

Идентификатор Модель Страница на сайте
gpt/5-6-luna GPT 5.6 Luna Открыть
gpt/5-6-terra GPT 5.6 Terra Открыть
gpt/5-6-sol GPT 5.6 Sol Открыть
gpt/6-astra GPT 6 Astra Открыть

Попробовать

Input

Потолок ответа — предел выбранной модели. Списывается фактический расход, а не потолок. Меньшее значение обрывает ответ на полуслове: у рассуждающих моделей тысяча токенов уходит на размышление, и текста ответа не остаётся вовсе.

Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.


          
Output

Нажмите «Запустить» — ответ модели появится здесь

{ }

Поля запроса

Все три лежат в корне тела запроса — вложенного input у текста нет. Остальные поля формата OpenAI — temperature, top_p, stop, seed, response_format, reasoning_effort и прочие — шлюз передаёт поставщику, проверив значение: temperature от 0 до 2 (у Claude до 1), top_p от 0 до 1, штрафы от −2 до 2, reasoning_effort — minimal, low, medium или high (у GPT 6 Astra — low, medium или high), стоп-слов не больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего: поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо на её странице.

stream работает: ответ приходит событиями, как это принято у Chat Completions, и заканчивается строкой data: [DONE]. У поставщика ответ при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём стоят на последнем событии, рядом с признаком конца.

tools передаётся всем моделям каталога. n и best_of не передаются: несколько вариантов ответа умножают расход, а перед вызовом проверено, что денег хватает на один.

ПолеТипОбяз.Допустимые значения
model текст обязательное gpt/5-6-luna либо другое имя из каталога текстовых моделей
messages массив обязательное Непустой список сообщений с ролями system, user, assistant. Пустой список или не массив — отказ 400
max_tokens целое опц. От 1 до 128000; вне границ — отказ 400. Синоним — max_completion_tokens · без него шлюз подставит 1024

Вызов

Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.

chat.sh
curl https://api.gen202.com/v1/chat/completions \
  -H "Authorization: Bearer sk-ваш-ключ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt/5-6-luna",
    "messages": [{"role": "user", "content": "Привет"}],
    "max_tokens": 200
  }'
chat.py
from openai import OpenAI

client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")

answer = client.chat.completions.create(
    model="gpt/5-6-luna",
    messages=[{"role": "user", "content": "Привет"}],
    max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage)  # по нему выставлен счёт

Ответ

Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.

chat-response.txt
{
  "choices": [
    {
      "index": 0,
      "message": { "role": "assistant", "content": "…" },
      "finish_reason": "stop"
    }
  ],
  "usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}

Текст лежит в choices[0].message.content, причина остановки — в finish_reason (stop или length). По usage выставляется счёт, так что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI (id, created, object) шлюз не добавляет.

Цена по уровням

GPT 5.6 Luna. Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля usage ответа: сколько токенов ушло в запрос и сколько модель вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит денег само по себе, независимо от длины запроса.

Токены Наша цена
Вход 92 кр. $0.4646 ₽
Выход 554 кр. $2.77277 ₽

кр. — кредиты, покупаются за рубли.

Длинный запрос. У GPT 5.6 Luna он считается по второй цене: как только на вход уходит от 272 000 токенов, дороже становится весь запрос целиком — и вход, и выход.

Токены Наша цена
Вход 185 кр. $0.92592,5 ₽
Выход 831 кр. $4.155415,5 ₽

GPT 5.6 Terra. Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля usage ответа: сколько токенов ушло в запрос и сколько модель вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит денег само по себе, независимо от длины запроса.

Токены Наша цена
Вход 923 кр. $4.615461,5 ₽
Выход 5539 кр. $27.6952769,5 ₽

кр. — кредиты, покупаются за рубли.

Длинный запрос. У GPT 5.6 Terra он считается по второй цене: как только на вход уходит от 272 000 токенов, дороже становится весь запрос целиком — и вход, и выход.

Токены Наша цена
Вход 1846 кр. $9.23923 ₽
Выход 8309 кр. $41.5454154,5 ₽

GPT 5.6 Sol. Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля usage ответа: сколько токенов ушло в запрос и сколько модель вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит денег само по себе, независимо от длины запроса.

Токены Скидка от официальной цены Наша цена
Вход $5 −7,7% 923 кр. $4.615461,5 ₽
Выход $30 −10% 5400 кр. $272700 ₽

На 8,8% ниже официальной цены поставщика. кр. — кредиты, покупаются за рубли.

Длинный запрос. У GPT 5.6 Sol он считается по второй цене: как только на вход уходит от 272 000 токенов, дороже становится весь запрос целиком — и вход, и выход.

Токены Скидка от официальной цены Наша цена
Вход $10 −7,7% 1846 кр. $9.23923 ₽
Выход $45 −10% 8100 кр. $40.54050 ₽

GPT 6 Astra. Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля usage ответа: сколько токенов ушло в запрос и сколько модель вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит денег само по себе, независимо от длины запроса.

Токены Наша цена
Вход 4616 кр. $23.082308 ₽
Выход 23080 кр. $115.411540 ₽

кр. — кредиты, покупаются за рубли.

Длинный запрос. У GPT 6 Astra он считается по второй цене: как только на вход уходит от 272 000 токенов, дороже становится весь запрос целиком — и вход, и выход.

Токены Наша цена
Вход 9232 кр. $46.164616 ₽
Выход 34620 кр. $173.117310 ₽

Подробнее: что общего у текстовых моделей — правила счёта, потоковая передача и удержание под запрос; отказы — коды и что они значат; баланс и расход — как спросить списание по ключу. Все модели каталога — в каталоге.