Grok 4.5 API

Принимает переписку списком сообщений и изображения, возвращает текст. Контекст 500 000 токенов, знания до 1 февраля 2026 года. Модель xAI.

Grok 4.5 API работает в России без VPN: один API ключ GEN202, оплата рублями с российской карты.

Цена: за миллион токенов, вход — 923 кр. (461,5 ₽ · $4.615), выход — 2770 кр. (1385 ₽ · $13.85).

кр. — кредиты, покупаются за рубли.

Model

Статус

работает

Песочница

Input

Модель grok/4-5

Потолок ответа — предел выбранной модели. Списывается фактический расход, а не потолок. Меньшее значение обрывает ответ на полуслове: у рассуждающих моделей тысяча токенов уходит на размышление, и текста ответа не остаётся вовсе.

Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.


          
Output

Нажмите «Запустить» — ответ модели появится здесь

{ }

Цена Grok 4.5

Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля usage ответа: сколько токенов ушло в запрос и сколько модель вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит денег само по себе, независимо от длины запроса.

Токены Наша цена
Вход 923 кр. $4.615461,5 ₽
Выход 2770 кр. $13.851385 ₽

кр. — кредиты, покупаются за рубли.

Длинный запрос. У Grok 4.5 он считается по второй цене: как только на вход уходит от 200 000 токенов, дороже становится весь запрос целиком — и вход, и выход.

Токены Наша цена
Вход 1846 кр. $9.23923 ₽
Выход 5539 кр. $27.6952769,5 ₽

Вызов через API

POST https://api.gen202.com/v1/chat/completions

Адрес один, и ответ приходит на этот же запрос: задачу ставить и опрашивать не нужно — этим текст и отличается от картинок. Ключ передаётся заголовком Authorization: Bearer sk-… и выпускается в кабинете. На один ключ шлюз пропускает 60 запросов в минуту.

Счёт идёт по токенам из поля usage ответа: вход и выход по своим ставкам. Кредиты списываются после ответа, по факту — заранее ничего не удерживается, поэтому короткий вопрос стоит ровно столько, сколько стоит, и не занимает баланс под будущий ответ. Сколько списано, приходит в самом ответе полем credits_consumed. Перед вызовом проверяется одно: на балансе есть деньги. Запрос, не дошедший до ответа, не тарифицируется вовсе.

Поля запроса

Все три лежат в корне тела запроса — вложенного input у текста нет. Остальные поля формата OpenAI — temperature, top_p, stop, seed, response_format, reasoning_effort и прочие — шлюз передаёт поставщику, проверив значение: temperature от 0 до 2 (у Claude до 1), top_p от 0 до 1, штрафы от −2 до 2, reasoning_effort — minimal, low, medium или high (у GPT 6 Astra — low, medium или high), стоп-слов не больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего: поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо на её странице.

stream работает: ответ приходит событиями, как это принято у Chat Completions, и заканчивается строкой data: [DONE]. У поставщика ответ при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём стоят на последнем событии, рядом с признаком конца.

tools передаётся всем моделям каталога. n и best_of не передаются: несколько вариантов ответа умножают расход, а перед вызовом проверено, что денег хватает на один.

ПолеТипОбяз.Допустимые значения
model текст обязательное grok/4-5 либо другое имя из каталога текстовых моделей
messages массив обязательное Непустой список сообщений с ролями system, user, assistant. Пустой список или не массив — отказ 400
max_tokens целое опц. От 1 до 128000; вне границ — отказ 400. Синоним — max_completion_tokens · без него шлюз подставит 1024

Вызов

Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.

chat.sh
curl https://api.gen202.com/v1/chat/completions \
  -H "Authorization: Bearer sk-ваш-ключ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok/4-5",
    "messages": [{"role": "user", "content": "Привет"}],
    "max_tokens": 200
  }'
chat.py
from openai import OpenAI

client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")

answer = client.chat.completions.create(
    model="grok/4-5",
    messages=[{"role": "user", "content": "Привет"}],
    max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage)  # по нему выставлен счёт

Ответ

Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.

chat-response.txt
{
  "choices": [
    {
      "index": 0,
      "message": { "role": "assistant", "content": "…" },
      "finish_reason": "stop"
    }
  ],
  "usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}

Текст лежит в choices[0].message.content, причина остановки — в finish_reason (stop или length). По usage выставляется счёт, так что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI (id, created, object) шлюз не добавляет.

Отказы

Тело отказа — объект error, как у OpenAI: {"error":{"message":…,"type":…,"code":…,"param":null}}. Ни один из этих отказов не тарифицируется: деньги списываются только после ответа модели, и возвращать после отказа нечего.

КодcodeКогда
400 model_not_found Имени из поля model нет среди текстовых моделей. В сообщении перечислено, что принимается.
400 invalid_messages Поле messages не передано, пустое или не массив.
400 invalid_max_tokens Поле max_tokens не целое число либо вне границ от 1 до 128000.
400 invalid_setting Настройка запроса с негодным значением: temperature вне границ от 0 до 2 (у Claude до 1), top_p вне границ от 0 до 1, штраф вне границ от −2 до 2, reasoning_effort не из списка minimal, low, medium, high, пустое стоп-слово или больше четырёх стоп-слов. В сообщении назван сам параметр.
400 key_required Названный заголовком учёта ключ не принадлежит аккаунту или отключён. При вызове по ключу Bearer такого отказа не бывает.
400 Тело запроса не разобралось как JSON. Проверьте, что отправляете правильно составленный объект.
401 invalid_api_key Ключа нет в заголовке Authorization, либо он неверный или отключён.
402 insufficient_credits На балансе не осталось свободных кредитов. Перед вызовом шлюз проверяет только это — сумма списывается после ответа, по факту.
403 forbidden Аккаунт заблокирован: вызовы модели, пополнение и загрузка файлов ему закрыты. Ключи при этом не отключены — запрет лежит на аккаунте.
413 Тело запроса больше предела в 512 КиБ.
415 Не тот тип содержимого. Заголовок Content-Type должен быть application/json.
429 Больше 60 запросов в минуту на один ключ.
502 upstream_error Поставщик не ответил или ответил ошибкой. Запрос не тарифицируется: списывать нечего, ответа не было.
503 service_overloaded Поставщик перегружен или отбил запрос по своему лимиту. Запрос не тарифицируется, повторить можно через несколько секунд — срок назван в заголовке Retry-After.
503 upstream_error Модель временно недоступна у поставщика. Запрос не тарифицируется.

Что xAI говорит про Grok 4.5

Grok 4.5 — языковая модель компании xAI, объявленная 16 июля 2026 года. У GEN202 миллион присланных токенов обходится в 461,5 ₽, миллион токенов ответа — в 1385 ₽, пока запрос не дорос до порога второй ставки.

Чем разработчик считает этот выпуск, сказано первой строкой карточки модели в документации xAI: «SpaceXAI's intelligent coding model for agentic software, engineering, and workflow tasks. Trained in SpaceXAI's data centers in Memphis with new datasets spanning science, engineering, and math». Перевод наш: «Умная модель SpaceXAI для самостоятельной работы над программами, инженерных задач и рабочих процессов. Обучена в дата-центрах SpaceXAI в Мемфисе на новых наборах данных по науке, инженерии и математике». Именем SpaceXAI разработчик подписывает свои страницы, а домены у него прежние — x.ai и docs.x.ai.

Про оснастку обучения в объявлении о выпуске Grok 4.5 написано так: «Grok 4.5 was trained across tens of thousands of NVIDIA GB300 GPUs, with training and stability techniques designed for large-scale runs». Перевод наш: «Grok 4.5 обучали на десятках тысяч видеокарт NVIDIA GB300, приёмами обучения и удержания устойчивости, рассчитанными на прогоны такого размаха».

Скорость ответа названа там же одним числом: «Grok 4.5 is served at fast-model speeds of 80 TPS». Перевод наш: «Grok 4.5 отдаётся на скорости быстрых моделей — 80 токенов в секунду». Число замерено самим xAI на его стороне.

Тем же днём выпуск отмечен строкой в заметках о выпусках xAI: «Grok 4.5, SpaceXAI's model for coding, agentic tasks, and knowledge work, is now available on the xAI API. Priced at $2 / 1M input tokens and $6 / 1M output tokens, with configurable reasoning effort (low, medium, or high; default high)». Перевод наш: «Grok 4.5, модель SpaceXAI для программирования, агентных задач и работы со знаниями, доступна в xAI API. Цена $2 за 1M входных и $6 за 1M выходных токенов, глубина обдумывания настраивается (low, medium или high; по умолчанию high)».

Про само обдумывание руководство xAI говорит две фразы: «If not specified, `reasoning_effort` defaults to "high". Reasoning cannot be disabled». Перевод наш: «Если поле reasoning_effort не задано, оно равно "high". Отключить обдумывание нельзя». Значит, подробное обдумывание эта модель даёт без единой настройки, а короткого ответа совсем без обдумывания у неё не бывает.

Слова xAI о Grok 4.5 приведены по его страницам на 15 сентября 2026 года.

Выпуски ряда Grok: что вышло до Grok 4.5 и после

Ряд Grok разработчик ведёт с ноября 2024 года, когда в его API открылась публичная проба, и номера в нём идут не подряд. Ниже собрано, как он называет каждый выпуск, какой датой объявил его и что назвал переменой.

Имя у xAIДата по анонсуЧто названо переменой
Grok 319 февраля 2025Обучение на вычислителе Colossus и отдельный режим обдумывания
Grok 49 июля 2025Встроенная работа с инструментами и поиск в реальном времени
Grok 4 Fast19 сентября 2025Ответ с рассуждением и без него в одной модели
Grok 4.117 ноября 2025Упор на разговор: замысел собеседника и цельный нрав
Grok 4.1 Fast19 ноября 2025Агенты, зовущие инструменты, в API разработчика
Grok 4.20 и Grok 4.20 Multi-agentмарт 2026Скорость и вызов инструментов; в многоагентном варианте тему разбирают несколько агентов сразу
Grok Build 0.1май 2026Модель под самостоятельную работу над кодом, ранний доступ
Grok 4.3объявления не былоБыстрая надёжная модель, следующая указаниям
Grok 4.516 июля 2026Обучена вместе с Cursor под код, самостоятельные задачи и работу со знаниями
Grok 4.612 августа 2026Долгий дополнительный этап обучения и упор на долго работающих агентов

Два последних выпуска стоят в каталоге GEN202 и разобраны каждый на своей странице: этот — здесь, следующий — на странице Grok 4.6. Даты взяты с подписей объявлений: Grok 3 подписан «Feb 19, 2025», Grok 4 — «Jul 9, 2025», Grok 4 Fast — «Sep 19, 2025», Grok 4.1 — «Nov 17, 2025».

Номер 4.20 — написание самого разработчика, а не «четыре и две десятых»: он читает его как двадцатую правку четвёртого поколения. Поэтому по датам ряд идёт 4 → 4 Fast → 4.1 → 4.1 Fast → 4.20 → 4.5 → 4.6, хотя по номеру 4.20 крупнее 4.5.

У Grok 4.3 даты нет ни в заметках о выпусках, ни отдельной страницей объявления: модель стоит в справочнике и в прайс-листе разработчика, а день её выхода он не называл. Строки Grok 4.20 и Grok Build 0.1 подтверждены месяцем в заметках о выпусках — дня там тоже нет.

Характеристики Grok 4.5: окно, ответ и ступень цены

Grok 4.5 — одна модель, а не набор уровней под общим номером: имя для поля model у неё единственное, и выбирать внутри страницы нечего.

В таблице собрано то, что задаёт рамку запроса ещё до первой строки кода.

ХарактеристикаЗначение
Имя для поля modelgrok/4-5
Окно контекста500 000 токенов
Предел одного ответаразработчик его не назвал
Что берёт на входтекст и картинки
Чем отвечаеттекстом
Порог второй ставки200 000 токенов во входе

Обе ставки — обычная и повышенная — стоят в таблице цен выше по этой же странице.

Как вести в Grok 4.5 работу длиннее одного запроса

Задача на один ответ вопросов не вызывает. Трудности начинаются там, где работа идёт несколькими заходами подряд, и порядок ниже их снимает.

  1. Попросите сначала план. План складывают отдельно от самой работы. Оборвалась работа на середине — её продолжают с места обрыва, а не начинают заново.
  2. Собирайте частями. Целиком задачу не отдают: сперва основание, потом по одной части сверху. Каждую следующую часть заводят отдельным разговором.
  3. Считайте первый ответ черновиком. Готовым он бывает редко. Дальше его правят, а не переписывают задание с нуля.
  4. Правьте по одному месту за раз. Короткая просьба про одну беду проходит вернее, чем список замечаний сразу. Список модель разбирает не весь.
  5. Проверьте сказанное «готово». Сообщение об успехе само по себе ничего не подтверждает: результат смотрят своими глазами, а не по отчёту модели.
  6. Повторите то, что не вышло. На трудном месте две попытки подряд могут кончиться ничем, а третья выйти. Одной попытки для вывода мало.

Особых полей запроса ни один из шагов не требует: порядок этот про то, как разбита сама задача.

Для чего xAI предлагает Grok 4.5

Отдельно названа работа в офисных приложениях: расчёты в Excel с формулами по нескольким листам, схемы из родных фигур PowerPoint, текст в Word.

В своём сервисе Grok Build и в надстройках для Word, PowerPoint и Excel разработчик поставил её моделью по умолчанию.

В редакторе Cursor Grok 4.5 открыта на всех тарифах.

Сколько текста Grok 4.5 держит за раз

Контекст у неё 500 тысяч токенов.

Это меньше, чем у соседей по каталогу: у Gemini 3.6 Flash окно в миллион токенов, у уровней GPT 5.6 — 1 050 000.

Меньше это и чем у прошлых моделей самого xAI: у Grok 4.3 и у трёх вариантов Grok 4.20 окно было миллионным.

Предела длины ответа не назвали ни в справочнике, ни в карточке модели.

Когда запрос к Grok 4.5 дорожает

В окно уходит запрос целиком: указание, приложенный материал и вся прошлая переписка того же разговора.

У цены есть вторая ступень, и включается она рано — на 200 000 токенах во входе.

По повышенной ставке идёт с этого места и присланный текст, и написанный ответ.

Порог этот заметно ниже размера окна: материал успевает подорожать задолго до того, как перестанет помещаться.

Из этого следует и обратное: пока запрос до порога не дорос, длина на ставку не влияет вовсе.

Какие числа xAI публикует про Grok 4.5

Среди опубликованного есть редкое: насколько модель склонна выдумывать и поддакивать.

Доля выдуманных утверждений — 0,98 процента. Падение точности под нажимом собеседника — 0,01 процента. Доля нечестных ответов под тем же нажимом — 0,67 процента.

Доля предвзятых ответов — 20,4 процента, а доля выполненных запросов, которые следовало отклонить, — 0,73 процента.

Из рабочих чисел названы 64,7 процента решённых задач в многофайловых репозиториях и 29 процентов на сверхдлинных инженерных задачах. Средний ответ на одну такую задачу — 15 954 токена.

Проверки на выдумывание и на поддакивание внутренние, публичной методики у них нет. Замерено всё на высоком уровне рассуждения — том самом, который у этой модели стоит по умолчанию.

Что показали независимые проверки Grok 4.5

Первым выпуск разобрало издание TechCrunch, автор Lucas Ropek, на странице стоит время «12:30 PM PDT · July 8, 2026». Цену издание приводит со слов разработчика: «SpaceXAI says that its new model costs $2 per million input tokens and $6 per million output tokens…». Перевод наш: «SpaceXAI сообщает, что новая модель стоит 2 доллара за миллион входных токенов и 6 долларов за миллион выходных».

Сразу за ценой издание ставит оговорку и на веру слова разработчика не берёт: «That's quite competitive, if Grok's capabilities match SpaceXAI's rhetoric». Перевод наш: «Это вполне конкурентоспособно, если способности Grok соответствуют словам SpaceXAI». Собственных прогонов в заметке нет — это разбор объявления.

Второй источник — разбор Matthias Bastian в издании The Decoder от 9 июля 2026 года. Работа в командной строке описана там так: «On Terminal Bench 2.1, which tests complex command-line tasks, Grok 4.5 scores 83.3%…». Перевод наш: «На Terminal Bench 2.1, где проверяют сложные задачи в командной строке, Grok 4.5 набирает 83,3 процента».

Ровный результат держится не везде, и издание говорит это прямо: «But the gaps widen elsewhere. On DeepSWE 1.1, which measures the ability to resolve real GitHub issues, Grok 4.5 hits 53%…». Перевод наш: «Но в других местах разрыв шире. На DeepSWE 1.1, где меряют умение закрывать настоящие задачи с GitHub, Grok 4.5 берёт 53 процента». Оба числа издание не мерило само: те же значения стоят и в таблице разработчика, выложенной в объявлении о выпуске.

Третий источник — арена LMArena с картинками, где человеку показывают два ответа без имён и просят выбрать лучший. На снимке 15 сентября 2026 года из всего ряда Grok в этой арене стоит одна строка — как раз этот выпуск, 1279 очков при 8 355 голосах. То есть работу с картинкой на входе у ряда замеряли только на нём.

По-русски ряд с секундомером разбирали один раз, и не на этом выпуске: разбор на Хабре от 21 июля 2025 года сделан на Grok 4. Автор пишет: «Что касается скорости вывода ответов, Grok 4 выдаёт около 43,7 токена/с, что немного медленнее темпов топовых моделей» и «Первый токен модель выводит в среднем через 15,07 секунды после отправки запроса пользователя». Числа эти к Grok 4.5 не относятся: разработчик называет для неё другую скорость, и замеров на русском по ней пока нет.

Даты у источников с объявлением расходятся: обе заметки вышли 8 и 9 июля 2026 года, а объявление на сайте разработчика подписано 16 июля. Четыре источника о Grok 4.5 приведены на 15 сентября 2026 года.

Где Grok 4.5 промахивается и что с этим делают

В документации перечислено, подо что выпуск задуман. Дальше — то, что вылезает на второй и третьей задаче подряд.

  • Новый код на распространённых наборах библиотек выходит без замечаний. Расхождение начинается на правке готового и на случаях, которые в задании не оговорены.
  • Просьбу поправить по месту модель понимает шире, чем она сказана: вместо правки в десяток строк переписывает целые куски затронутых файлов.
  • На долгой работе она теряет собственный учёт и ссылается на записи, которых не заводила. Со стороны при этом всё выглядит идущим своим чередом.
  • Уверенный тон ответа не отличает верное от неверного: названное поломкой оказывается ею не всегда.
  • Ответ выходит короче, чем у соседних моделей на том же задании: длину она сокращает сама, без просьбы.
  • По ходу работы она переспрашивает и уточняет условие, а не идёт делать молча.
  • К заданию она нередко добавляет то, о чём не просили: разбор в конце ответа выходит подробнее заказанного.
  • Собранное ею выходит неподвижным: движение и оживление приходится просить отдельным указанием.

Отсюда и порядок работы выше: сначала план, потом сборка частями, а правки — короткими просьбами по одному месту за раз.

До какого времени Grok 4.5 знает мир

Мир Grok 4.5 знает по 1 февраля 2026 года.

Ни событий, ни данных, появившихся после этой даты, в ней нет.

Вопрос о том, что случилось весной 2026 года, модель не закроет.

Где xAI не советует применять Grok 4.5

Границу применения xAI очерчивает в карточке модели сам, и укладывается она в одну фразу.

На самостоятельные решения там, где ошибка дорого стоит, модель не рассчитана.

Перечень такой: медицина, юридические вопросы, финансы и системы, отказ которых опасен для людей.

Работать в них модель может, но за ней должен смотреть человек, а результат — проверять специалист.

Рубли на этой странице — цены GEN202, сервиса доступа к моделям с оплатой из России; доллары xAI стоят рядом только для сравнения. Из чего складывается кредит и какими пакетами он пополняется, написано на странице цен.

Канал Grok — объявление о выпуске: xAI называет, с кем модель обучали и сколько она стоит у него самого. Идёт меньше минуты.

Частые вопросы

Как вызвать Grok 4.5 через API из России?
Запрос уходит на api.gen202.com, и это адрес GEN202, а не адрес xAI: обращения за границу в вызове Grok 4.5 нет, поэтому VPN не требуется. В поле model уходит идентификатор grok/4-5. Порядок вызова Grok 4.5 с примерами кода разобран в документации.
Сколько стоит Grok 4.5
Цена за миллион токенов Grok 4.5 — от 923 кр. (461,5 ₽ · $4.615) за вход в Grok 4.5 до 2770 кр. (1385 ₽ · $13.85) за выход. У Grok 4.5 списывается фактический расход, а задача, завершившаяся ошибкой, не тарифицируется вовсе.
Нужны ли VPN и иностранная карта для Grok 4.5
Ни то, ни другое: обращение к Grok 4.5 идёт на наш адрес, а расчёты с xAI ведём мы, поэтому договариваться с ним клиенту не о чем. Оплата рублями с карты российского банка.
Что Grok 4.5 принимает на вход
Обязательные поля запроса к Grok 4.5: model — идентификатор модели; messages — переписка списком сообщений. Остальные поля необязательны.
Как подключить Grok 4.5 API и сделать первый вызов
Войти на сайт и выпустить ключ в кабинете: при первом входе начисляется 50 кредитов, и этот же ключ открывает Grok 4.5 вместе с остальным каталогом. Собственного ключа xAI и договора с ним для вызова Grok 4.5 не нужно.