Grok 4.5 API
Принимает переписку списком сообщений и изображения, возвращает текст. Контекст 500 000 токенов, знания до 1 февраля 2026 года. Модель xAI.
Grok 4.5 API работает в России без VPN: один API ключ GEN202, оплата рублями с российской карты.
Цена: за миллион токенов, вход — 923 кр. (461,5 ₽ · $4.615), выход — 2770 кр. (1385 ₽ · $13.85).
кр. — кредиты, покупаются за рубли.
работает
Песочница
Модель grok/4-5
Потолок ответа — предел выбранной модели. Списывается фактический расход, а не потолок. Меньшее значение обрывает ответ на полуслове: у рассуждающих моделей тысяча токенов уходит на размышление, и текста ответа не остаётся вовсе.
Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.
Нажмите «Запустить» — ответ модели появится здесь
{ }
Цена Grok 4.5
Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля
usage ответа: сколько токенов ушло в запрос и сколько модель
вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит
денег само по себе, независимо от длины запроса.
| Токены | Наша цена |
|---|---|
| Вход | 923 кр. $4.615461,5 ₽ |
| Выход | 2770 кр. $13.851385 ₽ |
кр. — кредиты, покупаются за рубли.
Длинный запрос. У Grok 4.5 он считается по второй цене: как только на вход уходит от 200 000 токенов, дороже становится весь запрос целиком — и вход, и выход.
| Токены | Наша цена |
|---|---|
| Вход | 1846 кр. $9.23923 ₽ |
| Выход | 5539 кр. $27.6952769,5 ₽ |
Вызов через API
Адрес один, и ответ приходит на этот же запрос: задачу ставить и опрашивать не нужно — этим текст и
отличается от картинок. Ключ передаётся заголовком
Authorization: Bearer sk-… и выпускается
в кабинете. На один ключ шлюз пропускает
60 запросов в минуту.
Счёт идёт по токенам из поля usage ответа: вход и выход по своим
ставкам. Кредиты списываются после ответа, по факту — заранее ничего не удерживается, поэтому
короткий вопрос стоит ровно столько, сколько стоит, и не занимает баланс под будущий ответ.
Сколько списано, приходит в самом ответе полем credits_consumed.
Перед вызовом проверяется одно: на балансе есть деньги. Запрос, не дошедший до ответа, не
тарифицируется вовсе.
Поля запроса
Все три лежат в корне тела запроса — вложенного input у текста нет.
Остальные поля формата OpenAI — temperature,
top_p, stop,
seed, response_format,
reasoning_effort и прочие — шлюз передаёт поставщику, проверив
значение: temperature от 0 до 2 (у Claude до 1),
top_p от 0 до 1, штрафы от −2 до 2,
reasoning_effort — minimal, low, medium или high (у GPT 6 Astra — low, medium или high), стоп-слов не
больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего:
поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого
семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо
на её странице.
stream работает: ответ приходит событиями, как это принято у Chat
Completions, и заканчивается строкой data: [DONE]. У поставщика ответ
при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена
вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём
стоят на последнем событии, рядом с признаком конца.
tools передаётся всем моделям каталога.
n и
best_of не передаются: несколько вариантов ответа умножают расход, а
перед вызовом проверено, что денег хватает на один.
| Поле | Тип | Обяз. | Допустимые значения |
|---|---|---|---|
| model | текст | обязательное | grok/4-5 либо другое имя из каталога текстовых моделей |
| messages | массив | обязательное |
Непустой список сообщений с ролями system,
user, assistant. Пустой список
или не массив — отказ 400
|
| max_tokens | целое | опц. |
От 1 до 128000; вне границ — отказ 400.
Синоним — max_completion_tokens
· без него шлюз подставит 1024
|
Вызов
Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.
curl https://api.gen202.com/v1/chat/completions \
-H "Authorization: Bearer sk-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "grok/4-5",
"messages": [{"role": "user", "content": "Привет"}],
"max_tokens": 200
}'
from openai import OpenAI
client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")
answer = client.chat.completions.create(
model="grok/4-5",
messages=[{"role": "user", "content": "Привет"}],
max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage) # по нему выставлен счёт
Ответ
Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.
{
"choices": [
{
"index": 0,
"message": { "role": "assistant", "content": "…" },
"finish_reason": "stop"
}
],
"usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}
Текст лежит в choices[0].message.content, причина остановки — в
finish_reason (stop или
length). По usage выставляется счёт, так
что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI
(id, created,
object) шлюз не добавляет.
Отказы
Тело отказа — объект error, как у OpenAI:
{"error":{"message":…,"type":…,"code":…,"param":null}}. Ни один из этих отказов не тарифицируется:
деньги списываются только после ответа модели, и возвращать после отказа нечего.
| Код | code | Когда |
|---|---|---|
| 400 | model_not_found | Имени из поля model нет среди текстовых моделей. В сообщении перечислено, что принимается. |
| 400 | invalid_messages | Поле messages не передано, пустое или не массив. |
| 400 | invalid_max_tokens | Поле max_tokens не целое число либо вне границ от 1 до 128000. |
| 400 | invalid_setting | Настройка запроса с негодным значением: temperature вне границ от 0 до 2 (у Claude до 1), top_p вне границ от 0 до 1, штраф вне границ от −2 до 2, reasoning_effort не из списка minimal, low, medium, high, пустое стоп-слово или больше четырёх стоп-слов. В сообщении назван сам параметр. |
| 400 | key_required | Названный заголовком учёта ключ не принадлежит аккаунту или отключён. При вызове по ключу Bearer такого отказа не бывает. |
| 400 | — | Тело запроса не разобралось как JSON. Проверьте, что отправляете правильно составленный объект. |
| 401 | invalid_api_key | Ключа нет в заголовке Authorization, либо он неверный или отключён. |
| 402 | insufficient_credits | На балансе не осталось свободных кредитов. Перед вызовом шлюз проверяет только это — сумма списывается после ответа, по факту. |
| 403 | forbidden | Аккаунт заблокирован: вызовы модели, пополнение и загрузка файлов ему закрыты. Ключи при этом не отключены — запрет лежит на аккаунте. |
| 413 | — | Тело запроса больше предела в 512 КиБ. |
| 415 | — | Не тот тип содержимого. Заголовок Content-Type должен быть application/json. |
| 429 | — | Больше 60 запросов в минуту на один ключ. |
| 502 | upstream_error | Поставщик не ответил или ответил ошибкой. Запрос не тарифицируется: списывать нечего, ответа не было. |
| 503 | service_overloaded | Поставщик перегружен или отбил запрос по своему лимиту. Запрос не тарифицируется, повторить можно через несколько секунд — срок назван в заголовке Retry-After. |
| 503 | upstream_error | Модель временно недоступна у поставщика. Запрос не тарифицируется. |
Что xAI говорит про Grok 4.5
Grok 4.5 — языковая модель компании xAI, объявленная 16 июля 2026 года. У GEN202 миллион присланных токенов обходится в 461,5 ₽, миллион токенов ответа — в 1385 ₽, пока запрос не дорос до порога второй ставки.
Чем разработчик считает этот выпуск, сказано первой строкой карточки модели в документации xAI: «SpaceXAI's intelligent coding model for agentic software, engineering, and workflow tasks. Trained in SpaceXAI's data centers in Memphis with new datasets spanning science, engineering, and math». Перевод наш: «Умная модель SpaceXAI для самостоятельной работы над программами, инженерных задач и рабочих процессов. Обучена в дата-центрах SpaceXAI в Мемфисе на новых наборах данных по науке, инженерии и математике». Именем SpaceXAI разработчик подписывает свои страницы, а домены у него прежние — x.ai и docs.x.ai.
Про оснастку обучения в объявлении о выпуске Grok 4.5 написано так: «Grok 4.5 was trained across tens of thousands of NVIDIA GB300 GPUs, with training and stability techniques designed for large-scale runs». Перевод наш: «Grok 4.5 обучали на десятках тысяч видеокарт NVIDIA GB300, приёмами обучения и удержания устойчивости, рассчитанными на прогоны такого размаха».
Скорость ответа названа там же одним числом: «Grok 4.5 is served at fast-model speeds of 80 TPS». Перевод наш: «Grok 4.5 отдаётся на скорости быстрых моделей — 80 токенов в секунду». Число замерено самим xAI на его стороне.
Тем же днём выпуск отмечен строкой в заметках о выпусках xAI: «Grok 4.5, SpaceXAI's model for coding, agentic tasks, and knowledge work, is now available on the xAI API. Priced at $2 / 1M input tokens and $6 / 1M output tokens, with configurable reasoning effort (low, medium, or high; default high)». Перевод наш: «Grok 4.5, модель SpaceXAI для программирования, агентных задач и работы со знаниями, доступна в xAI API. Цена $2 за 1M входных и $6 за 1M выходных токенов, глубина обдумывания настраивается (low, medium или high; по умолчанию high)».
Про само обдумывание руководство xAI говорит две фразы: «If not specified, `reasoning_effort` defaults to "high". Reasoning cannot be disabled». Перевод наш: «Если поле reasoning_effort не задано, оно равно "high". Отключить обдумывание нельзя». Значит, подробное обдумывание эта модель даёт без единой настройки, а короткого ответа совсем без обдумывания у неё не бывает.
Слова xAI о Grok 4.5 приведены по его страницам на 15 сентября 2026 года.
Выпуски ряда Grok: что вышло до Grok 4.5 и после
Ряд Grok разработчик ведёт с ноября 2024 года, когда в его API открылась публичная проба, и номера в нём идут не подряд. Ниже собрано, как он называет каждый выпуск, какой датой объявил его и что назвал переменой.
| Имя у xAI | Дата по анонсу | Что названо переменой |
|---|---|---|
| Grok 3 | 19 февраля 2025 | Обучение на вычислителе Colossus и отдельный режим обдумывания |
| Grok 4 | 9 июля 2025 | Встроенная работа с инструментами и поиск в реальном времени |
| Grok 4 Fast | 19 сентября 2025 | Ответ с рассуждением и без него в одной модели |
| Grok 4.1 | 17 ноября 2025 | Упор на разговор: замысел собеседника и цельный нрав |
| Grok 4.1 Fast | 19 ноября 2025 | Агенты, зовущие инструменты, в API разработчика |
| Grok 4.20 и Grok 4.20 Multi-agent | март 2026 | Скорость и вызов инструментов; в многоагентном варианте тему разбирают несколько агентов сразу |
| Grok Build 0.1 | май 2026 | Модель под самостоятельную работу над кодом, ранний доступ |
| Grok 4.3 | объявления не было | Быстрая надёжная модель, следующая указаниям |
| Grok 4.5 | 16 июля 2026 | Обучена вместе с Cursor под код, самостоятельные задачи и работу со знаниями |
| Grok 4.6 | 12 августа 2026 | Долгий дополнительный этап обучения и упор на долго работающих агентов |
Два последних выпуска стоят в каталоге GEN202 и разобраны каждый на своей странице: этот — здесь, следующий — на странице Grok 4.6. Даты взяты с подписей объявлений: Grok 3 подписан «Feb 19, 2025», Grok 4 — «Jul 9, 2025», Grok 4 Fast — «Sep 19, 2025», Grok 4.1 — «Nov 17, 2025».
Номер 4.20 — написание самого разработчика, а не «четыре и две десятых»: он читает его как двадцатую правку четвёртого поколения. Поэтому по датам ряд идёт 4 → 4 Fast → 4.1 → 4.1 Fast → 4.20 → 4.5 → 4.6, хотя по номеру 4.20 крупнее 4.5.
У Grok 4.3 даты нет ни в заметках о выпусках, ни отдельной страницей объявления: модель стоит в справочнике и в прайс-листе разработчика, а день её выхода он не называл. Строки Grok 4.20 и Grok Build 0.1 подтверждены месяцем в заметках о выпусках — дня там тоже нет.
Характеристики Grok 4.5: окно, ответ и ступень цены
Grok 4.5 — одна модель, а не набор уровней под общим номером: имя для поля model у неё единственное, и выбирать внутри страницы нечего.
В таблице собрано то, что задаёт рамку запроса ещё до первой строки кода.
| Характеристика | Значение |
|---|---|
| Имя для поля model | grok/4-5 |
| Окно контекста | 500 000 токенов |
| Предел одного ответа | разработчик его не назвал |
| Что берёт на вход | текст и картинки |
| Чем отвечает | текстом |
| Порог второй ставки | 200 000 токенов во входе |
Обе ставки — обычная и повышенная — стоят в таблице цен выше по этой же странице.
Как вести в Grok 4.5 работу длиннее одного запроса
Задача на один ответ вопросов не вызывает. Трудности начинаются там, где работа идёт несколькими заходами подряд, и порядок ниже их снимает.
- Попросите сначала план. План складывают отдельно от самой работы. Оборвалась работа на середине — её продолжают с места обрыва, а не начинают заново.
- Собирайте частями. Целиком задачу не отдают: сперва основание, потом по одной части сверху. Каждую следующую часть заводят отдельным разговором.
- Считайте первый ответ черновиком. Готовым он бывает редко. Дальше его правят, а не переписывают задание с нуля.
- Правьте по одному месту за раз. Короткая просьба про одну беду проходит вернее, чем список замечаний сразу. Список модель разбирает не весь.
- Проверьте сказанное «готово». Сообщение об успехе само по себе ничего не подтверждает: результат смотрят своими глазами, а не по отчёту модели.
- Повторите то, что не вышло. На трудном месте две попытки подряд могут кончиться ничем, а третья выйти. Одной попытки для вывода мало.
Особых полей запроса ни один из шагов не требует: порядок этот про то, как разбита сама задача.
Для чего xAI предлагает Grok 4.5
Отдельно названа работа в офисных приложениях: расчёты в Excel с формулами по нескольким листам, схемы из родных фигур PowerPoint, текст в Word.
В своём сервисе Grok Build и в надстройках для Word, PowerPoint и Excel разработчик поставил её моделью по умолчанию.
В редакторе Cursor Grok 4.5 открыта на всех тарифах.
Сколько текста Grok 4.5 держит за раз
Контекст у неё 500 тысяч токенов.
Это меньше, чем у соседей по каталогу: у Gemini 3.6 Flash окно в миллион токенов, у уровней GPT 5.6 — 1 050 000.
Меньше это и чем у прошлых моделей самого xAI: у Grok 4.3 и у трёх вариантов Grok 4.20 окно было миллионным.
Предела длины ответа не назвали ни в справочнике, ни в карточке модели.
Когда запрос к Grok 4.5 дорожает
В окно уходит запрос целиком: указание, приложенный материал и вся прошлая переписка того же разговора.
У цены есть вторая ступень, и включается она рано — на 200 000 токенах во входе.
По повышенной ставке идёт с этого места и присланный текст, и написанный ответ.
Порог этот заметно ниже размера окна: материал успевает подорожать задолго до того, как перестанет помещаться.
Из этого следует и обратное: пока запрос до порога не дорос, длина на ставку не влияет вовсе.
Какие числа xAI публикует про Grok 4.5
Среди опубликованного есть редкое: насколько модель склонна выдумывать и поддакивать.
Доля выдуманных утверждений — 0,98 процента. Падение точности под нажимом собеседника — 0,01 процента. Доля нечестных ответов под тем же нажимом — 0,67 процента.
Доля предвзятых ответов — 20,4 процента, а доля выполненных запросов, которые следовало отклонить, — 0,73 процента.
Из рабочих чисел названы 64,7 процента решённых задач в многофайловых репозиториях и 29 процентов на сверхдлинных инженерных задачах. Средний ответ на одну такую задачу — 15 954 токена.
Проверки на выдумывание и на поддакивание внутренние, публичной методики у них нет. Замерено всё на высоком уровне рассуждения — том самом, который у этой модели стоит по умолчанию.
Что показали независимые проверки Grok 4.5
Первым выпуск разобрало издание TechCrunch, автор Lucas Ropek, на странице стоит время «12:30 PM PDT · July 8, 2026». Цену издание приводит со слов разработчика: «SpaceXAI says that its new model costs $2 per million input tokens and $6 per million output tokens…». Перевод наш: «SpaceXAI сообщает, что новая модель стоит 2 доллара за миллион входных токенов и 6 долларов за миллион выходных».
Сразу за ценой издание ставит оговорку и на веру слова разработчика не берёт: «That's quite competitive, if Grok's capabilities match SpaceXAI's rhetoric». Перевод наш: «Это вполне конкурентоспособно, если способности Grok соответствуют словам SpaceXAI». Собственных прогонов в заметке нет — это разбор объявления.
Второй источник — разбор Matthias Bastian в издании The Decoder от 9 июля 2026 года. Работа в командной строке описана там так: «On Terminal Bench 2.1, which tests complex command-line tasks, Grok 4.5 scores 83.3%…». Перевод наш: «На Terminal Bench 2.1, где проверяют сложные задачи в командной строке, Grok 4.5 набирает 83,3 процента».
Ровный результат держится не везде, и издание говорит это прямо: «But the gaps widen elsewhere. On DeepSWE 1.1, which measures the ability to resolve real GitHub issues, Grok 4.5 hits 53%…». Перевод наш: «Но в других местах разрыв шире. На DeepSWE 1.1, где меряют умение закрывать настоящие задачи с GitHub, Grok 4.5 берёт 53 процента». Оба числа издание не мерило само: те же значения стоят и в таблице разработчика, выложенной в объявлении о выпуске.
Третий источник — арена LMArena с картинками, где человеку показывают два ответа без имён и просят выбрать лучший. На снимке 15 сентября 2026 года из всего ряда Grok в этой арене стоит одна строка — как раз этот выпуск, 1279 очков при 8 355 голосах. То есть работу с картинкой на входе у ряда замеряли только на нём.
По-русски ряд с секундомером разбирали один раз, и не на этом выпуске: разбор на Хабре от 21 июля 2025 года сделан на Grok 4. Автор пишет: «Что касается скорости вывода ответов, Grok 4 выдаёт около 43,7 токена/с, что немного медленнее темпов топовых моделей» и «Первый токен модель выводит в среднем через 15,07 секунды после отправки запроса пользователя». Числа эти к Grok 4.5 не относятся: разработчик называет для неё другую скорость, и замеров на русском по ней пока нет.
Даты у источников с объявлением расходятся: обе заметки вышли 8 и 9 июля 2026 года, а объявление на сайте разработчика подписано 16 июля. Четыре источника о Grok 4.5 приведены на 15 сентября 2026 года.
Где Grok 4.5 промахивается и что с этим делают
В документации перечислено, подо что выпуск задуман. Дальше — то, что вылезает на второй и третьей задаче подряд.
- Новый код на распространённых наборах библиотек выходит без замечаний. Расхождение начинается на правке готового и на случаях, которые в задании не оговорены.
- Просьбу поправить по месту модель понимает шире, чем она сказана: вместо правки в десяток строк переписывает целые куски затронутых файлов.
- На долгой работе она теряет собственный учёт и ссылается на записи, которых не заводила. Со стороны при этом всё выглядит идущим своим чередом.
- Уверенный тон ответа не отличает верное от неверного: названное поломкой оказывается ею не всегда.
- Ответ выходит короче, чем у соседних моделей на том же задании: длину она сокращает сама, без просьбы.
- По ходу работы она переспрашивает и уточняет условие, а не идёт делать молча.
- К заданию она нередко добавляет то, о чём не просили: разбор в конце ответа выходит подробнее заказанного.
- Собранное ею выходит неподвижным: движение и оживление приходится просить отдельным указанием.
Отсюда и порядок работы выше: сначала план, потом сборка частями, а правки — короткими просьбами по одному месту за раз.
До какого времени Grok 4.5 знает мир
Мир Grok 4.5 знает по 1 февраля 2026 года.
Ни событий, ни данных, появившихся после этой даты, в ней нет.
Вопрос о том, что случилось весной 2026 года, модель не закроет.
Где xAI не советует применять Grok 4.5
Границу применения xAI очерчивает в карточке модели сам, и укладывается она в одну фразу.
На самостоятельные решения там, где ошибка дорого стоит, модель не рассчитана.
Перечень такой: медицина, юридические вопросы, финансы и системы, отказ которых опасен для людей.
Работать в них модель может, но за ней должен смотреть человек, а результат — проверять специалист.
Рубли на этой странице — цены GEN202, сервиса доступа к моделям с оплатой из России; доллары xAI стоят рядом только для сравнения. Из чего складывается кредит и какими пакетами он пополняется, написано на странице цен.