Gemini API в России

Gemini — семейство языковых моделей Google: на вход они берут текст, изображения, звук и видео, а отвечают текстом. Миллион входных токенов стоит от 173 ₽. За Gemini API платят рублями с российской карты, API ключ один на весь каталог, а VPN для вызова не нужен.

Модели Gemini

Модель Поставщик Цена от, за миллион токенов
Gemini 3.6 Flash Google $1.73173 ₽
Gemini 3.7 Flash Google $1.73173 ₽

Как купить доступ к Gemini API в России

Купить API ключ Gemini — моделей Google — можно у GEN202, и покупка целиком проходит здесь: вход на сайт, пополнение баланса, выпуск ключа в кабинете. Заводить учётную запись в Google AI Studio и открывать проект в Google Cloud для этого не требуется.

Баланс пополняется картой российского банка. Валютный перевод и счёт за границей не понадобятся: платёж принимает российский продавец. Внутри сервиса счёт ведётся кредитами, и покупаются они готовыми пакетами. Самый дешёвый обойдётся в 500 ₽ и принесёт 1 000 кредитов.

Gemini Flash API оплачивается по расходу: миллион входных токенов у Gemini 3.6 Flash стоит 173 ₽, миллион выходных — 865,5 ₽. Обе ставки собраны в ценах модели. Один баланс покрывает весь каталог: те же кредиты уходят на картинки, на ролики и на языковые модели других разработчиков.

Что Google говорит о Gemini

Линейку Google ведёт поколениями и говорит об этом прямо: «Every generation of Gemini has built on the last, enabling you to do more». Перевод наш: «Каждое поколение Gemini опиралось на предыдущее и позволяло сделать больше». Так написал Сундар Пичаи, объявляя третье поколение, — объявление о выпуске Gemini 3.

Ряд Flash внутри поколения Google размечает сам, ступенями. Самый свежий выпуск подписан так: «Gemini 3.8 Flash — Our most intelligent Flash model, engineered for long-horizon software engineering, autonomous agents, and complex enterprise workflows». Перевод наш: «Gemini 3.8 Flash — наша самая умная модель Flash, сделанная для долгой работы над кодом, самостоятельных помощников и сложных задач организаций». Страница — справочник моделей Gemini API.

Соседние выпуски подписаны там же и иначе: Gemini 3.7 Flash — «Our previous-generation Flash model for complex coding, agentic workflows, and reliable multi-step execution», перевод наш: «модель Flash прошлого поколения для сложного кода, самостоятельной работы и надёжного прохождения нескольких шагов». Gemini 3.6 Flash — «Our previous-generation Flash model, balancing speed and multimodal capabilities across general agentic and everyday tasks», перевод наш: «модель Flash прошлого поколения, где уравновешены скорость и работа с разными видами данных в обычных и повседневных задачах».

Третья ступень у него называется старой: «Gemini 3.5 Flash — Our legacy Flash model, providing baseline speed and foundational performance for routine, high-throughput workloads». Перевод наш: «Gemini 3.5 Flash — наша старая модель Flash: опорная скорость и базовое качество для однообразных задач с большим потоком». То есть ступеней у Google три — самая умная, прошлого поколения и старая, — и расставляет их он, а не мы.

Что более свежий выпуск не отменяет предыдущий, Google написал прямо: «For applications where compute efficiency is the primary constraint, developers can utilize lower effort levels to minimize token overhead or continue to rely on Gemini 3.7 Flash, which remains fully supported for efficiency-first workloads». Перевод наш: «Там, где главное ограничение — расход вычислений, разработчику стоит либо снизить уровень усилия, чтобы тратить меньше токенов, либо остаться на Gemini 3.7 Flash: она полностью поддерживается для задач, где важнее экономия». Страница — объявление о выпуске Gemini 3.8 Flash.

Почему так, объяснено там же: «These performance gains stem from a core design choice: 3.8 Flash works harder. On complex tasks, it exhibits greater diligence — executing extra reasoning steps, and calling tools iteratively. At times, the model might use more tokens to maximize performance, especially at higher effort levels». Перевод наш: «Прирост качества идёт из одного решения при разработке: 3.8 Flash работает усерднее. На сложных задачах она старательнее — делает лишние шаги рассуждения и зовёт инструменты по кругу. Иногда она тратит больше токенов ради качества, особенно на высоких уровнях усилия».

Цену нового выпуска Google назвал в том же объявлении: «available at the same introductory price as 3.7 Flash at $0.75 per million input tokens and $3.75 per million output tokens». Перевод наш: «по той же вводной цене, что и 3.7 Flash: 0,75 доллара за миллион входных токенов и 3,75 за миллион выходных». Это доллары самого разработчика; рублёвые ставки GEN202 стоят в таблице выше.

Как устроен ряд Flash внутри поколения, Google пишет в карточке модели: «Gemini 3 Flash is built off of the Gemini 3 Pro reasoning foundation with thinking levels to control the mix of quality, cost and latency». Перевод наш: «Gemini 3 Flash построена на рассуждающей основе Gemini 3 Pro и даёт уровни обдумывания, чтобы управлять сочетанием качества, цены и задержки». Страница — карточка Gemini 3 Flash.

Для чего модели предлагаются, Google перечисляет сам: работа по шагам с вызовом средств, задачи с кодом и длинные корпоративные процессы. Звук и видео на вход из языковых моделей нашего каталога берёт только это семейство: ни одна модель OpenAI, xAI или Anthropic в каталоге этого не принимает.

Слова Google о Gemini приведены по его страницам на 15 сентября 2026 года.

Версии Gemini: от поколения 2.5 до ряда Flash

Google держит перечень своих выпусков в двух местах: в таблице снятия с поддержки, где у каждой модели стоит день выхода, и в карточках моделей. В таблице ниже — имя у разработчика, этот день, суть перемены и страница, откуда дата взята.

Имя у разработчикаДата выходаЧто изменилосьГде объявлено
Gemini 2.5, первой — 2.5 Pro Experimental25 марта 2025Поколение думающих моделей: до ответа модель прокручивает мысльобъявление о выпуске Gemini 2.5
Gemini 2.5 Pro и Gemini 2.5 Flash17 июня 2025Старший и рабочий выпуски поколения открыты всемтаблица снятия с поддержки
Gemini 2.5 Flash-Lite22 июля 2025Самый дешёвый выпуск поколения под однообразный поток запросовтаблица снятия с поддержки
Gemini 3 Pro Preview18 ноября 2025Третье поколение: работа с разными видами данных и самостоятельные задачиобъявление о выпуске Gemini 3
Gemini 3 Flash Preview17 декабря 2025Ряд Flash третьего поколения на рассуждающей основе Proкарточка Gemini 3 Flash
Gemini 3.1 Pro Preview19 февраля 2026Правка старшего ряда; у разработчика она до сих пор помечена предварительнойкарточка Gemini 3.1 Pro
Gemini 3.1 Flash-Lite7 мая 2026Дешёвый выпуск ряда; снимается с поддержки 7 мая 2027 годатаблица снятия с поддержки
Gemini 3.5 Flash19 мая 2026Опорная скорость ряда; сам разработчик зовёт её старойкарточка Gemini 3.5 Flash
Gemini 3.5 Flash-Lite21 июля 2026Младший выпуск того же ряда под короткие повторяющиеся запросытаблица снятия с поддержки
Gemini 3.6 Flash21 июля 2026Скорость и работа с разными видами данных в повседневных задачахкарточка Gemini 3.6 Flash
Gemini 3.7 Flash13 августа 2026Сложный код, самостоятельная работа и надёжное прохождение шаговкарточка Gemini 3.7 Flash
Gemini 3.8 Flash2 сентября 2026Долгая работа над кодом ценой большего расхода токеновкарточка Gemini 3.8 Flash

Что означает снятие с поддержки, Google определяет сам: «Deprecation means we no longer provide support for a model, and that it will be "shut down" in the near future». Перевод наш: «Снятие с поддержки означает, что мы больше не поддерживаем модель и в скором времени её "выключат"». Страница — таблица снятия с поддержки.

Про сами даты там сказано отдельно: «The shutdown dates listed in the table indicate the earliest possible dates on which a model might be retired. We will communicate the exact shutdown date to users with advance notice». Перевод наш: «Указанные в таблице даты снятия — это самые ранние возможные даты, когда модель могут убрать. Точную дату мы сообщим заранее».

Карточки моделей у разработчика открываются файлом PDF, а не обычной страницей, и дата публикации стоит внутри. Даты выпусков Gemini приведены по страницам Google на 15 сентября 2026 года.

Что показали независимые проверки Gemini

Свежий выпуск ряда разбирало издание The Decoder, автор Matthias Bastian, 2 сентября 2026 года. Темп выпусков там назван прямо: «This is the third Flash release in just six weeks, and whether that rapid cadence is a sign of strength or a distraction from the still-missing frontier models Gemini 3.5 Pro and Gemini 4 depends on who you ask». Перевод наш: «Это третий выпуск Flash всего за шесть недель, и считать ли такой темп признаком силы или отвлечением от по-прежнему отсутствующих старших моделей Gemini 3.5 Pro и Gemini 4 — зависит от того, кого спросить». Заметка — разбор выпуска 3.8 Flash в The Decoder.

Обратную сторону обновления издание разбирает так: «Google explains the performance gains over 3.7 partly by saying that 3.8 Flash runs extra reasoning steps on complex tasks and calls tools iteratively. The model "works harder," Google says, which means higher token consumption that partly offsets the lower per-token price». Перевод наш: «Прирост против 3.7 Google отчасти объясняет тем, что 3.8 Flash делает лишние шаги рассуждения на сложных задачах и вызывает инструменты по кругу. Модель "работает усерднее", говорит Google, а это значит больший расход токенов, который частично съедает более низкую цену за токен». Там же стоит оговорка к любым таблицам замеров: «These are just benchmarks, though, and real-world performance can feel very different» — перевод наш: «Но это всего лишь наборы проверок, и в живой работе ощущение может быть совсем другим».

Второй разбор — издание MarkTechPost, автор Asif Razzaq, 2 сентября 2026 года. Оно пересчитывает, что у выпуска осталось прежним: «Specs are unchanged: a 1,048,576-token context window, 65,536-token maximum output, text, image, audio, and video input, and text output. Thinking levels remain LOW, MEDIUM, and HIGH with MEDIUM as the default. One breaking detail for anyone migrating: MINIMAL is not supported on 3.8 Flash and setting it returns an API validation error». Перевод наш: «Характеристики не изменились: окно контекста 1 048 576 токенов, потолок ответа 65 536 токенов, на вход текст, картинки, звук и видео, на выход текст. Уровни обдумывания остаются LOW, MEDIUM и HIGH, по умолчанию MEDIUM. Одна ломающая мелочь для тех, кто переходит: MINIMAL на 3.8 Flash не поддерживается, и при его установке API возвращает ошибку проверки». Заметка — разбор выпуска 3.8 Flash в MarkTechPost.

Совет разработчика остаться на прошлом выпуске то же издание называет необычным: «That is an unusually direct admission that the newer model is not the right default for every workload». Перевод наш: «Это необычно прямое признание того, что более новая модель не годится как выбор по умолчанию для любой задачи». И про запуск у себя: «Weights are closed, so there is no self-hosted or on-premises path» — перевод наш: «Веса закрыты, так что пути к самостоятельному размещению у себя нет».

Сами выпуски ряда сравнивает между собой LMArena: там человек читает два ответа, не зная, чьи они, и выбирает лучший, а из этих выборов складывается оценка. В текстовой арене строки ряда стоят ровно по номерам: gemini-3.8-flash-high — 1493, gemini-3.7-flash-high — 1490, gemini-3.6-flash-high — 1480, gemini-3.5-flash-high — 1478, gemini-3-flash — 1474. Страница — текстовая арена на LMArena. Обновлена она 13 сентября 2026 года.

Разрыв между соседними выпусками там от двух до десяти пунктов, а у двух верхних строк ряда стоит пометка «Preliminary» и по пять с небольшим тысяч голосов против двадцати шести тысяч у gemini-3.6-flash-high. То есть порядок в верхней части ряда ещё может измениться.

Ни одна из этих проверок не сделана через GEN202: заметки написаны изданиями, а голоса на арене оставили её посетители. Заметки изданий и таблица арены о Gemini приведены на 15 сентября 2026 года.

Gemini AI API: что модель читает и что возвращает в ответ

Под Gemini в каталоге стоят Gemini 3.6 Flash и Gemini 3.7 Flash, а разобрана ниже Gemini 3.6 Flash: в поле model запроса называется её имя — gemini/3-6-flash. Читает она текст, изображение, звук и видео, а отвечает всегда текстом: рисовать картинки эта модель не умеет.

Снимок, звуковая запись и ролик кладутся в тот же запрос, что и вопрос о них. Отдельного адреса под каждый вид входа заводить не надо: строение запроса от вложенного материала не меняется.

СтрокаЧто в ней стоит
Имя в поле modelgemini/3-6-flash
Что модель читаеттекст, изображение, звук и видео
Что модель возвращаеттекст
Окно контекста1 000 000 токенов
Потолок ответа64 000 токенов
Счёт идётза миллион токенов

Окно контекста — это весь запрос целиком: и заданный вопрос, и вложенные файлы, и вся прошлая переписка. Ответа длиннее 64 000 токенов от модели не придёт, сколько бы ни просили полем max_tokens. Упёрся ответ в потолок — в поле finish_reason приходит слово length, и продолжение забирают вторым вызовом.

Вложенный материал попадает в счёт входными токенами, и растёт эта часть не так, как размер файла на диске. Снимок пересчитывается по своим правилам, а у звука и ролика счёт идёт от длительности, а не от веса файла. Сколько токенов вышло на самом деле, видно из того же ответа: числа расхода приходят рядом с текстом.

Как получить Gemini API key

Получить API Gemini можно за один вход на сайт: ключ выпускается в кабинете одним нажатием, и подтверждать его никому не надо. Ни заявки на доступ, ни ожидания одобрения между входом и первым ответом модели нет.

API ключ для Gemini на счёте бывает не один, и у каждого своё имя не длиннее 60 знаков. Любой из них отзывается отдельно от остальных. Ключ уходит в запрос заголовком. Как он там задаётся, показано в разделе «Ключ и заголовки»; поля самого вызова разобраны в разделе «Gemini».

Весь путь от чистого браузера до первого ответа Gemini 3.6 Flash укладывается в пять шагов.

  1. Вход. Вы входите через Яндекс либо по ссылке из письма — пароль придумывать не нужно.
  2. Пополнение. Деньги кладут на баланс картой российского банка, и кредиты появляются на счёте сразу после оплаты.
  3. Выпуск ключа. В кабинете нажимают создание ключа и дают ему имя, по которому его потом отличают от соседних.
  4. Настройка клиента. В клиентской библиотеке OpenAI базовым адресом ставят https://api.gen202.com/v1, а выпущенный ключ — полем ключа.
  5. Первый запрос. В поле model пишут gemini/3-6-flash, в messages кладут вопрос, и ответ приходит на тот же запрос.

Ключ копируется целиком, вместе с его началом, и лишний пробел по краям строки ломает запрос. Отказ по такому ключу выглядит как отказ по неверному ключу, хотя сам ключ при этом рабочий. Готовый пример первого вызова вместе с адресом и заголовком стоит в разделе «Быстрый старт».

Чем это отличается от Google AI Studio

Google AI Studio — кабинет разработчика у самого Google: там заводят проект, там же выдают ключ, и оплачивается он зарубежной картой. Gemini AI API key выдаёт там сам Google, а у нас ни проекта, ни кабинета на той стороне не заводится.

Модель отвечает одна и та же — та, что стоит в каталоге Google, — разной остаётся дорога до неё. Ваша программа обращается к https://api.gen202.com, а всё, что происходит дальше, берёт на себя GEN202.

В самой программе от этой разницы меняются три строки настройки, а остальной код остаётся прежним.

  • Базовый адрес: в клиенте вместо адреса Google ставится https://api.gen202.com/v1, а путь до метода клиент дописывает сам.
  • Ключ: в заголовке подставляется ключ из нашего кабинета, а не тот, что выдан в Google AI Studio.
  • Имя модели: в поле model пишется gemini/3-6-flash — так модель названа в каталоге GEN202.

Отдельную библиотеку под Gemini ставить не нужно: запрос идёт в том же формате, что и у OpenAI. Ответ разбирается привычными полями — сам текст лежит в choices, израсходованные токены в usage.

У самого разработчика проверяется не только ключ, но и место, откуда ушёл запрос. Поэтому там рабочая связка ломается после переезда на другой сервер, хотя ни ключ, ни код никто не трогал. К Google GEN202 обращается сам, и от того, где стоит ваша программа, ответ не зависит.

Из чего складывается счёт за Gemini API

Платят здесь не за запрос, а за токены: считается и прочитанное моделью, и написанное ею. Ставка входа и ставка выхода разные, и обе собраны в ценах модели. Вложенный снимок и звуковая запись тоже превращаются в токены и попадают во входную часть счёта.

Перед вызовом деньги не откладываются: проверяется только, что свободные кредиты на балансе есть. Списывается после ответа фактический расход токенов: прочитанное по своей ставке, написанное по своей. Сумма приходит в самом ответе полем credits_consumed.

Длину ответа ограничивает поле max_tokens с верхней границей 128 000 токенов. Без этого поля потолок ставится сам — 1 024 токена. Платится при этом написанное, а не потолок.

Модель не ответила или ответила ошибкой — такой вызов не стоит ничего. Баланс от одного вызова может оказаться чуть ниже нуля, и тогда следующий запрос не пройдёт до пополнения.

Потолок ответа лучше не ставить впритык к ожидаемой длине ответа. Часть запаса модель тратит на обдумывание до того, как напишет первое слово ответа. Запас кончился на этом месте — приходит пустой текст с причиной остановки length, а токены при этом израсходованы.

Что отвечает Gemini API при отказе и во что обходится ошибка

Отказ приходит в том виде, к которому привык клиент OpenAI: в теле лежит объект error с сообщением и кодом. Разбирать его надёжнее по числу ответа, а не по тексту сообщения: текст меняется, число остаётся.

Почти все отказы GEN202 даёт сам, до обращения к Google, и потому они не стоят ни кредита.

  • 401 — ключа нет в заголовке Authorization, либо он неверный или отключённый.
  • 400 — не разобралось тело запроса, названо неизвестное имя модели, пуст список сообщений или негоден max_tokens.
  • 402 — свободные кредиты на балансе кончились.
  • 413 — тело запроса больше 512 КиБ.
  • 415 — заголовок Content-Type не назвал формат JSON.
  • 429 — на один ключ пришло больше 60 запросов за минуту.
  • 502 — модель не ответила, и запрос не тарифицируется.
  • 503 — модель перегружена или сработал её лимит, а срок повтора стоит в заголовке Retry-After.

Частота считается по ключу, а не по сетевому адресу программы: два ключа с одной машины считаются порознь. Что означает каждый ответ GEN202, разобрано построчно в разделе «Отказы».

Отдельно стоит проверять не только отказы, но и успешные ответы. Модель иногда останавливается по своим правилам содержания и возвращает пустой текст без всякой ошибки. Программа принимает такой ответ за удачный, поэтому пустоту в поле текста разбирают до того, как показать её человеку.

Нужен ли ключ Google, чтобы вызвать Gemini

Нет. Своего ключа Google для вызова Gemini не требуется: к Google GEN202 обращается своим ключом, а с вашего баланса списываются кредиты.

Можно ли купить у нас Google Gemini API key

Купить API ключ Gemini у нас нельзя: выдаёт их только сам Google. Продаём мы вызов модели: запрос уходит на адрес GEN202, а до Google его доводим мы сами.

Ключ GEN202 заводите и отключаете вы сами, а деньги остаются на вашем балансе до последнего кредита.

Есть ли бесплатный доступ к Gemini API

Бесплатный API Gemini у нас не раздают, но первые запросы делаются без оплаты. Без входа даётся один бесплатный запрос в сутки — в песочнице на странице модели. Отвечает на него gpt/5-6-luna, а ответ обрывается на 512 токенах.

При первом входе на баланс начисляется 50 кредитов, и вот тогда отвечает уже выбранная модель. Если считать по ставке ответа, этого хватает примерно на 28 тысяч токенов Gemini 3.6 Flash. Сам Gemini API key бесплатно выдаётся в кабинете: платить приходится только за токены.

Чего Google не обещает от Gemini API

Знания у модели двойные, и Google предупреждает об этом сам: верхняя граница — март 2026 года, но по части областей модель знает мир только до января 2025 года. Какие это области, он не перечисляет.

В той же карточке названо и остальное: модель может выдумывать факты, а ещё возможны замедления и обрывы по времени ожидания.

Дословно у Google это сказано так: «The knowledge cutoff date for Gemini 3.7 Flash is March 2026 – users can expect updated information for some domains while in others they may experience the model's knowledge is limited to January 2025 (in line with the Gemini 3 Model Family)». Перевод наш: «Отсечка знаний Gemini 3.7 Flash — март 2026; в одних областях сведения будут свежими, а в других знания модели могут быть ограничены январём 2025 года — как у всего семейства Gemini 3». Страница — карточка Gemini 3.7 Flash.

Про остальное там сказано столь же прямо: «Gemini 3.7 Flash may exhibit some of the general limitations of foundation models, such as hallucinations… There may also be occasional slowness or timeout issues». Перевод наш: «Gemini 3.7 Flash может проявлять общие ограничения базовых моделей, например выдумывать факты… Возможны также отдельные замедления и обрывы по времени ожидания».

Рубли на этой странице — цена GEN202, а не Google: у него счёт идёт в долларах, а наши пакеты пополнения собраны на странице тарифов.

Gemini API из России

Работать из России можно без VPN, а платить — рублями с карты российского банка. Прямой доступ идёт через биллинг поставщика, и счёт он выставляет в долларах. GEN202 стоит между вами и поставщиком: расчёты с ним наши, вы платите российскому продавцу.

Gemini — семейство языковых моделей Google. На витрине из него стоит Gemini 3.6 Flash, и у Google она проходит под тем же именем.