Gemini 3.6 Flash API

Принимает переписку списком сообщений, изображения, звук и видео, возвращает текст. Контекст 1 000 000 токенов, ответ до 64 000, знания до марта 2026 года. Модель Google.

Gemini 3.6 Flash API работает в России без VPN: один API ключ GEN202, оплата рублями с российской карты.

Цена: за миллион токенов, вход — 346 кр. (173 ₽ · $1.73), выход — 1731 кр. (865,5 ₽ · $8.655).

кр. — кредиты, покупаются за рубли.

Model

Статус

работает

Песочница

Input

Модель gemini/3-6-flash

Потолок ответа — предел выбранной модели. Списывается фактический расход, а не потолок. Меньшее значение обрывает ответ на полуслове: у рассуждающих моделей тысяча токенов уходит на размышление, и текста ответа не остаётся вовсе.

Войдите и получите 50 кредитов на тесты и любое использование сервиса. Без регистрации доступен один запрос в сутки.


          
Output

Нажмите «Запустить» — ответ модели появится здесь

{ }

Цена Gemini 3.6 Flash

Цена за миллион токенов, отдельно за вход и за выход. Списывается фактический расход из поля usage ответа: сколько токенов ушло в запрос и сколько модель вернула. Минимальное списание за вызов — 0.02 кр.: обращение к модели стоит денег само по себе, независимо от длины запроса.

Токены Наша цена
Вход 346 кр. $1.73173 ₽
Выход 1731 кр. $8.655865,5 ₽

кр. — кредиты, покупаются за рубли.

Вызов через API

POST https://api.gen202.com/v1/chat/completions

Адрес один, и ответ приходит на этот же запрос: задачу ставить и опрашивать не нужно — этим текст и отличается от картинок. Ключ передаётся заголовком Authorization: Bearer sk-… и выпускается в кабинете. На один ключ шлюз пропускает 60 запросов в минуту.

Счёт идёт по токенам из поля usage ответа: вход и выход по своим ставкам. Кредиты списываются после ответа, по факту — заранее ничего не удерживается, поэтому короткий вопрос стоит ровно столько, сколько стоит, и не занимает баланс под будущий ответ. Сколько списано, приходит в самом ответе полем credits_consumed. Перед вызовом проверяется одно: на балансе есть деньги. Запрос, не дошедший до ответа, не тарифицируется вовсе.

Поля запроса

Все три лежат в корне тела запроса — вложенного input у текста нет. Остальные поля формата OpenAI — temperature, top_p, stop, seed, response_format, reasoning_effort и прочие — шлюз передаёт поставщику, проверив значение: temperature от 0 до 2 (у Claude до 1), top_p от 0 до 1, штрафы от −2 до 2, reasoning_effort — minimal, low, medium или high (у GPT 6 Astra — low, medium или high), стоп-слов не больше четырёх. Негодное значение возвращается отказом 400 с именем поля и не стоит ничего: поставщик на такое отвечает своей пятисоткой, из которой не видно, что дело в значении. Набор у каждого семейства свой, потому что форматы вызова разные: что именно принимает выбранная модель, названо на её странице.

stream работает: ответ приходит событиями, как это принято у Chat Completions, и заканчивается строкой data: [DONE]. У поставщика ответ при этом запрашивается целиком — иначе неоткуда взять объём токенов, по которому считается цена вызова, — поэтому весь текст приходит одним событием, а не словом за словом. Расход и объём стоят на последнем событии, рядом с признаком конца.

tools передаётся всем моделям каталога. n и best_of не передаются: несколько вариантов ответа умножают расход, а перед вызовом проверено, что денег хватает на один.

ПолеТипОбяз.Допустимые значения
model текст обязательное gemini/3-6-flash либо другое имя из каталога текстовых моделей
messages массив обязательное Непустой список сообщений с ролями system, user, assistant. Пустой список или не массив — отказ 400
max_tokens целое опц. От 1 до 128000; вне границ — отказ 400. Синоним — max_completion_tokens · без него шлюз подставит 1024

Вызов

Запрос показан целиком, с именем этой модели: подставить остаётся только свой ключ. Ответ приходит сразу — задачу ставить и опрашивать не нужно.

chat.sh
curl https://api.gen202.com/v1/chat/completions \
  -H "Authorization: Bearer sk-ваш-ключ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini/3-6-flash",
    "messages": [{"role": "user", "content": "Привет"}],
    "max_tokens": 200
  }'
chat.py
from openai import OpenAI

client = OpenAI(api_key="sk-ваш-ключ", base_url="https://api.gen202.com/v1")

answer = client.chat.completions.create(
    model="gemini/3-6-flash",
    messages=[{"role": "user", "content": "Привет"}],
    max_tokens=200,
)
print(answer.choices[0].message.content)
print(answer.usage)  # по нему выставлен счёт

Ответ

Форма ответа — OpenAI Chat Completions. Многоточия стоят там, где значение зависит от самого запроса: текст ответа и три числа расхода. Выдумывать их вместо примера нельзя — счёт выставляется по этим самым числам.

chat-response.txt
{
  "choices": [
    {
      "index": 0,
      "message": { "role": "assistant", "content": "…" },
      "finish_reason": "stop"
    }
  ],
  "usage": { "prompt_tokens": …, "completion_tokens": …, "total_tokens": … }
}

Текст лежит в choices[0].message.content, причина остановки — в finish_reason (stop или length). По usage выставляется счёт, так что сверить списание можно прямо из ответа. Служебных полей ответа OpenAI (id, created, object) шлюз не добавляет.

Отказы

Тело отказа — объект error, как у OpenAI: {"error":{"message":…,"type":…,"code":…,"param":null}}. Ни один из этих отказов не тарифицируется: деньги списываются только после ответа модели, и возвращать после отказа нечего.

КодcodeКогда
400 model_not_found Имени из поля model нет среди текстовых моделей. В сообщении перечислено, что принимается.
400 invalid_messages Поле messages не передано, пустое или не массив.
400 invalid_max_tokens Поле max_tokens не целое число либо вне границ от 1 до 128000.
400 invalid_setting Настройка запроса с негодным значением: temperature вне границ от 0 до 2 (у Claude до 1), top_p вне границ от 0 до 1, штраф вне границ от −2 до 2, reasoning_effort не из списка minimal, low, medium, high, пустое стоп-слово или больше четырёх стоп-слов. В сообщении назван сам параметр.
400 key_required Названный заголовком учёта ключ не принадлежит аккаунту или отключён. При вызове по ключу Bearer такого отказа не бывает.
400 Тело запроса не разобралось как JSON. Проверьте, что отправляете правильно составленный объект.
401 invalid_api_key Ключа нет в заголовке Authorization, либо он неверный или отключён.
402 insufficient_credits На балансе не осталось свободных кредитов. Перед вызовом шлюз проверяет только это — сумма списывается после ответа, по факту.
403 forbidden Аккаунт заблокирован: вызовы модели, пополнение и загрузка файлов ему закрыты. Ключи при этом не отключены — запрет лежит на аккаунте.
413 Тело запроса больше предела в 512 КиБ.
415 Не тот тип содержимого. Заголовок Content-Type должен быть application/json.
429 Больше 60 запросов в минуту на один ключ.
502 upstream_error Поставщик не ответил или ответил ошибкой. Запрос не тарифицируется: списывать нечего, ответа не было.
503 service_overloaded Поставщик перегружен или отбил запрос по своему лимиту. Запрос не тарифицируется, повторить можно через несколько секунд — срок назван в заголовке Retry-After.
503 upstream_error Модель временно недоступна у поставщика. Запрос не тарифицируется.

Что Google говорит про Gemini 3.6 Flash

Gemini 3.6 Flash — языковая модель компании Google, вышедшая 21 июля 2026 года. Через GEN202 миллион присланных токенов стоит 173 ₽, миллион токенов ответа — 865,5 ₽.

Чем Google считает этот выпуск, сказано в первом же разделе карточки модели Gemini 3.6 Flash: «Gemini 3.6 Flash is an addition to the Gemini 3 series of highly-capable, natively multimodal, reasoning models. Gemini 3.6 Flash is our workhorse model that delivers better coding, knowledge work, and multimodal performance, while providing better token-efficiency than Gemini 3.5 Flash». Перевод наш: «Gemini 3.6 Flash — пополнение ряда Gemini 3, очень способных, изначально многомодальных рассуждающих моделей. Это наша рабочая лошадка: она лучше справляется с кодом, работой со знаниями и разными видами материала и при этом экономнее расходует токены, чем Gemini 3.5 Flash».

Родство с прошлым выпуском названо там же отдельной строкой: «Gemini 3.6 Flash is based on Gemini 3.5 Flash». Перевод наш: «Gemini 3.6 Flash построена на основе Gemini 3.5 Flash». Тем же образом разработчик объясняет, почему устройство модели, обучающие данные и оснастку он описывает не здесь, а в карточке прошлого выпуска.

Что модель берёт и что отдаёт, в карточке названо двумя строками: «Text strings (e.g., a question, a prompt, document(s) to be summarized), images, audio, and video files, with a token context window of up to 1M» и «Text, with a 64K token output». Перевод наш: «Текстовые строки (вопрос, задание, документы для пересказа), изображения, звуковые файлы и видео при окне до 1 млн токенов» и «Текст с ответом до 64 тысяч токенов».

Кому и подо что она предложена, сказано там же: «Gemini 3.6 Flash is well-suited for users, developers, and enterprises. Some use cases include: agentic workflows, complex video reasoning, coding tasks, and enterprise workflows». Перевод наш: «Gemini 3.6 Flash подходит обычным пользователям, разработчикам и компаниям. Среди применений — работа по шагам с вызовом инструментов, разбор сложного видео, задачи с кодом и внутренние процессы компаний».

В справочнике моделей та же модель подписана короче и иначе: «Gemini 3.6 Flash — Our previous-generation Flash model, balancing speed and multimodal capabilities across general agentic and everyday tasks». Перевод наш: «Gemini 3.6 Flash — модель Flash прошлого поколения, где уравновешены скорость и работа с разными видами материала в обычных и самостоятельных задачах». Слово «previous-generation» стоит в справочнике и у следующего выпуска: новейшей Google называет ту, что вышла позже обоих.

Свою цену Google держит вводной и называет срок. На странице цен Gemini API у этой модели стоит: «Output price (including thinking tokens) … $3.75 through December 31, 2026. $7.50 starting January 1, 2027». Перевод наш: «Цена ответа вместе с токенами обдумывания — $3,75 до 31 декабря 2026 года и $7,50 с 1 января 2027 года».

В таблице снятия с поддержки напротив неё стоят дата выхода «July 21, 2026» и строка «No shutdown date announced» — перевод наш: «дата отключения не объявлена».

Слова Google о Gemini 3.6 Flash приведены по его страницам на 15 сентября 2026 года.

Выпуски ряда Flash: даты выхода и подписи Google

Ряд Flash Google обновляет чаще прочих, и у каждой модели в его же таблице стоит своя дата выхода. Ниже собрано, как он называет выпуски, каким опознавателем они уходят в запрос и какой подписью помечены в справочнике.

Имя у GoogleОпознаватель у GoogleДата выходаКак помечена у Google
Gemini 3 Flashgemini-3-flash-preview17 декабря 2025Предварительный выпуск
Gemini 3.5 Flashgemini-3.5-flash19 мая 2026Старая модель ряда
Gemini 3.5 Flash-Litegemini-3.5-flash-lite21 июля 2026Самая быстрая и дешёвая в поколении 3.5
Gemini 3.6 Flashgemini-3.6-flash21 июля 2026Модель прошлого поколения
Gemini 3.7 Flashgemini-3.7-flash13 августа 2026Модель прошлого поколения
Gemini 3.8 Flashgemini-3.8-flash2 сентября 2026Самая умная модель ряда

Даты и опознаватели взяты со страницы снятия с поддержки: там у каждой модели своя строка «Release date». Две модели ряда стоят в каталоге GEN202 — эта и следующая за ней Gemini 3.7 Flash, разобранная на своей странице. Имя, которое уходит в поле model через GEN202, пишется иначе и стоит строкой в таблице характеристик ниже.

Как соотносятся выпуски, Google говорит подписями в справочнике: у сентябрьской модели ряда — «Our most intelligent Flash model», у двух предыдущих — «previous-generation», у майской — «Our legacy Flash model». Перевод наш: «самая умная модель Flash», «прошлого поколения» и «старая модель Flash».

Правило самой таблицы снятия читается так: «The shutdown dates listed in the table indicate the earliest possible dates on which a model might be retired». Перевод наш: «Указанные в таблице даты отключения — самые ранние возможные даты, когда модель могут убрать».

Характеристики Gemini 3.6 Flash одной таблицей

Gemini 3.6 Flash — одна модель Google, а не ряд уровней: имя для поля model у неё единственное.

Материал не из одних букв берут в каталоге только две языковые модели, и обе — Gemini; эта из них вышла первой. Видно это первой же строкой таблицы.

ХарактеристикаЗначение
Что модель берёт на входтекст, картинки, звук и видео
Чем отвечаеттекстом
Имя для поля modelgemini/3-6-flash
Окно контекста1 000 000 токенов
Предел одного ответа64 000 токенов

Цена за миллион токенов стоит в таблице цен выше по этой же странице, отдельно за присланный текст и за ответ.

Как разобрать длинный документ в Gemini 3.6 Flash

Окно у модели вмещает целый документ, и дробить его на части не нужно. Но у длинного материала есть свои места, где ответ расходится с исходником.

  1. Положите документ целиком. Резать его на части заранее не нужно: при разборе по кускам теряются связи между дальними местами, а именно их и ищут.
  2. Назовите, что именно нужно найти. Точная задача проходит вернее общей: не «разбери документ», а «найди два места, которые спорят между собой».
  3. Попросите дословную выдержку. Иначе на месте цитаты может встать строка о том, что там сказано. Просьбу приводить сами слова ставят прямо.
  4. Вынесите отдельное условие в конец. Условие, поставленное посреди задания, выполняется не всегда. Приписанное последней строкой — надёжнее.
  5. Проверьте конец ответа. На длинном материале пропадает не начало: кусок ближе к концу может не попасть в ответ, а сам ответ выглядит законченным.
  6. Прогоните задание ещё раз. На одном и том же материале ответ от раза к разу расходится. По одной попытке судить нельзя.

Для чего Google предлагает Gemini 3.6 Flash

Названы разбор документов, работа с графиками и данными и составление отчётов.

Отдельно названы разбор финансовых данных и стенограмм, а ещё перенос кода с одного языка на другой.

Сама Google поставила модель в приложение Gemini, в Google AI Studio, в Android Studio, в Antigravity и в корпоративные продукты Gemini Enterprise.

Что Gemini 3.6 Flash принимает на вход и сколько держит за раз

Кроме текста и картинок, модель принимает звуковые файлы и видео.

В один запрос помещается до миллиона токенов, а ответ бывает длиной до 64 тысяч.

Отвечает она только текстом. Картинки в каталоге рисуют другие модели.

Что у Gemini 3.6 Flash выросло против Gemini 3.5 Flash и Gemini 3.1 Pro

Во всех строках таблицы замеров новая модель стоит выше прошлой Flash.

Заметнее всего разница в двух местах: машинное обучение — 63,9 процента против 49,7, и поиск нужного куска в тексте длиной в миллион токенов — 54 процента против 26,6.

Заявленный миллион токенов и умение находить в этом миллионе нужное — разные вещи, и вторая пара чисел это показывает.

Прошлую старшую модель ряда, Gemini 3.1 Pro, новая Flash обходит тоже по всем строкам.

Что показали независимые проверки Gemini 3.6 Flash

Замеры выше — собственные числа разработчика. Со стороны выпуски ряда расставляет текстовая арена LMArena: там человеку показывают два ответа без имён моделей и просят выбрать лучший, а из этих выборов складывается оценка. На снимке 15 сентября 2026 года таблица обновлена 13 сентября и собрана из 8 146 274 голосов.

Строки ряда Flash стоят в ней ровно по номерам выпусков: у сентябрьской модели 1493 очка, у августовской 1490, у этой модели 1480 при 26 445 голосах, у майской 1478, у декабрьской 1474. Разрыв между соседними выпусками — от 2 до 10 очков, и он укладывается в доверительный интервал площадки или стоит на его границе.

Вторая арена той же площадки замеряет работу с картинкой на входе. В арене с картинками у этой модели 1283 очка при 5 159 голосах, а у прошлого выпуска ряда — 1284 при 9 579: разница в одно очко при разбросе ±10 и ±8, то есть выпуски стоят вровень.

Две оговорки к этим числам. Голоса собраны на произвольных запросах людей, а не на наборе задач с известным ответом, и уровень обдумывания в арене не назван. И ни один из голосов не собран через GEN202: таблицы чужие, мы их только читаем.

Чего нет в описании Gemini 3.6 Flash, но видно за работой

Разработчик перечисляет, что модель принимает и что умеет. Как этот материал разбирается на деле, в описании не сказано.

  • В расшифровке длинной записи отметки времени уезжают тем сильнее, чем дальше от начала. Сами слова при этом распознаны верно — расходится их привязка к месту.
  • Из разбора длинной записи молча пропадает целый кусок, а ответ выглядит законченным. Пропажу находят только сличением с исходником.
  • Один и тот же материал, отправленный дважды, разбирается по-разному: то один кусок повторяется много раз подряд, то разбор обрывается раньше конца.
  • Дословное место модель иногда заменяет строкой о том, что там сказано. Когда нужны сами слова, это оговаривают в задании.
  • Со снимка читаются не только надписи: по рисунку графика модель восстанавливает числа и называет, чем именно он вводит в заблуждение.
  • Труднее всего на снимке даётся таблица — не сами слова, а связь строки со столбцом.
  • Подробность, с которой модель разглядывает картинку, бывает разной, и правкой формулировки задания низкую подробность не выправить.
  • Перечислить увиденное на снимке модель может, а показать каждый предмет по отдельности — уже не всегда.
  • Задание из двух условий выполняется наполовину и молча: ответ приходит верный, а второе условие обходится стороной.
  • Границы задания она держит точно — не переименовывает и не трогает лишнего, — но точность формы не означает верности по существу.

Отсюда простое правило работы: длинный ответ сверяют с исходником, а не принимают по виду законченности.

До какого времени Gemini 3.6 Flash знает мир

Отсечка знаний названа двумя датами сразу.

Верхняя граница — март 2026 года.

По части областей знания заканчиваются гораздо раньше, на январе 2025 года, а списка таких областей нигде нет.

Март 2026 — это потолок, а не обещание по любой теме.

Что Google называет недоработанным у Gemini 3.6 Flash

Устойчивость к попыткам обойти ограничения модели дорабатывается до сих пор, и защиту недавно усилили.

По собственной проверке тона новая модель немного уступила прошлой — на 3,31 процента, — и на общей безопасности это не сказалось.

Проверки эти автоматические: ни живых людей, ни попыток сломать модель вручную в них не было.

Отдельной строкой в карточке стоит оговорка про время ответа: «There may also be occasional slowness or timeout issues». Перевод наш: «Случаются также замедления и обрывы по времени ожидания». Отсюда рабочая привычка — важный вызов повторяют, а не считают отказ по времени концом дела.

Рубли в лиде и в таблице выше — цены GEN202, сервиса доступа к моделям с оплатой из России; доллары Google стоят рядом только для сравнения. Что входит в кредит и какими пакетами он пополняется, разобрано на странице цен.

Официальный канал Google — случай заказчика, а не показ модели: фермер из Мичигана собирает на Gemini 3.6 Flash панель учёта для своего хозяйства. Снято Google 22 июля 2026 года, идёт две с половиной минуты.

Частые вопросы

Как вызвать Gemini 3.6 Flash через API из России?
Запрос уходит на api.gen202.com, и это адрес GEN202, а не адрес Google: обращения за границу в вызове Gemini 3.6 Flash нет, поэтому VPN не требуется. В поле model уходит идентификатор gemini/3-6-flash. Порядок вызова Gemini 3.6 Flash с примерами кода разобран в документации.
Сколько стоит Gemini 3.6 Flash
Цена за миллион токенов Gemini 3.6 Flash — от 346 кр. (173 ₽ · $1.73) за вход в Gemini 3.6 Flash до 1731 кр. (865,5 ₽ · $8.655) за выход. У Gemini 3.6 Flash списывается фактический расход, а задача, завершившаяся ошибкой, не тарифицируется вовсе.
Нужны ли VPN и иностранная карта для Gemini 3.6 Flash
Ни то, ни другое: обращение к Gemini 3.6 Flash идёт на наш адрес, а расчёты с Google ведём мы, поэтому договариваться с ним клиенту не о чем. Оплата рублями с карты российского банка.
Что Gemini 3.6 Flash принимает на вход
Обязательные поля запроса к Gemini 3.6 Flash: model — идентификатор модели; messages — переписка списком сообщений. Остальные поля необязательны.
Как подключить Gemini 3.6 Flash API и сделать первый вызов
Войти на сайт и выпустить ключ в кабинете: при первом входе начисляется 50 кредитов, и этот же ключ открывает Gemini 3.6 Flash вместе с остальным каталогом. Собственного ключа Google и договора с ним для вызова Gemini 3.6 Flash не нужно.