Gemini Omni 1.1 Flash API
Одной моделью делает и ролик по описанию, и ролик из присланного изображения. Разрешение 360p, 720p, 1080p, 4k, соотношение сторон 16:9, 9:16, на вход до 7 изображений, описание до 20 000 символов. Модель Google.
Gemini Omni 1.1 Flash API работает в России без VPN: один API ключ GEN202, оплата рублями с российской карты.
Цена: за генерацию, 1080p — от 81.9 кр. (40,95 ₽ · $0.4095), 4K — от 191.1 кр. (95,55 ₽ · $0.9555).
кр. — кредиты, покупаются за рубли.
работает
Песочница
Ещё настройки
Чтобы создать видео — войдите и получите 50 кредитов на тесты и любое использование сервиса.
{ "model": "gemini-omni/flash-1-1", "input": { "prompt": "Рыжий кот в скафандре на фоне Земли, мягкий свет", "duration": "4", "aspect_ratio": "16:9", "resolution": "360p" } }
Нажмите «Запустить» — готовый ролик появится здесь
Ролик делается минуты. Задача живёт не дольше 60 минут, после чего шлюз закрывает её сам и возвращает удержание целиком.
{
"code": 200,
"msg": "success",
"data": {
"taskId": "cm8r4t0vk0001s60p2xq7f9ab",
"model": "gemini-omni/flash-1-1",
"state": "success",
"resultJson": "{\"resultUrls\":[\"https://file.example/result.mp4\"]}",
"failCode": "",
"failMsg": "",
"creditsConsumed": 81.9
}
}
Цена Gemini Omni 1.1 Flash
Цена за генерацию. Списывается фактический расход, о котором сообщил поставщик.
| Вариант | Наша цена |
|---|---|
| 4 с, до 1080p | 81.9 кр. $0.409540,95 ₽ |
| 6 с, до 1080p | 109.2 кр. $0.54654,6 ₽ |
| 8 с, до 1080p | 136.5 кр. $0.682568,25 ₽ |
| 10 с, до 1080p | 163.8 кр. $0.81981,9 ₽ |
| 4 с, 4k | 191.1 кр. $0.955595,55 ₽ |
| 6 с, 4k | 218.4 кр. $1.092109,2 ₽ |
| 8 с, 4k | 245.7 кр. $1.2285122,85 ₽ |
| 10 с, 4k | 273 кр. $1.365136,5 ₽ |
кр. — кредиты, покупаются за рубли.
На время работы шлюз удерживает ставку выбранного разрешения, умноженную на запрошенную длительность; больше 273 кредита по этой модели он не удержит ни при каком запросе (цена фиксирована за ролик). Разница между удержанием и фактическим расходом возвращается на баланс тем же запросом состояния, который увидел итог.
Вызов через API
Ролик делается минуты, поэтому файл не приходит в ответ на запрос. Первый вызов
ставит задачу и сразу отвечает её номером, второй по этому номеру отдаёт состояние задачи, а когда
она готова — ссылку на результат. Ключ передаётся в обоих запросах заголовком
Authorization: Bearer sk-… и выпускается
в кабинете. На один ключ шлюз пропускает
30 постановок задачи и 300
запросов состояния в минуту.
Поля запроса
Значения проверяются до обращения к поставщику: поле не из списка модели или значение вне
перечисления возвращают 422 и кредитов не тратят.
| Поле | Тип | Обяз. | Допустимые значения |
|---|---|---|---|
| model | текст | обязательное | gemini-omni/flash-1-1 |
| input | объект | обязательное | Параметры генерации — поля из таблицы ниже |
Поля input
| Поле | Тип | Обяз. | Допустимые значения |
|---|---|---|---|
| prompt | текст | обязательное | от 1 до 20 000 символов |
| duration | значение из списка | обязательное | 4 · 6 · 8 · 10 |
| image_urls | список ссылок | опц. | до 7 ссылок на изображение |
| first_frame_url | ссылка | опц. | одна ссылка на изображение |
| last_frame_url | ссылка | опц. | одна ссылка на изображение |
| aspect_ratio | значение из списка | опц. | 16:9 · 9:16 |
| resolution | значение из списка | опц. | 360p · 720p · 1080p · 4k |
| seed | целое число | опц. | целое от 0 до 2 147 483 647 |
Ссылка на изображение принимается только полным адресом на http или https: не длиннее 2048 символов, на общедоступном сайте, без имени и пароля перед адресом и без порта, кроме 80 и 443. Относительный путь, а также адреса внутри сети — localhost, 127.0.0.1, 10.0.0.5, 192.168.1.2 — и имена без точки шлюз отклоняет ответом 422, к поставщику не обращаясь.
Ответ
Оба запроса отвечают одним конвертом: {"code":…,"msg":…,"data":…}, где
code повторяет HTTP-статус, а полезное лежит в
data. Тот же конверт приходит и при отказе — разбирать две формы ответа
не нужно.
/api/v1/jobs/createTask
| Поле | Тип | Что в нём |
|---|---|---|
| data.taskId | строка | Номер задачи. Больше в ответе ничего нет и быть не может — работа только началась. |
/api/v1/jobs/recordInfo
| Поле | Тип | Что в нём |
|---|---|---|
| data.taskId | строка | Номер задачи — тот же, что вернул createTask. |
| data.model | строка | Имя модели в том виде, в каком его прислал клиент. |
| data.state | строка | Состояние задачи: waiting, queuing, generating, success или fail. |
| data.param | строка | Параметры, с которыми задача создана, — строкой JSON внутри JSON. |
| data.resultJson | строка | Результат строкой JSON внутри JSON: {"resultUrls":["https://…"]} — разбирается вторым разбором. До завершения задачи — пустая строка. |
| data.failCode | строка | Код неудачи из таблицы ниже. У остальных задач — пустая строка. |
| data.failMsg | строка | Причина неудачи словами. Иначе пустая строка. |
| data.costTime | число | Сколько задача заняла, миллисекунды. Пока не завершилась — null. |
| data.completeTime | число | Когда завершилась, миллисекунды эпохи Unix. Пока не завершилась — null. |
| data.createTime | число | Когда создана, миллисекунды эпохи Unix. |
| data.updateTime | число | Когда состояние менялось в последний раз, миллисекунды эпохи Unix. |
| data.creditsConsumed | число | Сколько кредитов списано. Ноль, пока задача не завершилась, и ноль у неудачной. |
Состояния задачи
Состояние лежит в поле state ответа
/api/v1/jobs/recordInfo. Первые три означают, что работа идёт: запрос надо
повторить примерно через 3 секунды — чаще спрашивать нечего, столько же
ждёт между опросами сам шлюз. Два последних состояния окончательные: после них задача не меняется.
| state | Что происходит |
|---|---|
| waiting | Задача принята и стоит в очереди шлюза; поставщику она ещё не отправлена. |
| queuing | Поставщик задачу принял и поставил в свою очередь. |
| generating | Генерация идёт. |
| success | Готово: ссылки на результат лежат в resultJson, в creditsConsumed — сколько списано. |
| fail | Задача не удалась: причина в failCode и failMsg, удержанные кредиты возвращены целиком. |
Опрос не бывает бесконечным: задача на видео живёт не дольше 60
минут, после чего шлюз закрывает её сам состоянием fail и возвращает
удержанные кредиты целиком. Причина неудачи приходит двумя полями:
failCode из таблицы ниже и failMsg словами.
| failCode | Что произошло |
|---|---|
| 501 | Поставщик вернул отказ: генерация не удалась. |
| 408 | Результата нет дольше крайнего срока задачи (60 минут для видео). |
| 404 | Поставщик не знает такой задачи. |
| 429 | Поставщик отбил создание задачи по своему лимиту. |
| 500 | Поломка на нашей стороне; подробности остаются в журнале шлюза. |
Ссылка на готовый файл живёт 14 дней — столько его хранит поставщик. Файл,
который нужен дольше, скачивайте к себе сразу после того, как задача пришла в состояние
success.
Отказы
Тело отказа одно на все случаи: {"code":…,"msg":…,"data":null}. Задача, не
дошедшая до результата, не тарифицируется — удержанные кредиты возвращаются целиком.
| Код | Адрес | Когда |
|---|---|---|
| 400 | /api/v1/jobs/createTask | Тело запроса — не разбираемый JSON. |
| 401 | /api/v1/jobs/createTask | Ключа нет в заголовке Authorization, либо он неверный или отключён. |
| 402 | /api/v1/jobs/createTask | Свободных кредитов меньше, чем удерживается под задачу. |
| 403 | /api/v1/jobs/createTask | Аккаунт заблокирован: вызовы модели, пополнение и загрузка файлов ему закрыты. Ключи при этом не отключены — запрет лежит на аккаунте. |
| 413 | /api/v1/jobs/createTask | Тело запроса больше 512 КиБ. |
| 415 | /api/v1/jobs/createTask | Тело отправлено не как application/json или заголовок Content-Type не передан. |
| 422 | /api/v1/jobs/createTask | Поле model пустое или его имени нет в каталоге, input — не объект, поле не из списка модели либо значение вне её перечисления. В сообщении перечислено, что принимается. |
| 429 | /api/v1/jobs/createTask | Больше 30 запросов в минуту на один ключ либо больше 50 незавершённых задач на аккаунте. |
| 500 | /api/v1/jobs/createTask | Поломка на нашей стороне. Подробности остаются в журнале шлюза и наружу не уходят. |
| 401 | /api/v1/jobs/recordInfo | Ключа нет в заголовке Authorization, либо он неверный или отключён. |
| 404 | /api/v1/jobs/recordInfo | Задачи с таким номером нет или она создана другим аккаунтом. |
| 422 | /api/v1/jobs/recordInfo | Параметр taskId не передан. |
| 429 | /api/v1/jobs/recordInfo | Больше 300 запросов в минуту на один ключ. |
| 500 | /api/v1/jobs/recordInfo | Поломка на нашей стороне. Подробности остаются в журнале шлюза и наружу не уходят. |
Пример вызова
# 1. Поставить задачу — в ответе придёт её номер
TASK=$(curl -s https://api.gen202.com/api/v1/jobs/createTask \
-H "Authorization: Bearer sk-ваш-ключ" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-omni/flash-1-1",
"input": {
"prompt": "Рыжий кот в скафандре на фоне Земли, мягкий свет",
"duration": "4",
"aspect_ratio": "16:9",
"resolution": "360p"
}
}' | jq -r '.data.taskId')
# 2. Спрашивать состояние, пока задача не закончится: waiting, queuing и
# generating означают «работа идёт», success и fail — окончательные
while true; do
RECORD=$(curl -s "https://api.gen202.com/api/v1/jobs/recordInfo?taskId=$TASK" \
-H "Authorization: Bearer sk-ваш-ключ")
STATE=$(echo "$RECORD" | jq -r '.data.state')
case "$STATE" in success|fail) break;; esac
sleep 3
done
# 3. Забрать результат. Ссылка на файл лежит в resultJson — это строка JSON
# внутри JSON, поэтому её разбирают вторым разбором (fromjson)
echo "$RECORD" | jq -r '.data |
if .state == "fail"
then "отказ \(.failCode): \(.failMsg)"
else .resultJson | fromjson | .resultUrls[0]
end'
import json
import time
import requests
headers = {"Authorization": "Bearer sk-ваш-ключ"}
# 1. Поставить задачу — в ответе придёт её номер
created = requests.post(
"https://api.gen202.com/api/v1/jobs/createTask",
headers=headers,
json={
"model": "gemini-omni/flash-1-1",
"input": {
"prompt": "Рыжий кот в скафандре на фоне Земли, мягкий свет",
"duration": "4",
"aspect_ratio": "16:9",
"resolution": "360p"
}
},
).json()
task_id = created["data"]["taskId"]
# 2. Спрашивать состояние, пока задача не закончится: waiting, queuing и
# generating означают «работа идёт», success и fail — окончательные
while True:
task = requests.get(
"https://api.gen202.com/api/v1/jobs/recordInfo",
headers=headers,
params={"taskId": task_id},
).json()["data"]
if task["state"] in ("success", "fail"):
break
time.sleep(3)
# 3. Разобрать итог. У неудачи причина в failCode и failMsg
if task["state"] == "fail":
raise SystemExit("отказ " + task["failCode"] + ": " + task["failMsg"])
# resultJson — строка JSON внутри JSON, поэтому разбор второй
result = json.loads(task["resultJson"])
print(result["resultUrls"][0])
print("списано кредитов:", task["creditsConsumed"])
Пример проходит весь путь: ставит задачу, повторяет запрос состояния раз в
3 секунды, пока задача не закончится, и разбирает ответ до ссылки
на файл. Разборов два, потому что поле resultJson — строка JSON
внутри JSON. В теле первого запроса стоят обязательные поля модели и значения из её
перечислений, поэтому он проходит проверку шлюза как есть.
Подставить остаётся только свой ключ.
Пример на оболочке разбирает ответ через jq; на Python своего
ничего не нужно, кроме requests.
Остальные модели этого семейства и их поля — в разделе документации Видео.
Что делает нейросеть Gemini Omni 1.1 Flash
Gemini Omni 1.1 Flash — видеомодель Google, выпущенная в общий доступ 27 августа 2026 года. Цена у GEN202 — от 40,95 ₽ до 136,5 ₽ за генерацию, и назначают её вместе выбранные длительность и разрешение. Ролик со звуком модель снимает по описанию, а рядом с описанием принимает картинки-образцы и пару кадров, начальный и конечный. Работы у модели две — видео из текста и видео из изображения, и обе заказываются одним и тем же вызовом.
У Google та же модель названа gemini-omni-1.1-flash, и под этим именем она разобрана в его справочнике. В поле model уходит gemini-omni/flash-1-1.
Звук модель пишет сама вместе с изображением, и задают его тем же описанием. Какая нужна музыка и какие слышны шумы, называют там же, где названо действие.
Платят здесь за ролик целиком: сумма его известна ещё до запуска. Тело запроса по полям собрано в разделе «Gemini Omni».
Как заказать ролик в Gemini Omni 1.1 Flash
Считает ролик Google, а запрос к нему идёт через нас — работа целиком на его стороне. Поля заполняют в песочнице, и готовый ролик открывается прямо в ней, откуда сохраняется файлом.
Сумма известна до запуска целиком: длительность и разрешение выбраны заранее, а на их пару в каталоге приходится своя цена. Все 8 строк стоят в таблице цен выше.
Картинки прикладывают ссылкой, открытой снаружи: по ней модель и забирает файл. Съёмка по одному описанию и съёмка с образцами идут одним и тем же путём — различие только в том, какие поля заполнены.
- Опишите сцену. Под описание отведено до 20 000 знаков: место, герои, действие, работа камеры и то, что слышно.
- Приложите картинки. Образцы кладут списком image_urls — до 7 ссылок. Вместо списка ставят пару кадров: ссылку на первый и ссылку на последний.
- Выберите длительность. В поле duration ставят одно значение из списка: 4, 6, 8 и 10 секунд.
- Выберите разрешение. Значений 4 — от 360p до 4k, и вместе с длительностью разрешение определяет сумму за ролик.
- Закрепите удачный заход. Поле seed повторяет прежний запуск: совпадение оно делает вероятнее, а последнее слово остаётся за моделью.
Чем Gemini Omni 1.1 Flash отличается от посекундных моделей каталога
Устройство модели проще читать по столбцам: слева названо то, что задают в запросе, справа — как это выглядит у Gemini Omni 1.1 Flash и у посекундного соседа по каталогу.
| Что задают | Gemini Omni 1.1 Flash | MiniMax H3 |
|---|---|---|
| Единица счёта | ролик целиком | секунда готового ролика |
| Длительность | 4, 6, 8 и 10 секунд на выбор | целое число от 4 до 15 секунд |
| Разрешения | 360p, 720p, 1080p и 4k | 768P и 2K |
| Формы кадра | 16:9, 9:16 | 21:9, 16:9, 4:3, 1:1, 3:4, 9:16 |
| Обязательные поля | prompt и duration | prompt, duration и aspect_ratio |
| Образцы и кадры | до 7 картинок либо пара кадров | задаются в соседних режимах страницы |
Строк в таблице цен 8 — по одной на каждое сочетание длительности и разрешения, и растут они ступенями. Удержание до запуска равно сумме этого самого ролика: она известна заранее, и пересчитывать по факту нечего.
Все разрешения ниже старшего собраны в таблице одной строкой, а своя сумма назначена только 4k. Черновой прогон на самом низком разрешении поэтому обходится в ту же сумму, что и чистовой на 1080p, а выигрыш от него — во времени расчёта.
Посекундные соседи устроены иначе: там ставку умножают на заказанные секунды, а до запуска откладывают потолок. Как это выглядит у одного из них, видно на странице MiniMax H3.
Выпуски Gemini Omni: имена у Google и даты
У Google каждый выпуск этой модели зовётся своим именем. В таблице собраны эти имена, даты объявлений, суть каждого шага и то имя, которое уходит в поле model у GEN202.
| Имя у Google | Дата по анонсу | Что изменилось | Имя для поля model |
|---|---|---|---|
| gemini-omni-1.1-flash | 27 августа 2026 | Общий доступ: первый и последний кадр в запросе, выбор разрешения от 360p до 4k | gemini-omni/flash-1-1 |
| gemini-omni-flash-preview | 30 июня 2026 | Первый выпуск для разработчиков: ролики от 3 до 10 секунд в 720p | — |
Дата общего доступа стоит в заметках о выпусках отдельным разделом «August 27, 2026»: «Gemini Omni Flash generally available (GA): Released gemini-omni-1.1-flash, the GA version of our fast, conversational video generation and editing model». Перевод наш: «Gemini Omni Flash выпущена в общий доступ: вышла gemini-omni-1.1-flash, общедоступная версия нашей быстрой модели генерации и правки видео разговором». Страница — заметки о выпусках Gemini API.
Там же назван срок прежнего адреса: «The existing gemini-omni-flash-preview endpoint will be deprecated on September 30, 2026». Перевод наш: «Действующий адрес gemini-omni-flash-preview будет выведен из употребления 30 сентября 2026 года». Прочерк во второй строке таблицы стоит именно поэтому: в поле model у GEN202 уходит имя нынешнего выпуска.
Что прибавилось в этом выпуске по части разрешений, в тех же заметках сказано дословно: «Resolution control: New resolution parameter in video_config supports 360p, 720p (default), 1080p, and 4k outputs. 1080p and 4K outputs are generated using upscaling». Перевод наш: «Управление разрешением: новый параметр resolution в video_config принимает 360p, 720p (по умолчанию), 1080p и 4k; 1080p и 4K получаются увеличением». Тот же набор из таблицы полей выше — 360p, 720p, 1080p и 4k.
Какой длины выходит ролик Gemini Omni 1.1 Flash и в каком разрешении
Длину ролика задают одним из готовых значений — 4, 6, 8 и 10 секунд. Поле это обязательное, и вместе с разрешением оно назначает сумму за ролик.
Разрешений 4: 360p, 720p, 1080p и 4k. Младшее разработчик отводит под черновик, а два старших называет подъёмом готовой картинки — за ними идут, когда сцена уже сложилась.
Форм кадра 2: 16:9, 9:16. Широкий кадр стоит значением по умолчанию, вертикальный называют отдельно — им снимают ролик под телефон.
Момент события внутри ролика называют прямо в описании обычными словами: через сколько секунд оно происходит и что случается следом. Тот же порядок разработчик принимает и разметкой отрезками времени в квадратных скобках.
Что кладут в запрос Gemini Omni 1.1 Flash кроме описания
Обязательных полей 2: prompt и duration. Под описание отведено до 20 000 знаков, и там же говорят, что должно звучать.
Образцы кладут списком image_urls — до 7 ссылок на картинки. По ним модель берёт героя, обстановку или манеру съёмки и переносит их в готовый ролик.
Начальный и конечный кадр приходят каждый своей ссылкой: first_frame_url задаёт первый кадр ролика, last_frame_url — последний. Конечный кадр ставят вместе с начальным, а переход между ними описывают словами.
Список образцов и первый кадр принимаются порознь: в запросе стоит либо одно, либо другое. Служебное поле seed закрепляет удачный заход, а имена всех полей и их пределы стоят в таблице выше.
Что Google говорит о модели Gemini Omni 1.1 Flash
Как устроена модель, сказано в справочнике: «Native multimodality: it processes text, image, audio, and video simultaneously, giving you more cohesive, consistent, and controllable output». Перевод наш: «Родная многомодальность: модель обрабатывает текст, картинку, звук и видео одновременно, поэтому результат выходит более цельным, согласованным и управляемым». Там же про звук: «The model generates a video with audio based on your text description» — перевод наш: «Модель порождает видео со звуком по вашему текстовому описанию». Страница — справочник Google по Gemini Omni Flash.
Про пару кадров Google пишет в анонсе выпуска: «Achieve smooth transitions and camera movements by specifying the starting and ending frames of a shot». Перевод наш: «Плавные переходы и движения камеры получаются, если задать первый и последний кадр плана». Страница — анонс «Build with Gemini Omni 1.1 Flash».
Сколько планов выходит без особой просьбы, в справочнике Gemini Omni Flash сказано прямо: «By default Omni Flash will try to create a video with a few different shots». Перевод наш: «По умолчанию Omni Flash попробует сделать видео из нескольких разных планов». Один непрерывный план там просят словами в самом описании.
Про пометку готового ролика тот же справочник по модели говорит: «All generated videos include SynthID watermarking, which is invisible to viewers but can be detected programmatically for provenance verification». Перевод наш: «Во все созданные ролики вшит водяной знак SynthID: зрителю он не виден, но его можно обнаружить программно и подтвердить происхождение».
Свою цену Google считает за токены, и сноска под таблицей переводит её в секунды: «Billing is based on total output token consumption, calculated at a rate of 5,792 tokens per second of 720p video. Under Standard pricing, this equates to an effective price of approximately $0.10 per second». Перевод наш: «Счёт считается по общему расходу выходных токенов из расчёта 5 792 токена на секунду видео 720p. По обычному тарифу это даёт итоговую цену около 0,10 $ за секунду». Страница — страница цен Gemini API.
Счёт у GEN202 устроен иначе: Google считает по токенам за секунду, а здесь цена назначена за ролик целиком и известна до запуска — все 8 строк стоят в таблице цен выше. Про черновик в младшем разрешении Google в анонсе пишет «at a third of the cost» — перевод наш: «втрое дешевле», — а в GEN202 разрешения ниже старшего стоят по одной цене.
Слова Google о Gemini Omni приведены по его страницам на 14 сентября 2026 года.
Где Google сам очерчивает границу
Настройки вроде системной подсказки, температуры и отдельного поля под запреты разработчик оставляет за рамками этого вызова. Всё, чего в кадре быть не должно, пишут обычными словами в самом описании.
Узнаваемых людей на присланных картинках разработчик оставляет за границей вызова, и защитная проверка стоит и на описании, и на готовом ролике.
Звуковые образцы разработчик оставляет на будущее: в этой версии вызова звук задают описанием.
Длина ролика назначается до запуска и выбирается из готовых значений. Продление готового ролика в каталоге делает Veo, и разобрано оно на странице Veo.
Что показали независимые проверки Gemini Omni 1.1 Flash
Слепые сравнения LMArena дают модели свои строки: человеку показывают два ролика без имён моделей и просят выбрать лучший. В арене «картинка в видео» у gemini-omni-1.1-flash стоит 1488 с допуском 11 при 3 731 голосе, у прошлого выпуска, gemini-omni-flash, — 1464 с допуском 6 при 80 749. В арене «текст в видео» у gemini-omni-1.1-flash — 1515 с допуском 16 при 1 777 голосах, у gemini-omni-flash — 1511 с допуском 10 при 21 934. Числа Gemini Omni взяты из таблиц — арена «картинка в видео» и арена «текст в видео» на LMArena.
Первый разбор — ролик Tim Harris AI «Gemini Omni Flash 1.1: I Tested Every New Feature» от 5 сентября 2026 года: автор прогоняет одно и то же описание на этой модели и на Seedance 2.5. Итог он сводит так: «So, is Gemini Omni 1.1 flash better than SeaDance 2.5? Not necessarily. SeaDance still edges Gemini Omni on its raw physical realism, particularly with complicated movement, but Gemini wins on control and workflow». Перевод наш: «Лучше ли Gemini Omni 1.1 Flash, чем Seedance 2.5? Не обязательно. Seedance всё ещё впереди по чистому физическому правдоподобию, особенно на сложном движении, а Gemini выигрывает в управлении и в порядке работы». Имя Seedance автоматические субтитры передают как «SeaDance». Ролик — проверка всех новых возможностей Omni 1.1.
Про пару кадров тот же автор говорит: «There's still a few things that get lost in the detail there, but look at how it actually finds a believable visual path from one completely different image into the other». Перевод наш: «Кое-что в деталях там теряется, но посмотрите, как она находит правдоподобный визуальный путь от одной совершенно другой картинки к другой». Про черновики он добавляет: «Instead of waiting for your drafts to generate at full resolution, I can rapidly create several versions at just 360p in quick time» — перевод наш: «Вместо ожидания черновиков в полном разрешении я быстро делаю несколько вариантов в 360p».
Второй разбор — ролик Oprelia AI «Gemini Omni 1.1 Flash Is Fast — But Is It Good?» от 29 августа 2026 года, снятый в кабинете сторонней площадки. Про картинку-образец там сказано: «there was a reference image that I tried to use from a thumbnail of my last thing. It totally ignored that». Перевод наш: «Я пробовал дать картинку-образец — обложку прошлого ролика. Она её полностью проигнорировала». Ролик — проверка скорости и качества Omni 1.1.
Там же автор отделяет, чего он на этой модели делать не стал бы: «And honestly, like I wouldn't do anything actionbased with Gemini Omni Flash on 2D based on this test alone here». Перевод наш: «Честно, по одному этому прогону я бы не стал делать на Gemini Omni Flash ничего с действием в 2D». Про число подходов он говорит прямо по ходу работы: «Here's another try which ended up being bit better» — перевод наш: «Вот ещё одна попытка, вышло чуть лучше».
Предел длины в том разборе назван так: «10 seconds which is still the limit by the way which is extremely limiting» — перевод наш: «десять секунд, которые по-прежнему остаются пределом, и это сильно связывает руки». В форме GEN202 стоит та же верхняя отметка: длительность выбирают из готовых значений — 4, 6, 8 и 10 секунд.
Оба ролика о Gemini Omni приведены на 14 сентября 2026 года, числа арен — на 21 сентября.
Что видно на работе с Gemini Omni 1.1 Flash
Справочник разработчика и его руководство по работе с видео в Gemini API описывают поля и приёмы. Ниже собрано то, что всплывает уже на работе: чем черновик отличается от чистового прогона и как просят поправить одну вещь.
- Повторный запуск того же описания даёт другой ролик: черновик на низком разрешении и чистовой прогон — это две разные сцены, а не одна в двух качествах.
- Поле seed делает совпадение вероятнее: Google называет его способом повторить результат, а последнее слово оставляет за моделью.
- Правку просят по одной вещи за раз: называют, что меняется, и добавляют, что всё остальное сохраняется. Длинное переписывание всего замысла уводит картинку целиком.
- Простое описание правки срабатывает точнее подробного: разработчик просит писать коротко именно здесь, а не в первом описании сцены.
- Длину ролика выбирают до того, как собраны кадры: она стоит в запросе готовым значением и задаётся на весь прогон сразу.
Порядок работы из этого складывается такой: черновик на низком разрешении под проверку замысла, короткая правка одной вещи и чистовой прогон, который сам по себе даёт новую сцену. Длину планируют в самом начале, потому что продление готового ролика живёт у моделей Veo.