Читайте нас в Telegram или Макс

Как оживить фото в Google Omni: подробная инструкция для России и доступ без VPN

Наткнулся на Gemini Omni Flash — первую модель нового семейства Omni от Google DeepMind. Модель совсем свежая: часть функций у меня еще была в превью, а API появился только в конце июня 2026 года.

Заметил, что Google уже заменил Veo 3.1 на Omni — так что если открываете Gemini и генерируете видео, вы уже работаете с Omni.

Первое, что меня зацепило, когда я разбирался, как оживить фото, — «any-to-any» трансформер: модель принимает текст, изображения, аудио и видео, обрабатывает все через языковую модель с пониманием мира и только потом генерирует видео.

Модель понимает содержимое фото семантически, а не просто анимирует пиксели — она знает, что кот является живым существом с определенными паттернами движения, а ткань и волосы подчиняются гравитации.

Рассказываю, как я разобрался с новой моделью и без труда стал оживлять в ней фото. Делюсь инструкцией, промптами и способами использовать Omni без VPN.

Самое насущное — есть ли доступ из России

К сожалению, Gemini в России не открывается без дополнительных инструментов, причем у меня сайт порой не открывался даже с ними. Мне не хотелось разбираться с обходами и экспортными ограничениями Google, поэтому я пошел через российские агрегаторы, у меня их несколько.

Например, можно оживить фото через SpeShu.AI: своя точка доступа, оплата в рублях, без иностранной карты. Также там есть аналоговые модели: SpeShu Claude, SpeShu Gemini, SpeShu ChatGPT. Они не уступают официальным моделям и при этом работают без дополнительных инструментов, оплачиваются картой банков РФ и стоят дешевле.

Технические характеристики Omni

Максимальная длина клипа сейчас 10 секунд — по словам Google, в будущих обновлениях длина будет расти. Аудио генерируется нативно за один проход, а редактировать результат можно в разговорном формате: я описывал нужное изменение следующим сообщением в чате, и модель применяла его.

Не обошлось и без мелких разочарований: консистентность страдает при многошаговых правках, и каждое новое редактирование может частично нарушить предыдущее; сложные сцены с быстрым движением нескольких объектов даются хуже; точный рендеринг (понимание и визуализация) текста остается проблемой вообще для многих нейросетей.

Обход, который я нашел случайно

Оказалось, Gemini Omni Flash доступен бесплатно прямо внутри YouTube Shorts и приложения YouTube Create. Да, YouTube в России работает с ограничениями, но все же доступен, и это оказался самый дешевый формально бесплатный вход в Omni. Правда, только для контента, который публикуется в YouTube.

Тарифы Gemini Omni: бесплатно и платно

Важная особенность, которую я для себя отметил: отдельной подписки только на Omni не существует — модель включена в тарифы Google AI Plus, Pro и Ultra без дополнительной платы.

  • Тариф AI Plus стоит $4,99 в месяц — цену снизили с $7,99 8 июня 2026 года — и дает 200 AI-кредитов в месяц для Flow и Whisk, а также 400 ГБ хранилища; я для себя определил это как минимальный вход в Omni через приложение Gemini.
  • AI Pro за $19,99 в месяц, с 50-процентной скидкой на первый год для новых подписчиков, дает 1000 AI-кредитов в месяц, 5 ТБ хранилища, доступ к Gemini Omni для видео, безлимитную генерацию слайдов и полное контекстное окно на 1 миллион токенов — я выбрал бы именно этот тариф для регулярного использования.
  • AI Ultra стоит $99,99 в месяц — снижение с $249,99, объявленное на I/O 2026, — и дает максимальные лимиты вместе с ранним доступом к новым моделям.

Кредитная система не самая щедрая: я подсчитал, что два видео в Omni Flash расходуют около 86% дневной квоты на тарифе Pro, то есть получается 2–3 видео в день. Для регулярного контента это заметно ограничивающий фактор.

На бесплатном тарифе я нашел чат на Gemini 3.6 Flash, ежедневную квоту Gemini 3.1 Pro для сложных задач, генерацию изображений через Nano Banana 2 и до пяти отчетов Deep Research в месяц, но видео через Omni в приложении Gemini на бесплатном тарифе оказалось недоступно вовсе — бесплатный путь остается только через YouTube.

Разговорное редактирование — что меня больше всего впечатлило

Этого нет ни у Kling, ни у WAN, ни у Hailuo. Я уже пробовал стандартный процесс в Kling: загружаешь фото, пишешь промпт, получаешь видео, а если результат не понравился — генерируешь заново с нуля, и каждая новая попытка это отдельный запрос без гарантии, что результат станет лучше.

В Omni у меня дело пошло иначе: я загрузил фото, получил первый клип, а следующим сообщением написал что-то вроде «добавь больше движения» — модель применила именно это изменение, сохранив все остальное неизменным, а дальше я продолжал итерировать в том же треде: «теперь сделай взгляд немного правее» и так далее.

Для меня это было похоже на диалог с режиссером. Но если увлечься и закинуть много точечных правок, модель начнет путаться и сбиваться.

Промпты, которые я использовал, чтобы оживить фото

Я заметил, что Omni принимает запросы в свободной форме через обычный чат, а не через строгий синтаксис промпта, как у Kling или WAN. Для меня это одновременно и плюс — модель хорошо понимает естественный язык, — и минус, поскольку четкой структуры для запоминания здесь нет.

В первый запрос я стараюсь включать описание желаемого движения, атмосферу — свет и настроение — и явное указание, что должно остаться неизменным.

В последующих итеративных запросах у меня хорошо сработали точечные корректировки конкретного элемента, усиление или ослабление уже заданного эффекта, а также добавление звука или изменение характера движения.

1. Портрет с минимальным движением

text

Animate this photo gently. The person should blink once naturally, take a subtle breath, and make the smallest comfortable head movement. Keep lighting and expression true to the original. No dramatic changes.

2. Взгляд в камеру

text

The person in this photo slowly lifts their gaze to look directly at the viewer. Add one natural blink. Let the eyes soften slightly at the end. Preserve the original photo's warmth and style.

3. Оживить старое архивное фото

text

Bring this vintage photograph to life with the most subtle animation possible — a single slow blink, barely perceptible breathing, nothing more. Preserve the original monochrome tones and photographic grain. Do not modernize the appearance.

4. Лес или природа

text

Trees and leaves sway gently in a soft wind. Light filters through the canopy and shifts slightly. Birds or insects are not added. Preserve the color palette of the original image exactly.

5. Добавить звук (итеративная правка)

text

Add ambient outdoor sound to this video — soft wind through trees, distant birds, natural atmosphere. No music, no human voices.

Ограничения, с которыми я столкнулся

Есть запрет, о котором я узнал не сразу: нельзя синхронизировать губы статичного фото реального человека с аудиодорожкой — это прописано в карточке модели DeepMind как ограничение безопасности. Значит, Omni как минимум не заменяет Hedra или HeyGen, где такая функция доступна. Редактирование голоса тоже ограничено.

По своему опыту сравнения с конкурентами могу сказать: Omni выигрывает в семантическом понимании сцены и итеративном редактировании, но проигрывает Kling по фотореалистичной физике движения в сложных сценах. WAN при этом остается более дешевым и доступным из России вариантом, но без разговорного редактирования, которое я нашел только у Omni.

Что для меня стало главным открытием

Gemini Omni оказался единственным из инструментов, которые я пробовал (вместе с Kling, WAN, Hailuo и Haiper), который понимает контекст сцены через языковую модель до того, как начинает генерировать движение. Если на фото бабушка в одежде 1950-х годов, Omni знает, как люди двигались и выглядели в то время.

Если на фото кот смотрит за птицей, модель понимает охотничье поведение кошки как поведенческий паттерн, а не просто набор пикселей для анимации. Для себя я это сформулировал так: это не фильтр «добавить реализм», а именно семантическое понимание — то, что отличает Omni как «Gemini плюс видео» от WAN как специализированного видеогенератора без встроенного языкового рассуждения.

Итог

Gemini Omni приятно удивил меня инструментом, который сначала «думает» о содержимом снимка через языковую модель, а потом уже его оживляет, и именно разговорное итеративное редактирование сделало его для меня особенно удобным для точного результата. Доступ и оплата в рублях без дополнительных инструментов и разбора с экспортными ограничениями у меня получились через SpeShu.AI.

Сервис поделился промокодом для моих читателей. При пополнении баланса введите промокод KODTSNIS15 и получите +15% на счет агрегатора.

Реклама. ООО "ЦНИС", ИНН: 9704271170