18 сентября 2026

btc = 80 638.00$ 3 850.94 (4.91 %)

usd = 84.20 -0.31 (-0.37 %)

eur = 96.67 -0.83 (-0.85 %)

cny = 12.57 -0.01 (-0.09 %)

moex = 2 280.71 пт. 31.84 (1.42 %)

btc = 80 638.00$ 3 850.94 (4.91 %)

usd = 84.20 -0.31 (-0.37 %)

Как оживить фото в Google Omni: подробная инструкция для России и доступ без VPN

6 минут на чтение
Как оживить фото в Google Omni: подробная инструкция для России и доступ без VPN

Кодик кратко объясняет суть статьи

Появилась новая модель Google DeepMind — Gemini Omni Flash, которая заменила Veo 3.1 в Gemini и предназначена для генерации и редактирования видео. Модель работает по принципу «any-to-any», принимая текст, изображения, аудио и видео, и использует языковую модель для семантического понимания контента перед генерацией. Она способна оживлять фото, понимая природу объектов — например, движения животных или физику тканей — а не просто анимируя пиксели. Видео генерируются длиной до 10 секунд, с нативной аудиогенерацией. Ключевая особенность — разговорное редактирование: пользователь может уточнять изменения в чате (например, «добавь больше движения»), и модель вносит правки, сохраняя предыдущий результат. Это делает процесс похожим на диалог с режиссёром, чего нет у конкурентов вроде Kling, WAN или Hailuo. Доступ к Gemini в России затруднён, но возможен через локальные агрегаторы, например SpeShu.AI, где доступны копии Gemini, ChatGPT и Claude с оплатой в рублях без обхода блокировок. Также Omni Flash доступна бесплатно в YouTube Shorts и приложении YouTube Create, но только для публикуемого там контента. Тарифы на Gemini включены в подписки Google AI Plus ($4,99), Pro ($19,99) и Ultra ($99,99), где Omni доступна без доплат. На тарифе Pro генерация двух видео расходует около 86% дневной квоты, что ограничивает частое использование. На бесплатном тарифе видео через Omni недоступны в Gemini, но возможны через YouTube. Модель имеет ограничения: нельзя синхронизировать губы на фото с аудио (из соображений безопасности), сложные сцены с быстрым движением нескольких объектов даются хуже, а рендеринг текста остаётся проблемным. По фотореалистичности движений Omni уступает Kling, но превосходит его в понимании контекста и итеративном редактировании. Пользователь делится промптами для оживления фото — от портретов с мягким движением до архивных снимков и природы — и отмечает, что Omni понимает запросы в естественной форме, без строгого синтаксиса. Главное преимущество Omni — семантическое понимание сцены через языковую модель, что делает её ближе к «Gemini с видео», чем к узкоспециализированным генераторам. Для российских пользователей удобный и легальный доступ с оплатой в рублях реализован через SpeShu.AI, который также предлагает промокод KODTSNIS15 для +15% к пополнению счёта. Реклама. ООО "ЦНИС", ИНН: 9704271170

Содержание

Читайте в Telegram

|

Наткнулся на Gemini Omni Flash — первую модель нового семейства Omni от Google DeepMind. Модель совсем свежая: часть функций у меня еще была в превью, а API появился только в конце июня 2026 года.

Заметил, что Google уже заменил Veo 3.1 на Omni — так что если открываете Gemini и генерируете видео, вы уже работаете с Omni.

Первое, что меня зацепило, когда я разбирался, как оживить фото, — «any-to-any» трансформер: модель принимает текст, изображения, аудио и видео, обрабатывает все через языковую модель с пониманием мира и только потом генерирует видео.

Модель понимает содержимое фото семантически, а не просто анимирует пиксели — она знает, что кот является живым существом с определенными паттернами движения, а ткань и волосы подчиняются гравитации.

Рассказываю, как я разобрался с новой моделью и без труда стал оживлять в ней фото. Делюсь инструкцией, промптами и способами использовать Omni без VPN.

Самое насущное — есть ли доступ из России

К сожалению, Gemini в России не открывается без дополнительных инструментов, причем у меня сайт порой не открывался даже с ними. Мне не хотелось разбираться с обходами и экспортными ограничениями Google, поэтому я пошел через российские агрегаторы, у меня их несколько.

Например, можно оживить фото через SpeShu.AI: своя точка доступа, оплата в рублях, без иностранной карты. Также там есть аналоговые модели: SpeShu Claude, SpeShu Gemini, SpeShu ChatGPT. Они не уступают официальным моделям и при этом работают без дополнительных инструментов, оплачиваются картой банков РФ и стоят дешевле.

Как оживить фото в Google Omni: подробная инструкция для России и доступ без VPN

Технические характеристики Omni

Максимальная длина клипа сейчас 10 секунд — по словам Google, в будущих обновлениях длина будет расти. Аудио генерируется нативно за один проход, а редактировать результат можно в разговорном формате: я описывал нужное изменение следующим сообщением в чате, и модель применяла его.

Не обошлось и без мелких разочарований: консистентность страдает при многошаговых правках, и каждое новое редактирование может частично нарушить предыдущее; сложные сцены с быстрым движением нескольких объектов даются хуже; точный рендеринг (понимание и визуализация) текста остается проблемой вообще для многих нейросетей.

Обход, который я нашел случайно

Оказалось, Gemini Omni Flash доступен бесплатно прямо внутри YouTube Shorts и приложения YouTube Create. Да, YouTube в России работает с ограничениями, но все же доступен, и это оказался самый дешевый формально бесплатный вход в Omni. Правда, только для контента, который публикуется в YouTube.

Как оживить фото в Google Omni: подробная инструкция для России и доступ без VPN

Тарифы Gemini Omni: бесплатно и платно

Важная особенность, которую я для себя отметил: отдельной подписки только на Omni не существует — модель включена в тарифы Google AI Plus, Pro и Ultra без дополнительной платы.

  • Тариф AI Plus стоит $4,99 в месяц — цену снизили с $7,99 8 июня 2026 года — и дает 200 AI-кредитов в месяц для Flow и Whisk, а также 400 ГБ хранилища; я для себя определил это как минимальный вход в Omni через приложение Gemini.
  • AI Pro за $19,99 в месяц, с 50-процентной скидкой на первый год для новых подписчиков, дает 1000 AI-кредитов в месяц, 5 ТБ хранилища, доступ к Gemini Omni для видео, безлимитную генерацию слайдов и полное контекстное окно на 1 миллион токенов — я выбрал бы именно этот тариф для регулярного использования.
  • AI Ultra стоит $99,99 в месяц — снижение с $249,99, объявленное на I/O 2026, — и дает максимальные лимиты вместе с ранним доступом к новым моделям.

Кредитная система не самая щедрая: я подсчитал, что два видео в Omni Flash расходуют около 86% дневной квоты на тарифе Pro, то есть получается 2–3 видео в день. Для регулярного контента это заметно ограничивающий фактор.

На бесплатном тарифе я нашел чат на Gemini 3.6 Flash, ежедневную квоту Gemini 3.1 Pro для сложных задач, генерацию изображений через Nano Banana 2 и до пяти отчетов Deep Research в месяц, но видео через Omni в приложении Gemini на бесплатном тарифе оказалось недоступно вовсе — бесплатный путь остается только через YouTube.

Разговорное редактирование — что меня больше всего впечатлило

Этого нет ни у Kling, ни у WAN, ни у Hailuo. Я уже пробовал стандартный процесс в Kling: загружаешь фото, пишешь промпт, получаешь видео, а если результат не понравился — генерируешь заново с нуля, и каждая новая попытка это отдельный запрос без гарантии, что результат станет лучше.

В Omni у меня дело пошло иначе: я загрузил фото, получил первый клип, а следующим сообщением написал что-то вроде «добавь больше движения» — модель применила именно это изменение, сохранив все остальное неизменным, а дальше я продолжал итерировать в том же треде: «теперь сделай взгляд немного правее» и так далее.

Для меня это было похоже на диалог с режиссером. Но если увлечься и закинуть много точечных правок, модель начнет путаться и сбиваться.

Промпты, которые я использовал, чтобы оживить фото

Я заметил, что Omni принимает запросы в свободной форме через обычный чат, а не через строгий синтаксис промпта, как у Kling или WAN. Для меня это одновременно и плюс — модель хорошо понимает естественный язык, — и минус, поскольку четкой структуры для запоминания здесь нет.

В первый запрос я стараюсь включать описание желаемого движения, атмосферу — свет и настроение — и явное указание, что должно остаться неизменным.

В последующих итеративных запросах у меня хорошо сработали точечные корректировки конкретного элемента, усиление или ослабление уже заданного эффекта, а также добавление звука или изменение характера движения.

1. Портрет с минимальным движением

text

Animate this photo gently. The person should blink once naturally, take a subtle breath, and make the smallest comfortable head movement. Keep lighting and expression true to the original. No dramatic changes.

2. Взгляд в камеру

text

The person in this photo slowly lifts their gaze to look directly at the viewer. Add one natural blink. Let the eyes soften slightly at the end. Preserve the original photo's warmth and style.
Как оживить фото в Google Omni: подробная инструкция для России и доступ без VPN

3. Оживить старое архивное фото

text

Bring this vintage photograph to life with the most subtle animation possible — a single slow blink, barely perceptible breathing, nothing more. Preserve the original monochrome tones and photographic grain. Do not modernize the appearance.

4. Лес или природа

text

Trees and leaves sway gently in a soft wind. Light filters through the canopy and shifts slightly. Birds or insects are not added. Preserve the color palette of the original image exactly.

5. Добавить звук (итеративная правка)

text

Add ambient outdoor sound to this video — soft wind through trees, distant birds, natural atmosphere. No music, no human voices.

Ограничения, с которыми я столкнулся

Есть запрет, о котором я узнал не сразу: нельзя синхронизировать губы статичного фото реального человека с аудиодорожкой — это прописано в карточке модели DeepMind как ограничение безопасности. Значит, Omni как минимум не заменяет Hedra или HeyGen, где такая функция доступна. Редактирование голоса тоже ограничено.

По своему опыту сравнения с конкурентами могу сказать: Omni выигрывает в семантическом понимании сцены и итеративном редактировании, но проигрывает Kling по фотореалистичной физике движения в сложных сценах. WAN при этом остается более дешевым и доступным из России вариантом, но без разговорного редактирования, которое я нашел только у Omni.

Что для меня стало главным открытием

Gemini Omni оказался единственным из инструментов, которые я пробовал (вместе с Kling, WAN, Hailuo и Haiper), который понимает контекст сцены через языковую модель до того, как начинает генерировать движение. Если на фото бабушка в одежде 1950-х годов, Omni знает, как люди двигались и выглядели в то время.

Если на фото кот смотрит за птицей, модель понимает охотничье поведение кошки как поведенческий паттерн, а не просто набор пикселей для анимации. Для себя я это сформулировал так: это не фильтр «добавить реализм», а именно семантическое понимание — то, что отличает Omni как «Gemini плюс видео» от WAN как специализированного видеогенератора без встроенного языкового рассуждения.

Как оживить фото в Google Omni: подробная инструкция для России и доступ без VPN

Итог

Gemini Omni приятно удивил меня инструментом, который сначала «думает» о содержимом снимка через языковую модель, а потом уже его оживляет, и именно разговорное итеративное редактирование сделало его для меня особенно удобным для точного результата. Доступ и оплата в рублях без дополнительных инструментов и разбора с экспортными ограничениями у меня получились через SpeShu.AI.

Сервис поделился промокодом для моих читателей. При пополнении баланса введите промокод KODTSNIS15 и получите +15% на счет агрегатора.

Реклама. ООО "ЦНИС", ИНН: 9704271170

Теги:
Материал обновлен|
Обсудить
Блоги 940
SpeShu.AI
Softline
OTP Bank
билайн
Слетать.ру
Т-Банк
StudyAI
VK
ВТБ
Газпромбанк

Кодик

Привет!

Я — Кодик, твой персональный ИИ-агент для поиска информации по «Код.ру» на базе Yandex AI Studio. Я могу быстро найти на сайте нужную тему, порекомендовать похожие материалы или объяснить сложный термин — и в целом поделиться знаниями о науке и технологиях. Задай вопрос или начни с одного из предложенных вариантов.