Содержание
Google на Google I/O 2026 представила Gemini Omni — семейство моделей, которые объединяют рассуждение, генерацию медиа и редактирование в одной системе. Первая версия, Gemini Omni Flash, сфокусирована на видео: Google хочет, чтобы ролики собирались и правились разговором, а не через классический видеоредактор.
Ключевая идея Omni Flash — стартовать можно почти с чего угодно. Google перечисляет текст, изображения, аудио и уже существующее видео. Дальше проект уточняют обычными фразами, шаг за шагом, без пересборки сцены с нуля после каждого нового промпта.
Gemini Omni Flash: ставка на «разговорный» монтаж
Gemini Omni Flash задумывали как инструмент, где правки вносятся естественным языком и при этом сохраняется целостность результата. Google отдельно подчёркивает три вещи: персонажи остаются узнаваемыми, сцены держат continuity, а движение выглядит связно, вместо того чтобы «сбрасываться» при каждой итерации.
Ещё один технический акцент — лучшее понимание физики и динамики движения. Google говорит про более корректную работу с motion, «гравитацией» и поведением объектов. В примерах такого подхода компания описывает эффекты вроде «жидкого» зеркала, которое идёт рябью от прикосновения, или скульптуры, собранной из пузырей.
По сути, Google позиционирует Omni не только как генератор видео, а как систему, которая одновременно генерирует и монтирует. Цель звучит жёстко: заменить традиционный софт для монтажа диалогом, который постоянно уточняет ролик.
Где появится Omni Flash и что обещают дальше
Раскатка Gemini Omni Flash идёт через Gemini app, Google Flow, а также инструменты для коротких роликов — YouTube Shorts и YouTube Create. Google отдельно упоминает, что позже планирует расширение доступа для разработчиков и корпоративных клиентов.
Сейчас Omni Flash концентрируется на видео, но Google уже описывает следующий шаг. Будущие версии Gemini Omni должны собирать один проект из разных источников сразу:
- Фото: как исходники и референсы
- Текстовые промпты: для постановки и правок
- Музыка: как часть итогового монтажа
- Референс-видео: для стиля и примеров сцен
Прозрачность и безопасность: SynthID и ограничения на голос
Google признаёт, что чем мощнее генеративные инструменты, тем острее вопрос доверия. Для видео, созданных в Omni, компания заявляет поддержку SynthID — водяного знака для идентификации AI-медиа. Google также говорит о верификации, которая будет работать в экосистеме компании, включая Gemini, Chrome и Search, как часть инициатив по прозрачности.
По части идентичности пользователей стартуют с относительно «мягкого» сценария. На первом этапе пользователи смогут создавать видео-аватары на основе себя, включая собственный голос. Более продвинутые функции, связанные с модификацией речи, Google пока держит на оценке, ссылаясь на вопросы безопасности.
Отдельно Google напоминает, что это продолжение её линии на AI-визуалы. В 2025 компания расширила возможности Gemini в изображениях через Nano Banana: инструмент применяли и для восстановления старых фотографий, и для превращения набросков в более «чистые» концепты.
Gemini Omni показали на Google I/O 2026, а первая версия Gemini Omni Flash уже начинает появляться в Gemini app, Google Flow, YouTube Shorts и YouTube Create.