Google на Google I/O 2026 представила Gemini Omni — семейство моделей, которые объединяют рассуждение, генерацию медиа и редактирование в одной системе. Первая версия, Gemini Omni Flash, сфокусирована на видео: Google хочет, чтобы ролики собирались и правились разговором, а не через классический видеоредактор.

Ключевая идея Omni Flash — стартовать можно почти с чего угодно. Google перечисляет текст, изображения, аудио и уже существующее видео. Дальше проект уточняют обычными фразами, шаг за шагом, без пересборки сцены с нуля после каждого нового промпта.

Gemini Omni Flash: ставка на «разговорный» монтаж

Gemini Omni Flash задумывали как инструмент, где правки вносятся естественным языком и при этом сохраняется целостность результата. Google отдельно подчёркивает три вещи: персонажи остаются узнаваемыми, сцены держат continuity, а движение выглядит связно, вместо того чтобы «сбрасываться» при каждой итерации.

Продолжение после рекламы

Ещё один технический акцент — лучшее понимание физики и динамики движения. Google говорит про более корректную работу с motion, «гравитацией» и поведением объектов. В примерах такого подхода компания описывает эффекты вроде «жидкого» зеркала, которое идёт рябью от прикосновения, или скульптуры, собранной из пузырей.

Изображение к статье: Google показала Gemini Omni Flash: монтаж видео в диалоге

По сути, Google позиционирует Omni не только как генератор видео, а как систему, которая одновременно генерирует и монтирует. Цель звучит жёстко: заменить традиционный софт для монтажа диалогом, который постоянно уточняет ролик.

Где появится Omni Flash и что обещают дальше

Раскатка Gemini Omni Flash идёт через Gemini app, Google Flow, а также инструменты для коротких роликов — YouTube Shorts и YouTube Create. Google отдельно упоминает, что позже планирует расширение доступа для разработчиков и корпоративных клиентов.

Сейчас Omni Flash концентрируется на видео, но Google уже описывает следующий шаг. Будущие версии Gemini Omni должны собирать один проект из разных источников сразу:

  • Фото: как исходники и референсы
  • Текстовые промпты: для постановки и правок
  • Музыка: как часть итогового монтажа
  • Референс-видео: для стиля и примеров сцен
Изображение к статье: Google показала Gemini Omni Flash: монтаж видео в диалоге

Прозрачность и безопасность: SynthID и ограничения на голос

Google признаёт, что чем мощнее генеративные инструменты, тем острее вопрос доверия. Для видео, созданных в Omni, компания заявляет поддержку SynthID — водяного знака для идентификации AI-медиа. Google также говорит о верификации, которая будет работать в экосистеме компании, включая Gemini, Chrome и Search, как часть инициатив по прозрачности.

По части идентичности пользователей стартуют с относительно «мягкого» сценария. На первом этапе пользователи смогут создавать видео-аватары на основе себя, включая собственный голос. Более продвинутые функции, связанные с модификацией речи, Google пока держит на оценке, ссылаясь на вопросы безопасности.

Отдельно Google напоминает, что это продолжение её линии на AI-визуалы. В 2025 компания расширила возможности Gemini в изображениях через Nano Banana: инструмент применяли и для восстановления старых фотографий, и для превращения набросков в более «чистые» концепты.

Gemini Omni показали на Google I/O 2026, а первая версия Gemini Omni Flash уже начинает появляться в Gemini app, Google Flow, YouTube Shorts и YouTube Create.

Продолжение после рекламы

Рейтинг: 0 / 5. Оценок: 0

Рекомендуем почитать

Оставьте комментарий

Перед оставлением комментария, пожалуйста, ознакомьтесь с правилами комментирования.