Google выкатила Gemini Omni 1.1 Flash: 40 секунд без разрывов…
Google выкатила Gemini Omni 1.1 Flash: 40 секунд без разрывов
Главная проблема большинства нейросетей для создания видео — непредсказуемость. Вы пишете промпт, тратите бюджет и надеетесь, что короткий клип получится удачным. Обновление Gemini Omni Flash 1.1 от Google переводит процесс из формата случайных попыток в режим понятной пошаговой режиссуры.
Модель позволяет не просто создавать клипы, но и последовательно дорабатывать один и тот же дубль, расширять хронометраж до 40 секунд и точно контролировать движение.
5 режимов работы
✳️Text-to-Video: создание нового кадра с нуля по текстовому описанию.
✳️Image-to-Video: анимация картинки или интерполяция между двумя заданными кадрами.
✳️Reference-to-Video: сборка сцены с сохранением внешности конкретного персонажа или стиля.
✳️Edit: точечная замена одной детали в уже готовом видео без полной перегенерации.
✳️Extend: продление удачного ролика шагами по 10 секунд с сохранением контекста.
Практический алгоритм работы
☑️ Задайте опорные точки через теги. Загрузите до 10 изображений и до 3 коротких видео (до 3 секунд). Чтобы зафиксировать начало и конец сцены, используйте теги <FIRST_FRAME> и <LAST_FRAME>. Для переноса стиля или героя примените <IMAGE_REF_0> или <VIDEO_REF_0>. Если поставить одну картинку в начало и конец, получится зацикленный луп.
☑️ Соберите промпт по формуле. Пишите запрос на английском языке: сначала объект и действие, затем окружение и свет, в конце — звук.
☑️ Управляйте структурой и звуком. Если нужен непрерывный дубль, добавьте фразу «single continuous shot, no scene cuts». Если звук не нужен, обязательно укажите «no music, just room tone», иначе модель добавит собственную фоновую музыку.
☑️ Вносите правки по одной. В режиме Edit меняйте только один элемент за раз (например: «Change the jacket color to blue. Keep everything else the same»). Слишком сложный список правок разрушает геометрию сцены.
Частые ошибки
✳️Поздняя загрузка референсов: добавляйте всех персонажей и стили сразу в первом сообщении, иначе сцена начнет деформироваться в процессе правок.
✳️Перегруженный кадр: удерживайте в фокусе не более трех активных персонажей одновременно, чтобы избежать артефактов и смешивания лиц.
✳️Генерация черновиков: тестируйте движение камеры и логику действий в черновом разрешении 360p (это втрое дешевле и на 60% быстрее), а готовый утвержденный дубль масштабируйте до 1080p или 4K.
Контроль над опорными кадрами, текстовые правки и пошаговое продление превращают работу с видео в предсказуемый производственный процесс вместо бесконечных перегенераций.
🟣
Похожие записи
Оцените материал:
Похожие записи
Дуров переодел аватарку в вахаббита — основатель Telegram подхватил волну…
30.07.2026
BoltzGen — ИИ, который создаёт новые белки и ускоряет разработку…
28.12.2025
📶 Количество базовых станций «Булат» в эфире перевалило за 1000…
11.11.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
