Нещодавно Google представила оновлену версію своєї відеомоделі Gemini Omni 1.1 Flash, яка значно розширює можливості користувачів у створенні та редагуванні відеоконтенту. Ця нова модель, розроблена Google, пропонує низку інноваційних функцій, спрямованих на покращення якості, плавності та реалістичності згенерованих відео.
Ключові нововведення Gemini Omni 1.1 Flash
Однією з найважливіших функцій є можливість продовження відео на 10-секундні фрагменти, що дозволяє досягти загальної тривалості відео до 40 секунд. Цей процес передбачає глибокий аналіз попередніх 10 секунд відео, що забезпечує кращу консистентність персонажів, оточення та сюжетної лінії порівняно з попередніми версіями, які враховували лише одну секунду. Згідно з заявою Google, це суттєво сприяє збереженню цілісності візуального ряду та наративу.
Інноваційні інструменти для креативності
Gemini Omni 1.1 Flash також надає користувачам можливість задавати початковий та кінцевий кадри відеосцени. Модель самостійно генерує послідовність кадрів між ними, що відкриває широкі перспективи для створення плавних рухів камери, ефектних переходів між сценами та зациклення роликів. Це дозволяє досягти кінематографічної якості та додає динаміки візуальному контенту.
Для прискорення процесу тестування та оптимізації витрат, розробники можуть створювати чорнові версії відео у роздільній здатності 360p. За оцінками Google, такі чернетки генеруються до 60% швидше та коштують утричі дешевше порівняно зі стандартними відео у 720p. Після фіналізації, відео можна підвищити до роздільної здатності 1080p або навіть 4K, забезпечуючи високу деталізацію зображення.
Розширені можливості введення даних
Ще однією значною перевагою Gemini Omni 1.1 Flash є можливість додавати до запиту до трьох секунд відео як зразок, що визначає бажаний рух, стиль або поведінку персонажа. Ця функція доповнює вже існуючу підтримку текстових запитів, зображень та аудіо, створюючи комплексний інструмент для генерації відео.
Доступність та безпека
Модель Gemini Omni 1.1 Flash вже доступна для використання у Google AI Studio та на корпоративній платформі Gemini Enterprise Agent Platform. Підписники Google AI Plus, Pro та Ultra також мають доступ до неї через сервіс Flow. Google підкреслює свою відданість безпеці та прозорості, тому створені або відредаговані за допомогою моделі відео містять невидимий цифровий водяний знак SynthID, а також інформацію про походження контенту у форматі C2PA.
Нагадаємо, що перша версія Gemini Omni Flash, яка представила базові можливості створення та редагування відео на основі різноманітних вхідних даних, була анонсована Google у травні.




