• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
SmartLogicTech
Категория:

Генерация видео

    Генерация видео

    Google довела ролики Gemini Omni до сорока секунд и сделала черновики втрое дешевле

    admin 01.09.2026


    Gemini Omni 1.1 Flash научилась достраивать снятую сцену продолжениями и доводить ролик до сорока секунд, а перед чистовой генерацией показывать дешёвый черновик. 27 августа Google перевела модель в производственный статус и открыла её в Gemini API, Google AI Studio и Flow.

    Содержание

    1. Сорок секунд из четырёх кусков
    2. Ключевые кадры вместо длинных описаний
    3. Цена спустилась до уровня Alibaba
    4. Лица и надписи всё ещё плывут
    5. Где включили и кто уже встроил
    6. Черновики в 360p, чистовик в 1080p
    7. Гонка ушла из качества в управляемость

    Gemini Omni 1.1 Flash — видеомодель Google для разработчиков, которую компания предлагает встраивать в редакторы и генераторы роликов. Обновление подаётся не как скачок в качестве картинки, а как набор рычагов управления: чем снимает виртуальная камера, что происходит между двумя кадрами, сколько длится сцена. Модель вышла из тестового статуса и работает в производственном режиме.

    Сорок секунд из четырёх кусков

    За одну генерацию Gemini Omni 1.1 Flash по-прежнему выдаёт десять секунд. Новое — возможность продолжить готовый фрагмент ещё одним десятисекундным куском, и так до сорока секунд общей длительности.

    Работает это заметно аккуратнее прежнего. Раньше модель при продолжении смотрела только на последнюю секунду ролика, теперь берёт в расчёт до десяти секунд предыдущего материала. Именно на стыках генеративное видео обычно и рассыпается — герой меняет куртку, свет прыгает, интерьер перестраивается.

    Ключевые кадры вместо длинных описаний

    Второй рычаг — генерация по двум опорным кадрам. Разработчик задаёт первый и последний кадр, а Google достраивает то, что между ними: наезд, облёт объекта, разворот камеры, бесшовную петлю для фона. Сложные операторские движения вроде резкой панорамы или наезда с одновременным отъездом объектива модель отрабатывает по описанию.

    К этому добавили визуальные референсы. На вход принимается до трёх видеофрагментов длиной до трёх секунд каждый — по ним модель удерживает внешность персонажа, стиль и вид товара. Раскадровка перестаёт быть текстовым упражнением, где нужную картинку выпрашивают формулировками.

    Цена спустилась до уровня Alibaba

    Для перебора вариантов появился режим 360p. Google обещает генерацию до 60% быстрее стандартного 720p и примерно треть его цены. Секунда 720p обходится около $0,10, считается она по токенам — 5792 токена на секунду ролика.

    Про цену 1080p и 4K в анонсе не сказано ничего. Оба разрешения получаются апскейлом, тарифицируются те же токены, но во сколько раз дороже выйдет чистовик в 4K, компания отдельной строкой не показала. Для продукта, который продают студиям и редакторам, это неудобный пробел.

    Цены

    Google Veo 3.1 просит около $0,40 за секунду. Gemini Omni 1.1 Flash в стандартном качестве стоит вчетверо меньше и ровно столько же, сколько Alibaba берёт за 720p у Wan3.0, — ценовой паритет с китайским конкурентом Google держит впервые за год.

    По длине ролика расклад другой. Wan3.0 выдаёт 30 секунд за одну генерацию без склейки, ByteDance в Seedance 2.5 — те же 30 секунд сразу в 4K. Сорок секунд Gemini Omni собираются из четырёх кусков, и это компромисс, а не рекорд. Зато поле Google освобождают сами конкуренты. Sora у OpenAI доживает последние недели, приложение закрыли ещё весной, API отключают в сентябре.

    Лица и надписи всё ещё плывут

    Слабые места Google не прячет. Согласованность персонажа при последовательных правках и текст в кадре остаются нерешёнными задачами — те же грабли, на которые публично наступила Alibaba с Wan3.0. Работа со звуком и речью придержана. Доступ к редактированию аудио Google открывает осторожно, пока обкатывает правила ответственного выпуска.

    Потолок в сорок секунд тоже стоит держать в голове. Это четыре последовательных обращения к API, четыре точки, где сцена может уехать, и оплата каждой генерации отдельно.

    Где включили и кто уже встроил

    Разработчикам модель доступна в Google AI Studio и через Gemini API, корпоративным клиентам — через API платформы Gemini Enterprise. В Flow, видеоредакторе Google, она открыта подписчикам планов AI Plus, Pro и Ultra. Продолжение сцен добавили и в обычное приложение Gemini, там рычагов меньше, но попробовать механику можно без кода.

    Из внешних продуктов модель уже подключили Adobe в Firefly, Figma в редакторе Weave и Runway , плюс несколько облачных провайдеров. Набор подобран под одну ставку. Google продаёт Gemini Omni тем, кто делает инструменты для монтажёров, а не конечному зрителю.

    Черновики в 360p, чистовик в 1080p

    Тем, кто делает ролики для сайтов и соцсетей, Gemini Omni 1.1 Flash меняет порядок работы. Идеи перебираются в 360p, пока не сойдётся композиция и движение камеры, и только потом оплачивается чистовая генерация. Черновой режим стоит треть обычного, поэтому десяток проб выходит дешевле одного неудачного финала.

    Вторая привычка — короткие фоновые петли через первый и последний кадр. Одинаковые опорные кадры дают зацикленный ролик без видимого стыка, и такой фон в шапку страницы генерируется за секунды.

    Гонка ушла из качества в управляемость

    Заявку Gemini Omni 1.1 Flash стоит проверять на длинных сценах. Если четыре сшитых куска действительно держат лицо героя и свет, у рекламных студий пропадает главный довод против генеративного видео. Если на третьем стыке картинка поедет, сорок секунд останутся цифрой из пресс-релиза, а рабочим форматом — те же десять.



    Источник

    01.09.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Генерация видео

    Революционная платформа KLING AI для генерации видео теперь доступна каждому

    admin 01.08.2026
    01.08.2026

    Китайская платформа KLING AI, которая нашумела благодаря своим выдающимся возможностям генерации видео, теперь открыта для всех без необходимости телефонной верификации. …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Adobe запустила Firefly Video Model – генератор AI-видео с общим доступом

    admin 30.07.2026
    30.07.2026

    Firefly Video Model теперь могут протестировать все желающие. Этот инструмент позволяет создавать 5-секундные видеоролики в 1080p на основе текстовых описаний …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Google Veo 2 дебютировал на Freepik: новая эра в создании видео с помощью ИИ

    admin 29.07.2026
    29.07.2026

    Платформа Freepik первой в мире внедрила Google Veo 2 — новую модель генерации видео от Google DeepMind. Интеграция этой технологии …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Pika Labs представляет Pika 2.2: Новая эра в AI-видеогенерации с 10-секундными клипами

    admin 28.07.2026
    28.07.2026

    Pika Labs снова удивляет мир искусственного интеллекта: новая модель Pika 2.2 поднимает планку возможностей AI-видеогенерации, предлагая пользователям более длинные и …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    HeyGen представил обновление AI-аватаров: теперь еще реалистичнее

    admin 27.07.2026
    27.07.2026

    Компания HeyGen, известная своими решениями для генерации видео с искусственным интеллектом, обновила технологию UGC (User-Generated Content) AI-аватаров. Теперь виртуальные персонажи …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Новая модель Runway Gen-4: реалистичные видео и полный контроль над сюжетом

    admin 26.07.2026
    26.07.2026

    Gen-4 предлагает более высокую реалистичность, согласованность и контроль над визуальным повествованием. Новая технология уже доступна подписчикам и открывает новые горизонты …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Higgsfield AI анонсировала Higgsfield Mix: новый инструмент для создания кинематографических видео

    admin 25.07.2026
    25.07.2026

    Компания Higgsfield AI представила инструмент Higgsfield Mix, позволяющий создавать невозможные с точки зрения физики движения камеры в видео. Новинка открывает …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Kling 2.0 открывает новую главу в генерации визуального контента

    admin 24.07.2026
    24.07.2026

    Китайская платформа Kling 2.0 от Kuaishou выходит на новый уровень: искусственный интеллект научился создавать видео и изображения с кинематографическим качеством …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    ​Искусство за восемь секунд: Google запустила генерацию видео в Gemini и Whisk

    admin 23.07.2026
    23.07.2026

    Компания Google представила новую функцию для подписчиков сервиса Gemini Advanced — возможность создавать восьмисекундные видеоролики по текстовым запросам с помощью …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Runway запускает Gen-4 References — инструмент для создания непрерывных визуальных историй

    admin 22.07.2026
    22.07.2026

    Компания Runway представила функцию Gen-4 References, которая позволяет пользователям легко воссоздавать персонажей и сцены с сохранением визуальной целостности. Новинка вызвала …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    ИИ-видео под контролем: Higgsfield AI представила функцию Start & End Frames

    admin 21.07.2026
    21.07.2026

    Новая функция позволяет пользователям задавать начальный и финальный кадры ролика, обеспечивая контроль над сценарием и движением камеры. Содержание Новый подход …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Microsoft сократила около 4 800 сотрудников на фоне масштабной реструктуризации Xbox
  • Discord признал, что из-за бага в ИИ-системе модерации были ошибочно забанены тысячи пользователей
  • Anthropic представила Claude Design — новый продукт для быстрого создания визуалов
  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Microsoft сократила около 4 800 сотрудников на фоне масштабной реструктуризации Xbox

    17.09.2026
  • Discord признал, что из-за бага в ИИ-системе модерации были ошибочно забанены тысячи пользователей

    17.09.2026
  • Anthropic представила Claude Design — новый продукт для быстрого создания визуалов

    17.09.2026
  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах

    16.09.2026
  • ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

    16.09.2026
  • OpenAI покажет человекоподобного робота в 2027 году

    15.09.2026

Рубрики

  • Генерация видео (108)
  • Генерация звука (23)
  • Генерация изображений (88)
  • Генерация текста (68)
  • Новости (73)
  • Обзор сервисов (49)

Microsoft сократила около 4 800 сотрудников на фоне...

17.09.2026

Discord признал, что из-за бага в ИИ-системе модерации...

17.09.2026

Anthropic представила Claude Design — новый продукт для...

17.09.2026

СМИ требуют санкций против OpenAI за сокрытие доказательств...

16.09.2026

ElevenLabs добавила генерацию речи, музыки, изображений и видео...

16.09.2026

Обзоры

  • Microsoft сократила около 4 800 сотрудников на фоне масштабной реструктуризации Xbox

    17.09.2026
  • Discord признал, что из-за бага в ИИ-системе модерации были ошибочно забанены тысячи пользователей

    17.09.2026
  • СМИ требуют санкций против OpenAI за сокрытие доказательств по делу об авторских правах

    16.09.2026

Выбор редакции

  • DeepSeek выпустила V4.1 Flash — открытую ИИ-модель с контекстом до 1 млн токенов

    11.09.2026
  • Приложения для создания и обработки фото с помощью ИИ: топ-10 на Android/iPhone

    30.06.2026
  • MiniMax Hub добавил аудиомодели и готовые процессы для производства видео

    06.09.2026

Популярное

  • 1

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • 2

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • 3

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026

Выбор редакции

  • Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

    02.09.2026
  • DeepSeek V4 может выйти в октябре — обещают «1 млн токенов» и новые режимы рассуждений

    23.06.2026
  • ElevenLabs запустила Scribe v2 Realtime — ИИ для распознавания речи в режиме реального времени

    22.06.2026

@2026- All Right Reserved.


Наверх
SmartLogicTech
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов