Vidu Q4 Preview — новая нейросеть для видео, которая генерирует 16-секундный ролик в 4K за 22 цента. Она принимает до 15 референсов персонажей и до 3 аудиореференсов, синхронизирует диалоги со звуком и умеет менять планы внутри клипа. Залогинься через Google — сможешь сгенерировать три ролика.
Что вообще произошло
Vidu выпустила новый видеогенератор — Q4 Preview. Это тот же класс инструментов, что Sora или Runway: ты пишешь текстом, что хочешь увидеть, или подкидываешь картинку, и получаешь готовое видео. Разница в деталях, и как раз они тут интересные.
Разработчики сделали ставку на четыре вещи: качество картинки, управление персонажами, сложные сцены и пригодность для дальнейшего монтажа. То есть ролик задуман не как красивая игрушка на один просмотр, а как нормальный исходник, который можно порезать, свести с другими кадрами и прогнать через цветокоррекцию — как обычное видео со съёмки.
По сути это удешевление итераций. Раньше, чтобы попробовать пять разных версий ролика, нужно было пять раз снять, пять раз смонтировать и пять раз что-то переделать. Теперь ты просто генерируешь пять вариантов — и цена вопроса копеечная.
Что она умеет на самом деле
Список возможностей Vidu Q4 Preview выглядит так:
• Генерирует видео до 4K и длительностью до 16 секунд.
• Работает в двух режимах: Image-to-Video (оживляет одну картинку) и Reference-to-Video (собирает видео по набору образцов).
• Принимает до 15 изображений-референсов — чтобы персонаж, его одежда, предметы и окружение оставались одинаковыми от кадра к кадру.
• Использует до 3 аудиореференсов — то есть голос персонажа можно задать заранее.
• Генерирует диалоги и звуковые эффекты синхронно с картинкой.
• Поддерживает несколько планов и переключение камеры внутри одного ролика — это уже похоже на монтаж, а не на одно статичное движение.
• Прокачали мимику, эмоции, движение, освещение, взрывы, дым и другие VFX-эффекты.
И самое любопытное — 10-битный цвет. Простыми словами: у каждого канала цвета становится больше оттенков, плавные переходы в небе, тенях и на коже выглядят чище, а при цветокоррекции картинка меньше «рассыпается». Именно поэтому здесь говорят о пригодности для монтажа, а не только о генерации.
Что это даёт лично тебе
Вот несколько живых ситуаций, где такая нейросеть для создания видео уже сегодня закрывает боль.
Владелец кофейни. Ему нужен ролик для соцсетей, но снимать каждый день некогда, а фотограф стоит денег. Он загружает 15 своих фото — интерьер, вывеску, чашку, бариста — и просит видео с переключением планов. За пару центов получает 16 секунд, которые можно лить в рекламу.
Фрилансер-дизайнер. Клиент не понимает раскадровку на словах. Теперь можно показать не картинки, а движущийся ролик-концепт. Согласование сокращается с недели до дня, а работа выглядит сильно дороже.
Мама двоих детей, которая ведёт блог о развитии малышей. Она не хочет показывать лица детей. Загружает свои иллюстрации и референсы персонажей, получает мультяшную анимацию и озвучку. Аниме-стиль и анимация — как раз то, что в этом генераторе выглядит особенно интересно.
Учитель или репетитор. Скучную тему можно объяснить коротким визуальным роликом: несколько планов, синхронный звук, диалог между двумя «персонажами». Ученики досматривают до конца — это уже половина результата.
Небольшой интернет-магазин. 15 референсов позволяют держать один и тот же товар и одну и ту же модель во всех кадрах — раньше это была главная головная боль ИИ для генерации видео.
Монтажёр и контент-мейкер. 4K плюс 10-битный цвет — это запас для цветокоррекции. Такой файл не стыдно подложить в проект, а не просто выложить в ленту. Это уже ИИ для монтажа, а не отдельная игрушка.
Как попробовать прямо сейчас
Пошагово, без лишней теории.
1. Открой официальный сайт Vidu и страницу инструмента — Vidu Q4.
2. Залогинься через Google. Сразу получишь три бесплатных ролика по 10 секунд: один в 1080, второй в 720 и третий поменьше. Это три попытки — потрать их осмысленно.
3. Начни с Image-to-Video: возьми одну свою фотографию или картинку, где понятная композиция, и опиши, что должно произойти. Так проще понять, как инструмент держит движение.
4. Для повторяющихся персонажей переходи в Reference-to-Video: добавь до 15 изображений-референсов и до 3 аудиореференсов — так герой, одежда и обстановка останутся узнаваемыми.
5. Если ты разработчик — есть API с идентификатором `viduq4-preview`.
6. Когда бесплатные попытки закончатся, считай деньги: стартовая цена от $0.014 за секунду, а на Image-to-Video и Reference-to-Video действует скидка 30% до 30 ноября. Те самые 16 секунд за 22 цента — это и есть главный аргумент.
Плюсы и минусы без прикрас
Плюсы очевидны: цена, 4K, 10 бит, звук синхронно с картинкой, смена планов и референсы персонажей. Это набор, за который год назад просили в разы больше. Плюс три бесплатные попытки — попробовать можно, вообще ничего не потратив.
Теперь честно про ограничения. Точные параметры экспорта, кодек, цветовое пространство и наличие HDR разработчики не раскрыли. И важно понимать: само по себе 10 бит не означают HDR и не гарантируют более широкий цветовой охват — это про запас для обработки, а не про волшебство. По части фотореализма и лиц у меня остались вопросы: часть примеров напоминает генерации позапрошлого сезона, зато анимация и аниме-стилистика выглядят очень любопытно. И бесплатно дают всего три ролика по 10 секунд — на большой проект этого мало.
Что сделать прямо сегодня
Не откладывай на «когда будет время». Сегодня сделай одну вещь: зайди на Vidu Q4 Preview, залогинься через Google и потрать первую бесплатную попытку на Image-to-Video — оживи свою фотографию или картинку товара. Это займёт минут десять, а понимание возможностей появится конкретное, а не из чужих обзоров.
Если хочешь разбор под свою задачу — напиши в комментариях в @aigoby, кому именно нужен ролик: магазину, блогу, урокам или рекламе. Подскажу, с какого режима стартовать.
🎁 Бонус: готовый промпт для первого теста
Скопируй и подставь своё — структура из шести строк работает лучше, чем один длинный абзац.
```
Сцена: утренняя кофейня, тёплый свет из окна, лёгкий пар над чашкой.
Камера: средний план на бариста, затем плавный переход на чашку на стойке.
Действие: бариста улыбается, ставит чашку, поднимает глаза на камеру.
Детали: отражение в стекле, мягкое дрожание кадра, похожее на съёмку с рук.
Звук: негромкий шум кофемашины, звон ложки, короткая реплика: «Твоё капучино готово».
Формат: 10 секунд.
```
Чек-лист перед первой генерацией:
• Одна сцена — одно действие. Не пытайся впихнуть в 10 секунд три локации.
• Если персонаж должен быть одинаковым в нескольких роликах — собирай до 15 референсов заранее, потом не доклеишь.
• Голос задавай через аудиореференс, иначе интонация будет случайной.
• Бесплатные попытки берегутся под главный тест: сначала черновик на картинке, потом уже генерация.



Комментарии 0