Похоже, нейросеть для видео HeyGen выпустила HeyGen Video и до конца октября отдаёт 480p-генерации по $0.01/сек. Модель построена на MiniMax H3, которую в HeyGen дообучили под стабильность, промпты, референсы и звук. После промо будет $0.30.
Что вообще произошло
Рынок AI-видео прошёл первый этап: сервисы собирали у себя Kling, Veo, Seedance, MiniMax, прикручивали симпатичный интерфейс и называли это платформой. Удобно, но по сути — витрина.
Теперь началась вторая фаза. Берётся чужая открытая foundation-модель (то есть базовая модель, чьи веса выложили в открытый доступ), дообучается под конкретные задачи — и выпускается как «своя». HeyGen этого не скрывает: прямо пишет, что HeyGen Video построена на MiniMax H3 и отдельно дообучена внутри HeyGen.
Доучивали под конкретику: стабильность картинки от кадра к кадру, точное следование промпту, работу с товарами и референсами, синхронный звук и предсказуемый результат для коммерческого AI видео продакшна. То есть не «вау-эффект на один раз», а инструмент, который выдаёт одинаково приличный результат снова и снова.
Что умеет эта модель
Коротко и без жаргона. Ты можешь:
• text-to-video — написал текстом, получил видео;
• image-to-video — загрузил картинку, она ожила;
• reference-to-video — дал набор материалов, модель собрала сцену по ним;
• получить видео сразу со звуком, без отдельной озвучки;
• скормить до 9 картинок, 3 видео и 3 аудиофайлов как референсы — и обращаться к ним прямо внутри промпта;
• выбрать формат от широкого 21:9 до вертикального 9:16;
• вывести 480p или 768p;
• сделать ролик длиной 5–15 секунд.
HeyGen заявляет, что на их собственном слепом тесте (blind eval — когда модели сравнивают, не подписывая, кто есть кто) их версия обошла Seedance 2.0, H3 Max и Kling 3.0. Верить или нет — вопрос открытый, но сам факт, что модель построена на открытой базе и продаётся дешевле оригинала, интереснее любого рейтинга.
Что это даёт лично тебе
Вот где начинается практика. Пять живых примеров.
Мама двоих детей ведёт блог про детское питание. Раньше на один вертикальный ролик уходил вечер: снять, смонтировать, найти музыку. Теперь она пишет промпт, грузит фото тарелки как референс — и за пару минут получает 10-секундный вертикальный клип 9:16 со звуком. Это не «шедевр кино», но Reels и Shorts такого формата едят с удовольствием.
Владелец кофейни запускает новый напиток. У него есть три фото стакана и одно короткое видео пара. Он отдаёт их модели как референсы, просит: «оживи, добавь пар, покажи крупный план, лёгкий поворот камеры». Получает короткий рекламный клип для гео-сторис — без фотографа, без студии, без монтажёра.
Фрилансер-дизайнер защищает концепцию перед клиентом. Статичная картинка часто не продаёт идею: заказчик не понимает, как это будет в движении. Дизайнер оживляет макет через image-to-video и показывает 10-секундный превью на созвоне. Это плюс к доверию и плюс к чеку — и всё это в рамках создания видео с нейросетью, без аниматора в цепочке.
Репетитор по математике. Каждую неделю делает короткие разборы задач с голосом. Раньше — запись с телефона и вечная возня с озвучкой. Теперь видео генерируется сразу со звуком, а референсы позволяют держать один и тот же визуальный стиль канала.
Продавец на маркетплейсе. Карточка с видео конвертит лучше карточки с фото. Раньше видео — это отдельная статья расходов. Теперь это $0.15 за 10-секундный ролик в 768p. Можно тестировать десятки вариантов и выбирать тот, что реально продаёт.
Как попробовать прямо сейчас
Пошагово, без лишнего.
1. Заходи на HeyGen и создаёшь аккаунт.
2. Открываешь раздел с видеогенерацией и находишь модель HeyGen Video.
3. Выбираешь режим: text-to-video, image-to-video или reference-to-video — зависит от того, что у тебя уже есть на руках.
4. Если работаешь с референсами — загружаешь до 9 картинок, 3 видео и 3 аудиофайлов.
5. Пишешь промпт. Хочешь, чтобы модель опиралась на конкретный материал — сошлись на него прямо в тексте промпта.
6. Выставляешь формат (от 21:9 до 9:16), разрешение (480p или 768p) и длину (5–15 секунд).
7. Генерируешь. Смотришь, что получилось, правишь промпт, повторяешь.
8. Считаешь деньги заранее: 10 секунд в 768p — $0.15 по промо до конца октября.
Актуальные лимиты и тарифы всегда проверяй в документации HeyGen и каталоге моделей — цены и параметры там обновляются первыми.
Плюсы, минусы и что изменится
Главное: дешевле. Промо-цена $0.01/с — это половина обычной цены $0.02/с и в разы меньше, чем $0.08/с в API MiniMax H3. При этом берёшь ты не «сырую» базовую модель, а дообученную под стабильный результат.
Второе: контроль. Обычные генераторы любят выдавать красивое, но неуправляемое. Здесь акцент на следовании промпту, работе с товарами и референсами, синхронном звуке — то есть на предсказуемости, а не на «слопе» (дешёвом мусорном контенте, который никуда нельзя применить).
Что станет возможным через месяц-полгода: если открытые модели продолжают дешеветь такими темпами, короткое видео превращается в расходник. Не «сделаю ролик раз в месяц», а «сделаю тридцать вариантов и посмотрю, какой зашёл».
Теперь честно про ограничения. Ролики короткие — 5–15 секунд, это не фильм и не полноценный рекламный ролик, а скорее кирпичик. Максимум 768p, не 4K — для больших экранов не хватит. Промо-цена закончится в конце октября, дальше станет дороже. Заявление о победе над Seedance 2.0, H3 Max и Kling 3.0 — это их собственный слепой тест, независимые замеры ещё никто не публиковал. И да, база — MiniMax H3, то есть «собственная» модель здесь означает «дообученная», а не «созданная с нуля».
Вывод и что сделать сегодня
Мы смотрим на важный сдвиг: открытые модели наконец начали работать так, как и должны были. Кто-то выкладывает базу в открытый доступ, кто-то доучивает её под конкретную задачу и продаёт готовый инструмент дешевле, чем оригинал. Для обычного человека это значит одно — вход в производство видео подешевел настолько, что эксперимент стоит меньше чашки кофе.
Конкретное действие на сегодня: зарегистрируйся на HeyGen, возьми одну свою фотографию и попробуй оживить её в 9:16 на 5 секунд. Один тест — минус все сомнения. Если что-то не получилось или есть вопрос — пиши в комментариях @aigoby, разберём вместе.
🎁 Бонус: промпт для копирования
Скопируй и адаптируй под свою задачу. Такой промпт рассчитан на работу с референсами:
```
Собери 10-секундный вертикальный ролик 9:16 в разрешении 768p.
Основа: изображение @img1 — главный объект сцены.
Дополнительно: изображение @img2 — фон, видео @vid1 — движение камеры, аудио @aud1 — звуковая атмосфера.
Действие: камера медленно приближается к объекту, затем плавный поворот на 15 градусов вправо. Объект слегка в движении, детали остаются чёткими и не деформируются от кадра к кадру.
Стиль: естественное дневное освещение, мягкие тени, спокойный премиальный тон.
Звук: синхронный с картинкой, без резких переходов.
Без текста на экране, без резких склеек, без изменения формы объекта.
```
Мини-чек-лист перед генерацией:
• Есть хотя бы один референс (фото, видео или аудио) — качество вырастет в разы.
• Промпт не длиннее 3–4 предложений, но конкретный: что делает камера, что делает объект, какой свет.
• Выбран правильный формат: 9:16 для Reels и Shorts, 21:9 для сайта и презентаций.
• Длина в пределах 5–15 секунд.
• Перед серией тестов посчитал бюджет: 10 секунд 768p — $0.15 по промо.
Больше разборов и практики с ИИ — в @aigoby. Источники по новости: документация HeyGen, каталог моделей, разбор запуска, ababnews.



Комментарии 0