Нейросеть для видео от Google теперь умеет больше, чем рисовать ролики: Gemini 3.8 Live с функцией Live Avatar почти в реальном времени создаёт говорящего аватара, который ведёт с тобой диалог, двигает губами в такт речи и меняет мимику. Минута его речи стоит около 37 центов за видео плюс 2 цента за голос, а язык можно менять среди 97 поддерживаемых. Функция вышла в общий доступ 24 сентября 2026 года в Gemini Enterprise и через Gemini Live API. Ниже разбираем, что это значит для тебя и твоего дела.
Что именно выпустила Google: новая нейросеть для создания видео
15 сентября Google представила голосовую модель Gemini 3.8 Live, то есть ИИ, с которым можно разговаривать вслух. Теперь к ней добавили Live Avatar. Это персонаж на экране: он слушает тебя, отвечает голосом, а его лицо оживает в момент разговора.
Что он умеет по описанию Google:
• одновременно принимает от тебя видео и звук, а не только текст;
• естественно меняется репликами: можно перебить, уточнить, договорить;
• в фоне вызывает внешние инструменты (например, что-то найти или проверить), не обрывая разговор;
• подстраивает губы и мимику под 97 языков, и, по словам Google, при смене языка картинка не ухудшается;
• весь звук и видео получают невидимую метку SynthID, по которой можно определить, что ролик сделан ИИ.
Персонажа берут из готовой библиотеки. Свой аватар по одному изображению, с сохранением сходства и фирменного стиля, пока можно создать только корпоративным клиентам и по запросу.
Что это даёт лично тебе: возможности нейросети для генерации видео
Google называет два главных сценария: клиентская поддержка и интерактивные инструкции. Но идей больше. Ниже примеры для вдохновения, это наши размышления, а не заявления Google.
• Владелец интернет-магазина. Вместо чата с шаблонными ответами на сайте встречает клиента говорящий ИИ-аватар и подсказывает по товарам. Такой ai аватар для бизнеса выглядит живее бота в окошке.
• Фрилансер-переводчик или репетитор. Аватар, у которого мимика подстраивается под 97 языков, подходит для тренажёра: ученик болтает с «собеседником» и видит, как правильно артикулируется фраза.
• Мама двоих детей, открывшая онлайн-школу. Инструкции к урокам или настройке платформы не надо снимать самой: их проговаривает аватар.
• Руководитель отдела, который устал отвечать на одни и те же вопросы. Пошаговая инструкция «как оформить отпуск» или «как настроить принтер» превращается в разговор, где можно переспросить.
• Специалист по продажам. Аватар первым отвечает на типовые вопросы о цене и сроках, а сложные передаёт человеку.
Главное новшество в том, что говорящий аватар ии больше не заранее записанный ролик, а собеседник, который реагирует на тебя прямо сейчас.
Сколько это стоит на самом деле: бесплатная нейросеть для создания видео
Цена считается не за «готовый ролик», а за время, пока аватар говорит. Это честная модель: пока он молчит и слушает, видео не оплачивается.
Вот цифры из источника:
• видео с аватаром: 1 доллар за миллион выходных токенов;
• одна секунда ролика расходует примерно 6 тысяч токенов (токен, простыми словами, это маленький кусочек данных, по которым считают стоимость работы ИИ);
• минута речи аватара: 37 центов за видео + 2 цента за голос;
• входящие звук и видео от пользователя оплачиваются отдельно.
Простая арифметика: 10 минут разговора аватара в день обойдутся примерно в 3,9 доллара на выходе, плюс входящие данные. Если у тебя поддержка работает по 100 минут в месяц, это порядка 39 долларов на видео и голос аватара. Сравни с зарплатой оператора и поймёшь, ради чего всё затеяно.
Как попробовать прямо сейчас: нейросеть для видео бесплатно
Важно сразу сказать честно: в источнике нет информации о бесплатном тарифе для Live Avatar. Тем, кто ищет нейросеть для видео бесплатно, придётся проверить доступные пробные условия отдельно. Функция вышла в Gemini Enterprise и через Gemini Live API, то есть рассчитана на компании и разработчиков.
1. Зайди в Gemini: gemini.google.com. Это отправная точка в экосистему Google, там видно, какие возможности доступны твоему аккаунту.
2. Определи свой путь. Работаешь в компании, где подключён Gemini Enterprise: спроси у администратора, включена ли функция Live Avatar. Есть разработчик или подрядчик: попроси подключить её через Gemini Live API.
3. Посчитай бюджет. Возьми ожидаемое число минут разговоров и умножь на 39 центов. Добавь оплату входящих звука и видео.
4. Выбери персонажа из готовой библиотеки. Свой аватар по одной картинке пока только для корпоративных клиентов по запросу.
5. Запусти тест на одном сценарии, например «ответы на 10 частых вопросов клиентов», и посмотри, как реагируют люди.
Официальные описания смотри здесь: блог Google и анонс Google Cloud. Подробный обзор есть на Unite.AI и DataNorth.
Плюсы и что изменится дальше: лучшие нейросети для видео
Главный плюс в том, что нейросеть для создания видео теперь работает как собеседник. Раньше, чтобы получить говорящее лицо, нужно было записывать ролик, монтировать и озвучивать. Сейчас достаточно диалога. Плата идёт только за время речи, языков 97, а на всём контенте стоит метка SynthID, так что использовать аватар безопаснее с точки зрения прозрачности.
Скорее всего, в ближайшие месяцы такие аватары начнут появляться на сайтах компаний, в приложениях поддержки и обучающих курсах. Это предположение, а не обещание Google.
Ограничения. Свой персонаж пока доступен только корпоративным клиентам по запросу. Цена на минутах разговора складывается, а входящие звук и видео оплачиваются отдельно. О бесплатном доступе для частных пользователей в источнике ничего нет. Часть заявлений о качестве принадлежит самой Google, независимых тестов мы пока не видели.
Что сделать сегодня: нейросеть для видео из фото
Открой Gemini, загляни в описания функций и выбери один повторяющийся вопрос из твоей работы, который мог бы задавать говорящий аватар вместо тебя. Запиши его. Это будет твоё первое техническое задание для ИИ-аватара. А в комментариях к посту в @aigoby напиши, для чего ты бы использовал такой ии аватар, разберём самые интересные идеи.
🎁 Бонус: промпт для сценария аватара с нейросетью для генерации видео бесплатно
Скопируй и подставь свои данные, чтобы подготовить текст, который будет проговаривать аватар:
```
Ты — дружелюбный ИИ-консультант компании [название].
Твоя задача — отвечать на вопросы клиентов о [товар/услуга] голосом,
коротко (не больше 3 предложений), без сложных терминов.
Если не знаешь ответа — честно скажи и предложи связаться с человеком.
Вот 10 частых вопросов и правильные ответы: [вставь список].
Начни разговор с приветствия и вопроса «Чем могу помочь?».
```
Проверь такой сценарий на нескольких реальных вопросах, прежде чем показывать его клиентам.


Комментарии 0