В 17 лет Конрад Зелиньский потерял голос из-за рака гортани, но голос ИИ в Whitney за $1500 возвращает ему возможность петь. Этот протез не требует операции и, в отличие от обычных аппаратов, позволяет менять интонацию, передавать эмоции и петь. Конрад основал Uhura Bionics в 2023 году, а 7 октября выступит с Whitney на сцене в Сан-Франциско.
Что вообще произошло
История началась с диагноза. Конраду было 17, когда врачи нашли у него рак гортани. Через несколько лет голосовой аппарат пришлось удалить — человек в прямом смысле слова остаётся без голоса, а вместе с ним и без любимого дела: до болезни Конрад играл в группе, и музыка была частью его жизни.
Он не сдался, а пошёл учиться. Защитил диссертацию по бионическим системам синтеза голоса и в 2023 году вместе с инженером Мареком Гжельцом основал стартап Uhura Bionics. Результат — устройство Whitney, названное в честь Уитни Хьюстон. Это носимая электронная «коробка голоса»: не имплант, операции не требует.
Как это работает по сути? Ты формируешь звук так, как можешь, а электроника превращает это в понятную речь — причём не монотонную, а живую, с интонацией. Именно поэтому Конрад не просто говорит, а поёт.
Сейчас Uhura продаёт свои устройства как wellness-гаджеты — то есть товары для благополучия и комфорта, а не как медицинские изделия. Компания параллельно добивается статуса медицинского прибора. Стоить Whitney будет $1500. Плюс стартап экспериментирует с клонированием голоса на базе ИИ и получает ранний доступ к новым моделям ElevenLabs — подробности есть на сайте Uhura, а разборы новости — у nstartup.me, daily.dev и ua.news.
Что это даёт лично тебе
Даже если у тебя нет проблем с голосом, эта новость — про тебя. Потому что за ней стоит технология, которой ты уже сегодня можешь пользоваться в работе, в учёбе и в творчестве. Вот конкретные сценарии.
• Лена, фрилансер-дизайнер. Делает рекламные ролики для клиентов. Раньше искала диктора и платила ему за озвучку, теперь сама пишет текст и прогоняет его через синтез голоса из текста — ролик готов за пять минут, а не за три дня.
• Тимур, владелец кофейни. Записал аудиоприветствие для гостей и голосовые объявления в соцсетях: ИИ-голосом озвучил тексты, которые Тимур написал сам между сменами. Вышло дешевле, чем заказывать у студии.
• Аня, мама двоих детей в декрете. Хочет запустить аудиокурс, но на запись всех уроков нет ни сил, ни тишины в квартире. Она делает ИИ-озвучку текста, а наговаривает только вступление — курс выходит в свет, и это её собственный проект.
• Студент Максим. Скидывает конспекты в сервис и слушает их по дороге в универ. Тот самый случай, когда синтез голоса онлайн экономит часы, которые раньше уходили на перечитывание.
• Обычный парень с гитарой. Хочет сделать ИИ-песню своим голосом — например, поздравить маму. Записывает пару минут речи, выбирает голос, накладывает вокал на минусовку и дарит подарок, которого не купишь в магазине.
• Семья, где у близкого пропал голос. Устройства вроде Whitney стоят $1500, и да, для реального лечения пока нужен статус медизделия. Но сама планка «вернуть речь и пение» уже не выглядит фантастикой. Это то, к чему технологии для восстановления голоса идут прямо сейчас.
Как попробовать прямо сейчас
Тебе не нужно ждать Whitney и не нужно быть айтишником. Начни с самого простого шага — озвучки текста.
1. Открой ElevenLabs и заведи аккаунт — регистрация бесплатная, платить сразу не нужно.
2. Вставь в поле текст. Хоть абзац из этой статьи, хоть поздравление, хоть сценарий ролика.
3. Выбери голос из библиотеки и нажми генерацию. Через несколько секунд получишь готовую озвучку — это и есть синтез голоса из текста.
4. Скачай файл и вставь в видео, в подкаст, в презентацию или в тёплое голосовое сообщение.
5. Если хочешь звучать именно своим голосом — найди в сервисе функцию клонирования и запиши несколько образцов речи. Дальше любой твой текст сможет читать твоя цифровая копия.
6. Для песни сделай короче: сначала чистый вокал или текст через выбранный голос, потом наложи это на минусовку в любом видеоредакторе.
Хочешь подойти по-взрослому — посмотри, как это делает Uhura Bionics: они экспериментируют с клонированием голоса и работают с новыми моделями ElevenLabs, а получившийся результат Зелиньский показывает живым людям на сцене.
Плюсы, минусы и честные ограничения
Что изменилось к лучшему: голос перестал быть чем-то, что нужно получать только от диктора, студии или дорогого оборудования. Сделать ИИ-голос и озвучку сегодня можно с ноутбука и без бюджета на команду. Для бизнеса это скорость и деньги, для творческого человека — возможность высказаться, даже если микрофон и тишина есть не всегда.
Честно про минусы. Разработчики прямо говорят: пока задержка слишком большая для синтеза речи в реальном времени, а эмоции передаются не настолько точно, как хотелось бы. Зелиньский ожидает, что эти проблемы решатся в течение двух-трёх лет. То есть для готовых роликов и подкастов технология уже рабочая, а для живого разговора «здесь и сейчас» — ещё нет. Плюс есть юридический нюанс: Whitney сейчас продаётся как wellness-устройство, а статус медицинского изделия компания только добивается. Клонирование чужого голоса без разрешения — отдельная история, и она плохо заканчивается.
Что делать прямо сейчас
Главная мысль этой новости проста: голос, который ты считал потерянным или недоступным, становится инструментом в твоих руках. Конрад доказал это на своём примере — от удалённой гортани до сцены 7 октября.
Твоё действие на сегодня одно: открой ElevenLabs, заведи аккаунт и озвучь один короткий текст. Пять минут — и у тебя будет первый настоящий результат, а не просто прочитанная статья.
Сохрани статью, чтобы вернуться к шагам, и напиши в комментариях в @aigoby, где ты хочешь применить ИИ-голос: в работе, в бизнесе или в творчестве. Подскажем, что делать дальше.
🎁 Бонус
Готовый промпт, который превращает твой текст в сценарий для озвучки — копируй и вставляй:
```
Ты — сценарист коротких аудиороликов. Перепиши мой текст в реплику для озвучки длительностью 30 секунд.
Правила:
• одна мысль в предложении, короткие фразы;
• в конце — призыв к действию;
• убери канцелярит и длинные перечисления;
• поставь паузы маркером [пауза] там, где голос должен передохнуть.
Вот текст: [вставь свой текст]
```
И маленький чек-лист перед первой озвучкой:
• текст разбит на короткие предложения;
• выбран один голос, а не три разных подряд;
• громкость и темп отрегулированы до генерации;
• готовый файл прослушан целиком перед публикацией;
• если клонируешь голос — используешь только свой или тот, на который есть разрешение.



Комментарии 0