Нейросеть научили копировать голос при синтезе текста в речь
04.09.19
Группа разработчиков создала алгоритм для синтеза текста в речь на основе нейросетевых моделей Tacotron 2 и WaveNet. Алгоритмы могут создавать голос, имитирующий говорящего по фрагменту стороннего аудиофайла. Результаты работы опубликованы на arxiv.org в июне 2018 года, открытый исходный код размещён на площадке GitHub.
Для работы алгоритма нужно два аудиофайла: один с примером голоса, который необходимо скопировать, и второй с фразой, которую этим голосом нужно произнести. После этого алгоритм почти в реальном времени преобразует голос из второго аудиофайла. В итоге. получает голос похожий на тон говорящего из первого файла.
Не пропустите интересное!
Підписывайтесь на наши каналы и читайте анонсы хай-тек новостей, тестов и обзоров в удобном формате!
Обзор смартфона Oppo A6 Pro: амбициозный
Новый смартфон Oppo A6 Pro — телефон среднего уровня с функциональностью смартфонов премиум-класса. Производитель наделил его множеством характеристик, присущих более дорогим телефонам. Но не обошлось и без компромиссов. Как именно сбалансирован Oppo A6 Pro – расскажем в обзоре.
Обзор смартфона Oppo Reno16 Pro 5G: обстоятельно
Oppo Reno16 Pro 5G выглядит сбалансированным смартфоном, в котором производитель постарался не делать единственную характеристику определяющей. Преимуществ у него много. Расскажем какие
Кризис оперативной памяти: серверы Nvidia с ИИ-чипами подорожают более чем на 15%
Nvidia предупредила крупнейших клиентов о грядущем повышении цен на ИИ-серверы из-за дефицита компонентов памяти. Рост стоимости затронет системы на базе чипов Vera Rubin и Grace Blackwell.
Бюджетные фитнес-часы Xiaomi Smart Band 11 Active: автономность до 21 дней
Xiaomi официально выпустила новый бюджетный фитнес-трекер Smart Band 11 Active на мировом рынке. Устройство получило 1,47-дюймовый экран, базовый набор датчиков здоровья и впечатляющий срок службы аккумулятора.


