Нейросеть научили копировать голос при синтезе текста в речь
04.09.19
Группа разработчиков создала алгоритм для синтеза текста в речь на основе нейросетевых моделей Tacotron 2 и WaveNet. Алгоритмы могут создавать голос, имитирующий говорящего по фрагменту стороннего аудиофайла. Результаты работы опубликованы на arxiv.org в июне 2018 года, открытый исходный код размещён на площадке GitHub.
Для работы алгоритма нужно два аудиофайла: один с примером голоса, который необходимо скопировать, и второй с фразой, которую этим голосом нужно произнести. После этого алгоритм почти в реальном времени преобразует голос из второго аудиофайла. В итоге. получает голос похожий на тон говорящего из первого файла.
Не пропустите интересное!
Підписывайтесь на наши каналы и читайте анонсы хай-тек новостей, тестов и обзоров в удобном формате!
Обзор смартфона Oppo A6 Pro: амбициозный
Новый смартфон Oppo A6 Pro — телефон среднего уровня с функциональностью смартфонов премиум-класса. Производитель наделил его множеством характеристик, присущих более дорогим телефонам. Но не обошлось и без компромиссов. Как именно сбалансирован Oppo A6 Pro – расскажем в обзоре.
Logitech Signature Comfort Plus Combo MK880: приоритет на комфорт
Logitech Signature Comfort Plus Combo MK880 – беспроводной набор с клавиатуры и мыши, в котором акцент сделан на комфорте во время многочасовой работы, причем не только за счет эргономики корпуса, но и конструктивных дополений
Lenovo ThinkCentre X AIO Aura Edition: моноблок с необычным квадратным экраном
Lenovo представила новый моноблок ThinkCentre X AIO Aura Edition с 27.6-дюймовым экраном соотношением 16:18.
Bosgame E6 ECO дебютировал с Intel Core 3, LPDDR5X и SSD на 512 ГБ
Bosgame представляет E6 ECO — компактный мини-ПК на базе Intel Core 3 304 с 12 ГБ LPDDR5X и поддержкой новейшего стандарта Wi-Fi 7.


