Нейросеть научили копировать голос при синтезе текста в речь
04.09.19
Группа разработчиков создала алгоритм для синтеза текста в речь на основе нейросетевых моделей Tacotron 2 и WaveNet. Алгоритмы могут создавать голос, имитирующий говорящего по фрагменту стороннего аудиофайла. Результаты работы опубликованы на arxiv.org в июне 2018 года, открытый исходный код размещён на площадке GitHub.
Для работы алгоритма нужно два аудиофайла: один с примером голоса, который необходимо скопировать, и второй с фразой, которую этим голосом нужно произнести. После этого алгоритм почти в реальном времени преобразует голос из второго аудиофайла. В итоге. получает голос похожий на тон говорящего из первого файла.
Не пропустите интересное!
Підписывайтесь на наши каналы и читайте анонсы хай-тек новостей, тестов и обзоров в удобном формате!
Обзор смартфона Oppo A6 Pro: амбициозный
Новый смартфон Oppo A6 Pro — телефон среднего уровня с функциональностью смартфонов премиум-класса. Производитель наделил его множеством характеристик, присущих более дорогим телефонам. Но не обошлось и без компромиссов. Как именно сбалансирован Oppo A6 Pro – расскажем в обзоре.
Активное шумоподавление в наушниках-вкладышах: как Oppo научилась убирать шум
Наушники-вкладыши остаются одним из самых востребованных форм-факторов благодаря небольшому весу. Однако такая конструкция считается одной из самых сложных для внедрения активного шумоподавления (ANC). Расскажем как задачу решила компания Oppo
PlayStation Plus пополнится Kingdom Come: Deliverance II, Metro Exodus и Dying Light 2
Sony представила подборку игр, которые пополнят библиотеку PlayStation Plus в августе 2026 года.
One UI 9 — пятое бета-обновление : что нового для Samsung Galaxy S26 Ultra
Samsung представила пятую бета-версию One UI 9.5 для флагманской серии Galaxy S26. Разработчики исправили критические ошибки в интерфейсе и повысили общую стабильность системы.


