Китайские разработчики научили ИИ говорить человеческим голосом

Специалисты китайской лаборатории Baidu Research, принадлежащей крупнейшему поисковому гиганту Поднебесной, создали алгоритм ИИ Deep Voice, способный преобразовывать текст в речь.

Подобные проекты, существовавшие до этого, сталкивались с проблемой скорости синтеза звука, поэтому для генерации голоса предшественникам Deep Vice требовалось от нескольких минут до пары часов, чтобы корректно и максимально натуралистично воспроизвести текст человеческим голосом.

Новая разработка китайских учёных основана на нейронных сетях и способна преобразовывать текст в голос в реальном времени.

Deep Voice умеет имитировать тембр, интонацию голоса и акцент, делая их очень правдоподобными и почти неотличимыми от настоящих, при этом голос может быть мужским или женским.

Разработчики уверены, что их технологию можно использовать в качестве цифровых помощников, применять для записи голосов в идеоиграх или же вовсе использовать для синхронного перевода фильмов по субтитрам.

«Это настоящий прорыв с технической точки зрения, ведь мы смогли решить сложнейшую проблему, синтезировав живую речь со всеми ее особенностями» — говорит Лео Зу, один из авторов проекта.

Создатели алгоритма пояснили, что проект Deep Voice вдохновлён аналогичными разработками, вот только все его компоненты работают под управлением нейронной сети, при этом используя в работе довольно простые функции, что делает их алгоритм весьма адаптивным — голоса можно подстроить «под себя», наделив систему новыми акцентами и другими особенностями.

«Глубокое обучение привело к революции в различных областях, таких как компьютерное зрение и распознавание речи, а сейчас настало время и голосового синтеза. Мы рады, что смогли добиться таких результатов, и будем работать дальше, чтобы сделать систему «текст-голос» ещё более реалистичной» — приводит Motherboard цитату разработчиков.

Не забывайте про наш телеграм-чатик!

Самые актуальные новости - в Telegram-канале

Китайские разработчики научили ИИ говорить человеческим голосом

Читайте также

Аналитик Oppenheimer: В выигрыше остался тот инвестор, который не стали продавать эфир в феврале

WebMoney конвертирует деньги с кошельков WMU в WMZ, но нужно подождать 3 года

Обзор курсов ТОП-10 криптовалют к USD — 20 мая 2018

Еще 7 фильмов, если понравилась «Игра в кальмара»🦑

За полгода украинский Facebook вырос до 16 млн, а Instagram — до 14 млн: исследование

8 лучших направлений для запуска бизнеса в 2018 году по версии Inc.

Добавить комментарий Отменить ответ