Повернутися до часової лінії

Дослідження · вересень 2016 р.

WaveNet

DeepMind навчила мережу породжувати звук відлік за відліком — і синтезоване мовлення вперше перестало відрізнятися від людського на слух.

Чому це важливо

Синтез мовлення після сорока років фільтрів і склеювання фрагментів перейшов на породжувальну модель.

Попередні системи або складали мовлення з записаних шматків, або фільтрували збудження за параметрами — і в обох випадках звучали механічно. WaveNet моделює розподіл кожного наступного відліку за всіма попередніми, використовуючи розширені причинні згортки. Перша версія була надто повільною для практики; через рік оптимізована версія запрацювала в Google Assistant.

Відомості про подію

Дата події
вересень 2016 р.
Дата на часовій лінії
Дата події
Перевірка
Джерела зібрано автоматично · 17 вересня 2026 р.
Лінії
ID
evt-0232

Оголошення від 8 вересня 2016 року.

Джерела

Пов’язані події

Записи, що посилаються на цей