Мовлення, зібране заново з гудіння і шипіння
24 квітня 1939 року Гомер Дадлі з Bell Telephone Laboratories доповів Національній академії наук США про автоматичний синтез мовлення; у липні доповідь вийшла друком у PNAS. Аналізатор розкладав голос мовця на 11 повільних сигналів: один ніс висоту тону, десять - потужність у смугах від 0 до 2950 герц, і кожен проходив крізь фільтр до 25 герц. Синтезатор збирав із них мовлення знову з двох джерел: гудіння релаксаційного генератора для дзвінких звуків і шипіння газової лампи для глухих.
Чому це важливо
Голос розклали на дві незалежні речі, джерело збудження й форму спектра, і показали, що повільних керівних сигналів досить, щоб зібрати мовлення назад. Сам Дадлі бачив у цьому шлях до таємності розмов і до вужчої смуги для телефонного мовлення. На цьому поділі стоять пізніші параметричне кодування й синтез мовлення.
Висоту тону міряв окремий канал: частотний дискримінатор, лічильник частоти й фільтр до 25 герц; для глухих звуків цей сигнал падав до нуля, і реле перемикало синтезатор з гудіння на шипіння. Перший із десяти спектральних каналів брав смугу 0-250 герц, дев'ять інших - смуги по 300 герц до 2950, верхню межу взято як типову для комерційних телефонних ліній; у кожному стояли смуговий фільтр, випрямляч і фільтр нижніх частот на 25 герц. Синтетичне мовлення відставало від живого приблизно на 17 мілісекунд. Роботу аналізатора показано на осцилограмах фрази «She saw Mary», записаної на магнітну стрічку. Дадлі описує, як експериментатор може обернути інтонацію, звести голос до монотону або скласти гібридний голос із висоти тону одного мовця й спектра іншого. Жовтнева стаття «Remaking Speech» у журналі Акустичного товариства додає, за її резюме, що розбірливість дає переважно спектр, а висота тону несе емоційне забарвлення. Чого запис не стверджує: відсотка розбірливості й сумарної смуги передачі, бо стаття їх не наводить. Слова «вокодер» у ній теж немає.