Звук і видимий образ одне з одного
У травні 1951 року Франклін Купер, Елвін Ліберман і Джон Борст із Haskins Laboratories опублікували в матеріалах Національної академії наук США роботу про взаємне перетворення чутних і видимих образів як основу для досліджень сприйняття мовлення. Роботу читали перед Академією 10 жовтня 1950 року. У листопаді 1952 року та сама група описала, що з цього вийшло: синтетичні склади дозволили систематично перебрати акустичні ознаки, за якими людина впізнає приголосні.
Чому це важливо
Синтез мовлення перестав бути демонстрацією й став методом. Якщо звук можна зібрати з довільного намальованого образу, то будь-яку здогадку про те, яка саме частина спектра несе розпізнавання звука, можна перевірити на слух - змінивши образ і послухавши результат. Саме так знайшли ознаки приголосних, яких зі спектрограм самих по собі не видно.
Повний текст статті 1951 року - скан на 744 кілобайти, і прочитати його не вдалося: шлях до PDF у PubMed Central відповідає перевіркою reCAPTCHA, дзеркало Europe PMC віддає помилку 520, а копія в репозиторії Товариства Макса Планка позначена як приватна. Тому із цього джерела взято назву, авторів, лабораторію, дві дати й сторінки, і жодного числа з тексту статті. Стаття 1952 року в акустичному журналі теж закрита, і з неї взято лише резюме. Чого запис не стверджує: як саме влаштовано апарат - ні кількості гармонік, ні основної частоти, ні верхньої межі діапазону, ні матеріалу стрічки. Звіт, з якого зроблено пакет, приписував статті 1952 року висновок про те, що двох нижніх формант досить для дванадцяти англійських голосних; у резюме тієї статті йдеться про приголосні, а слова «голосний» немає взагалі, тож це твердження не ввійшло. Назви, під якою цей апарат відомий, жодне з прочитаних джерел не вживає.