Автоматичне розпізнавання вимовлених цифр
У листопаді 1952 року К. Г. Девіс, Р. Біддалф і С. Балашек із Bell Labs описали схему, яка автоматично впізнає десять цифр телефонної якості, вимовлених у звичайному темпі одним мовцем, із точністю від 97 до 99 відсотків. Спектр ділили на дві смуги, нижче й вище 900 герц, рахували в кожній перетини осі, а результат зіставляли з десятьма вбудованими еталонами - по одному на цифру - і брали найкращий збіг.
Чому це важливо
Уперше машина впізнавала вимовлені слова з виміряною точністю, а не в принципі. Разом із тим стаття одразу назвала обмеження, яке протримається два десятиліття: схему треба було налаштовувати під конкретного мовця, і без такого налаштування вона на низці різних голосів так не працювала.
Повний текст закритий платною стіною, і запис стоїть на резюме статті, де і точність, і спосіб названо прямо. Резюме каже, що після попереднього аналізу мовлення будь-якої людини схему можна налаштувати під неї з такою самою точністю, і що в теперішній конфігурації вона не працює однаково добре на низці мовців без такого звернення до налаштування. Чого запис не стверджує: що дві виміряні смуги давали першу й другу форманти, що еталони були резистивними схемами і що апарат називався Audrey. Усіх трьох тверджень у резюме немає, а звіт, з якого зроблено пакет, подавав усі три; вони не ввійшли. Кількості мовців, на яких проводили вимірювання, резюме теж не називає - лише що це була одна людина.