Корпус TIMIT
Спільна праця MIT, SRI і Texas Instruments дала корпус із 630 дикторів восьми діалектів, розмічений на рівні фонем.
Чому це важливо
Розпізнавання мовлення дістало спільну лінійку на п'ять років раніше, ніж обробка тексту отримала Penn Treebank.
Кожен диктор читав десять фонетично насичених речень; усього 6300 речень і понад п'ять годин мовлення з часовою прив'язкою транскрипції. Запис зробили в Texas Instruments, транскрибували в MIT, перевірив і видав NIST. Корпус досі вживають як навчальний приклад, хоч його розмір давно сміховинний. Головне, що він задав: результати стали порівнюваними між лабораторіями.