LibriSpeech: тисяча годин аудіокниг
У квітні 2015 року Васіл Панайотов, Даніел Пові й співавтори з Університету Джонса Гопкінса опублікували LibriSpeech — близько 1 000 годин читаної англійської мови з 16 кГц, вирівняної з текстом, узятої з аудіокниг LibriVox, що перебувають у суспільному надбанні.
Чому це важливо
Відкритий корпус такого розміру для навчання й перевірки розпізнавання мовлення з'явився вперше, разом зі скриптами Kaldi й мовними моделями. Його частини «clean» і «other» на роки стали спільною мірою для всіх систем розпізнавання.
Навчальні частини — train-clean-100 (100,6 години), train-clean-360 (363,6) і train-other-500 (496,7); дикторів розділено на «clean» і «other» за похибкою моделі, навченої на WSJ. Моделі, навчені на LibriSpeech, мали нижчу похибку на тестах Wall Street Journal, ніж навчені на самому WSJ. Запис не наводить чисел WER із таблиці статті: витягнутий текст таблиці розбитий.