Повернутися до часової лінії

Дослідження · квітень 2015 р.

LibriSpeech: тисяча годин аудіокниг

У квітні 2015 року Васіл Панайотов, Даніел Пові й співавтори з Університету Джонса Гопкінса опублікували LibriSpeech — близько 1 000 годин читаної англійської мови з 16 кГц, вирівняної з текстом, узятої з аудіокниг LibriVox, що перебувають у суспільному надбанні.

Чому це важливо

Відкритий корпус такого розміру для навчання й перевірки розпізнавання мовлення з'явився вперше, разом зі скриптами Kaldi й мовними моделями. Його частини «clean» і «other» на роки стали спільною мірою для всіх систем розпізнавання.

Навчальні частини — train-clean-100 (100,6 години), train-clean-360 (363,6) і train-other-500 (496,7); дикторів розділено на «clean» і «other» за похибкою моделі, навченої на WSJ. Моделі, навчені на LibriSpeech, мали нижчу похибку на тестах Wall Street Journal, ніж навчені на самому WSJ. Запис не наводить чисел WER із таблиці статті: витягнутий текст таблиці розбитий.

Відомості про подію

Дата події
квітень 2015 р.
Дата на часовій лінії
Дата події
Перевірка
Джерела зібрано автоматично · 25 вересня 2026 р.
Лінії
ID
evt-0770

Місяць за Crossref: матеріали ICASSP 2015, конференція 19–24 квітня в Брисбені. Авторська копія статті дати не несе.

Джерела

Пов’язані події

Записи, що посилаються на цей