Обличчя з новин як еталон розпізнавання
У жовтні 2007 року Гері Гуан, Ману Рамеш, Тамара Берг і Ерік Лернед-Міллер з Массачусетського університету в Амгерсті випустили Labeled Faces in the Wild: 13 233 фото облич 5749 людей із новинних статей у вебі, 1680 із них — на двох і більше знімках. Задача — сказати про пару фото, чи на них та сама людина.
Чому це важливо
Бази облич доти знімали в контрольованих умовах, де поза, світло й тло задані. LFW узяв обличчя такими, якими їх фотографує преса, з єдиним фільтром — детектором Віоли — Джонса, і дав фіксований протокол із десяти розбиттів. Цим еталоном міряли розпізнавання облич наступне десятиліття: DeepFace 2014 року підійде на ньому до людського рівня, FaceNet 2015 року перейде 99 %.
Технічний звіт 07-49. Зображення 250 × 250 пікселів; для кожного названо людину в центрі кадру; 4069 людей мають лише одне фото. Основою став набір «Faces in the Wild» Берг і колег, зібраний спільним аналізом новинних фото й підписів до них, з точністю міток 77 %; LFW очистили від помилок і дублікатів. Перший вигляд даних — 1100 пар однієї людини й 1100 пар різних людей для навчання, по 500 для тесту; другий — десять підмножин для перехресної перевірки. Автори попереджають про упередження джерела: мало фото в поганому світлі, а через детектор Віоли — Джонса — мало профілів і ракурсів згори чи знизу. Запис читає ранню редакцію звіту зі сторінки Лернед-Міллера; пізніша, з архіву сайту набору, відрізняється бібліографією, а не числами. Сам сайт набору більше не відкривається.