Дані важать більше за алгоритм
Банко і Брілл навчили чотири різні алгоритми на корпусах від мільйона до мільярда слів і показали, що на великих даних вони збігаються.
Чому це важливо
Найпростіший алгоритм на мільярді слів переміг найкращий на мільйоні — і це змістило зусилля поля з методів на дані.
Криві для всіх чотирьох методів продовжували зростати і не виходили на плато навіть на мільярді слів. Висновок автори сформулювали обережно: за наявних обсягів вибір алгоритму важить менше, ніж вважалося. Через вісім років Халеві, Норвіг і Перейра розгорнули цю саму тезу в статтю про нерозумну ефективність даних. Це попередник того, що згодом назвали законами масштабування.