TD-Gammon
Програма Тезауро навчилася грати в нарди на рівні найкращих людей, граючи винятково сама проти себе, без бази партій і без підказок.
Чому це важливо
Поєднання мережі й навчання за часовими різницями дало рівень експерта — перший переконливий доказ, що ця пара працює.
Мережа оцінювала позицію, а метод часових різниць виправляв оцінку за наступним ходом. Після мільйона партій самонавчання програма грала нарівні зі світовою елітою. Більше того, деякі її дебютні ходи суперечили усталеній теорії, і згодом гравці переглянули теорію на її користь. Це той самий рецепт, що через двадцять чотири роки дав AlphaGo.