Toyota оголошує великі поведінкові моделі
Toyota Research Institute повідомила, що навчила роботів понад 60 складних спритних навичок методом на основі Diffusion Policy, і назвала цей напрям великими поведінковими моделями за аналогією до великих мовних.
Чому це важливо
Тут промислова лабораторія, а не університетська група, підписалася під твердженням, що навички робота походитимуть з однієї навченої моделі, а не з інженерії під кожну задачу, і навела для цього число навичок. Тоді ж закріпився сам термін.
Навички охоплюють переливання рідин, користування інструментами й маніпуляцію м’якими предметами. Поведінка вчиться з гаптичних демонстрацій учителя разом із мовним описом мети, після чого дифузійна політика засвоює показане; нову поведінку можна ввести в дію з десятків демонстрацій. Оскільки навички працюють просто із зображень камери й тактильних давачів, самими лише вивченими поданнями, вони дають раду з задачами, які традиційно були дуже важкими: м’які предмети, тканина, рідини. Число 60 — власний підрахунок TRI у пресрелізі: часток успіху по навичках там не наведено і незалежної перевірки немає, тому певність цього запису середня.