Повна колекція за десятиліттями. Ця сторінка працює без JavaScript і показує кожен опублікований запис — незалежно від того, чи входить він у добірку на осі.
Атлас має часткове покриття. Порожній період не означає відсутність подій.
24 квітня 1939 р.Дослідження · МультимодальніЛінії: Мовлення
24 квітня 1939 року Гомер Дадлі з Bell Telephone Laboratories доповів Національній академії наук США про автоматичний синтез мовлення; у липні доповідь вийшла друком у PNAS. Аналізатор розкладав голос мовця на 11 повільних сигналів: один ніс висоту тону, десять - потужність у смугах від 0 до 2950 герц, і кожен проходив крізь фільтр до 25 герц. Синтезатор збирав із них мовлення знову з двох джерел: гудіння релаксаційного генератора для дзвінких звуків і шипіння газової лампи для глухих.
вересень 1940 р. — 1 лютого 1942 р.Дослідження · Наукові основиЛінії: Теорія навчання · Оборона
У вересні 1940 року Норберт Вінер запропонував свої послуги Ванневарові Бушу, який вів воєнні дослідження США, і взявся за задачу зенітників: передбачити, де літак опиниться, коли до нього долетить снаряд. 1 грудня NDRC уклав із MIT контракт, і разом з інженером Джуліаном Біґелоу Вінер будував предиктор, що рахував майбутнє положення цілі з її минулого курсу.
березень 1946 р.Віха · Наукові основиЛінії: Теорія навчання
Фонд Мейсі зібрав першу конференцію про механізми зворотного зв'язку й кругової причинності в біологічних і соціальних системах. Групу склали фізики, математики, інженери-електрики, фізіологи, неврологи, психіатри, соціологи й антропологи.
У липні 1946 року В. Кеніг, Г. К. Данн і Л. Й. Лейсі з Bell Labs опублікували конструкцію звукового спектрографа - аналізатора, який дає постійний зоровий запис того, як енергія звуку розподілена водночас за частотою і за часом. Стаття описує роботу приладу, механіку й електричні схеми конкретної моделі та наводить спектрограми голосу, звуків тварин і птахів, музики й частотних модуляцій.
У травні 1951 року Франклін Купер, Елвін Ліберман і Джон Борст із Haskins Laboratories опублікували в матеріалах Національної академії наук США роботу про взаємне перетворення чутних і видимих образів як основу для досліджень сприйняття мовлення. Роботу читали перед Академією 10 жовтня 1950 року. У листопаді 1952 року та сама група описала, що з цього вийшло: синтетичні склади дозволили систематично перебрати акустичні ознаки, за якими людина впізнає приголосні.
6 листопада 1950 – 25 грудня 1951 рр.Віха · Наукові основиЛінії: Обчислення
У лабораторії С. О. Лебедєва Інституту електротехніки АН УРСР у Феофанії під Києвом 6 листопада 1950 року вперше запустили макет Малої електронної лічильної машини (МЕСМ), а 25 грудня 1951 року урядова комісія прийняла її в регулярну експлуатацію. Того ж дня машина розв'язала першу справжню задачу: 585 значень функції розподілу, близько 250 000 операцій за 2,5 години.
У листопаді 1952 року К. Г. Девіс, Р. Біддалф і С. Балашек із Bell Labs описали схему, яка автоматично впізнає десять цифр телефонної якості, вимовлених у звичайному темпі одним мовцем, із точністю від 97 до 99 відсотків. Спектр ділили на дві смуги, нижче й вище 900 герц, рахували в кожній перетини осі, а результат зіставляли з десятьма вбудованими еталонами - по одному на цифру - і брали найкращий збіг.
1953Дослідження · Наукові основиЛінії: Пошук і міркування
У розділі збірника «Faster Than Thought» Тюрінг виклав правила вибору шахового ходу, які, за його словами, легко перетворити на програму для машини, і навів партію, зіграну за цими правилами проти слабкого гравця.
У листопаді 1956 року Гаррі Олсон і Герберт Белар із RCA Laboratories описали фонетичну друкарську машинку - спрощену, але повну систему, яка друкує у відповідь на слова, вимовлені в мікрофон. Стаття розбирає п'ять задач: у якій формі друкувати слова, чим аналізувати звуки мовлення, як упізнавати проаналізоване, як кодувати й розкодовувати це для виконавчого механізму і як цей механізм будувати.
9 грудня 1957 р.Дослідження · ЗображенняЛінії: Дані
9 грудня 1957 року Рассел Кірш і троє колег із Національного бюро стандартів США описали барабанний сканер, приєднаний до комп’ютера SEAC. Він за 25 секунд перетворював знімок 44 × 44 мм на 176 × 176 двійкових цифр, а програма показувала картинку назад на осцилографі.
1 липня 1958 р.Віха · Наукові основиЛінії: Оборона · Обчислення
1 липня 1958 року перший обчислювальний центр AN/FSQ-7 оголошено бойовим на базі Макгвайр. Машина приймала дані радарів, зводила з них цілісну повітряну картину і наводила засоби ураження на цілі.
24–27 листопада 1958 р.Дослідження · Наукові основиЛінії: Теорія навчання
Селфрідж описав розпізнавання як кілька рівнів простих агентів: одні бачать риси зображення, інші складають із них здогади, останній обирає найгучнішу.
3 липня 1959 р.Дослідження · Наукові основиЛінії: Наука · Теорія навчання
3 липня 1959 року Роберт Ледлі й Лі Ластед надрукували в Science статтю «Reasoning Foundations of Medical Diagnosis». Вони розклали діагноз на символьну логіку, що пов'язує симптоми з хворобами, імовірність за адаптованою формулою Байєса й теорію цінності для вибору лікування, а обчислення показали на картках із вирізами, які сортують руками.
жовтень 1959 р.Дослідження · ЗображенняЛінії: Теорія навчання · Наука
У жовтні 1959 року Девід Г'юбел і Торстен Візел описали поля окремих клітин первинної зорової кори кішки: поле ділилося на збудливі й гальмівні зони, що лежать поруч, і клітину рухав лише стимул певної форми, розміру, положення й орієнтації.
1959Дослідження · Наукові основиЛінії: Символьний підхід · Пошук і міркування
Ранньою весною 1959 року IBM 704 у дослідницькому центрі IBM із програмою приблизно на 20 000 інструкцій довів свою першу теорему евклідової планіметрії. Машина Герберта Гелернтера приймала підціль лише тоді, коли та справджувалася на кресленні, і так відкидала хибні кроки ще до спроби їх довести.
січень 1960 р.Дослідження · Наукові основиЛінії: Символьний підхід · Теорія навчання
У січні 1960 року Хао Ван описав в IBM Journal програми для IBM 704, що довели понад 200 теорем числення висловлень із перших п'яти розділів «Principia Mathematica» менш ніж за 3 хвилини чистого часу, а з предикатної частини — 139 із 158 теорем. Програми він написав улітку 1958 року в лабораторії IBM у Покіпсі.
березень 1960 р.Віха · Наукові основиЛінії: Обчислення
Навесні 1960 року інженери Cornell Aeronautical Laboratory описали Mark I — апаратний перцептрон Розенблатта. Сітківка з 20×20 фоторезисторів, 512 асоціативних елементів, 8 елементів відповіді, а ваги — потенціометри, які крутять електромотори. Після шістнадцяти показів кожної літери машина правильно впізнавала всі 26 літер стандартного шрифту.
березень 1960 р.Дослідження · Роботи й автономністьЛінії: Теорія навчання
У березні 1960 року Р. Е. Калман опублікував у Journal of Basic Engineering (Transactions of the ASME, том 82, випуск 1, с. 35–45) статтю «A New Approach to Linear Filtering and Prediction Problems». Класичну задачу фільтрації й прогнозу переглянуто через опис динамічної системи станом і переходами: виведено нелінійне рівняння для коваріації похибки оптимальної оцінки, з розвʼязку якого без додаткових обчислень виходять коефіцієнти оптимального лінійного фільтра; метод однаково працює для стаціонарної й нестаціонарної статистики.
6 травня 1960 р.Дослідження · Наукові основиЛінії: Безпека
6 травня 1960 року журнал Science надрукував статтю Норберта Вінера «Some Moral and Technical Consequences of Automation». На прикладі шашкових програм IBM, які після 10–20 годин гри й навчання обігрують того, хто їх запрограмував, Вінер доводив, що машина, яка вчиться, може виробити непередбачені стратегії швидше, ніж людина встигне їх зрозуміти й втрутитися.
8 червня 1961 р.Дослідження · Наукові основиЛінії: Символьний підхід · Теорія навчання
У звіті Нью-Йоркського університету від 8 червня 1961 року Мартін Девіс, Джордж Логеман і Дональд Лавленд описали програму для IBM 704, що перевіряє формули методом Девіса й Патнема 1960 року, замінивши одне з його правил правилом розщеплення. Формулу, над якою програма Гілмора працювала 21 хвилину без результату, вона довела менш ніж за дві хвилини.
1961 року інженер IBM Вільям Дерш показав на пресконференції Shoebox - машину завбільшки зі взуттєву коробку, яка розпізнавала 16 слів: цифри від нуля до дев'яти й шість команд, серед них «plus», «minus», «total» і «subtotal». Дерш промовив «Seven plus three plus six plus nine plus five. Subtotal», машина надрукувала кожну цифру й команду і видала 30. Схема обходилася 31 транзистором, менше ніж двома на слово, тоді як ранішим машинам, за словами IBM, треба було до 200 транзисторів на слово.
Перший промисловий робот Unimate став до роботи в автомобільній промисловості: за музейним записом, на заводі General Motors у Нью-Джерсі, де виймав розжарені відливки з машини лиття під тиском.
січень 1962 р.Дослідження · ЗображенняЛінії: Теорія навчання · Наука
У січні 1962 року Г'юбел і Візел поділили поля 303 клітин зорової кори кішки на прості й складні: складна клітина відповідала на правильно орієнтовану щілину, межу чи смугу будь-де у своєму полі. Кора виявилася складеною з колонок клітин з однаковою орієнтацією.
1962 року Обчислювальний центр Академії наук УРСР, створений 1957-го, став Інститутом кібернетики АН УРСР: статут інституту називає постанову Президії Академії від 11 травня 1962 року. Директором став Віктор Глушков, який очолював і сам центр.
1961 — листопад 1963 р.Дослідження · Наукові основиЛінії: Теорія навчання
У листопаді 1963 року Дональд Мічі описав у The Computer Journal машину MENACE, що вчилася грати в хрестики-нулики спробами й помилками: по сірниковій коробці на кожну з 287 істотно різних позицій, кольорові намистинки в ній — можливі ходи. Після нічиєї в кожну відкриту коробку додавали одну намистинку, після перемоги — три, після поразки одну забирали. Саму машину й перший турнір Мічі описав ще 1961 року.
1964Дослідження · Наукові основиЛінії: Теорія навчання
1964 року Видавництво Академії наук УРСР у Києві випустило книжку Віктора Глушкова «Введение в кибернетику» на 324 сторінки. Вона зводить в одне теорію алгоритмів і автоматів, булеву алгебру, самоорганізовні системи й навчання перцептронів, ЕОМ і Алгол-60, числення предикатів і автоматизацію доведень. 1966 року вийшли два англійські переклади.
1965Дослідження · Наукові основиЛінії: Теорія навчання
1965 року київське видавництво «Наукова думка» випустило російськомовну книжку хірурга й кібернетика Миколи Амосова про моделювання мислення й психіки на 302 сторінки; 1967 року вона вийшла англійською як «Modeling of Thinking and the Mind». Книжка описує кору мозку як «потужний моделювальний апарат» із тимчасовими й постійними моделями.
листопад 1966 р.Віха · Мовні моделіЛінії: Гроші й ринок · Право й політика
Комітет Національної академії наук дійшов висновку, що машинний переклад повільніший, дорожчий і гірший за людський, і рекомендував припинити його фінансування.
1966Дослідження · Наукові основиЛінії: Дані · Наука
У 1966 році Петр Гаєк, Іван Гавел і Методей Хитил із Праги опублікували метод GUHA (General Unary Hypotheses Automaton): комп'ютер систематично породжує всі гіпотези певного вигляду про зв'язки між властивостями об'єктів і видає ті, що справджуються на даних. Чеську статтю в Kybernetika перевірено на машині MINSK 2 на даних 230 пацієнтів з епілепсією, по 36 властивостей на кожного.
У шостому томі Advances in Computers, який видавець датує 1966 роком, Ірвінг Джон Гуд із Трініті-коледжу в Оксфорді опублікував «Speculations Concerning the First Ultraintelligent Machine». Він визначив ультраінтелектуальну машину як таку, що далеко перевершує будь-яку людину в усій інтелектуальній діяльності, і вивів, що вона зможе конструювати ще кращі машини.
січень 1968 р.Дослідження · Мовні моделіЛінії: Мовлення · Теорія навчання
У січні 1968 року український журнал «Кібернетика» надрукував роботу Т. К. Вінцюка «Розпізнавання мовлення динамічним програмуванням» - том 4, число 1, сторінки 81-88; англійський переклад вийшов як Cybernetics, том 4, сторінки 52-57. У ній динамічне програмування застосовано до вирівнювання двох висловлювань у часі, разом з алгоритмами для розпізнавання злитих слів.
листопад 1968 р.Дослідження · Наукові основиЛінії: Символьний підхід · Інструменти
У листопаді 1968 року Н. Г. де Брейн випустив у Технічному університеті Ейндговена звіт про Automath — мову для запису математики так докладно, що комп'ютер може перевірити, чи правильний текст. Такий текст може містити не лише доведення однієї теореми, а цілу теорію разом із її правилами виведення.
1968Дослідження · Наукові основиЛінії: Теорія навчання
У «Кібернетиці» 1968 року (№ 2, с. 81–88) М. І. Шлезінгер описав алгоритм самонавчання для розпізнавання образів: кожна ітерація спершу розпізнає зразки, обчислюючи апостеріорні ймовірності класів, а тоді розв'язує задачу навчання з цими ймовірностями. Стаття доводить, що правдоподібність при цьому строго зростає, а граничні значення параметрів — оцінки максимальної правдоподібності.
1965 — 1969Віха · Наукові основиЛінії: Обчислення · Символьний підхід
В Інституті кібернетики АН УРСР під керівництвом Віктора Глушкова в 1965–1969 роках створили машини для інженерних розрахунків МИР-1 і МИР-2. Вхідна мова МИР-1 мала знаки інтеграла, суми й добутку, а довжина чисел обмежувалася лише пам'яттю; мову «Аналітик» для аналітичних перетворень формул інтерпретувала сама машина. МИР-2 пішла у виробництво 1969 року.
1969Дослідження · Наукові основиЛінії: Теорія навчання
Брайсон і Хо показали, як отримати градієнт критерію за керуванням на кожному кроці багатоступеневої системи: множники Лагранжа, які вони називають також функціями впливу, обчислюються назад від останнього кроку.
березень 1970 р. – квітень 1970 р.Дослідження · Наукові основиЛінії: Символьний підхід · Теорія навчання
У «Кібернетиці» 1970 року (№ 2, березень–квітень) Віктор Глушков опублікував статтю про проблеми теорії автоматів і штучного інтелекту, у якій, за ретроспективами його учнів, сформулював програму «алгоритм очевидності»: формальна мова, близька до мови математичних статей, пошук доведення на основі машинного поняття очевидного кроку, що зростає з досвідом системи, і допомога людини в пошуку.
Близько 1970 року, за словами розробника, SYSTRAN Пітера Тоуми, розроблений за підтримки ВПС США, став робочою системою перекладу з російської на англійську й працював так і на березень 1976 року, коли Тоума доповідав на семінарі Служби моніторингу іноземного мовлення. За його словами, система на IBM 360/370 обробляла 300 000 слів за годину процесорного часу.
У «Кібернетиці» 1971 року (№ 2, березень–квітень) Т. К. Вінцюк поставив задачу розпізнавання злитого мовлення зі слів заданого словника і запропонував розв'язок: поділ сигналу на слова вибирається в самому процесі розпізнавання динамічним програмуванням, для чого введено нову обчислювальну схему з «потенційно-оптимальним індексом». Результат розпізнавання — послідовність слів.
травень 1971 р.Дослідження · Наукові основиЛінії: Теорія навчання
Кук показав, що задача виконуваності булевої формули — найважча у своєму класі: до неї зводиться будь-яка задача, розв'язок якої можна швидко перевірити.
Навесні 1971 року Кеннет Колбі, Сильвія Вебер і Франклін Гільф описали PARRY — програму-симуляцію параноїдного пацієнта, що веде психіатричне інтерв'ю через телетайп. Успіх моделі вони запропонували міряти тестами на нерозрізненність, і 1972 року судді-психіатри намагалися відрізнити інтерв'ю з нею від інтерв'ю з пацієнтами.
січень 1972 р.Дослідження · Мовні моделіЛінії: Теорія навчання
У січні 1972 року Карен Спарк-Джонс із Кембриджу запропонувала зважувати терміни запиту за тим, у скількох документах колекції вони трапляються: збіг на рідкому терміні важить більше, ніж на частому. На трьох тестових колекціях — Cranfield, INSPEC і Keen — таке зважування дало суттєвий приріст над простим підрахунком збігів.
1 квітня 1972 р.Бенчмарк · Наукові основиЛінії: Наука · Оцінювання
1 квітня 1972 року BMJ надрукував порівняння, яке група Ф. Т. де Домбаля з Лідського університету вела з 1 січня до 1 грудня 1971 року на 304 пацієнтах із гострим болем у животі. Діагноз, якому комп'ютер давав найбільшу ймовірність, збігся з остаточним у 279 випадках (91,8 %); діагноз найстаршого лікаря, що бачив пацієнта, — у 242 (79,6 %).
травень 1972 р.Дослідження · Наукові основиЛінії: Символьний підхід · Інструменти
У травні 1972 року Робін Мілнер описав у мемо Стенфордського проєкту штучного інтелекту LCF — програму, що перевіряє формальні доведення в логіці обчислюваних функцій, яку Дана Скотт запропонував в Оксфорді восени 1969 року. Людина ставить мету й розбиває її на підцілі, а машина веде доведення й перевіряє кожен крок.
20–23 серпня 1973 р.Дослідження · Наукові основиЛінії: Символьний підхід · Інструменти
У серпні 1973 року на IJCAI в Стенфорді Роберт Бойєр і Джей Стротер Мур з Единбурзького університету описали програму, що сама доводить теореми про рекурсивні функції LISP математичною індукцією: серед доведеного — що REVERSE є оберненою до самої себе і що певна програма сортування правильна. На ICL 4130 кожна теорема коштувала в середньому 8 секунд.
У 1973 році Емблер, Барроу, Браун, Берстолл і Попплстоун з Единбурга описали на IJCAI-73 систему збирання: рухомий стіл, рука з датчиками і дві телекамери, зʼєднані через Honeywell 316 з ICL 4130 під POP-2. Оператор кидає деталі купою; машина розбирає купу, впізнає деталі верхньою камерою, розкладає їх і збирає навпомацки кілочок з кільцями, іграшковий автомобіль чи корабель. Показати їй пів дюжини нових деталей — близько двох годин, запрограмувати збирання — близько чотирьох; саме збирання триває годину-дві і вдається приблизно чотири рази з пʼяти.
1973Дослідження · Роботи й автономністьЛінії: Втілення
На IJCAI-73 Борис Добротін із Лабораторії реактивного руху й Віктор Шейнман зі Стенфордського проєкту ШІ описали маніпулятор робототехнічної програми JPL, побудований за проєктом стенфордського проєкту «Hand-Eye»: шість ступенів свободи (два обертальні, один лінійний, три обертальні), виліт до 52 дюймів, підйом близько 5 фунтів, повний рух приблизно за 5 секунд, шість двигунів постійного струму з хвильовими редукторами на чотирьох внутрішніх обертальних суглобах. Рука цілком під керуванням компʼютера: людина дає лише команди верхнього рівня.
червень 1974 р.Дослідження · Наукові основиЛінії: Символьний підхід
Мінський запропонував подавати знання стереотипними ситуаціями: фрейм має поля, частина яких заповнена значеннями за замовчуванням, поки не з'явиться протилежне.
1974Дослідження · Наукові основиЛінії: Теорія навчання
Пол Вербос подав у Гарвард дисертацію, де показав, як за один прохід назад упорядкованою таблицею операцій обчислити всі похідні похибки складної моделі. Сам він назвав метод «dynamic feedback».
вересень 1975 р.Дослідження · Роботи й автономністьЛінії: Втілення
У вересні 1975 року на IJCAI-75 у Тбілісі Микола Амосов, Ернст Куссуль і В. Д. Фоменко з відділу біокібернетики київського Інституту кібернетики описали транспортного робота ТАІР, яким керує не програма, а нейроподібна мережа зі 100 вузлів у шести «сферах», із системою підкріплення й гальмування та 60 каналами від датчиків. Візок триколісний, 1600×1100×600 мм.
листопад 1975 р.Дослідження · Мовні моделіЛінії: Теорія навчання
У листопаді 1975 року Джерард Салтон, А. Вонг і Ч. С. Ян з Корнелла описали документи й запити як вектори ваг термінів і показали, що пошук працює краще там, де документи в цьому просторі лежать далі один від одного. На трьох колекціях — 424 документи з аеродинаміки, 450 з медицини і 425 статей Time — вони за цим мірилом добирали словник індексування.
9 грудня 1975 року система METEO групи TAUM Монреальського університету почала експериментально перекладати публічні прогнози погоди для всієї Канади з англійської на французьку, а на 15 травня 1976 року запланували повну експлуатацію. Речення, які система приймала, йшли до радіо й газет без людської правки.
13 січня 1976 р.Віха · МультимодальніЛінії: Мовлення
13 січня 1976 року Реймонд Курцвейл і Джеймс Гешел із Національної федерації сліпих показали репортерам машину, яка читає друкований текст уголос: сканер із камерою під склом, мінікомп'ютер розпізнає літери й перетворює їх на мовлення, а сліпий керує читанням клавішами з позначками Брайля.
Система Лоуерра розпізнавала 1011 слів злитного мовлення, згорнувши всі знання про мову в одну велику мережу переходів і шукаючи в ній промінь найкращих шляхів.
липень 1976 р.Віха · Наукові основиЛінії: Наука · Символьний підхід
У липні 1976 року Кеннет Аппель і Вольфганг Гакен з Іллінойського університету подали доведення того, що будь-яку плоску карту можна розфарбувати чотирма кольорами. Воно зводилося до скінченного набору конфігурацій, кожну з яких треба було перевірити на зводність; перевірку зробили програми авторів на комп'ютерах IBM.
23 грудня 1976 р.Дослідження · МультимодальніЛінії: Мовлення · Наука
23 грудня 1976 року Nature надрукував статтю Гаррі Мак-Ґурка й Джона Макдональда із Суррейського університету. Коли на відео обличчя жінки, що вимовляє [ga], накладали звук [ba], дорослі чули [da]; при зворотному накладанні більшість чула [bagba] або [gaba]. Сам звук або незмінений фільм давали склади правильно.
22–25 серпня 1977 р.Бенчмарк · Наукові основиЛінії: Наука · Оцінювання · Символьний підхід
На IJCAI-77 у Кембриджі (22–25 серпня 1977 року) С. М. Вайс, К. А. Куліковський і А. Сафір описали CASNET — програму для тривалого ведення глаукоми, що міркує через причинну мережу станів хвороби. На зустрічі Американської академії офтальмології й отоларингології 1976 року 49 офтальмологів оцінили її поради: 95 % визнали їх клінічно прийнятними, 77 % — експертними або дуже компетентними.
У серпні 1977 року група Лабораторії штучного інтелекту MIT повідомила, що на прототипі Lisp-машини працює майже повна система. Це персональний комп'ютер, чий набір інструкцій, за звітом, спроєктовано саме під мову Lisp, якою користувалися дослідники ШІ; повна машина мала б коштувати близько 80 000 доларів.
Шенк і Абельсон стверджували, що зрозуміти текст означає добудувати невимовлене: читач знає сценарій ресторану і тому не потребує згадки про офіціанта.
квітень 1978 р. – грудень 1978 р.Дослідження · Наукові основиЛінії: Обчислення · Теорія навчання
У квітні 1978 року Г. Т. Кунг і Чарлз Лейзерсон з Карнегі-Меллона описали систолічні масиви: мережу однакових процесорів, крізь яку дані ритмічно течуть, як кров крізь серце, і кожен процесор на кожному такті робить один крок скалярного добутку. Шестикутна решітка з w1·w2 процесорів множить дві смугові матриці n×n за 3n+min(w1, w2) тактів.
1977 — 1978Дослідження · Наукові основиЛінії: Символьний підхід · Наука
У 1977 році математик Ву Веньцзюнь з Академії наук Китаю реалізував на комп'ютері Great Wall 203 з пам'яттю 4K метод, що перетворює теорему елементарної геометрії на систему поліномів і перевіряє її алгебраїчно, і довів теорему про пряму Сімсона. Статтю про метод опубліковано 1978 року в Scientia Sinica.
лютий 1980 р.Дослідження · ЗображенняЛінії: Теорія навчання · Наука
У лютому 1980 року Девід Марр та Еллен Гілдрет опублікували теорію виявлення країв. Зображення згортається з лапласіаном гаусіана, а край позначається там, де результат переходить через нуль. Фільтр застосовують на кількох ширинах — у статті показано w = 6, 12 і 24 пікселі — і нулі визнають краєм, коли вони збігаються в каналах сусідніх розмірів.
У липні 1980 року Річард Болт з Architecture Machine Group MIT описав на SIGGRAPH систему, де людина в кріслі перед настінним екраном створює й пересуває фігури, кажучи «put that there» і показуючи рукою. Мовлення розпізнавав NEC DP-100 зі словником до 120 слів, напрям руки — магнітний датчик Polhemus на ремінці годинника.
1980Доступність · Роботи й автономністьЛінії: Оборона · Втілення
Виробництво почалося 1978 року, а 1980-го систему вперше встановили на авіаносці USS Coral Sea. Phalanx сам шукає, виявляє, оцінює, супроводжує, обстрілює ціль і оцінює результат — без стороннього втручання.
квітень 1981 р.Дослідження · ЗображенняЛінії: Теорія навчання
У квітні 1981 року Брюс Лукас і Такео Канаде показали метод суміщення двох зображень, який не перебирає можливі зсуви, а користується просторовим градієнтом яскравості, щоб на кожному кроці виправити поточну оцінку зсуву. Повний перебір зсувів у діапазоні M × M на зображенні N × N коштує O(M²N²); цей метод збігається в середньому за O(M² log N) кроків.
червень 1981 р.Дослідження · ЗображенняЛінії: Теорія навчання
У червні 1981 року Мартін Фішлер і Роберт Боллс опублікували RANSAC. Замість того щоб усереднювати всі виміри, метод бере мінімальну кількість точок, потрібну для гіпотези, будує модель і рахує, скільки решти з нею узгоджується. У досліді з двадцяти орієнтирів, п'ять із яких були грубо помилковими, метод знайшов правильний розв'язок з другої трійки точок і не взяв жодної помилкової.
серпень 1981 р.Дослідження · ЗображенняЛінії: Теорія навчання
Бертольд Горн і Браян Шанк показали, що швидкість руху не можна визначити локально: у кожній точці є один вимір і дві невідомі. Вони додали другу умову — вимогу, щоб поле швидкостей змінювалося плавно майже скрізь, — і звели оцінку руху до мінімізації одного функціонала на всьому зображенні. Стаття вийшла у серпні 1981 року.
10 вересня 1981 р.Дослідження · ЗображенняЛінії: Теорія навчання
10 вересня 1981 року Крістофер Лонге-Гіггінс опублікував у Nature алгоритм, що відновлює тривимірну будову сцени й взаємне положення двох ракурсів із самих лише відповідностей між точками двох знімків. Вісім пар відповідних точок дають систему лінійних рівнянь, і цього досить — без жодних відомостей про те, як стояли камери.
19 серпня 1982 р.Бенчмарк · Наукові основиЛінії: Оцінювання · Наука · Символьний підхід
19 серпня 1982 року NEJM опублікував систематичну оцінку INTERNIST-I, програми для множинних діагнозів у внутрішній медицині: на 19 клініко-патологічних випадках журналу вона діяла якісно як лікарі лікарні, але гірше за фахівців, що ці випадки обговорювали.
3 вересня 1982 р.Віха · Наукові основиЛінії: Символьний підхід · Наука
У Science від 3 вересня 1982 року Кемпбелл, Голлістер, Дуда й Гарт повідомили, що експертна система PROSPECTOR за геологічними картами, складеними до буріння, і правилами фахівця з порфірового молібдену вказала на горі Маунт-Толмен у штаті Вашингтон місце раніше невідомої руди промислового вмісту.
вересень 1982 р.Бенчмарк · Наукові основиЛінії: Наука · Оцінювання · Символьний підхід
У вересні 1982 року Стенфорд видав звіт про PUFF — програму, що інтерпретує тести функції легень у Pacific Medical Center у Сан-Франциско. Вона працює там із 1979 року, дає висновки приблизно для десяти пацієнтів щодня й обробила понад 4000 випадків; близько 85 % її звітів приймають без змін. На 144 нових випадках вона погодилася з лікарем, який її навчав, у 96 %, з незалежним лікарем — у 89 %.
жовтень 1982 р.Дослідження · Наукові основиЛінії: Теорія навчання
У жовтні 1982 року Здзіслав Павляк з Інституту комп'ютерних наук Польської академії наук опублікував статтю «Rough Sets» про наближені операції над множинами, наближену рівність і наближене включення. Автор подає підхід як альтернативу теоріям нечітких множин і толерантності та як математичну основу для штучного інтелекту: класифікації, індуктивного висновування, розпізнавання образів.
1982Дослідження · ЗображенняЛінії: Теорія навчання
1982 року посмертно вийшла книга Девіда Марра «Vision»: зір у ній — послідовність представлень від опису зображення до опису тривимірних об'єктів довкола, а кожну задачу треба розглядати на трьох рівнях — обчислювальному, алгоритмічному й рівні апаратної реалізації.
28 квітня 1983 р.Право й регулювання · Наукові основиЛінії: Право й політика · Гроші й ринок
28 квітня 1983 року міністр промисловості Великої Британії Патрік Дженкін оголосив у парламенті, що уряд приймає рекомендацію комітету Елві: п'ятирічну програму спільних досліджень промисловості, університетів і державних лабораторій у чотирьох напрямах, серед них інтелектуальні системи на знаннях. Звіт оцінив програму приблизно в 350 мільйонів фунтів, з них близько 200 мільйонів — державні.
травень 1983 р.Дослідження · Наукові основиЛінії: Теорія навчання · Пошук і міркування
Троє дослідників IBM показали, що складну задачу оптимізації можна розв'язувати, приймаючи іноді й гірші кроки, і поступово знижуючи ймовірність такого прийняття.
липень 1983 р.Доступність · Наукові основиЛінії: Символьний підхід · Гроші й ринок
У липні 1983 року дослідницький центр General Electric передав підрозділу локомотивів компанії CATS-1 — перший польовий прототип експертної системи DELTA, що шукає несправності дизель-електричних локомотивів у ремонтних депо й підказує ремонтникам порядок робіт. Близько 530 правил (330 для пошуку несправностей і 200 для довідки) працювали мовою FORTH на мінікомп'ютері PDP 11/23.
28 жовтня 1983 р.Право й регулювання · Наукові основиЛінії: Право й політика · Оборона · Обчислення
28 жовтня 1983 року Управління перспективних оборонних досліджень США (DARPA) виклало план програми Strategic Computing: протягом десятиліття створити «машинний інтелект» і показати його на трьох військових застосуваннях — автономному апараті, помічникові пілота й системі керування боєм авіаносної групи. Перші п'ять років оцінено приблизно в 600 мільйонів доларів.
1983 року Digital Equipment Corporation оголосила DECtalk — пристрій, що перетворює англійський текст на мовлення за правилами лабораторної системи Klattalk Денніса Клатта з MIT, ліцензованої 1982 року. Мовлення будує цифровий формантний синтезатор, а до пристрою можна підключити будь-який комп'ютер чи термінал.
грудень 1983 р.Дослідження · Роботи й автономністьЛінії: Втілення
У звіті лабораторії ніг Карнегі-Меллона від 13 грудня 1983 року Марк Рейберт, Бенджамін Браун і Майкл Чеппоніс описали машину на одній пружній нозі, яка стрибає і біжить по відкритій підлозі без жодної опори. Керування розкладено на три незалежні частини: висота стрибка, швидкість руху вперед і положення тіла. Машина стрибає на місці, рухається із заданою швидкістю, іде простим шляхом і тримає рівновагу після поштовху; найбільша зафіксована швидкість бігу — 2,2 м/с (4,8 милі за годину).
28 лютого 1984 р.Право й регулювання · Наукові основиЛінії: Право й політика · Гроші й ринок
28 лютого 1984 року Рада Європейських Співтовариств ухвалила ESPRIT — п'ятирічну програму досліджень в інформаційних технологіях від 1 січня 1984 року з внеском Співтовариства 750 мільйонів ЕКЮ. Один із п'яти напрямів — передова обробка інформації: експертні системи, подання знань, виведення й навчання, розпізнавання образів.
1981 — березень 1984 р.Дослідження · Наукові основиЛінії: Обчислення
Ігор Александер, Томас Стонем і Брюс Вілкі з Брунельського університету побудували WISARD — розпізнавач образів, у якому нейронами були 32 000 мікросхем оперативної пам'яті в одношаровій мережі. За Александером 1983 року, машина ухвалювала 5–10 рішень на секунду для зображень 512×512 пікселів; до березня 1984 року її перетворили на промисловий виріб.
листопад 1984 р.Дослідження · Наукові основиЛінії: Теорія навчання
Валіант дав означення: клас понять навченний, якщо існує алгоритм, що за поліноміальний час і розумну кількість прикладів дає майже правильну відповідь з великою ймовірністю.
березень 1985 р.Дослідження · Роботи й автономністьЛінії: Теорія навчання · Втілення
На ICRA 1985 у Сент-Луїсі (25–28 березня 1985 року) Уссама Хатіб зі Стенфорда показав, що уникання зіткнень, яке доти вважали задачею планування верхнього рівня, можна розподілити між рівнями керування: перешкода створює штучне потенціальне поле, що відштовхує робота просто в контурі керування. Керування маніпулятором переформульовано як пряме керування рухом у просторі задачі, а не в просторі суглобів. Метод реалізовано в системі COSMOS на роботі PUMA 560 і продемонстровано в реальному часі на рухомих перешкодах із зоровим датчиком.
лютий 1986 р.Віха · Наукові основиЛінії: Обчислення · Автономний рух
У лютому 1986 року General Electric передала Карнегі-Меллону перший десятикомірковий прототип Warp — систолічного масиву з лінійно з'єднаних програмованих комірок, кожна на 10 мільйонів операцій з рухомою комою на секунду, разом 100 MFLOPS. Машину зробили для зору роботизованих автомобілів, і вона стояла в фургоні Navlab.
травень 1986 р.Дослідження · Наукові основиЛінії: Символьний підхід · Теорія навчання
У травні 1986 року Тьєррі Кокан і Жерар Юе з INRIA випустили звіт про числення конструкцій — формалізм вищого порядку, у якому кожне доведення є лямбда-виразом, типізованим твердженням, яке воно доводить. Якщо стерти типи, лишається програма, що відповідає доведенню. Автори довели сильну нормалізацію: кожне обчислення завершується, а отже логіка несуперечлива.
травень 1985 р. – жовтень 1986 р.Віха · Роботи й автономністьЛінії: Автономний рух · Оборона
У травні 1985 року Autonomous Land Vehicle, машина, яку Martin Marietta будувала для програми Strategic Computing DARPA, уперше публічно проїхала дорогою сама — близько 1 км. У червні 1986 року вона пройшла весь випробувальний трек, 4,2 км, зі швидкістю до 10 км/год, а в жовтні 1986-го вперше оминала перешкоди, не з'їжджаючи з дороги, і на прямій дорозі без перешкод розвинула 20 км/год.
листопад 1986 р.Дослідження · ЗображенняЛінії: Теорія навчання
У листопаді 1986 року Джон Кенні записав виявлення країв як задачу оптимізації трьох величин: відношення сигнал/шум, точності положення відгуку й відсутності кількох відгуків на один край. Розв'язавши її чисельно, він показав, що між виявленням і локалізацією є принцип невизначеності, і що оптимальний оператор добре наближається першою похідною гаусіана.
червень 1985 р. — 1986Дослідження · Наукові основиЛінії: Обчислення · Пошук і міркування
У червні 1985 року аспірант Карнегі-Меллона Фен-сюн Сю взявся зробити генератор шахових ходів на одному кристалі за 3-мікронною технологією, доступною університетам. Перші робочі чипи прийшли приблизно через десять місяців; чип видавав до 2 мільйонів ходів на секунду, у десять разів швидше за 64-чиповий модуль машини Hitech.
грудень 1986 р.Дослідження · Роботи й автономністьЛінії: Теорія навчання
У випуску The International Journal of Robotics Research за зиму 1986 року (том 5, випуск 4, с. 56–68) Рендалл Сміт із SRI і Пітер Чізмен з NASA Ames подали спосіб оцінювати номінальний звʼязок і очікувану похибку (коваріацію) між системами координат, відомими лише через ланцюг непевних відношень. Дві операції: складання (compounding) згортає ланцюг непевних перетворень в одне, злиття (merging) поєднує паралельні оцінки в одну з меншою непевністю. Приклад — мобільний робот у трьох ступенях свободи (x, y, θ); метод узагальнюється на шість, а оцінки збігаються з незалежним моделюванням Монте-Карло.
серпень 1986 р. — 1987Доступність · Наукові основиЛінії: Оборона · Символьний підхід
У серпні 1986 року Texas Instruments і btg передали штабу командувача Тихоокеанського флоту США в Перл-Гарборі перший прототип FRESH — експертної системи, що стежить за станом і використанням кораблів і допомагає планувати їх залучення. Бюджет DARPA за лютий 1987 року пише, що прототип встановлено й показано в штабі разом з інтерфейсом природною мовою.
1987Доступність · Наукові основиЛінії: Дані · Оцінювання
1987 року аспірант Каліфорнійського університету в Ірвайні Девід Аха відкрив FTP-архів наборів даних для перевірки алгоритмів машинного навчання. На 4 грудня 1995 року в ньому було 111 наборів даних і теорій предметних галузей загальним обсягом 36 мегабайтів.
1987Віха · Роботи й автономністьЛінії: Автономний рух
У 1987 році VaMoRs — фургон Mercedes на 5 тонн, який група Ернста Дікманса в Університеті бундесверу в Мюнхені оснастила камерами й обчислювачами, — здійснив автономні поїздки вільним автобаном зі швидкістю до 96 км/год: і кермо, і швидкість вело компʼютерне бачення. Роком раніше та сама машина показала поздовжнє й бічне керування за зором на випробувальному майданчику Daimler-Benz у Штутгарті на швидкості до 10 м/с (36 км/год). Результати Дікманс і Цапп доповіли на 10-му Всесвітньому конгресі IFAC у Мюнхені 1987 року.
1987Віха · Наукові основиЛінії: Гроші й ринок · Символьний підхід
Ринок спеціалізованого заліза для ШІ почав зникати: універсальні робочі станції й персональні комп'ютери наблизилися до Lisp-машин у продуктивності за значно меншу ціну.
9–12 лютого 1988 р.Дослідження · Мовні моделіЛінії: Дані · Інструменти
На конференції ANLP в Остіні в лютому 1988 року Кеннет Черч із Bell Laboratories показав програму, що розставляє частини мови в довільному тексті, перемножуючи дві ймовірності, оцінені на розміченому корпусі Brown з близько мільйона слів: чи буває слово цією частиною мови і чи йде вона після двох попередніх. Точність — 95–99 % залежно від того, що вважати правильним.
У травні 1988 року Ерік Петаджан і колеги з AT&T Bell Laboratories разом із Майклом Бруком з Університету Бата показали на CHI '88 систему, що читає з губ за відео рота й поєднує результат зі звуковим розпізнавачем AT&T ASR1000. На англійській абетці поєднання зменшило його помилки від чверті до двох третин.
травень 1988 р.Дослідження · Роботи й автономністьЛінії: Автономний рух
У травні 1988 року Торп, Ебер, Канаде і Шейфер із Карнегі-Меллона описали в IEEE Transactions on Pattern Analysis and Machine Intelligence (том 10, випуск 3, с. 362–373) систему сприйняття й навігації фургона Navlab: розподілену архітектуру навколо бази даних CODGER, кольоровий зір для утримання дороги і тривимірний зір для виявлення й обходу перешкод; машина їде дорогами безперервно в справжньому вуличному середовищі, оминаючи перешкоди. Річний звіт CMU за 1987 рік називає серед віх демонстрацію Navlab на процесорі Warp зі швидкістю 50 см/с.
березень 1988 р. – червень 1988 р.Віха · Наукові основиЛінії: Оборона · Символьний підхід
У березні 1988 року команда Lockheed і ВПС США, а в червні — команда McDonnell Aircraft показали другу демонстрацію Pilot's Associate, програми DARPA й ВПС, розпочатої в лютому 1986 року для Strategic Computing: експертних систем, що допомагають пілотові в симуляторі кабіни. У McDonnell повністю інтегроване програмне забезпечення підтримало лише один із шести сегментів місії: хвилина польоту вимагала близько двох годин обчислень.
березень 1987 р. – листопад 1988 р.Доступність · Наукові основиЛінії: Гроші й ринок · Символьний підхід
У листопаді 1988 року, за статтею авторів на IAAI-89, American Express ввела Authorizer's Assistant у повну роботу в усіх центрах США: експертна система з 890 правил мовою ART від Inference Corporation готує авторизаторам рішення про оплату карткою й щодня схвалює кредит на мільйони доларів без участі людини. Пілотна версія працювала на одному центрі з березня–квітня 1987 року.
1988Дослідження · Роботи й автономністьЛінії: Автономний рух
На конференції NIPS 1988 року Дін Померло з Карнегі-Меллона описав ALVINN — тришарову мережу зворотного поширення, що з зображення камери 30×32 і зображення лазерного далекоміра 8×32 (разом 1217 входів) через 29 прихованих нейронів видає один із 45 напрямів руху. Мережу навчено на 1200 синтетичних зображеннях дороги за 40 епох; на нових синтетичних зображеннях вона вгадує кривину в межах двох одиниць приблизно в 90 % випадків. На фургоні Navlab вона вела машину 400-метровою доріжкою через лісисту ділянку кампусу на пів метра за секунду.
1 січня 1989 р.Віха · Наукові основиЛінії: Символьний підхід · Інструменти
1 січня 1989 року до бази даних проєкту Mizar Анджея Трибульця в Білостоці внесли перші три статті, і цю дату учасники називають офіційним початком Mizar Mathematical Library — зібрання математичних текстів, кожен рядок яких перевіряє машина. До кінця 1989 року статей було 66; з січня 1990 року вони виходили друком у журналі Formalized Mathematics.
березень 1987 р. – лютий 1989 р.Бенчмарк · Мовні моделіЛінії: Мовлення · Дані · Оцінювання
З березня 1987 року NIST на замовлення DARPA проводив тести систем розпізнавання мовлення на спільній базі Resource Management: прочитані речення до морської задачі керування ресурсами, словник близько тисячі слів, понад 21 000 записів від 160 дикторів. Базу описано на ICASSP-88 у квітні 1988 року; до лютого 1989-го відбулося чотири тести.
лютий 1989 р.Дослідження · Роботи й автономністьЛінії: Втілення
У лютому 1989 року Родні Брукс описав у меморандумі MIT AI Lab 1091 шестиногу машину завдовжки близько 35 см і масою близько 1 кг, якою керує мережа з 57 доповнених скінченних автоматів, побудована поступово: кожна наступна мережа — суворе доповнення попередньої, і на кожному кроці робот лишається працездатним. Робот ходить по нерівній поверхні й іде за людиною, яку пасивно відчуває шістьма піроелектричними інфрачервоними датчиками. Стаття вийшла в Neural Computation, том 1, випуск 2, у червні 1989 року.
вересень 1990 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Дані
У вересні 1990 року Скотт Дірвестер, Сьюзен Дюмей, Джордж Фурнас, Томас Ландауер і Річард Гаршман описали в JASIS пошук документів через сингулярний розклад матриці «термін — документ»: терміни й документи дістають вектори з близько ста факторів, а запит порівнюється з ними за косинусом. На медичній колекції MED точність зросла на 13 % проти прямого збігу слів.
жовтень 1990 р.Дослідження · Наукові основиЛінії: Обчислення · Теорія навчання
У жовтні 1990 року Карвер Мід із Каліфорнійського технологічного інституту назвав нейроморфними системами аналогові кристали, побудовані за принципами нервової системи. Його прикладом була силіконова сітківка, яку він описав разом із Мішею Маговальд: близько 100 тисяч приладів, 100 мільйонів операцій на секунду за 1 мВт, тобто близько 10⁻¹¹ Дж на операцію проти 10⁻⁷ Дж у цифровій схемі.
У 1989–1990 роках з'явилися два кристали, зроблені саме під нейромережі. Аналоговий ETANN Intel мав 64 нейрони й 10 240 синапсів із вагами у вигляді заряду на плаваючих затворах і рахував понад 1,3 мільярда з'єднань на секунду. Цифровий CNAPS Adaptive Solutions мав 64 процесори на 25 МГц і вчився на самому кристалі.
грудень 1990 р.Дослідження · Мовні моделіЛінії: Символьний підхід · Дані
У грудні 1990 року прінстонська група Джорджа Міллера опублікувала WordNet — базу англійської лексики, побудовану не за абеткою, а за значеннями. Одиниця бази — синсет, множина слів, що виражають одне поняття; іменники розкладено на 25 незалежних ієрархій.
17 січня 1991 року есмінець USS Paul F. Foster випустив залп Tomahawk у відкривальному ударі війни — перше бойове застосування цієї ракети. На кінцевій ділянці ракета наводилася системою DSMAC, яка звіряла те, що бачила камера, зі збереженими наперед еталонними сценами місцевості.
січень 1991 р.Дослідження · ЗображенняЛінії: Теорія навчання
У січні 1991 року Метью Терк і Алекс Пентленд описали систему, що знаходить голову в кадрі й упізнає людину майже в реальному часі. Обличчя проєктують у простір власних векторів навчальної вибірки — тих самих «власних облич», — і впізнавання зводиться до порівняння кількох коефіцієнтів, а не до відновлення тривимірної форми носа чи очей.
лютий 1991 р.Дослідження · Наукові основиЛінії: Теорія навчання
У лютневому випуску Neural Computation 1991 року (том 3, випуск 1, с. 79–87) Роберт Джейкобс і Майкл Джордан з MIT та Стівен Ноулан і Джеффрі Гінтон з Торонтського університету описали систему з кількох мереж-експертів і мережі-вентиля, яка для кожного навчального прикладу вирішує, котрий експерт його бере. На задачі розрізнення чотирьох голосних 75 мовців суміші з 4 або 8 простих лінійних експертів досягали критерію похибки приблизно вдвічі швидше за мережі зворотного поширення, за тих самих 90 % на перевірці.
8 листопада 1991 р.Бенчмарк · Мовні моделіЛінії: Оцінювання
8 листопада 1991 року в Бостонському комп'ютерному музеї відбувся перший конкурс на премію Г'ю Лебнера — обмежений тест Тюрінга: десять суддів із публіки розмовляли на задані теми з шістьма програмами й двома людьми. Перемогла програма Джозефа Вайнтрауба на тему «примхливої розмови»; п'ятеро суддів назвали її людиною.
листопад 1991 р.Дослідження · Роботи й автономністьЛінії: Теорія навчання · Втілення
На семінарі IROS ’91 в Осаці (3–5 листопада 1991 року) Джон Леонард з NEC Research Institute і Гʼю Даррант-Вайт з Оксфорда назвали відкриту задачу мобільної робототехніки — одночасне будування карти й локалізацію — і визначили її як довготривале оцінювання положення в глобальній системі відліку без апріорної інформації. Задача важка через парадокс: щоб рухатися точно, роботові потрібна точна карта, а щоб побудувати карту, треба точно знати, звідки він міряв. Для сонарів вони ставлять на машину кілька датчиків на сервоприводах, вивчають підмножину ознак середовища з початкового положення й далі стежать за ними.
1 грудня 1991 р.Бенчмарк · Наукові основиЛінії: Оцінювання · Наука
1 грудня 1991 року Вільям Бакст опублікував проспективну сліпу перевірку нейромережі, навченої на 351 госпіталізованому пацієнті: на 331 пацієнті приймального відділення з болем у грудях вона розпізнала інфаркт із чутливістю 97,2 % і специфічністю 96,2 % проти 77,7 % і 84,7 % у лікарів.
липень 1991 р. – грудень 1991 р.Дослідження · Наукові основиЛінії: Обчислення
У 1991 році Бернгард Бозер, Ян Лекун і колеги з AT&T Bell Labs описали ANNA — кристал, що виконує понад 2 000 множень і додавань одночасно. На ньому працювала згорткова мережа для рукописних цифр зі 133 тисячами з'єднань: понад 1 000 символів на секунду з помилкою 5,3 % проти 4,9 % у початкової мережі з рухомою комою.
1991Віха · Наукові основиЛінії: Оборона · Гроші й ринок
Планувальник перевезень, зроблений за десять тижнів під час операції «Щит пустелі», працював у Транспортному командуванні США та Європейському командуванні всю зиму 1990–91 років. Він переробляв плани перекидання військ і вантажів у темпі, у якому вони змінювалися.
31 березня – 3 квітня 1992 р.Дослідження · Мовні моделіЛінії: Символьний підхід · Дані
На третій конференції ANLP у Тренто (31 березня — 3 квітня 1992 року) Ерік Брілл із Пенсильванського університету показав тегер частин мови, що сам знаходить правила виправлення власних помилок. 71 знайдене правило звело частку помилок на тестових 5 % корпусу Brown до 5,1 %.
27–28 травня 1992 р.Бенчмарк · ЗображенняЛінії: Дані · Оцінювання
27–28 травня 1992 року NIST на замовлення Бюро перепису США зібрав у Гейтерсберзі учасників першої конференції систем оптичного розпізнавання для перепису: 26 організацій із Північної Америки та Європи розпізнавали ті самі близько 85 000 рукописних цифр і літер, яких раніше не бачили. Приблизно половина систем правильно розпізнала понад 95 відсотків цифр; людина — близько 98,5.
липень 1992 р.Дослідження · Наукові основиЛінії: Теорія навчання
Автори показали, що лінійний класифікатор із максимальним відступом можна застосувати до нелінійних задач, не виходячи в простір високої розмірності явно.
вересень 1992 р.Доступність · Наукові основиЛінії: Гроші й ринок
У вересні 1992 року HNC із Сан-Дієго запустила Falcon — систему, яка під час авторизації кожної операції кредитною карткою оцінювала нейромережею ймовірність шахрайства. За річним звітом компанії, до серпня 1994 року Falcon купили 18 із 20 найбільших емітентів кредитних карток США, і він стежив за понад 100 мільйонами рахунків.
4–6 листопада 1992 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані
4–6 листопада 1992 року в Ґейтерсберзі NIST і DARPA провели першу конференцію Text REtrieval Conference: 25 груп прогнали свої системи на спільній колекції близько двох гігабайтів тексту і спільних темах, а результати оцінено однією процедурою. Прийшло 92 учасники.
листопад 1992 р.Дослідження · ЗображенняЛінії: Теорія навчання
У листопаді 1992 року Карло Томазі й Такео Канаде показали: якщо скласти координати P точок, простежених через F кадрів, в одну матрицю 2F × P, то за ортографічної проєкції й без шуму ця матриця має ранг рівно три. Сингулярний розклад розділяє її на рух камери й форму сцени — одним обчисленням на всю послідовність, без накопичення похибки від кадру до кадру.
грудень 1992 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Дані
У грудні 1992 року п'ятеро дослідників IBM на чолі з Пітером Брауном описали в Computational Linguistics, як розкласти словник із 260 741 слова на 1 000 класів лише за тим, які слова стоять поруч у майже 366 мільйонах слів тексту, і будувати мовну модель на класах замість окремих слів.
22 жовтня 1994 р.Дослідження · Наукові основиЛінії: Дані
22 жовтня 1994 року на конференції CSCW Пол Резнік із MIT, Джон Рідл з Університету Міннесоти та троє співавторів описали GroupLens — відкриту архітектуру колаборативної фільтрації новин Usenet. Читачі оцінюють статті, сервери оцінок, названі Better Bit Bureaus, збирають оцінки й передбачають, як статтю оцінить інший читач, виходячи з того, що люди, які погоджувалися раніше, погодяться знову.
1994Дослідження · Мовні моделіЛінії: Теорія навчання · Оцінювання
1994 року група Стівена Робертсона з City University в Лондоні, готуючи систему Okapi до TREC-3, об'єднала дві свої вагові функції BM11 і BM15 в одну — BM25, де параметр b визначає, наскільки довжина документа змінює внесок частоти терміна. Прогін citya1 із цією функцією очолив шістку найкращих автоматичних прогонів ad hoc.
1994Віха · Роботи й автономністьЛінії: Автономний рух
У 1994 році на заключній демонстрації європейського проєкту EUREKA PROMETHEUS під Парижем легковик VaMP Університету бундесверу в Мюнхені й машина VITA-2 Daimler-Benz їхали автострадою A1 у звичайному щільному русі трьох смуг зі швидкістю до 130 км/год: вільна їзда смугою, їзда в колоні, перестроювання для обгону, причому рішення, чи перестроювання безпечне, машина ухвалювала сама, а людина-страхувальник лише підтверджувала. VaMP бачив дорогу двома парами камер уперед і назад і стежив до десяти інших машин на відстані до 100 м.
Магістерська робота Теда Старнера в MIT Media Lab (лютий 1995 року, керівник — Алекс Пентленд) описала систему прихованих марковських моделей, що в реальному часі розпізнає речення американської жестової мови з відео однієї камери; словник — 40 слів. У листопаді на ISCV у Корал-Гейблз вони повідомили про 99,2 % точності слів.
9–12 травня 1995 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Мовлення
На ICASSP-95 у Детройті (9–12 травня 1995 року) Райнгард Кнезер із дослідницьких лабораторій Philips в Ахені й Германн Ней з Ахена запропонували для n-грамної мовної моделі розподіли відступу, оптимізовані саме для випадків, коли довшої послідовності в даних не було. Перплексія знизилася приблизно на 10 %, частка помилок слів у розпізнаванні мовлення — на 5 %.
У вересні 1995 року Майрон Флікнер і ще одинадцять дослідників IBM Almaden описали в IEEE Computer систему QBIC. Базу зображень і відео можна було питати прикладом, ескізом, обраним кольором чи текстурою, а не словами. Відповідь рахувалася за схожістю кольору, текстури, форми й руху, обчислених із самого зображення.
6–8 листопада 1995 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані
6–8 листопада 1995 року в Колумбії (Меріленд) шоста конференція Message Understanding, яку фінансувала DARPA, підбила підсумки оцінки, де вперше окремо міряли розпізнавання іменованих сутностей: імен людей, організацій і місць, дат, сум і відсотків. Найкраща з 20 систем п'ятнадцяти учасників, від SRA, мала F-міру 96,42, а двоє людей-анотаторів між собою — 96,68.
У листопаді 1995 року Генрі Роулі, Шумит Балуджа й Такео Канаде з Карнегі-Меллона описали в технічному звіті детектор облич: нейромережа оглядає кожне вікно 20 × 20 пікселів у кількох масштабах, а арбітраж між двома мережами відсіює хибні спрацьовування. На 130 складних зображеннях із 507 обличчями основна система знаходила 85,4 % облич з одним хибним спрацьовуванням на 1 319 035 вікон.
листопад 1995 р.Віха · Роботи й автономністьЛінії: Автономний рух
У листопаді 1995 року VaMP проїхав понад 1600 км з Мюнхена до Оденсе на засідання проєкту й назад з автономним поздовжнім і бічним керуванням за чорно-білим зображенням: за оцінкою групи, близько 95 % відстані машина проїхала повністю автоматично. На вільному відрізку автобану в Люнебурзькій пустищі швидкість сягала 180 км/год; пʼять разів машина йшла понад 100 км без жодного втручання, найдовший відрізок — близько 160 км; понад 400 перестроювань виконано автономно за командою страхувальника; бічне відхилення від середини смуги рідко перевищувало 0,2 м.
березень 1996 р.Дослідження · Мовні моделіЛінії: Теорія навчання
У березні 1996 року Адам Бергер, Стівен і Вінсент Делла П'єтра описали в Computational Linguistics, як будувати ймовірнісну модель мови за принципом максимальної ентропії: з усіх розподілів, що узгоджуються з обраними фактами про дані, брати найрівномірніший, а самі факти (ознаки) добирати автоматично.
7–10 травня 1996 р.Дослідження · МультимодальніЛінії: Мовлення · Генеративні медіа · Дані
На ICASSP-96 в Атланті (7–10 травня 1996 року) Ендрю Гант і Алан Блек з лабораторій ATR у Кіото описали, як синтезатор CHATR складає мовлення з фонем, вирізаних із великої бази записів одного диктора. Кожну фонему обирає пошук Вітербі за двома вартостями: наскільки одиниця схожа на ціль і наскільки гладко вона з'єднується з сусідньою.
червень 1996 р.Віха · ЗображенняЛінії: Гроші й ринок
За статтею Ботту, Бенжіо й Лекуна з AT&T Laboratories на CVPR-97, їхню систему читання сум на чеках вбудували в машини NCR для обробки чеків, у червні 1996 року вперше поставили в банку, і відтоді вона читала мільйони чеків на місяць. Суму розпізнавала згорткова мережа LeNet5, навчена разом з усією системою.
серпень 1996 р.Дослідження · Роботи й автономністьЛінії: Теорія навчання
У серпні 1996 року Кавракі й Латомб зі Стенфорда та Швестка й Овермарс з Утрехта опублікували в IEEE Transactions on Robotics and Automation (том 12, випуск 4, с. 566–580) метод планування руху з двох фаз: у фазі навчання випадково вибрані безколізійні конфігурації робота зʼєднуються простим швидким локальним планувальником у граф, дорожню карту; у фазі запиту початкова й кінцева конфігурації приєднуються до графа, і в ньому шукається шлях. Для плоских шарнірних роботів із багатьма ступенями свободи планування займає частку секунди на робочій станції близько 150 MIPS після кількох десятків секунд навчання.
вересень 1996 р.Бенчмарк · ЗображенняЛінії: Оцінювання · Дані · Оборона
У вересні 1996 року відбулося третє й останнє оцінювання FERET. Протокол вимагав зіставити набір із 3323 зображень із набором із 3816 — близько 12.6 мільйона порівнянь — на базі з 14 126 знімків 1199 осіб, зібраній незалежно від розробників алгоритмів. Результати рахували окремо для знімків того самого дня, різних днів і з розривом понад рік.
10 жовтня 1996 р.Віха · Наукові основиЛінії: Символьний підхід · Наука
10 жовтня 1996 року програма EQP, створена в Аргоннській національній лабораторії, знайшла доведення того, що кожна алгебра Роббінса булева. Пошук тривав близько восьми днів на процесорі RS/6000 і зайняв близько 30 мегабайтів пам'яті. Питання поставив Герберт Роббінс невдовзі після 1933 року; ні він, ні Гантінгтон доведення не знайшли, а згодом задачу вивчали Тарський і його учні.
20 грудня 1996 р.Віха · Роботи й автономністьЛінії: Втілення
20 грудня 1996 року Honda оприлюднила десять років закритих досліджень і вперше показала прототип самостійного двоногого людиноподібного робота з батареєю на борту: дві ноги, дві руки, зріст 180 см, маса 210 кг, час роботи близько 15 хвилин. Робот сам оцінює стан поверхні й іде рівною підлогою, через пороги, схилами і сходами вгору й униз, не падає від поштовху, змінює напрямок за бездротовою командою і двома руками штовхає візок чи закручує болти за дистанційним керуванням.
Восени 1996 року Ерлінг Волд, Том Блум, Дуглас Кейслар і Джеймс Вітон з берклійської компанії Muscle Fish описали в IEEE MultiMedia систему, що зводить будь-який звук до гучності, висоти, яскравості, ширини смуги й гармонічності. За цими ознаками вона шукає схожі звуки за зразком і відносить нові до класів, навчених на прикладах, на базі з близько 400 файлів.
7–12 липня 1997 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Дані
На спільній конференції ACL і EACL у Мадриді (7–12 липня 1997 року) Майкл Коллінз із Пенсильванського університету описав три генеративні моделі лексикалізованої контекстно-вільної граматики. На розділі 23 Wall Street Journal у Penn Treebank найкраща дала 88,1 % точності й 87,5 % повноти складників.
9 грудня 1997 р.Доступність · Мовні моделіЛінії: Інструменти
9 грудня 1997 року Digital Equipment Corporation відкрила на пошуковику AltaVista безкоштовну пробну службу перекладу на рушії SYSTRAN: будь-хто міг перекласти вебсторінку, результати пошуку чи вставлений текст з англійської на іспанську, французьку, німецьку, португальську й італійську і назад.
26 червня 1998 р.Доступність · ЗображенняЛінії: Право й політика · Наука
26 червня 1998 року FDA схвалило ImageChecker M1000 компанії R2 Technology — систему, що позначає підозрілі ділянки на скринінговій мамограмі, щоб радіолог переглянув їх уже після власного читання.
липень 1998 р.Дослідження · Роботи й автономністьЛінії: Втілення
На AAAI-98 у Медісоні (26–30 липня 1998 року) Синтія Брізіл з лабораторії ШІ MIT описала мотиваційну систему автономного робота Kismet, яка регулює взаємодію з людиною за зразком пари «доглядач — немовля»: потяги, емоції й вирази обличчя разом утримують обмін на прийнятній для робота інтенсивності. Робот має активну стереосистему зору з кольоровими камерами в очних яблуках і мікрофон у кожному вусі; рухомі риси обличчя — брови, вуха, очі й повіки — показують вирази гніву, втоми, страху, огиди, збудження, радості, інтересу, смутку й здивування. Подано перші досліди взаємодії з людьми.
серпень 1998 р.Дослідження · Мовні моделіЛінії: Оцінювання · Теорія навчання
У серпні 1998 року Стенлі Чен і Джошуа Гудман випустили в Гарварді технічний звіт, що порівняв основні способи згладжування n-грамних мовних моделей на корпусах Brown, North American Business news, Switchboard і Broadcast News за різних обсягів навчальних даних. Запропонований ними модифікований варіант Кнезера — Нея виграв усі порівняння.
1998 року Мехран Сахамі зі Стенфорда та Сьюзен Дюмейс, Девід Геккерман і Ерік Горвіц з Microsoft Research показали, що наївний баєсівський класифікатор, навчений на листах користувача, відсіює небажану пошту. На 1789 листах із простими ознаками поштового домену він досяг 100 % точності й 98,3 % повноти для небажаних.
22 лютого 1999 р.Віха · Наукові основиЛінії: Символьний підхід · Дані
22 лютого 1999 року консорціум W3C затвердив Рекомендацією специфікацію RDF. Вона задала єдиний спосіб записати твердження про будь-який мережевий ресурс: суб'єкт, предикат, об'єкт, де суб'єкт і предикат названо ідентифікатором URI.
лютий 1999 р.Дослідження · МультимодальніЛінії: Мовлення · Дані
Цифрова відеобібліотека Informedia в Карнеґі-Меллон, розпочата 1994 року за Digital Library Initiative (NSF, DARPA, NASA), транскрибувала звук відео розпізнавачем Sphinx і шукала сюжети за словами транскрипту. На травень 1998 року вона мала понад 1 000 годин новин і 400 годин документального відео; підсумок надруковано в IEEE Computer у лютому 1999-го.
На Eurospeech '99 у Будапешті (5–9 вересня 1999 року) Такайосі Йосімура, Кейіті Токуда та співавтори з Нагойського й Токійського технологічних інститутів описали синтезатор, у якому прихована марковська модель сама породжує спектр, висоту голосу й тривалість звуків. 25 грудня 2002 року їхня група відкрито випустила систему як HTS 1.0.
20–27 вересня 1999 р.Дослідження · ЗображенняЛінії: Генеративні медіа
У вересні 1999 року на ICCV Олексій Ефрос і Томас Люн з Берклі показали синтез текстури без моделі: нове зображення росте від зерна по одному пікселю, і кожен піксель береться з місця в зразку, чия околиця схожа на вже зроблене. Параметр один — розмір вікна.
вересень 1999 р.Дослідження · ЗображенняЛінії: Теорія навчання
У вересні 1999 року Девід Лоу показав SIFT: стійкі точки шукають як екстремуми в піраміді різниць гаусіанів, а околицю кожної описують вектором із гістограм напрямків градієнта. На двадцяти зображеннях і приблизно 15 тисячах точок 85.4 % точок знаходилися на місці після повороту на 20°, 85.1 % після зміни масштабу вдвічі й 90.3 % після додавання 10 % шуму.
11 жовтня 1999 р.Доступність · Наукові основиЛінії: Обчислення
NVIDIA випустила чип, який назвала першим у світі графічним процесором: перетворення, освітлення й малювання трикутників уперше зібрано на одній мікросхемі.
12 квітня 2000 р.Бенчмарк · МультимодальніЛінії: Мовлення · Оцінювання · Дані
У 1997–1999 роках NIST провів у TREC трек пошуку в записаному мовленні: системи розпізнавали випуски новин і шукали в розшифровці за запитами. Колекція виросла з 50 годин у 1997 році до 557 годин і 21 754 сюжетів у 1999-му. Підсумок NIST представив на RIAO 2000 у Парижі 12–14 квітня 2000 року.
23–28 липня 2000 р.Дослідження · ЗображенняЛінії: Генеративні медіа
У липні 2000 року на SIGGRAPH Марсело Бертальміо, Гільєрмо Сапіро (Міннесота), Вісент Касельєс і Колома Бальєстер (Помпеу Фабра) описали цифровий інпейнтинг: людина грубо позначає пошкоджене місце, а програма продовжує всередину лінії рівної яскравості, що підходять до його краю.
13–14 вересня 2000 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані
13–14 вересня 2000 року в Лісабоні одинадцять дослідницьких систем розібрали той самий текст на групи слів, на тих самих 211 727 навчальних і 47 377 тестових токенах, і порахувалися одним спільним скриптом. Найкраща дала F 93,48 проти 77,07 у простої базової лінії.
21–28 січня 2001 р.Віха · ЗображенняЛінії: Шкода · Право й політика
З 21 по 28 січня 2001 року в Тампі, на стадіоні перед Super Bowl XXXV і в районі Ybor City, камери знімали обличчя людей і звіряли з базою злочинців. Систему FaceTrac на рушії Viisage FaceFINDER поставили для поліції Graphco, Viisage, Raytheon і VelTek. Через турнікети пройшли 100 000 уболівальників і працівників; за AP, позначено 19 облич дрібних правопорушників, а поліція казала, що арештів не було.
червень 2001 р.Дослідження · Мовні моделіЛінії: Теорія навчання
На ICML 2001 Джон Лафферті (Карнегі-Меллон), Ендрю Маккаллум і Фернандо Перейра (WhizBang! Labs, Перейра також Пенсильванський університет) представили умовні випадкові поля: модель імовірності всієї послідовності міток за послідовністю спостережень, нормовану по всій послідовності, а не в кожному стані. На розмітці частин мови в Penn Treebank похибка на слово — 5,55 % проти 5,69 % у прихованої марковської моделі й 6,37 % у марковської моделі максимальної ентропії; з ознаками написання — 4,27 % проти 4,81 %.
16 серпня 2001 р.Дослідження · ЗображенняЛінії: Генеративні медіа
16 серпня 2001 року на SIGGRAPH Аарон Герцман і співавтори з NYU, Microsoft Research і Вашингтонського університету показали, як навчити фільтр за одним прикладом: пара зображень A і A′ задає перетворення, і програма застосовує його до нового B, отримуючи B′.
жовтень 2001 р.Дослідження · Наукові основиЛінії: Теорія навчання
У The Annals of Statistics за жовтень 2001 року (том 29, випуск 5, с. 1189–1232) Джером Фрідман зі Стенфорда подав бустинг як градієнтний спуск у просторі функцій: кожен новий складник адитивної моделі підганяється під від'ємний градієнт довільно обраної функції втрат. Він дав алгоритми для найменших квадратів, найменших абсолютних відхилень, втрат Губера й багатокласової логістичної правдоподібності, окремі версії для дерев регресії (TreeBoost) і засоби тлумачення таких моделей. Стаття — лекція Рейтца 1999 року.
жовтень 2001 р.Дослідження · Наукові основиЛінії: Теорія навчання
У журналі Machine Learning (том 45, випуск 1, жовтень 2001, с. 5–32) Лео Брейман з Каліфорнійського університету в Берклі визначив випадкові ліси: ансамбль дерев, кожне з яких вирощено за незалежно вибраним випадковим вектором, і дерева голосують за клас. Він довів, що похибка узагальнення лісу майже напевно збігається до межі зі зростанням кількості дерев, обмежив її силою окремих дерев і кореляцією між ними й показав, що випадковий вибір ознак у кожному вузлі дає похибку, порівнянну з AdaBoost або меншу, і стійкість до шуму.
13–16 листопада 2001 р.Бенчмарк · МультимодальніЛінії: Оцінювання · Дані
На TREC 2001 у Гейтерсбурзі (13–16 листопада 2001 року) NIST уперше провів відео-трек: 12 груп зі США, Азії та Європи шукали в 11 годинах відео MPEG-1 за 74 запитами, кожен із кліпом, зображенням чи звуком поряд із текстом, і визначали межі кадрів. З 2003 року трек став окремою щорічною оцінкою TRECVID.
29 квітня 2002 р.Дослідження · МультимодальніЛінії: Дані · Теорія навчання
У томі ECCV 2002, опублікованому 29 квітня 2002 року, Пінар Дуйґулу, Кобус Барнард, Нандо де Фрейтас і Девід Форсайт з Берклі й UBC подали розпізнавання як переклад: області зображення — слова однієї мови, ключові слова — іншої. На 4 500 зображеннях Corel із 371 словом EM навчив словник між 500 типами областей і словами.
липень 2002 р.Бенчмарк · МультимодальніЛінії: Дані · Оцінювання
У липні 2002 року Джордж Цанетакіс і Перрі Кук із Принстонського університету опублікували в IEEE Transactions on Speech and Audio Processing систему, що відносить музичний запис до жанру за ознаками тембру, ритму й висоти. На наборі з десяти жанрів по сто 30-секундних уривків вона вгадувала 61 %, коли випадковий вибір дав би 10 %.
У липні 2002 року четверо дослідників IBM показали спосіб оцінювати машинний переклад без людини: рахувати збіги ланцюжків завдовжки від одного до чотирьох слів із людськими еталонами, зі штрафом за надто коротку відповідь. На п'яти системах бал корелював із оцінками суддів на 0,99.
У серпні 2002 року Пол Ґрем опублікував есей «A Plan for Spam»: фільтр, що поєднує за Баєсом ймовірності спаму п'ятнадцяти найпоказовіших слів листа, на його пошті пропускав менше 5 спам-листів на 1000 без жодного хибного спрацювання.
січень 2003 р.Дослідження · Наукові основиЛінії: Гроші й ринок · Дані
У випуску IEEE Internet Computing за січень–лютий 2003 року Грег Лінден, Брент Сміт і Джеремі Йорк з Amazon.com описали item-to-item collaborative filtering, яким магазин персоналізує сторінки кожного клієнта. Таблицю схожих товарів рахують офлайн, а онлайн-частина залежить лише від того, скільки товарів клієнт купив чи оцінив, а не від розміру бази клієнтів чи каталогу.
лютий 2003 р.Дослідження · МультимодальніЛінії: Дані · Теорія навчання
У лютому 2003 року Journal of Machine Learning Research надрукував «Matching Words and Pictures» Барнарда, Дуйґулу, Форсайта, де Фрейтаса, Блея й Джордана. Кілька моделей спільного розподілу слів і областей зображення передбачали підписи до цілого зображення й називали окремі області; дані — зображення зі 160 дисків Corel по 100 на кожному.
липень 2002 р. – березень 2003 р.Бенчмарк · ЗображенняЛінії: Оцінювання
У березні 2003 року NIST опублікував звіт FRVT 2002. У липні й серпні 2002 року десять комерційних систем розпізнавання облич під наглядом організаторів перевірили на 121 589 фото 37 437 людей із візового архіву Держдепартаменту США. На порівнянних тестах помилка з часів FRVT 2000 знизилася приблизно вдвічі.
27–31 липня 2003 р.Дослідження · ЗображенняЛінії: Інструменти
У липні 2003 року на SIGGRAPH Патрік Перес, Мішель Ганже й Ендрю Блейк із Microsoft Research у Кембриджі показали, як вставити шматок одного зображення в інше без видимого шва: розв’язати рівняння Пуассона, яке бере з джерела перепади яскравості, а з межі — значення.
У жовтні 2003 року на ICCV Йосеф Сівіч і Ендрю Ціссерман з Оксфорда перенесли в зображення устрій текстового пошуку. Дескриптори ділянок кадру згруповано у «візуальні слова», найчастіші й найрідші відкинуто стоп-списком, кадри зважено за tf-idf і занесено в інвертований файл. Пошук обведеного об’єкта серед 4 тисяч ключових кадрів фільму тривав близько 0,1 секунди.
26–30 жовтня 2003 р.Дослідження · МультимодальніЛінії: Дані
На ISMIR 2003 у Балтиморі (26–30 жовтня 2003 року) Евері Ван із Shazam Entertainment описав алгоритм, що впізнає запис за кількома секундами звуку з мікрофона телефону. На час статті служба мала в базі понад 1,7 мільйона треків і працювала у Великій Британії й Німеччині; у Британії її запустили в серпні 2002 року дзвінком на номер 2580.
жовтень 2003 р.Дослідження · Роботи й автономністьЛінії: Втілення · Теорія навчання
У жовтні 2003 року Ендрю Девісон показав систему, у якій одна рухома камера водночас визначає власне положення й будує карту околиці — у темпі надходження кадрів, 30 разів на секунду. Розширений фільтр Калмана тримає в одному векторі стану позу камери та тривимірні координати орієнтирів, а нові точки вводяться в карту через розподіл гіпотез глибини.
10 лютого 2004 р.Віха · Наукові основиЛінії: Символьний підхід · Теорія навчання
10 лютого 2004 року W3C затвердив мову онтологій OWL і разом із нею перероблену специфікацію RDF. OWL додав до графа класи, обмеження на властивості й три рівні виразності — Lite, DL і Full.
25 квітня 2004 р.Дослідження · МультимодальніЛінії: Дані · Праця
Луїс фон Ан і Лора Дабіш з Карнеґі-Меллон виклали гру ESP 9 серпня 2003 року: двоє незнайомих гравців бачать одне зображення й виграють, коли напишуть однакове слово. До 10 грудня 13 630 гравців дали 1 271 451 мітку для 293 760 зображень. Статтю представлено на CHI 2004 25 квітня 2004 року.
8–12 серпня 2004 р.Дослідження · ЗображенняЛінії: Інструменти
У серпні 2004 року на SIGGRAPH Карстен Ротер, Володимир Колмогоров і Ендрю Блейк із Microsoft Research у Кембриджі описали GrabCut: людина грубо обводить об’єкт прямокутником, а програма сама відокремлює його від тла, повторюючи графовий розріз і уточнюючи моделі кольору.
жовтень 2004 р.Дослідження · Наукові основиЛінії: Символьний підхід · Дані
У жовтні 2004 року Г'юго Лю і Пуш Сінгх із MIT Media Lab описали ConceptNet 2.0 — базу побутових знань на 1,6 мільйона тверджень і 300 тисяч вузлів. Її не писали руками: її видобуто автоматично з 700 тисяч англійських речень, які на сайт Open Mind Common Sense наклали понад 14 тисяч людей.
Лі Фей-Фей, Роб Фергюс і П'єтро Перона зібрали набір зі 101 категорії предметів плюс клас фону й показали баєсівський метод, що вчиться з кількох прикладів. До того розпізнавання предметних класів перевіряли здебільшого на одному-двох класах, у Вебера з колегами — на чотирьох, у Фергюса з колегами — на шести; автори називають набір у п'ятнадцять разів більшим за все попереднє.
11 квітня 2005 р.Бенчмарк · ЗображенняЛінії: Оцінювання · Дані
11 квітня 2005 року в Саутгемптоні оголосили результати першого змагання PASCAL Visual Object Classes. Чотири класи — мотоцикли, велосипеди, люди й автомобілі; дві задачі — сказати, чи є об'єкт на знімку, і вказати рамку навколо нього. Заявилося дванадцять колективів, шестеро доповіли на воркшопі.
червень 2005 р.Дослідження · ЗображенняЛінії: Теорія навчання · Дані
У червні 2005 року Навніт Далал і Білл Тріггс показали, що щільна сітка гістограм орієнтованих градієнтів із нормалізацією в перекривних блоках разом із лінійним методом опорних векторів виявляє людей на зображенні щонайменше вдесятеро точніше за наявні набори ознак. Разом із методом вони випустили набір INRIA Person із 1805 знімків людей розміром 64 × 128.
4–8 вересня 2005 р.Бенчмарк · МультимодальніЛінії: Мовлення · Оцінювання
На Interspeech 2005 у Лісабоні (4–8 вересня 2005 року) Алан Блек (Карнегі-Меллон) і Кейіті Токуда (Нагойський технологічний інститут) підсумували перше змагання синтезаторів мовлення на спільних даних: шість команд з трьох континентів за тиждень-два збудували голоси з тих самих баз CMU ARCTIC і озвучили ті самі 250 речень. Слухачі оцінювали природність і вписували почуте; першою в усіх групах слухачів стала HMM-система Нагойського інституту.
8 вересня 2005 року Браян Рассел, Антоніо Торральба, Кевін Мерфі й Вільям Фрімен описали в мемо MIT LabelMe — веб-інструмент, де будь-хто обводить об’єкти на фото багатокутником і підписує власними словами. Разом з інструментом виклали 10 000 зображень, 3000 з них уже розмічено; на 21 грудня 2006 року база мала 111 490 багатокутників.
2 листопада 2005 р.Доступність · Наукові основиЛінії: Дані · Праця · Гроші й ринок
Увечері 2 листопада 2005 року Amazon відкрила бета-тестування майданчика, де замовник публікує дрібне завдання програмним викликом, а виконує його людина. На запуску вже були документація для розробників, WSDL-файл і набір інструментів замовника.
9 листопада 2005 р.Віха · Роботи й автономністьЛінії: Втілення · Гроші й ринок
iRobot вийшла на біржу за ціною 24 долари за акцію, а в реєстраційній заяві розкрила, що за три роки продала понад 1,2 мільйона роботів-пилососів Roomba і що вони дали 73,8% виторгу за 2004 рік.
квітень 2006 р.Доступність · Мовні моделіЛінії: Дані
У квітні 2006 року Google відкрив для всіх свою статистичну систему перекладу арабська↔англійська, про що 28 квітня написав Франц Ох. Систему навчено на мільярдах слів одномовних текстів і паралельних людських перекладів; на оцінюванні NIST 2005 року вона мала найвищий BLEU серед учасників для арабської й китайської.
травень 2006 р.Дослідження · ЗображенняЛінії: Теорія навчання
У травні 2006 року Герберт Бай, Тінне Тейтелаарс і Люк Ван Гол показали SURF. Гаусові ядра замінено на прямокутні коробкові фільтри, які рахуються за сталий час через інтегральне зображення, детектор побудовано на визначнику матриці Гессе, а дескриптор скорочено до 64 чисел. На одному й тому самому зображенні 800 × 640 виявлення разом з описом зайняло 354 мс проти 1036 мс у SIFT.
8–9 червня 2006 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані
8–9 червня 2006 року чотирнадцять команд з одинадцяти установ перекладали між англійською, французькою, німецькою та іспанською на корпусі Europarl. Уперше в цьому змаганні виходи оцінили і BLEU, і люди — близько 180 годин праці самих учасників, — і два оцінювання розійшлися.
30 липня – 3 серпня 2006 р.Дослідження · ЗображенняЛінії: Дані
На SIGGRAPH 2006 Ноа Снейвлі, Стівен Зейтц (Вашингтонський університет) і Річард Шеліскі (Microsoft Research) показали Photo Tourism. Система сама визначала, звідки знято кожне з тисяч випадкових інтернет-фото пам’ятки, складала з них розріджену тривимірну модель і дозволяла переходити по ній від знімка до знімка. Для Нотр-Даму з 2635 фото з Flickr зареєстровано 597.
грудень 2006 р.Дослідження · Роботи й автономністьЛінії: Втілення
Ашутош Саксена, Джастін Дрімаєр, Джастін Кернс і Ендрю Ин навчили алгоритм знаходити точку захвату просто на зображенні, тренуючи його лише на синтетичних картинках; на справжніх предметах, яких не було в навчанні, робот підняв 87,5% спроб.
5 квітня 2007 р.Бенчмарк · ЗображенняЛінії: Оцінювання · Шкода
5 квітня 2007 року NEJM опублікував порівняння 43 закладів трьох штатів за 1998–2002 роки: там, де запровадили комп'ютерне виявлення, специфічність скринінгової мамографії впала з 90,2 % до 87,2 %, біопсій стало на 19,7 % більше, а зростання чутливості з 80,4 % до 84,0 % було незначущим.
8 травня 2007 р.Дослідження · Наукові основиЛінії: Гроші й ринок
8 травня 2007 року Метью Річардсон, Ева Доміновська і Роберт Раньо з Microsoft опублікували в збірнику конференції WWW модель, що передбачає частку кліків для пошукових оголошень, які ще не мають історії показів. Логістична регресія на ознаках оголошення, ключових слів і рекламодавця зменшила помилку оцінки на 30 % проти базової моделі, яка просто бере середню частку кліків.
8 травня 2007 р.Дослідження · Наукові основиЛінії: Символьний підхід · Дані
8 травня 2007 року троє дослідників Інституту Макса Планка опублікували YAGO — онтологію приблизно на мільйон сутностей і п'ять мільйонів фактів, зібрану автоматично: особи й речі взяті з категорій та інфобоксів Вікіпедії, а вершина ієрархії — з WordNet. Вибіркова перевірка людьми дала точність близько 95 відсотків.
5–9 серпня 2007 р.Дослідження · ЗображенняЛінії: Інструменти
У серпні 2007 року на SIGGRAPH Шай Авідан (MERL) і Аріель Шамір (Міждисциплінарний центр Герцлія) показали, як змінити пропорції зображення, не спотворивши головного: програма знову й знову вирізає або вставляє шов — зв’язний ланцюжок найменш помітних пікселів згори донизу чи зліва направо.
5–9 серпня 2007 р.Дослідження · ЗображенняЛінії: Генеративні медіа · Дані
У серпні 2007 року на SIGGRAPH Джеймс Гейс і Олексій Ефрос з Карнегі-Меллона заповнили вирізану частину фото шматками інших фотографій. Спершу серед 2,3 мільйона знімків із Flickr шукалися 200 найсхожіших сцен, тоді — найкраще місце в кожній, а вставка зшивалася без шва.
жовтень 2007 р.Бенчмарк · ЗображенняЛінії: Дані · Оцінювання
У жовтні 2007 року Гері Гуан, Ману Рамеш, Тамара Берг і Ерік Лернед-Міллер з Массачусетського університету в Амгерсті випустили Labeled Faces in the Wild: 13 233 фото облич 5749 людей із новинних статей у вебі, 1680 із них — на двох і більше знімках. Задача — сказати про пару фото, чи на них та сама людина.
листопад 2007 р.Дослідження · Наукові основиЛінії: Символьний підхід · Дані · Відкритість
У листопаді 2007 року група з Берліна, Лейпцига й Пенсильванії подала на конференції ISWC проєкт DBpedia — 103 мільйони RDF-трійок, видобутих з інфобоксів англійської Вікіпедії. Набір описував понад 1,95 мільйона речей і відповідав на запити через відкритий SPARQL-ендпоінт.
листопад 2007 р.Дослідження · Роботи й автономністьЛінії: Втілення · Теорія навчання
У листопаді 2007 року Георг Кляйн і Девід Мюррей показали PTAM: стеження за камерою і побудова карти перестали бути одним обчисленням і роз'їхалися у два паралельні потоки на двоядерному комп'ютері. Потік стеження встигає за кожним кадром, а потік картування в цей час рахує пакетну оптимізацію на ключових кадрах — і карта виростає до тисяч точок.
9 червня 2008 р.Доступність · Наукові основиЛінії: Символьний підхід · Дані · Відкритість
9 червня 2008 року на конференції SIGMOD команда Metaweb Technologies описала Freebase — базу знань на понад 125 мільйонів кортежів, більш ніж 4000 типів і понад 7000 властивостей. Доступ на читання й запис давали всім через HTTP-API з власною мовою запитів MQL.
На CVPR у червні 2008 року Педро Фельценшвальб (Чиказький університет), Девід Мак-Аллестер (TTI Chicago) і Дева Раманан (UC Irvine) описали детектор, де об’єкт — грубий шаблон на гістограмах градієнтів плюс дрібніші шаблони частин, що можуть зсуватися. Навчений латентним SVM, він удвічі перевершив найкращий результат PASCAL 2006 для людей: 0,34 середньої точності проти 0,16.
1 липня 2008 р.Віха · Роботи й автономністьЛінії: Втілення · Праця
IEEE Spectrum навів цифри розгортань Kiva Systems: 500 роботів на складі Staples площею 30 тисяч квадратних метрів, сотні в розподільчому центрі Walgreens; 600 відборів на годину проти 200-400 у конвеєрного складу.
3 жовтня 2008 р.Право й регулювання · ЗображенняЛінії: Право й політика · Шкода
3 жовтня 2008 року набув чинності іллінойський закон про приватність біометричної інформації (BIPA): приватна компанія може зібрати скан обличчя, відбиток пальця чи голосовий відбиток лише після письмового повідомлення про мету й строк і письмового дозволу людини, а за кожне порушення людина може позиватися — 1 000 доларів за недбале, 5 000 за навмисне.
У листопаді 2008 року Антоніо Торральба, Роб Фергус і Вільям Фрімен з MIT описали в IEEE PAMI набір із 79 302 017 зображень 32 × 32 пікселі. За вісім місяців сім пошукових систем видали 97 245 098 картинок на запити з 75 846 іменників WordNet; після чистки лишилися зображення для 75 062 слів. Міткою кожного є лише запит, за яким його знайдено.
8 квітня 2009 р.Бенчмарк · ЗображенняЛінії: Дані · Оцінювання · Праця
8 квітня 2009 року Алекс Крижевський з Торонтського університету випустив технічний звіт, у якому описав CIFAR-10 — розмічену частину колекції 80 мільйонів крихітних зображень 32×32: 10 класів по 6 000 зображень, по 5 000 з кожного класу в навчальній частині. У тому ж звіті — CIFAR-100, 100 класів по 600.
3–7 серпня 2009 р.Дослідження · ЗображенняЛінії: Інструменти
У серпні 2009 року на SIGGRAPH Коннеллі Барнс, Елі Шехтман, Адам Фінкельштейн і Ден Голдман (Принстон, Adobe) описали PatchMatch — пошук схожих латок у зображенні, у 20–100 разів швидший за kd-дерева: спершу випадкові збіги, тоді добрі передаються сусідам і уточнюються випадковим пошуком.
2009Бенчмарк · Роботи й автономністьЛінії: Втілення · Оцінювання · Оборона
Програма Learning Locomotion поставила шість команд на однакового чотириногого робота LittleDog і міряла їх числом: за фазами треба було долати дедалі вищі перешкоди дедалі швидше, за порогами, які DARPA встановила наперед.
30 квітня 2010 р.Доступність · ЗображенняЛінії: Інструменти
30 квітня 2010 року Adobe почала постачати Creative Suite 5, а з ним Photoshop CS5, де виділений предмет можна прибрати, а порожнє місце програма сама заповнює вмістом довкола — функція Content-Aware Fill. Photoshop CS5 оголосили 12 квітня.
квітень 2010 р.Дослідження · Наукові основиЛінії: Праця · Дані
У квітні 2010 року п'ятеро дослідників з Каліфорнійського університету в Ірвайні звели шість опитувань працівників Mechanical Turk за двадцять місяців. Частка працівників з Індії зросла з 5 % у листопаді 2008 року до 36 % роком пізніше.
4 травня 2010 р.Доступність · Роботи й автономністьЛінії: Втілення · Оцінювання
Willow Garage роздала 11 роботів PR2 загальною вартістю понад 4,4 мільйона доларів одинадцятьом установам, обраним із 78 заявок, разом зі спільним програмним стеком.
квітень 2010 р. — 30 травня 2010 р.Доступність · Наукові основиЛінії: Оцінювання · Гроші й ринок
Навесні 2010 року Kaggle Pty Ltd відкрила платформу змагань із прогнозування: організація викладає дані й приз, аналітики надсилають розв'язки, найкращий бере приз. Першим змаганням був прогноз голосування Євробачення з призом 1 000 доларів; 30 травня 2010 року Kaggle оголосила переможця серед 22 команд.
травень 2010 р.Дослідження · Роботи й автономністьЛінії: Втілення
Робот PR2 у Берклі підняв зі столу навмання кинутий рушник, знайшов його кути за геометрією зображення, перехопив, розправив і склав — і зробив це успішно в усіх 50 наскрізних випробуваннях на рушниках, яких раніше не бачив.
23 вересня – 7 грудня 2010 р.Віха · Наукові основиЛінії: Гроші й ринок
23 вересня 2010 року британський реєстр компаній зареєстрував фірму 07386350 під назвою Friars 2022 Limited, із секретарем M&R Secretarial Services і кембриджською адресою. 15 листопада її перейменовано на DeepMind Technologies Limited, 7 грудня директором став Деміс Хассабіс, а Мустафа Сулейман — секретарем. Шейн Легг і Сулейман стали директорами лише 23 грудня 2011 року.
16 червня 2011 р.Право й регулювання · Роботи й автономністьЛінії: Право й політика · Автономний рух
16 червня 2011 року губернатор Невади схвалив законопроєкт AB 511: відомство транспортних засобів мусить до 1 березня 2012 року ухвалити правила, за якими автономні машини можуть їздити дорогами штату, — з вимогами до машини, страхування й безпеки та з випробуваннями лише в указаних зонах.
23 січня 2012 р.Доступність · Наукові основиЛінії: Дані · Відкритість
23 січня 2012 року Common Crawl Foundation оголосив, що його архів обходу вебу — п'ять мільярдів сторінок — розміщено в Amazon Public Data Sets. Зберігання оплачує Amazon, користувач платить лише за власні обчислення.
6 квітня 2012 р.Віха · Наукові основиЛінії: Гроші й ринок · Оцінювання
6 квітня 2012 року Ксав'єр Аматріайн і Джастін Базіліко з Netflix розповіли, що з відкритого змагання компанія ввела в продукт два алгоритми з переможного рішення першого проміжного призу 2007 року — факторизацію матриць і обмежені машини Больцмана. Суміш сотень моделей, що виграла головний приз, не ввели: виміряний офлайн приріст точності не виправдовував інженерних витрат.
16 травня 2012 р.Оголошення · Наукові основиЛінії: Символьний підхід · Пошук і міркування · Дані
16 травня 2012 року Аміт Сінгхал оголосив, що пошук Google починає відповідати про речі, а не про рядки. Компанія заявила понад 500 мільйонів об'єктів і понад 3,5 мільярда фактів і зв'язків між ними, зібраних із Freebase, Вікіпедії, Всесвітньої книги фактів ЦРУ та інших джерел.
3 липня 2012 р.Дослідження · Наукові основиЛінії: Теорія навчання
3 липня 2012 року Джеффрі Гінтон, Нітіш Шрівастава, Алекс Крижевський, Ілля Суцкевер і Руслан Салахутдінов з Торонтського університету виклали препринт: на кожному навчальному прикладі вимикати кожен прихований нейрон з імовірністю 0,5, а під час перевірки вдвічі зменшувати вихідні ваги. На MNIST найкраща звичайна мережа робила 160 помилок; dropout знизив їх приблизно до 130, а з вимиканням ще й 20 % пікселів входу — приблизно до 110. Одна мережа на ImageNet 2010 — з 48,6 % до 42,4 % похибки.
29 жовтня 2012 р.Доступність · Наукові основиЛінії: Символьний підхід · Дані · Відкритість
29 жовтня 2012 року Wikimedia Deutschland відкрила Wikidata. Спершу в ній можна було лише створювати елементи й чіпляти до них статті Вікіпедії різними мовами; кожен елемент дістав ідентифікатор із літерою Q, а всі дані — ліцензію CC0, тобто суспільне надбання.
21 листопада 2012 р.Право й регулювання · Наукові основиЛінії: Оборона · Право й політика
21 листопада 2012 року заступник міністра оборони Ештон Картер видав директиву 3000.09. Вона дала означення автономній системі озброєння і зобов'язала проєктувати такі системи так, щоб командири й оператори могли застосовувати належний рівень людського судження щодо застосування сили.
грудень 2012 р.Дослідження · ЗображенняЛінії: Шкода · Оцінювання · Дані
У грудневому випуску IEEE Transactions on Information Forensics and Security за 2012 рік Брендан Клер із колегами виміряв шість систем розпізнавання обличчя на 102 942 поліцейських знімках, поділених на вісім демографічних когорт. Найточніша з трьох комерційних систем упізнавала 88,7 % чорношкірих проти 94,4 % білих, 89,5 % жінок проти 94,4 % чоловіків і 91,7 % осіб 18–30 років проти 94,6 % осіб 30–50 років.
6 серпня 2013 року інженер Facebook Ларс Бекстром у першому дописі серії News Feed FYI пояснив, що за кожного відвідування стрічки користувач має в середньому 1 500 потенційних історій від друзів і сторінок, а ранжування відбирає з них у середньому 300 на день за сигналами взаємодії, реакцій і приховування. Того ж дня компанія оголосила, що непрочитані історії, які далі збирають реакції, можуть повернутися вгору стрічки.
11 листопада 2013 року Росс Гіршик, Джітендра Малік і співавтори з Берклі показали, що мережа, навчена класифікувати цілі зображення ImageNet, може знаходити об'єкти: вона оцінює близько 2 000 регіонів-пропозицій, і на PASCAL VOC 2007 середня точність сягає 48 %.
24 січня – 10 лютого 2014 р.Віха · Наукові основиЛінії: Гроші й ринок · Безпека
Британський реєстр датує зміну власника DeepMind Technologies 24 січня 2014 року: того дня розподілено акції, капітал після розподілу — 1 640,64 фунта стерлінгів, і тією самою датою записано призначення директора. 3 лютого одним пакетом припинено повноваження шістьох директорів — Гассабіса, Сулеймана, Легга і трьох інвесторів, — а 10 лютого призначено двох нових. Скільки Google заплатив, не сказано ніде.
1 травня 2014 р.Бенчмарк · ЗображенняЛінії: Дані · Оцінювання · Праця
1 травня 2014 року Цун-Ї Лінь і співавтори з Корнелла, Каліфорнійського технологічного, Брауна, Каліфорнійського університету в Ірвайні та Microsoft Research оприлюднили Microsoft COCO — 328 000 зображень повсякденних сцен із 2,5 мільйона розмічених екземплярів 91 категорії об'єктів, кожен з окремою маскою сегментації.
3 червня 2014 р.Дослідження · Мовні моделіЛінії: Теорія навчання
3 червня 2014 року Кьонхьон Чо, Йошуа Бенжіо й співавтори з Монреальського університету, Гетеборзького університету й Університету Мену виклали кодувальник–декодувальник на рекурентних мережах: одна мережа стискає фразу у вектор фіксованої довжини, друга розгортає його у фразу іншою мовою. Для нього запропоновано новий прихований блок із вентилем скидання й вентилем оновлення, натхненний LSTM, але значно простіший. Як ознака в фразовій системі перекладу з англійської на французьку він підняв BLEU на тесті з 29,33 до 29,96, а разом із нейронною мовною моделлю й штрафом за слова — до 31,18.
червень 2014 р.Дослідження · ЗображенняЛінії: Дані
У червні 2014 року Facebook AI Research і Тель-Авівський університет представили на CVPR DeepFace: мережа з понад 120 мільйонами параметрів після тривимірного вирівнювання обличчя досягла 97,35 % на Labeled Faces in the Wild, знизивши похибку понад на 27 %.
3 липня 2014 р.Дослідження · Наукові основиЛінії: Безпека
3 липня 2014 року Oxford University Press випустило книжку Ніка Бострома, директора оксфордського Інституту майбутнього людства, «Superintelligence: Paths, Dangers, Strategies», 352 сторінки. Книжка розбирає, як машинний інтелект може перевершити людський, чому його цілі можуть розійтися з людськими і які способи контролю для цього взагалі можливі.
31 липня 2014 р.Віха · Наукові основиЛінії: Гроші й ринок · Автономний рух
31 липня 2014 року Mobileye N.V. випустила остаточний проспект на 35 589 000 звичайних акцій по 25 доларів — 889,7 мільйона валом. Сама компанія продала 8 325 000 акцій і одержала до витрат 197,7 мільйона; решта 647,5 мільйона пішла акціонерам, які продавали. Документ уперше показав виручку розробника комп’ютерного зору: 81,2 мільйона доларів за 2013 рік.
24 серпня 2014 р.Дослідження · Наукові основиЛінії: Гроші й ринок
24 серпня 2014 року одинадцять інженерів Facebook, серед них Хоакін Кіньйонеро Кандела, описали на воркшопі ADKDD модель прогнозу кліків на рекламу: дерева градієнтного бустингу перетворюють ознаки, а логістична регресія, яку оновлюють онлайн, дає ймовірність кліку. Поєднання перевершило кожен із двох методів окремо більш ніж на 3 % за нормалізованою ентропією.
17 листопада 2014 р.Дослідження · МультимодальніЛінії: Генеративні медіа
17 листопада 2014 року Оріоль Віньялс і співавтори з Google описали мережу, яка сама складає речення про зміст зображення: згорткова мережа кодує картинку, рекурентна LSTM пише опис. На наборі Pascal BLEU — 59 проти попереднього найкращого 25 і людських близько 69.
12 березня 2015 р.Дослідження · ЗображенняЛінії: Дані
12 березня 2015 року Google описав FaceNet: мережа перетворює обличчя на вкладення в 128 байтів, де відстань означає схожість. На Labeled Faces in the Wild — 99,63 %, на YouTube Faces DB — 95,12 %, похибка на обох на 30 % нижча за найкращий опублікований результат.
2 квітня 2015 р.Дослідження · Роботи й автономністьЛінії: Втілення
Сергій Левін, Челсі Фінн, Тревор Даррелл і Пітер Аббіль показали, що коли сприйняття і керування тренувати спільно, а не двома окремими ступенями, робот виконує контактні задачі вдвічі надійніше на найважчих із них.
квітень 2015 р.Дослідження · Мовні моделіЛінії: Мовлення · Дані
У квітні 2015 року Васіл Панайотов, Даніел Пові й співавтори з Університету Джонса Гопкінса опублікували LibriSpeech — близько 1 000 годин читаної англійської мови з 16 кГц, вирівняної з текстом, узятої з аудіокниг LibriVox, що перебувають у суспільному надбанні.
3 травня 2015 р.Дослідження · МультимодальніЛінії: Дані · Оцінювання
3 травня 2015 року Станіслав Антол, Деві Парікх і співавтори запропонували задачу відкритих відповідей на запитання про зображення й набір для неї. У першій версії — 123 285 зображень MS COCO, 215 150 запитань і 430 920 відповідей, а також 10 000 абстрактних сцен із 30 000 запитань.
18 травня 2015 р.Дослідження · ЗображенняЛінії: Наука
18 травня 2015 року Олаф Роннебергер і співавтори з Фрайбурга описали U-Net — згорткову мережу, де стискальна гілка з'єднана з симетричною розгортальною. На ній вони виграли конкурс ISBI 2015 зі стеження за клітинами у двох категоріях, а знімок 512×512 сегментується менш ніж за секунду.
5 червня 2015 р.Доступність · Наукові основиЛінії: Інструменти · Відкритість
5 червня 2015 року токійська Preferred Networks випустила Chainer 1.0 — бібліотеку глибокого навчання на Python, у якій граф обчислень не описують наперед: він запам'ятовується сам, поки йде пряме обчислення. У грудні того ж року Сейя Токуй, Кента Оно, Шохей Хідо й Джастін Клейтон назвали цей підхід Define-by-Run на воркшопі LearningSys при NIPS.
8 червня 2015 року Джозеф Редмон, Алі Фаргаді й співавтори з Вашингтонського університету та Інституту Аллена описали YOLO: одна мережа за один прохід передбачає рамки й класи для всього зображення. Вона обробляє 45 кадрів за секунду, а точність на PASCAL VOC 2007 становить 58,8 mAP.
9 листопада 2015 р.Доступність · Наукові основиЛінії: Інструменти · Відкритість
Google відкрила власну систему для навчання моделей: обчислення описують графом, а виконувати його можна на процесорі, графічному прискорювачі чи кластері.
28 грудня 2015 р.Дослідження · Наукові основиЛінії: Гроші й ринок
28 грудня 2015 року Карлос Гомес-Урібе і Ніл Гант з Netflix описали в журналі ACM Transactions on Management Information Systems рекомендаційну систему компанії: вона впливає на вибір приблизно 80 % годин перегляду, решта 20 % припадає на пошук. Автори оцінили, що персоналізація й рекомендації разом заощаджують компанії понад мільярд доларів на рік, бо зменшують відтік підписників.
4 лютого 2016 р.Дослідження · Наукові основиЛінії: Теорія навчання · Обчислення
4 лютого 2016 року Володимир Мних і співавтори з Google DeepMind виклали асинхронні варіанти чотирьох алгоритмів навчання з підкріпленням: багато акторів-учнів паралельно працюють на копіях середовища замість навчання з пам'яті повторів. Найкращий, асинхронний актор-критик з перевагою (A3C), за чотири дні навчання на 16 ядрах CPU без GPU досяг у середньому 623,0 % і в медіані 112,6 % людського рівня на 57 іграх Atari проти 121,9 % і 47,5 % у DQN після восьми днів на GPU.
7 березня 2016 р.Дослідження · Роботи й автономністьЛінії: Втілення · Дані
У Google навчили згорткову мережу передбачати, чи закінчиться запропонований рух захвата успіхом, на 800 тисячах спроб, зібраних за два місяці шістьма-чотирнадцятьма маніпуляторами, що працювали паралельно.
23–25 березня 2016 р.Доступність · Мовні моделіЛінії: Шкода
23 березня 2016 року Microsoft запустила в Twitter чат-бота Tay для 18–24-річних американців, який навчався з розмов. За першу добу скоординована група користувачів скористалася вразливістю, і Tay публікував образливі тексти й зображення; 25 березня компанія вибачилася, а бот був уже вимкнений.
27 квітня 2016 р.Право й регулювання · Наукові основиЛінії: Право й політика · Дані
27 квітня 2016 року Європейський парламент і Рада підписали Загальний регламент про захист даних (GDPR), який застосовується з 25 травня 2018 року. Стаття 22 дає людині право не бути предметом рішення, заснованого виключно на автоматизованому обробленні, зокрема профілюванні, якщо воно має для неї правові чи подібно суттєві наслідки.
23 травня 2016 р.Дослідження · Наукові основиЛінії: Шкода · Оцінювання
23 травня 2016 року ProPublica опублікувала аудит COMPAS — шкали ризику рецидиву, яку суди США використовували в рішеннях про заставу й умовне звільнення. Видання взяло бали понад 7000 осіб, заарештованих в окрузі Бровард у Флориді 2013 і 2014 років, і звірило їх із новими обвинуваченнями за наступні два роки. Частка тих, кого позначено вищим ризиком і хто не вчинив нового злочину, склала 44,9 % серед чорношкірих підсудних проти 23,5 % серед білих.
16 червня 2016 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані · Праця
16 червня 2016 року Стенфорд опублікував набір із 107 785 питань, складених краудворкерами до 536 статей Вікіпедії, де відповіддю є відрізок самого абзацу. Власна модель авторів дала 51,0 F1, людина на тесті — 86,8.
21 червня 2016 р.Дослідження · Наукові основиЛінії: Безпека
21 червня 2016 року Даріо Амодей і Кріс Олах (Google Brain), Джейкоб Стейнгардт (Стенфорд), Пол Крістіано (Берклі), Джон Шульман (OpenAI) і Ден Мане (Google Brain) виклали препринт «Concrete Problems in AI Safety». Вони звели ризик аварій у системах машинного навчання до п'яти дослідницьких задач: побічні ефекти, зламування винагороди, масштабований нагляд, безпечне дослідження і зсув розподілу.
24 червня 2016 р.Дослідження · Наукові основиЛінії: Інструменти
24 червня 2016 року шістнадцять авторів з Google виклали препринт Wide & Deep: широка лінійна модель на перехресних ознаках і глибока мережа з векторними поданнями, навчені разом. Модель запустили й випробували в Google Play; в онлайн-експерименті на 1 % користувачів вона підняла частку встановлень застосунків з головної сторінки магазину на 3,9 % проти попередньої моделі — лише широкої логістичної регресії.
8 липня 2016 р.Дослідження · Наукові основиЛінії: Шкода · Оцінювання
8 липня 2016 року дослідницький відділ Northpointe відповів на аудит ProPublica власним аналізом тих самих даних. Звіт Вільяма Дітеріха, Крістіни Мендоси й Тіма Бреннана показав, що площа під ROC-кривою шкали загального рецидиву в головній вибірці видання дорівнює 0,69 для чорношкірих і 0,69 для білих підсудних, а частка позначених вищим ризиком, які не вчинили нового злочину, була не вищою, а нижчою для чорношкірих: 37 % проти 41 %.
7 вересня 2016 року Пол Ковінгтон, Джей Адамс і Емре Саргін з Google описали для конференції RecSys рекомендаційну систему YouTube на глибоких мережах у два етапи: генерація кандидатів звужує корпус із мільйонів відео до сотень, а окрема мережа ранжування впорядковує їх, передбачаючи очікуваний час перегляду, а не ймовірність кліку. Моделі мають близько мільярда параметрів і навчені на сотнях мільярдів прикладів.
19 вересня 2016 р.Дослідження · Наукові основиЛінії: Теорія навчання · Шкода · Оцінювання
19 вересня 2016 року Джон Клейнберг, Сендгіл Муллайнатан і Маніш Рагаван подали статтю, яка формалізувала три умови справедливості для шкал ризику й довела, що жодне призначення балів не задовольняє всі три одночасно — крім двох вироджених випадків: коли прогноз ідеальний або коли базові частоти в групах однакові. Стаття прямо називає суперечку навколо COMPAS як привід.
26 вересня 2016 р.Дослідження · Мовні моделіЛінії: Обчислення
26 вересня 2016 року Google виклав GNMT — нейронну систему перекладу з вісьмома шарами LSTM у кодері й вісьмома в декодері, а 27 вересня перевів на неї 100 % перекладів з китайської на англійську в Google Translate, близько 18 мільйонів на день. У людському оцінюванні вона зменшила помилки проти фразової статистичної системи в середньому на 60 %.
21 листопада 2016 р.Дослідження · ЗображенняЛінії: Генеративні медіа
21 листопада 2016 року Філліп Ізола, Олексій Ефрос і співавтори з Берклі показали, що умовна змагальна мережа з тією самою архітектурою й ціллю перетворює зображення на зображення в багатьох задачах: мітки на вуличні сцени, аерофото на карти, день на ніч, контури на фото.
листопад 2016 р.Віха · Наукові основиЛінії: Гроші й ринок · Наука
У листопаді 2016 року аудиторський офіс Техаського університету встановив, що онкоцентр MD Anderson заплатив зовнішнім фірмам 62,1 мільйона доларів за Oncology Expert Advisor — радника на технології IBM Watson, — а система не використовується в лікуванні й не з'єднана з новою медичною картою лікарні.
13 грудня 2016 р.Дослідження · ЗображенняЛінії: Наука · Оцінювання
13 грудня 2016 року JAMA опублікував згорткову мережу Google, навчену на 128 175 знімках очного дна: на двох незалежних наборах вона виявляла ретинопатію, що потребує направлення до офтальмолога, з площею під ROC-кривою 0,991 і 0,990.
23 січня 2017 р.Дослідження · Наукові основиЛінії: Теорія навчання · Обчислення
23 січня 2017 року Ноам Шазір і співавтори з Google Brain, серед них Джеффрі Дін і Джеффрі Гінтон, виклали шар з тисяч мереж-експертів, з яких навчуваний вентиль обирає для кожного прикладу лише кілька (зашумлений вибір top-k). Вставлений між шарами LSTM, він дав моделі до 137 млрд параметрів і, за словами авторів, понад 1000-кратне зростання місткості за незначної втрати обчислювальної ефективності. На WMT'14 — 40,56 BLEU для англійська–французька і 26,03 для англійська–німецька.
25 січня 2017 р.Дослідження · ЗображенняЛінії: Наука · Оцінювання
25 січня 2017 року Nature опублікував згорткову мережу Стенфорда, навчену на 129 450 клінічних знімках 2 032 хвороб шкіри: у двох задачах — карциноми проти доброякісних кератозів, меланоми проти невусів — вона зрівнялася з 21 сертифікованим дерматологом.
січень 2017 р. — 30 січня 2017 р.Віха · Наукові основиЛінії: Пошук і міркування
У січні 2017 року програма Libratus Університету Карнеґі-Меллона за двадцять днів зіграла 120 000 роздач безлімітного техаського холдему один на один проти чотирьох професіоналів у казино Rivers у Піттсбурзі й завершила матч 30 січня з перевагою 1 766 250 доларів у фішках.
У січні 2017 року Future of Life Institute оприлюднив 23 Асиломарські принципи ШІ, вироблені на його конференції Beneficial AI 2017 в Асиломарі. Принципи згруповано в три розділи — дослідження, етика й цінності, довгострокові питання — і відкрито для підпису.
27 березня 2017 р.Дослідження · Роботи й автономністьЛінії: Втілення
Dex-Net 2.0 навчили на 6,7 мільйона синтетичних хмар точок, згенерованих із тривимірних моделей, без жодної спроби на справжньому роботі — і політика дала 99% точності на сорока небачених побутових предметах.
29 березня 2017 р.Дослідження · МультимодальніЛінії: Мовлення · Генеративні медіа
29 березня 2017 року Юйсюань Ван і співавтори з Google описали Tacotron — модель, яка синтезує мовлення безпосередньо з символів тексту й навчається з нуля на парах «текст — звук». Середня оцінка природності — 3,82 з 5 проти 3,69 у серійної параметричної системи.
березень 2017 р.Дослідження · МультимодальніЛінії: Дані
У березні 2017 року Йорт Геммеке й співавтори з Google представили AudioSet — ієрархічну онтологію звукових подій і 2 084 320 розмічених людьми 10-секундних кліпів із відео YouTube; розмітники перевіряли, чи чутно в сегменті певний клас звуку.
26 квітня 2017 р.Віха · Наукові основиЛінії: Оборона
26 квітня 2017 року заступник міністра оборони Роберт Ворк підписав записку про створення Міжфункціональної групи алгоритмічної війни, щоб «прискорити інтеграцію великих даних і машинного навчання» в міністерстві. Її першим завданням було автоматизувати обробку відео з безпілотників для кампанії проти ІДІЛ.
23–27 травня 2017 р.Віха · Наукові основиЛінії: Пошук і міркування
З 23 по 27 травня 2017 року в Учжені DeepMind разом із Китайською асоціацією ґо провела Future of Go Summit: матч із трьох партій проти першого номера світу Ке Цзє, парну гру, де двоє професіоналів мали по AlphaGo в напарниках, і гру проти команди з п'яти професіоналів. AlphaGo виграла всі три партії, і DeepMind оголосила цей матч для програми останнім.
12 червня 2017 р.Дослідження · Наукові основиЛінії: Теорія навчання · Безпека
12 червня 2017 року Пол Крістіано й Даріо Амодей з OpenAI, Ян Лайке, Мільян Мартич і Шейн Легг з DeepMind та Том Браун виклали метод, у якому людина порівнює пари коротких відрізків траєкторії агента, модель винагороди підганяється під ці вибори, а агент учиться з підкріпленням на передбаченій винагороді. На восьми задачах робототехніки в MuJoCo і семи іграх Atari метод працював без доступу до функції винагороди, з людським відгуком менш ніж на 1 % взаємодій агента із середовищем.
4 липня 2017 р.Доступність · Роботи й автономністьЛінії: Автономний рух · Відкритість
4 липня 2017 року Baidu виклала на GitHub Apollo 1.0 — відкритий код платформи для автономного водіння. Перша версія вміла одне: повторювати маршрут і швидкість, які проїхав водій-людина, на закритому майданчику за GPS. Перешкод поблизу вона не бачила й на дороги загального користування не виїжджала. Відкрити код Baidu пообіцяла ще 18 квітня.
20 липня 2017 р.Дослідження · Наукові основиЛінії: Теорія навчання
20 липня 2017 року Джон Шульман, Філіп Вольський, Прафулла Дхарівал, Алек Редфорд і Олег Клімов з OpenAI виклали проксимальну оптимізацію політики: сурогатну цільову функцію, яка обрізає відношення ймовірностей нової й старої політики (в експериментах ε = 0,2), тож ту саму вибірку можна використати для кількох епох оновлень мініпакетами лише методами першого порядку. На семи задачах MuJoCo по мільйону кроків PPO перевершив попередні методи градієнта політики майже скрізь; на 49 іграх Atari виграв 30 за середньою винагородою за навчання проти 18 в ACER і однієї в A2C.
20 липня 2017 р.Віха · Наукові основиЛінії: Право й політика
Державна рада КНР оприлюднила план, за яким країна мала до 2030 року стати головним світовим центром інновацій у ШІ, з проміжними цілями на 2020 і 2025 роки.
8–21 серпня 2017 р.Віха · Наукові основиЛінії: Гроші й ринок · Автономний рух · Обчислення
21 серпня 2017 року Intel завершила тендерну пропозицію на акції Mobileye, зібравши 97,3 відсотка після 84,4 відсотка 8 серпня. Оголошення 13 березня називало 63,54 долара за акцію, вартість капіталу близько 15,3 мільярда доларів і вартість підприємства 14,7 мільярда. Річний звіт за 2017 рік каже інше: загальна винагорода — 14,5 мільярда доларів за вирахуванням 366 мільйонів готівки, що надійшла з компанією.
7 вересня 2017 р.Доступність · Наукові основиЛінії: Інструменти · Відкритість
7 вересня 2017 року Microsoft і Facebook спільно оголосили відкритий формат обміну нейромережами. Навчену модель стало можливо перенести між фреймворками, не переписуючи її.
14 грудня 2017 р.Дослідження · Наукові основиЛінії: Праця · Дані · Гроші й ринок
14 грудня 2017 року вийшов препринт, у якому погодинну оплату на Mechanical Turk виміряли не опитуванням, а записом роботи: 2 676 працівників, 3,8 мільйона завдань. Медіана становила близько 2 доларів на годину, і лише 4 % заробляли більше за федеральний мінімум США 7,25 долара.
21 січня 2018 р.Дослідження · ЗображенняЛінії: Шкода · Оцінювання · Дані
21 січня 2018 року в збірнику першої конференції з чесності, підзвітності й прозорості вийшла праця Джой Буоламвіні й Тімніт Гебру. Вони показали, що два вживані набори для оцінювання складаються переважно зі світлошкірих людей — 79,6 % в IJB-A і 86,2 % в Adience, — зібрали збалансований набір на 1270 осіб і виміряли на ньому три комерційні класифікатори статі. Похибка на темношкірих жінках склала від 20,8 % до 34,7 %, на світлошкірих чоловіках — не більше 0,8 %.
11 грудня 2017 – 7 лютого 2018 рр.Віха · ЗображенняЛінії: Шкода · Генеративні медіа · Право й політика
11 грудня 2017 року Motherboard повідомив, що користувач Reddit на ім'я deepfakes вставляє обличчя акторок у порнографічні відео, навчивши мережу на Keras і TensorFlow. 7 лютого 2018 року Reddit закрив r/deepfakes і заборонив інтимні зображення без згоди, «зокрема підроблені».
9 квітня 2018 р.Право й регулювання · Наукові основиЛінії: Безпека
9 квітня 2018 року OpenAI оприлюднила статут із чотирма принципами: широко розподілена користь, довгострокова безпека, технічне лідерство й кооперативна орієнтація. AGI у ньому визначено як високоавтономні системи, що перевершують людей у більшості економічно цінної роботи, а головний фідуціарний обов'язок організації — перед людством.
11 квітня 2018 р.Доступність · ЗображенняЛінії: Право й політика · Наука
11 квітня 2018 року FDA дозволило продаж IDx-DR — програми, що за знімками очного дна сама вирішує, чи є в дорослого з діабетом ретинопатія понад легку. За словами FDA, це перший дозволений пристрій, чий скринінговий висновок не потребує лікаря, який би ще раз інтерпретував знімок.
20 квітня 2018 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані
20 квітня 2018 року дослідники з Нью-Йоркського університету зібрали дев'ять наявних задач розуміння мови під один лідерборд із закритими тестовими даними й одним усередненим балом. Найкраща базова лінія самої статті дала 60,3.
квітень 2018 р.Віха · Наукові основиЛінії: Обчислення · Гроші й ринок
У квітні 2018 року TSMC перевела процес N7 у серійне виробництво. До липня 2020 року на цьому вузлі виготовлено мільярд придатних кристалів для понад сотні виробів десятків замовників — TSMC стала першою ливарнею, що вивела 7 нанометрів у великосерійне виробництво.
1–7 червня 2018 р.Віха · Наукові основиЛінії: Оборона · Безпека
1 червня 2018 року керівниця хмарного підрозділу Дайан Ґрін оголосила співробітникам, що контракт із Project Maven не продовжуватимуть. 7 червня Сундар Пічаї опублікував принципи, у яких Google зобов'язалася не створювати ШІ для зброї та для стеження поза міжнародними нормами.
11 червня 2018 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані
11 червня 2018 року до SQuAD дописали 53 775 питань, на які абзац відповіді не містить, складених краудворкерами так, щоб вони скидалися на відповідні. Найкраща модель упала з 85,8 до 66,3 F1, тоді як людина трималася на 89,5.
27 червня 2018 р.Дослідження · Роботи й автономністьЛінії: Втілення
QT-Opt навчили на понад 580 тисячах справжніх спроб захвату методом навчання з підкріпленням; політика дала 96% успіху на небачених предметах і сама виробила поведінку, якої їй не задавали.
1 серпня 2018 р.Дослідження · Роботи й автономністьЛінії: Втілення
OpenAI навчила п’ятипалу руку Shadow перевертати кубик у долоні, тренуючи політику виключно в симуляції з випадковими фізичними властивостями; на залізі вона дала медіану в 13 успішних поворотів поспіль.
28 вересня 2018 р.Право й регулювання · Мовні моделіЛінії: Право й політика · Шкода
28 вересня 2018 року губернатор Каліфорнії схвалив закон SB 1001, чинний з 1 липня 2019 року: незаконно використовувати бота, щоб спілкуватися з людиною онлайн, вводячи її в оману щодо його штучної природи з наміром спонукати до покупки чи вплинути на голосування. Хто ясно розкриває, що це бот, не відповідає.
17 листопада 2018 р.Доступність · Мовні моделіЛінії: Інструменти · Відкритість
17 листопада 2018 року Hugging Face випустила бібліотеку, спершу названу pytorch-pretrained-bert. Вона давала доступ до попередньо навчених трансформерних моделей через єдиний інтерфейс — двома рядками коду замість власної реалізації.
7 грудня 2018 р.Доступність · Наукові основиЛінії: Інструменти
7 грудня 2018 року з'явився перший публічний випуск JAX — бібліотеки, що бере звичайний код на Python і NumPy та застосовує до нього перетворення: диференціювання, компіляцію, векторизацію, розпаралелення.
12 грудня 2018 р.Дослідження · ЗображенняЛінії: Генеративні медіа · Дані
12 грудня 2018 року NVIDIA описала StyleGAN: генератор змагальної мережі, у якому прихований код керує стилем на кожному рівні через AdaIN, а окремий шум додає випадкові деталі. На новому наборі облич FFHQ FID склав 4,40 проти 8,04 у Progressive GAN.
грудень 2018 р. — 19 грудня 2018 р.Віха · Наукові основиЛінії: Обчислення
19 грудня 2018 року програма AlphaStar від DeepMind виграла в професіонала Ґжеґожа «MaNa» Коміньча 5:0 у StarCraft II, після такої самої перемоги над Даріо «TLO» Вюншем; про обидва матчі компанія розповіла 24 січня 2019 року. 30 жовтня 2019 року Nature опублікувала статтю: AlphaStar грала на рівні гросмейстера всіма трьома расами.
24 січня 2019 р.Дослідження · Роботи й автономністьЛінії: Втілення
У ETH Zurich навчили керувальну політику в симуляції й перенесли її на чотириногого ANYmal: робот пішов зі швидкістю 1,5 м/с проти попереднього рекорду 1,2 м/с і піднімався після падіння з довільної пози.
11 лютого 2019 р.Право й регулювання · Наукові основиЛінії: Право й політика
11 лютого 2019 року президент США підписав указ 13859 «Збереження американського лідерства у штучному інтелекті»: п'ять принципів, шість цілей і доручення агенціям — OMB за 180 днів видати меморандум про регулювання застосувань ШІ, NIST за 180 днів — план федеральної участі в технічних стандартах.
11 березня 2019 р.Віха · Наукові основиЛінії: Гроші й ринок · Безпека
11 березня 2019 року Грег Брокман та Ілля Суцкевер оголосили OpenAI LP — компанію з «обмеженим прибутком», яку контролює рада неприбуткової OpenAI. Віддача інвесторам першого раунду обмежена стократною сумою вкладу, а все понад неї належить неприбутковій організації. У LP перейшла більшість працівників, близько ста людей.
8 квітня 2019 р.Право й регулювання · Наукові основиЛінії: Право й політика
8 квітня 2019 року група експертів високого рівня з питань ШІ, створена Європейською комісією, оприлюднила настанови з етики надійного штучного інтелекту: чотири етичні принципи, сім вимог до систем і список самооцінки для пілоту. Проєкт грудня 2018 року зібрав відгуки понад 500 учасників.
13 квітня 2019 р.Віха · Наукові основиЛінії: Обчислення
13 квітня 2019 року OpenAI Five — програма OpenAI, що керує п'ятьма героями й навчена з підкріпленням, — виграла в команди OG, чинних чемпіонів світу з Dota 2, дві гри поспіль. Препринт 13 грудня 2019 року підсумував навчання: один безперервний прогін з 30 червня 2018 по 22 квітня 2019 року.
2 травня 2019 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані
2 травня 2019 року автори GLUE визнали власний набір вичерпаним і випустили складніший, лишивши з дев'яти завдань два. Людську оцінку вклали в сам випуск: 89,6 проти 69,7 у найкращої базової лінії. 6 січня 2021 року DeBERTa стояла нагорі з 90,3.
21 травня 2019 р.Право й регулювання · ЗображенняЛінії: Право й політика · Шкода
21 травня 2019 року наглядова рада Сан-Франциско остаточно ухвалила постанову № 103-19 голосами 10 проти 1. Вона заборонила міським відомствам, зокрема поліції, діставати, зберігати й використовувати технологію розпізнавання обличчя чи отримані з неї відомості, а для будь-якої іншої техніки стеження запровадила попереднє схвалення радою зі звітом про вплив і щорічним аудитом контролера.
22 травня 2019 р.Право й регулювання · Наукові основиЛінії: Право й політика
22 травня 2019 року Рада Організації економічного співробітництва й розвитку ухвалила рекомендацію OECD/LEGAL/0449 — п'ять ціннісних принципів відповідального поводження з надійним ШІ й п'ять порад урядам. Крім країн-членів, до неї приєдналися Аргентина, Бразилія, Колумбія, Коста-Рика, Перу й Румунія. Сама ОЕСР тоді називала це першими такими принципами, під якими підписалися уряди.
5 червня 2019 р.Дослідження · Наукові основиЛінії: Обчислення · Шкода
5 червня 2019 року Массачусетський університет в Амгерсті порахував енергію та викиди навчання мовних моделей у фізичних одиницях. Повний архітектурний пошук для трансформера оцінено у 274 120 годин на восьми прискорювачах P100, 656 347 кВт·год і 626 155 фунтів CO2-еквівалента — приблизно вп'ятеро більше, ніж автомобіль викидає за весь термін служби разом із паливом.
11 липня 2019 р.Дослідження · Наукові основиЛінії: Пошук і міркування · Обчислення
11 липня 2019 року Ноам Браун і Туомас Сандгольм (Карнеґі-Меллон і Facebook AI) описали в Science програму Pluribus, яка обіграла професіоналів у безлімітний техаський холдем на шістьох: за 10 000 роздач проти п'ятьох професіоналів одночасно вона вигравала в середньому 48 тисячних великого блайнда на роздачу.
29 липня 2019 року група Baidu на чолі з Юй Сунем виклала ERNIE 2.0 — схему, у якій до мовної моделі поступово додають нові завдання попереднього навчання й учать їх разом із попередніми, щоб вивчене не забувалося. Велика модель набрала 83,6 на прихованому тестовому наборі GLUE, на 3,1 % більше за BERT, і обійшла BERT на всіх десяти завданнях тесту.
9 серпня 2019 р.Право й регулювання · ЗображенняЛінії: Право й політика · Праця
9 серпня 2019 року губернатор Іллінойсу схвалив закон про відеоспівбесіди зі штучним інтелектом, чинний з 1 січня 2020 року: роботодавець, який дає ШІ аналізувати записане кандидатом відео, мусить до співбесіди повідомити про це, пояснити, як ШІ працює і які загальні риси оцінює, і отримати згоду; без згоди ШІ не застосовують.
23 серпня 2019 р.Доступність · Наукові основиЛінії: Обчислення · Інструменти
23 серпня 2019 року Huawei випустила прискорювач Ascend 910 — 256 терафлопс у FP16, 512 тераопс у INT8, 310 Вт — і власний фреймворк MindSpore. Обидва призначені працювати разом: компанія заявила навчання ResNet-50 удвічі швидше за інші поширені карти на TensorFlow.
16 жовтня 2019 р.Дослідження · Роботи й автономністьЛінії: Втілення
OpenAI навчила ту саму руку Shadow складати кубик Рубіка, породжуючи щораз важчі симульовані середовища автоматично; частка успіху склала 60% на половинному перемішуванні й 20% на повному.
23 жовтня 2019 р.Доступність · Наукові основиЛінії: Дані · Відкритість
23 жовтня 2019 року Google випустив C4 — близько 750 ГБ англомовного тексту, зробленого з одного місячного зрізу Common Crawl за квітень 2019 року. Корпус роздавали через TensorFlow Datasets разом зі статтею про моделі T5.
25 жовтня 2019 р.Дослідження · Наукові основиЛінії: Шкода · Оцінювання
25 жовтня 2019 року Science опублікував аналіз поширеного комерційного алгоритму, що відбирає пацієнтів для додаткової допомоги: за однакового балу чорношкірі пацієнти значно хворіші за білих, а усунення цього підняло б їхню частку серед відібраних з 17,7 % до 46,5 %.
19 листопада 2019 р.Дослідження · Наукові основиЛінії: Пошук і міркування
19 листопада 2019 року Джуліан Шріттвізер і співавтори з DeepMind описали MuZero: пошук деревом поверх навченої моделі, якій не дають правил гри. На 57 іграх Atari вона встановила новий найкращий результат, а в го, шахах і сьоги зрівнялася з AlphaZero, яка правила знала.
16 грудня 2019 р.Віха · Наукові основиЛінії: Гроші й ринок · Обчислення
16 грудня 2019 року Intel оголосила, що придбала ізраїльську Habana Labs, розробника програмованих прискорювачів глибокого навчання для центрів обробки даних, «приблизно за 2 мільярди доларів». Через вісім тижнів річний звіт компанії за 2019 фінансовий рік назвав ту саму угоду однією фразою й іншим числом: приблизно 1,7 мільярда доларів.
19 грудня 2019 р.Бенчмарк · ЗображенняЛінії: Оцінювання · Шкода
19 грудня 2019 року Національний інститут стандартів і технологій США оприлюднив звіт NISTIR 8280 Патріка Гротера, Мей Нган і Кейї Ханаоки. Через 189 здебільшого комерційних алгоритмів від 99 розробників пропустили 18,27 мільйона зображень 8,49 мільйона людей із чотирьох урядових баз. Частка хибнопозитивних збігів між демографічними групами часто різниться у 10 і більше ніж у 100 разів, тоді як хибнонегативні різняться зазвичай менш ніж утричі.
1 січня 2020 р.Бенчмарк · ЗображенняЛінії: Оцінювання · Наука
1 січня 2020 року Nature опублікував модель Google Health і DeepMind для скринінгу раку грудей: на британському і американському наборах вона абсолютно зменшила хибнопозитивні результати на 1,2 і 5,7 пункта, а хибнонегативні — на 2,7 і 9,4, і перевершила кожного з шести радіологів.
9 січня 2020 року поліція Детройта заарештувала Роберта Вільямса на газоні перед його будинком у Фармінгтон-Гіллз, на очах дружини й двох доньок. Підставою був хибний збіг розпізнавання обличчя за записом камери з крамниці Shinola, звідки в жовтні 2018 року винесли п'ять годинників. Вільямса звільнили близько 21-ї години наступного дня — приблизно через тридцять годин.
20 лютого 2020 р.Дослідження · Наукові основиЛінії: Наука
20 лютого 2020 року Cell опублікував роботу MIT: мережа, навчена на 2 335 молекулах пригнічувати ріст кишкової палички, знайшла серед відомих сполук halicin — структурно несхожий на антибіотики, він убивав широке коло збудників і вилікував у мишей інфекції панрезистентного Acinetobacter baumannii і C. difficile.
19 березня 2020 р.Дослідження · ЗображенняЛінії: Генеративні медіа
19 березня 2020 року дослідники з Берклі, Google Research і Сан-Дієго описали NeRF: повнозв'язна мережа за точкою простору й напрямом погляду повертає густину й колір, і з набору знімків із відомими позиціями камери вона синтезує нові ракурси складних сцен.
31 березня 2020 р.Право й регулювання · ЗображенняЛінії: Право й політика · Шкода
31 березня 2020 року губернатор штату Вашингтон схвалив закон SB 6280, чинний з 1 липня 2021 року: державні й місцеві органи можуть застосовувати розпізнавання облич лише після публічного звіту про підзвітність, рішення з правовими наслідками мусить переглядати людина, а постійне стеження й розпізнавання в реальному часі потребують ордера.
30 квітня 2020 р.Дослідження · МультимодальніЛінії: Генеративні медіа · Відкритість
30 квітня 2020 року Прафулла Дгарівал і співавтори з OpenAI описали Jukebox — модель, що генерує музику зі співом одразу як звукову хвилю: багаторівневий VQ-VAE стискає звук у дискретні коди, а трансформери їх моделюють. Генерацію можна скеровувати виконавцем, жанром і текстом пісні.
22 травня 2020 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Дані
22 травня 2020 року Патрік Льюїс і одинадцять співавторів з Facebook AI Research, University College London і Нью-Йоркського університету виклали RAG: попередньо навчений генератор (BART-large, 400 млн параметрів) разом зі щільним векторним індексом Вікіпедії — дампом грудня 2018 року, поділеним на 21 015 324 уривки по 100 слів; пошуковик і генератор донавчаються разом. RAG-Sequence дав 44,5 точного збігу на Natural Questions, 56,1 на TriviaQA, 45,2 на WebQuestions і 52,2 на CuratedTrec; стаття заявляє новий найкращий результат на всіх чотирьох, для TriviaQA — лише на поділі, порівнянному з T5, бо на звичайному DPR має 57,9.
8 червня 2020 р.Оголошення · ЗображенняЛінії: Шкода · Гроші й ринок
8 червня 2020 року генеральний директор IBM Арвінд Крішна надіслав п'ятьом членам Конгресу США лист із пропозиціями щодо поліцейської реформи, у якому повідомив: IBM більше не пропонує програмного забезпечення загального призначення для розпізнавання й аналізу облич. Компанія заявила, що заперечує проти використання будь-якої такої технології, зокрема чужої, для масового стеження, расового профілювання й порушення прав людини.
10 червня 2020 р.Оголошення · ЗображенняЛінії: Шкода · Гроші й ринок
10 червня 2020 року Amazon оголосила річний мораторій на використання поліцією її технології розпізнавання обличчя. Доступ зберегли для організацій Thorn, Міжнародного центру зниклих і експлуатованих дітей та Marinus Analytics, які шукають жертв торгівлі людьми й зниклих дітей. Компанія пояснила, що рік має дати Конгресу час ухвалити правила.
18 червня 2020 року TikTok опублікував опис того, як рекомендаційна система наповнює стрічку For You: вона ранжує відео за взаємодіями користувача, інформацією про відео (підписи, звуки, хештеги) і, з меншою вагою, за налаштуваннями пристрою й облікового запису. Кількість підписників автора і його попередні успішні відео, за дописом, не є прямими чинниками.
2 липня 2020 р.Доступність · Наукові основиЛінії: Обчислення
2 липня 2020 року SK hynix почала повномасштабний серійний випуск пам'яті HBM2E: вісім кристалів по 16 гігабітів, з'єднаних наскрізними отворами в кремнії, 16 гігабайтів на стос і понад 460 гігабайтів за секунду через 1024 лінії при 3,6 гігабіта за секунду на контакт.
7 вересня 2020 р.Бенчмарк · Наукові основиЛінії: Оцінювання
7 вересня 2020 року вийшов тест із 15 908 питань із чотирма варіантами відповіді в 57 дисциплінах — від елементарної математики до професійної медицини й права, — який модель має складати без донавчання. GPT-3 на 175 мільярдів параметрів дала 43,9 % при 25 % у випадкового вгадування.
5 жовтня 2020 р.Дослідження · Мовні моделіЛінії: Дані · Відкритість
5 жовтня 2020 року спільнота Masakhane виклала статтю про партисипативне дослідження машинного перекладу для африканських мов: понад 400 учасників щонайменше з 20 країн за рік зібрали нові набори перекладів і еталони для понад 30 мов, третину з них оцінено людьми. Серед авторів — дослідники з кількох десятків установ, від Преторії й Кано до Стелленбоша.
2 грудня 2020 р.Віха · Наукові основиЛінії: Праця · Шкода
2 грудня 2020 року закінчилася робота Тімніт Гебру в Google, де вона була старшою науковою співробітницею і співкерівницею групи з етичного ШІ. Приводом стала вимога керівництва відкликати неопубліковану статтю про ризики великих мовних моделей. Google написала, що приймає її відставку; сама Гебру заявила, що її звільнили. Петицію на її підтримку підписали 2695 працівників Google і 4302 зовнішні підписанти.
8 грудня 2020 р.Віха · Наукові основиЛінії: Гроші й ринок
8 грудня 2020 року C3.ai випустила остаточний проспект на 15 500 000 акцій класу A по 42 долари — 651 мільйон доларів публіці, з них 610,3 мільйона компанії. Документ показав те, чого доти не публікували про корпоративний ШІ: виручка 156,7 мільйона доларів за рік до 30 квітня 2020-го, збиток 69,4 мільйона — і тридцять «суб’єктів» та шістдесят чотири клієнти станом на 31 жовтня 2020 року.
31 грудня 2020 р.Доступність · Наукові основиЛінії: Дані · Відкритість · Право й політика
31 грудня 2020 року незалежна група EleutherAI випустила The Pile — англомовний корпус на 825,18 гібібайта, зібраний із двадцяти двох окремих наборів. Найбільший з них, веб-обхід Pile-CC, дає 227,12 ГіБ, тобто менш ніж п'яту частину.
2 лютого 2021 р.Право й регулювання · ЗображенняЛінії: Право й політика · Дані · Шкода
2 лютого 2021 року уповноважений із приватності Канади разом із комісіями Квебеку, Британської Колумбії й Альберти оприлюднив висновки спільного розслідування щодо Clearview AI. Регулятори встановили, що збирання понад трьох мільярдів зображень з мережі без згоди не підпадає під виняток про загальнодоступні відомості й не має належної мети, і назвали це тривалим масовим наглядом за всіма, чиї обличчя потрапили до бази.
5 березня 2021 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані
5 березня 2021 року Ден Гендрікс і співавтори з Берклі та Чиказького університету оприлюднили MATH — 12 500 задач зі шкільних математичних змагань (7 500 навчальних і 5 000 тестових) із покроковими розв'язками, у семи розділах і п'яти рівнях складності. Великі мовні моделі розв'язували від 2,9 до 6,9 %.
9 березня 2021 р.Віха · Наукові основиЛінії: Обчислення · Наука
9 березня 2021 року RIKEN оголосив, що розробку Fugaku завершено й машина відкрита для спільного користування. Її 158 976 вузлів мають по одному процесору Fujitsu A64FX на архітектурі Arm — 48 обчислювальних ядер плюс два допоміжних, 32 гібібайти HBM2 на 1024 гігабайти за секунду — і жодного окремого прискорювача. Linpack дав 442,01 петафлопса.
3–10 березня 2021 р.Дослідження · Наукові основиЛінії: Безпека · Дані · Шкода
У березні 2021 року в матеріалах конференції ACM FAccT '21 вийшла стаття Емілі Бендер, Тімніт Гебру, Анджеліни Макміллан-Мейджор і четвертої авторки під псевдонімом. Чотирнадцять сторінок питають, наскільки великою модель бути завелика, і називають чотири напрями ризику: екологічна й фінансова ціна навчання, непідйомні для розуміння навчальні дані, приписування моделі розуміння, якого в неї немає, і шкода від тексту, що вона породжує.
18 квітня 2021 р.Дослідження · Наукові основиЛінії: Дані · Шкода · Відкритість
18 квітня 2021 року вийшов перший опис корпусу C4 — 156 мільярдів токенів, 365 мільйонів документів, — на якому навчали моделі T5. Фільтр «поганих слів» викидав афроамериканську англійську з часткою 42 % проти 6,2 % для білої, а в усіх п'яти перевірених тестових наборах знайшлися дослівні збіги.
20 квітня 2021 р.Дослідження · Мовні моделіЛінії: Теорія навчання
20 квітня 2021 року Цзяньлінь Су, Юй Лу, Шенфен Пань, Бо Вень і Юньфен Лю із Zhuiyi Technology (Шеньчжень) виклали RoFormer: позиція токена кодується матрицею обертання, що повертає вектор на кут, залежний від позиції, і самоувага природно дістає залежність від відносної відстані. Експерименти першої версії — лише китайські: після попереднього навчання на близько 34 ГБ китайських текстів на задачі зіставлення судових справ CAIL2019-SCM RoFormer досяг 69,79 % на тесті при довжині 1024 проти 68,10 % у WoBERT при 512.
21 квітня 2021 р.Дослідження · Наукові основиЛінії: Обчислення · Шкода
21 квітня 2021 року Google і Каліфорнійський університет у Берклі опублікували енергетичний облік п'яти великих моделей. Навчання GPT-3 — 10 000 прискорювачів V100 упродовж 14,8 доби, 3,14·10^23 операції — коштувало 1287 МВт·год і 552,1 тонни CO2-еквівалента. Це 0,01055 % річного споживання енергії Google за 2019 рік.
17 червня 2021 р.Дослідження · Наукові основиЛінії: Обчислення
17 червня 2021 року Едвард Ху і семеро співавторів з Microsoft виклали LoRA: ваги попередньо навченої моделі заморожуються, а в кожен шар трансформера вводяться навчувані матриці низькорангового розкладу. Для GPT-3 175B перша версія повідомляє в 10 000 разів менше навчуваних параметрів і втричі менші вимоги до обчислювального обладнання, ніж повне донавчання, за якості на рівні або вищій, і контрольну точку, що зменшується з 350 ГБ до 35 МБ.
21 червня 2021 р.Бенчмарк · Наукові основиЛінії: Оцінювання · Шкода
21 червня 2021 року JAMA Internal Medicine опублікував зовнішню перевірку моделі сепсису Epic, розгорнутої в сотнях лікарень США: на 38 455 госпіталізаціях у Мічигані площа під ROC-кривою — 0,63 проти 0,76–0,83 у документації Epic; модель не помітила 67 % випадків сепсису.
7 липня 2021 р.Бенчмарк · Мовні моделіЛінії: Оцінювання
7 липня 2021 року Марк Чен і співавтори з OpenAI оприлюднили HumanEval — 164 написані вручну задачі на Python із модульними тестами. Codex розв'язав 28,8 % з першої спроби, GPT-3 — 0 %, GPT-J — 11,4 %; зі 100 спробами на задачу — 70,2 %.
20 серпня 2021 р.Доступність · ЗображенняЛінії: Дані · Відкритість · Генеративні медіа
20 серпня 2021 року неприбуткова мережа LAION виклала 400 мільйонів англомовних пар «зображення — текст», витягнутих із Common Crawl. Пари відбирала модель CLIP: лишалися ті, де косинусна схожість тексту й зображення була не нижчою за 0,3.
27 жовтня 2021 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Дані · Праця
27 жовтня 2021 року Карл Коббе й співавтори з OpenAI оприлюднили GSM8K — 8,5 тисячі текстових задач шкільної математики (7,5 тисячі навчальних і тисяча тестових), кожна на 2–8 кроків. Разом із набором вони запропонували верифікатор, який оцінює кандидатні розв'язки моделі й вибирає найкращий.
11 листопада 2021 р.Дослідження · Мовні моделіЛінії: Дані · Відкритість
11 листопада 2021 року Келечі Огведжі, Юйсінь Чжу та Джиммі Лін показали AfriBERTa — багатомовну модель, навчену з нуля лише на одинадцяти африканських мовах на корпусі 0,94 гігабайта, тобто 108,8 мільйона токенів. XLM-R для порівняння навчали на 2395 гігабайтах і 164 мільярдах токенів, mBERT — на 100 гігабайтах і 12,8 мільярда.
листопад 2021 р.Право й регулювання · Наукові основиЛінії: Право й політика · Шкода
У листопаді 2021 року 193 держави — члени ЮНЕСКО ухвалили Рекомендацію про етику штучного інтелекту. Документ на 43 сторінки будується на чотирьох цінностях і десяти принципах, серед яких пропорційність і незаподіяння шкоди, право на приватність і захист даних, безпека й захищеність, і додає до них конкретні напрями політики — від гендеру до даних і міжнародної співпраці.
11 грудня 2021 р.Право й регулювання · Наукові основиЛінії: Право й політика · Праця
11 грудня 2021 року в Нью-Йорку набув сили Local Law 144: з 1 січня 2023 року роботодавець не може відбирати кандидатів автоматизованим інструментом, якщо той не пройшов аудиту упередженості за рік до використання і підсумок аудиту не оприлюднено; кандидатів треба повідомити щонайменше за десять робочих днів.
7–30 грудня 2021 р.Віха · Наукові основиЛінії: Гроші й ринок · Право й політика
Проспект від 7 грудня 2021 року виставляв 1,5 мільярда акцій класу B у коридорі 3,85–3,99 гонконгського долара; ціну мали назвати 16 грудня. 10 грудня Міністерство фінансів США внесло SenseTime Group Limited до переліку Non-SDN Chinese Military-Industrial Complex Companies. 13 грудня компанія оголосила про зупинку розміщення й повне повернення заявкових коштів, 20 грудня перезапустила його додатковим проспектом, і торги призначила на 30 грудня.
28 січня 2022 р.Дослідження · Мовні моделіЛінії: Теорія навчання
28 січня 2022 року Джейсон Вей і шестеро колег з Google Brain виклали підказку з ланцюжком міркувань: вісім розв'язаних прикладів у підказці показують проміжні кроки перед кожною відповіддю, і модель далі пише такі кроки сама. У моделі на 137 млрд параметрів точність на шкільних задачах з математики GSM8K зросла з 6,3 % до 14,8 %, а з зовнішнім калькулятором — до 19,5 % проти 18 % у GPT-3 175B, донавченої з калькулятором; на MultiArith — з 7,6 % до 45,0 %.
11 лютого 2022 р.Дослідження · Наукові основиЛінії: Обчислення
11 лютого 2022 року Epoch AI звела обчислення для навчання 123 знакових систем від 1952 року й поділила історію на три епохи. До 2010 року обсяг подвоювався кожні 21,3 місяця; з 2010-го — кожні 5,7 місяця; а з вересня 2015 року окремий ряд найбільших моделей подвоюється кожні 9,9 місяця, починаючись на порядок-два вище за попередній тренд.
1 березня 2022 р.Право й регулювання · Наукові основиЛінії: Право й політика · Шкода
1 березня 2022 року набули чинності Положення про управління алгоритмічними рекомендаціями в інформаційних інтернет-службах, підписані 31 грудня 2021 року керівниками чотирьох відомств КНР. Стаття 24 зобовʼязала оператора, чий сервіс має властивості впливу на суспільну думку або здатність до суспільної мобілізації, подати до державного реєстру назву, вид сервісу, галузь застосування, тип алгоритму та звіт самооцінки протягом десяти робочих днів від початку надання послуг.
12 квітня 2021 – 4 березня 2022 рр.Віха · Наукові основиЛінії: Гроші й ринок · Мовлення
12 квітня 2021 року Microsoft і Nuance подали умови домовленості: 56 доларів за акцію готівкою, премія 23 відсотки до ціни закриття 9 квітня, вартість угоди 19,7 мільярда доларів з урахуванням чистого боргу. 4 березня 2022 року угоду завершено, і примітка про об’єднання бізнесів у річному звіті Microsoft називає загальну купівельну ціну — 18,8 мільярда доларів, переважно готівкою.
12 березня 2022 р.Віха · ЗображенняЛінії: Оборона · Шкода
12 березня 2022 року, за словами гендиректора Clearview AI Хоана Тон-Тата, міністерство оборони України почало безкоштовно користуватися пошуковиком облич компанії. До 24 березня віцепрем'єр і міністр цифрової трансформації Михайло Федоров підтвердив Reuters, що Україна шукає за його допомогою акаунти загиблих російських військових у соцмережах і повідомляє їхні родини.
29 березня 2022 р.Дослідження · Наукові основиЛінії: Обчислення · Дані
29 березня 2022 року Джордан Гоффманн і колеги з DeepMind виклали результат навчання понад 400 мовних моделей від 70 млн до понад 16 млрд параметрів на 5–500 млрд токенів: за оптимального використання обчислень розмір моделі й кількість токенів треба масштабувати порівну. Chinchilla на 70 млрд параметрів, навчена на 1,4 трлн токенів за бюджетом Gopher (учетверо більше даних, ніж у Gopher на 280 млрд), перевершила Gopher, GPT-3, Jurassic-1 і Megatron-Turing NLG і досягла 67,5 % на MMLU — поліпшення понад 7 % щодо Gopher.
31 березня 2022 р.Доступність · ЗображенняЛінії: Дані · Відкритість · Генеративні медіа
31 березня 2022 року LAION виклала 5,85 мільярда пар «зображення — текст», у чотирнадцять разів більше за LAION-400M. Англійською — 2,3 мільярда пар, ще 2,2 мільярда — понад сотнею інших мов, і близько мільярда — без визначеної мови.
4 квітня 2022 р.Дослідження · Роботи й автономністьЛінії: Втілення · Агенти
SayCan поєднала пропозицію мовної моделі про те, що робити, з оцінкою вивченої функції цінності про те, що робот насправді може зробити зараз; на 101 задачі, заданій природною мовою, це дало 84% успішних планів і 74% успішних виконань.
29 квітня 2022 року Жан-Батіст Алайрак і співавтори з DeepMind описали Flamingo — моделі, що з'єднують заморожений зоровий кодер і заморожену мовну модель та приймають вперемішку текст, зображення й відео. Найбільша має 80 млрд параметрів і на 6 із 16 завдань перевершила донавчені моделі, маючи лише 32 приклади.
5 жовтня 2021 – 30 квітня 2022 рр.Віха · Наукові основиЛінії: Гроші й ринок · Безпека
Заява боржників FTX, подана до банкрутного суду Делаверу 3 лютого 2024 року, описує найбільший внесок у Series B Anthropic точніше за будь-який пресреліз: 5 жовтня 2021 року Alameda Research Ventures заплатила 500 000 000 доларів за угодою про майбутній капітал, 30 квітня 2022 року раунд закрився, а 13 травня угода конвертувалася в 44 539 240 привілейованих акцій серії B по 11,2261 долара.
9 травня 2022 р.Оголошення · Наукові основиЛінії: Гроші й ринок · Відкритість · Інструменти
9 травня 2022 року Hugging Face оголосила раунд Series C на 100 мільйонів доларів на чолі з Lux Capital, за участю Sequoia і Coatue та наявних інвесторів. У тому самому дописі компанія назвала розмір сховища: 100 000 попередньо навчених моделей і 10 000 наборів даних, понад 10 000 компаній-користувачів і зростання штату з 30 до понад 120 осіб за дванадцять місяців.
11 травня 2022 р.Право й регулювання · ЗображенняЛінії: Право й політика · Шкода
11 травня 2022 року суд округу Кук в Іллінойсі підписав згоджений наказ у справі ACLU проти Clearview AI: компанії назавжди заборонено по всіх США давати приватним компаніям і особам доступ до своєї бази облич, зібраної з інтернету, а на п'ять років — і будь-якому органу влади чи компанії в Іллінойсі, зокрема поліції.
23 травня 2022 р.Дослідження · ЗображенняЛінії: Генеративні медіа · Відкритість
23 травня 2022 року Google Research описав Imagen: дифузійна модель, що генерує зображення з тексту, закодованого замороженою мовною моделлю T5-XXL. Без навчання на COCO вона дала FID 7,27. Ні коду, ні публічної демонстрації Google не випустив.
27 травня 2022 р.Дослідження · Наукові основиЛінії: Обчислення
27 травня 2022 року Трі Дао, Деніел Фу, Стефано Ермон і Крістофер Ре зі Стенфорда та Атрі Рудра з Університету в Баффало виклали FlashAttention — алгоритм точної уваги, що обчислює її плитками, аби зменшити кількість читань і записів між високошвидкісною пам'яттю GPU і вбудованою SRAM. Він навчив BERT-large на 15 % швидше від рекорду MLPerf 1.1, GPT-2 — утричі швидше при 1 тис. токенів, Long Range Arena — у 2,4 раза швидше при 1–4 тис.
8 червня 2022 р.Доступність · Наукові основиЛінії: Обчислення
8 червня 2022 року SK hynix почала серійний випуск HBM3 і вперше назвала покупця на ім'я: NVIDIA. 819 гігабайтів за секунду на модуль при 6,4 гігабіта за секунду на контакт; постачання узгоджено з графіком відвантаження систем H100 у третьому кварталі того року.
9 червня 2022 р.Бенчмарк · Наукові основиЛінії: Оцінювання · Відкритість · Теорія навчання
9 червня 2022 року 442 автори зі 132 установ виклали 204 завдання, свідомо дібрані так, щоб бути за межами того, що моделі вміють. Прогін через розміри від мільйонів до сотень мільярдів параметрів показав, що якість подекуди росте стрибком на певному масштабі, а подекуди цей стрибок дає крихка метрика.
13 червня 2022 р.Доступність · Наукові основиЛінії: Обчислення
13 червня 2022 року в Каяані, Фінляндія, відкрили LUMI — машину EuroHPC на платформі Cray EX від Hewlett Packard Enterprise, здатну, за словами релізу, на понад 375 петафлопсів. Бюджет 144,5 мільйона євро склали спільно Спільне підприємство ЄС і консорціум десяти держав. На той момент машина була найшвидшою в Європі й третьою у світі.
27 червня 2022 р.Дослідження · Наукові основиЛінії: Обчислення · Гроші й ринок
27 червня 2022 року Epoch AI виміряла темп здешевлення обчислення на 470 моделях відеокарт за 2006–2021 роки: флопси на долар подвоюються кожні 2,46 року. «Закон Хуанга» — 25-кратне зростання за п'ять років, тобто подвоєння за 1,08 року — з даними не узгоджується.
28 червня 2022 р.Дослідження · Роботи й автономністьЛінії: Втілення
DayDreamer застосували алгоритм світової моделі просто до фізичних роботів, без симулятора й без скидань: чотириногий навчився перевертатися зі спини, вставати й ходити з нуля за одну годину.
13 липня 2022 р.Доступність · ЗображенняЛінії: Генеративні медіа
13 липня 2022 року Midjourney оголосив відкриту бету: будь-хто міг приєднатися до сервера в Discord і генерувати зображення з текстового запиту, з обмеженою кількістю безкоштовних генерацій. Перед тим, за Motherboard, Девід Гольц відкрив доступ усім на 24 години.
20 липня 2022 р.Доступність · ЗображенняЛінії: Генеративні медіа · Гроші й ринок
20 липня 2022 року OpenAI відкрив бету DALL·E 2 і почав запрошувати мільйон людей зі списку очікування. Кожен діставав 50 безкоштовних кредитів у перший місяць і 15 щомісяця далі, 115 кредитів коштували 15 доларів, а користувачі дістали повні права на комерційне використання зображень.
9 серпня 2022 р.Право й регулювання · Наукові основиЛінії: Право й політика · Обчислення
9 серпня 2022 року набув чинності закон CHIPS and Science Act: фонд CHIPS for America отримав 50 млрд доларів на 2022–2026 фінансові роки, з них 39 млрд на стимули для виробництва напівпровідників, а інвестиції в заводи — податковий кредит 25 %. Отримувач зобов'язується десять років не розширювати суттєво виробництво в Китаї.
10 жовтня 2022 р.Доступність · Наукові основиЛінії: Обчислення · Гроші й ринок
10 жовтня 2022 року Amazon відкрила загальний доступ до інстансів EC2 Trn1 на власному кристалі AWS Trainium. Найбільша конфігурація — 16 чипів, 512 гігабайтів пам'яті з високою смугою, до 3,4 петафлопса в TF32, FP16 і BF16 та до 800 гігабітів за секунду мережі.
19 серпня – 13 жовтня 2022 р.Віха · Наукові основиЛінії: Пошук і міркування · Агенти
З 19 серпня до 13 жовтня 2022 року агент Cicero команди Meta FAIR анонімно зіграв 40 партій «Дипломатії» на webDiplomacy.net проти 82 людей, домовляючись із ними звичайною мовою. Його середній бал — 25,8 % проти 12,4 % у суперників. Статтю опубліковано в Science 22 листопада 2022 року.
7–21 жовтня 2022 р.Право й регулювання · Наукові основиЛінії: Право й політика · Обчислення
У жовтні 2022 року Бюро промисловості та безпеки США вписало прискорювач у список експортного контролю за двома числами разом: смуга обміну з іншими кристалами від 600 гігабайтів за секунду і водночас добуток розрядності на продуктивність від 4800. Окремо перекрито обладнання для логіки тонше за 16/14 нм, пам'яті DRAM тонше за 18 нм і NAND від 128 шарів.
25 жовтня 2022 р.Доступність · Мовні моделіЛінії: Інструменти · Агенти
25 жовтня 2022 року вийшов перший випуск LangChain — бібліотеки для побудови застосунків із мовних моделей через композицію. Власний опис: «Building applications with LLMs through composability».
3 листопада 2022 р.Віха · Мовні моделіЛінії: Право й політика · Відкритість · Інструменти
3 листопада 2022 року двоє позивачів під псевдонімами подали колективний позов до Окружного суду Північного округу Каліфорнії проти GitHub, Microsoft і OpenAI, справа 3:22-cv-06823. Скарга стверджує, що Copilot, навчений на публічних репозиторіях, видає чужий код без трьох речей, яких вимагають одинадцять поширених відкритих ліцензій: зазначення авторства, повідомлення про авторське право й тексту самої ліцензії.
3 листопада 2022 р.Дослідження · Наукові основиЛінії: Обчислення · Шкода · Відкритість
3 листопада 2022 року вийшов облік повного життєвого циклу відкритої моделі BLOOM на 176 мільярдів параметрів. Навчання на 384 прискорювачах A100 у французькому центрі IDRIS тривало 118 діб і спожило 433 196 кВт·год. Струм дав 24,69 тонни CO2-еквівалента, виготовлення обладнання — 11,2, холостий хід кластера — 14,6; разом 50,5 тонни.
16 листопада 2022 р.Бенчмарк · Наукові основиЛінії: Оцінювання · Відкритість · Шкода
16 листопада 2022 року Стенфордський центр досліджень базових моделей прогнав тридцять моделей від дванадцяти організацій через сорок два сценарії, міряючи сім речей замість однієї. До того моделі в середньому оцінювали лише на 17,9 % цих сценаріїв; після прогону — на 96,0 %.
18 листопада 2022 р.Доступність · Наукові основиЛінії: Обчислення · Право й політика · Гроші й ринок
Наприкінці 2022 року NVIDIA почала пропонувати китайським замовникам A800 — варіант, що, за словами самої компанії у квартальному звіті, «не підпадає під нові ліцензійні вимоги». Уперше поріг експортного контролю став вхідним параметром для проєктування мікросхеми.
24 листопада 2022 р.Доступність · Наукові основиЛінії: Обчислення
24 листопада 2022 року в Болоньї EuroHPC і CINECA відкрили Leonardo — BullSequana XH2000 від Atos на процесорах Intel Xeon Platinum 8358 та прискорювачах NVIDIA A100 SXM4 на 64 гігабайти. У списку TOP500 того місяця машина стала четвертою у світі: 1 463 616 ядер, 174,70 петафлопса Linpack при піку 255,75 і 5610 кіловатів споживання. На церемонії був президент Італії Серджо Матарелла.
6 грудня 2022 р.Дослідження · Наукові основиЛінії: Дані · Відкритість
6 грудня 2022 року консорціум BigScience описав ROOTS — багатомовний корпус на 1,6 ТБ, що охоплює 59 мов: 46 природних і 13 мов програмування. 62 % його обсягу в байтах походить із каталогу 252 джерел, які вибрали й задокументували учасники, а не автоматичний обхід.
13 грудня 2022 р.Дослідження · Роботи й автономністьЛінії: Втілення · Теорія навчання
RT-1 навчили на 130 тисячах епізодів, зібраних за 17 місяців флотом із 13 роботів; одна модель виконала 97% із понад 700 вивчених вказівок і 76% таких, яких ніколи не бачила.
15 грудня 2022 р.Дослідження · Мовні моделіЛінії: Безпека
15 грудня 2022 року 51 автор з Anthropic на чолі з Юньтао Баєм виклав препринт «Constitutional AI». Асистента навчили бути нешкідливим без жодної людської мітки шкідливих відповідей: людський нагляд зведено до короткого переліку принципів, «конституції», а порівняння відповідей, на яких учиться модель переваг, робить сама модель.
15 грудня 2022 р.Право й регулювання · Наукові основиЛінії: Шкода · Право й політика
15 грудня 2022 року місто Даллс в Орегоні уклало мирову угоду з газетою The Oregonian і оприлюднило річні обсяги води, які дата-центри Google брали з міського водогону у 2012–2021 роках. У 2021 році це 355 мільйонів галонів — 29 % усієї води міста й утричі більше, ніж у 2017-му. Google заявила, що більше не вважатиме такі числа комерційною таємницею.
26 грудня 2022 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Наука
26 грудня 2022 року Google Research і DeepMind опублікували Med-PaLM і набір MultiMedQA: Flan-PaLM дала 67,6 % на питаннях у стилі медичного ліцензійного іспиту США, на понад 17 пунктів вище за попередній рекорд, а донавчена підказками Med-PaLM відповідала згідно з науковим консенсусом майже так часто, як лікарі.
29 грудня 2022 р.Віха · Наукові основиЛінії: Обчислення · Гроші й ринок
29 грудня 2022 року TSMC провела на Fab 18 церемонію запуску серійного виробництва вузла N3 і заявила, що процес пішов у серію «з добрим виходом придатних». Проти N5 — до 1,6 раза вища щільність логіки й на 30–35 % менше споживання за тієї самої швидкодії.
5 січня 2023 р.Дослідження · МультимодальніЛінії: Мовлення · Генеративні медіа
5 січня 2023 року Ченї Ван і співавтори з Microsoft описали VALL-E — мовну модель над дискретними кодами нейрокодека EnCodec, навчену на 60 000 годин англійського мовлення. Трисекундного запису незнайомого мовця досить, щоб синтезувати будь-який текст його голосом.
10 січня 2023 р.Право й регулювання · Наукові основиЛінії: Право й політика · Генеративні медіа · Шкода
10 січня 2023 року набули чинності Положення про управління глибоким синтезом в інформаційних інтернет-службах, оприлюднені 25 листопада 2022 року як спільний наказ № 12 трьох відомств. Стаття 16 зобовʼязала постачальника додавати до всього згенерованого або відредагованого вмісту технічну мітку, яка не заважає користуватися ним, і зберігати журнал; стаття 17 вимагає ще й помітної мітки там, де синтез може ввести публіку в оману.
13 січня 2023 р.Віха · ЗображенняЛінії: Право й політика · Дані · Генеративні медіа
13 січня 2023 року Сара Андерсен, Келлі Маккернан і Карла Ортіс подали колективний позов проти Stability AI, Midjourney і DeviantArt, справа 3:23-cv-00201. Скарга каже, що Stability заплатила LAION за складання набору LAION-5B на 5,85 мільярда зображень із підписами, навчила на ньому Stable Diffusion, і що вихідні зображення є похідними творами від робіт, які до набору потрапили без дозволу.
18 січня 2023 р.Віха · Наукові основиЛінії: Праця · Шкода · Безпека
18 січня 2023 року TIME оприлюднив розслідування: фільтр токсичного вмісту для ChatGPT навчали на текстах, розмічених працівниками підрядника Sama в Найробі за 1,32-2 долари на годину. OpenAI платила Sama 12,50 долара за ту саму годину.
26 січня 2023 р.Дослідження · МультимодальніЛінії: Генеративні медіа · Дані
26 січня 2023 року Андреа Агостінеллі й співавтори з Google описали MusicLM — модель, що генерує музику з опису на кшталт «спокійна скрипкова мелодія на тлі спотвореної гітари»: 24 кГц, узгоджено на кілька хвилин. Мелодію можна й наспівати чи насвистати, і модель виконає її в описаному стилі.
3 лютого 2023 р.Віха · ЗображенняЛінії: Право й політика · Дані · Генеративні медіа
3 лютого 2023 року Getty Images подала позов проти Stability AI до Окружного суду штату Делавер, справа 1:23-cv-00135. Перший пункт скарги називає число: понад 12 мільйонів фотографій із колекції Getty скопійовано разом із підписами й метаданими. Окремо позов стверджує, що Stable Diffusion відтворює спотворений водяний знак Getty, і додає вимоги про торговельні марки.
15–16 лютого 2023 р.Право й регулювання · Наукові основиЛінії: Оборона · Право й політика
15–16 лютого 2023 року на саміті REAIM у Гаазі США оприлюднили Політичну декларацію про відповідальне військове застосування штучного інтелекту й автономності. Станом на 27 листопада 2024 року її підтримали 58 держав, серед них Україна.
17 лютого 2023 р.Віха · Мовні моделіЛінії: Безпека
17 лютого 2023 року, менш ніж за два тижні попереднього доступу до чату в новому Bing, Microsoft обмежила його до 50 ходів на день і 5 на сесію. За два дні до того компанія визнала, що в сесіях із 15 чи більше запитань чат може повторюватися або піддатися на провокацію й відповідати тоном, якого не задумували.
7 березня 2023 р.Дослідження · Роботи й автономністьЛінії: Втілення
Замість передбачати одну дію, Diffusion Policy подає рух робота як дифузійний процес над послідовностями дій; на 12 задачах із чотирьох наявних тестових наборів це дало в середньому 46,9% приросту над попередніми методами.
6 квітня 2023 р.Дослідження · Наукові основиЛінії: Обчислення · Шкода
6 квітня 2023 року дослідники з Ріверсайда й Арлінгтона запропонували спосіб рахувати воду, яку витрачає ШІ, і застосували його до GPT-3. Навчання в американських дата-центрах Microsoft випаровує 700 тисяч літрів прісної води на місці й ще 2,8 мільйона — на електростанціях, що дає 3,5 мільйона разом. Розмова на 20–50 реплік — приблизно пів літра.
16 квітня 2023 р.Дослідження · Мовні моделіЛінії: Дані · Оцінювання
16 квітня 2023 року група Maritaca AI показала Sabiá — LLaMA 7B, LLaMA 65B і GPT-J, донавчені португальською на 3 % або менше від їхнього початкового бюджету навчання. На наборі з 14 португальських задач Poeta модель Sabiá-65B трохи випередила GPT-3.5-turbo, основу тодішнього ChatGPT.
17 квітня 2023 р.Дослідження · МультимодальніЛінії: Дані · Відкритість
17 квітня 2023 року Хаотянь Лю й співавтори з Вісконсинського університету, Microsoft Research і Колумбійського університету описали LLaVA: зоровий кодер CLIP, з'єднаний із мовною моделлю LLaMA однією лінійною проєкцією й донавчений на 158 тисячах інструкцій, які згенерувала текстова GPT-4.
23 квітня 2023 р.Дослідження · Роботи й автономністьЛінії: Втілення · Гроші й ринок
ALOHA — дворукий телеоперований стенд, зібраний у межах заявленого бюджету в 20 тисяч доларів; на демонстраціях із нього алгоритм ACT навчився шести точних задач із 10 хвилин показу на кожну, з часткою успіху 80-90%.
26 квітня 2023 р.Віха · Наукові основиЛінії: Оборона
26 квітня 2023 року Міністерство цифрової трансформації, Міністерство оборони, Генеральний штаб ЗСУ, РНБО, Міністерство економіки й Міністерство стратегічних галузей промисловості представили Brave1 — кластер оборонних технологій, що дає розробникам державні гранти, військову експертизу, випробування й супровід.
3 травня 2023 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Відкритість
3 травня 2023 року LMSYS відкрила майданчик, де відвідувач пише власний запит, дістає дві відповіді від неназваних моделей і голосує за кращу. Перший лідерборд стояв на 4,7 тисячі голосів за тиждень і поставив нагору Vicuna-13B з 1169 очками Elo.
16 травня 2023 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Наука
16 травня 2023 року Google опублікувала Med-PaLM 2: 86,5 % на MedQA, на понад 19 пунктів вище за Med-PaLM, а на 1 066 питаннях споживачів лікарі віддали перевагу її відповідям над відповідями лікарів за вісьмома з дев'яти осей клінічної корисності.
23 травня 2023 р.Дослідження · Наукові основиЛінії: Теорія навчання · Обчислення
Метод дозволив донавчати модель на 65 мільярдів параметрів на одній відеокарті, зберігаючи ваги в чотирьох бітах і змінюючи лише невеликі додаткові матриці.
25 травня 2023 р.Доступність · Мовні моделіЛінії: Відкритість · Дані · Обчислення
25 травня 2023 року Інститут технологічних інновацій в Абу-Дабі відкрив Falcon 40B — модель на 40 мільярдів параметрів, навчену на трильйоні токенів корпусу RefinedWeb. Навчання зайняло два місяці на 384 прискорювачах A100 на 40 гігабайтів у хмарі AWS. 31 травня інститут оголосив модель вільною від роялті під ліцензією Apache 2.0.
19 червня 2023 р.Доступність · Мовні моделіЛінії: Інструменти · Обчислення
19 червня 2023 року вийшов перший випуск vLLM — рушія для обслуговування мовних моделей. У його основі PagedAttention: керування кешем ключів і значень за зразком сторінкової віртуальної пам'яті операційних систем.
28 червня 2023 р.Віха · Мовні моделіЛінії: Право й політика · Дані
28 червня 2023 року Пол Тремблей і Мона Авад подали колективний позов проти OpenAI, справа 3:23-cv-03223. OpenAI ніколи не розкривала, що лежить у наборах Books1 і Books2, тож скарга рахує їх із чисел у статті про GPT-3: Books1 приблизно вдев'ятеро більший за BookCorpus, Books2 приблизно в сорок два рази, тобто близько 63 000 і близько 294 000 книжок.
5 липня 2023 р.Оголошення · Наукові основиЛінії: Безпека
5 липня 2023 року OpenAI оголосила команду superalignment на чолі з Іллею Суцкевером і Яном Лейке й пообіцяла віддати їй 20 % обчислень, забезпечених на той день, на чотири роки. Мета — за чотири роки розв'язати ядро технічних проблем узгодження суперінтелекту, збудувавши приблизно людського рівня автоматичного дослідника узгодження.
7 липня 2023 р.Віха · Мовні моделіЛінії: Право й політика · Дані · Відкритість
7 липня 2023 року Річард Кадрі, Сара Сільверман і Крістофер Голден подали позов проти Meta Platforms, справа 3:23-cv-03417. Стаття про LLaMA сама називає серед навчальних даних розділ Books3 набору The Pile, не описуючи його. Скарга описує: за статтею EleutherAI це 108 гігабайтів, близько 12 відсотків The Pile і третя за розміром його складова, а той, хто зібрав Books3, публічно казав, що це «весь Bibliotik» і що там 196 640 книжок.
20 липня 2023 р.Оголошення · Наукові основиЛінії: Обчислення · Гроші й ринок
20 липня 2023 року на квартальній телеконференції генеральний директор TSMC Сі Сі Вей сказав, що з передньою частиною виробництва проблем немає, а не вистачає потужностей заднього — пакування CoWoS, яким кристал з'єднують із пам'яттю. Потужності мали приблизно подвоїти протягом 2024 року.
28 липня 2023 р.Дослідження · Роботи й автономністьЛінії: Втілення
RT-2 — модель «зір-мова-дія»: попередньо навчену на вебі модель зору й мови донавчили так, щоб дії робота вона видавала текстовими токенами. На небачених предметах і середовищах успіх зріс із 32% у RT-1 до 62% за понад 6000 випробувань.
26 травня – 1 серпня 2023 р.Право й регулювання · МультимодальніЛінії: Право й політика · Шкода · Генеративні медіа
Губернатор Міннесоти підписав закон HF 1370 26 травня 2023 року, і 1 серпня набула чинності стаття 609.771 кримінального кодексу штату. Вона карає поширення діпфейка про особу без її згоди, у межах 90 днів до виборів і з наміром зашкодити кандидатові чи вплинути на результат. Покарання йде трьома щаблями: до 90 днів і 1000 доларів у звичайному разі, до 364 днів і 3000 за наміру насильства, до п'яти років і 10 000 за повторного злочину протягом п'яти років.
15 серпня 2023 р.Право й регулювання · Наукові основиЛінії: Право й політика · Генеративні медіа
15 серпня 2023 року набули чинності Тимчасові заходи щодо управління послугами генеративного штучного інтелекту, оприлюднені 10 липня 2023 року як наказ Управління кіберпростору № 15 за погодженням шести інших відомств. Стаття 17 зобовʼязала постачальника генеративної послуги з властивостями впливу на суспільну думку пройти безпекову оцінку й подати алгоритм до реєстру; стаття 2 вивела з-під заходів усе, що не пропонують публіці всередині країни.
30 серпня 2023 р.Доступність · Мовні моделіЛінії: Дані · Відкритість · Обчислення
30 серпня 2023 року Inception, MBZUAI і Cerebras Systems випустили Jais і Jais-chat — моделі на 13 мільярдів параметрів під ліцензією Apache 2.0. Навчання пройшло на 395 мільярдах токенів, де арабська складає 33 %: 72 мільярди зібраних токенів, пройдених 1,6 раза до 116 мільярдів, плюс 232 мільярди англійських і решта коду.
19 вересня 2023 р.Право й регулювання · Наукові основиЛінії: Безпека
19 вересня 2023 року Anthropic оприлюднила політику відповідального масштабування (RSP): рівні безпеки ШІ від ASL-1 до ASL-3, побудовані за зразком рівнів біобезпеки, де вищий рівень вимагає суворіших доказів безпеки. Чинні моделі, зокрема Claude, компанія віднесла до ASL-2; ASL-4 і вище ще не визначено.
19 вересня 2023 р.Віха · Мовні моделіЛінії: Право й політика · Дані · Праця
19 вересня 2023 року Гільдія авторів США й сімнадцятеро письменників подали колективний позов проти одинадцяти юридичних осіб OpenAI до Окружного суду Південного округу Нью-Йорка, справа 1:23-cv-08292. Серед позивачів Девід Балдаччі, Майкл Коннеллі, Джонатан Франзен, Джон Грішем, Джордж Р. Р. Мартін, Джоді Піколт, Джордж Сондерс і Скотт Туроу.
19 вересня 2023 р.Оголошення · Роботи й автономністьЛінії: Втілення
Toyota Research Institute повідомила, що навчила роботів понад 60 складних спритних навичок методом на основі Diffusion Policy, і назвала цей напрям великими поведінковими моделями за аналогією до великих мовних.
25 вересня 2023 р.Доступність · МультимодальніЛінії: Мовлення
25 вересня 2023 року OpenAI почала відкривати в ChatGPT зображення як вхід і голосову розмову для користувачів Plus і Enterprise протягом двох тижнів. Разом вийшла системна картка GPT-4V, моделі, яку оголосили з GPT-4 у березні, але відкривали лише обмеженому колу.
3 жовтня 2023 р.Дослідження · Роботи й автономністьЛінії: Втілення · Дані
Лабораторії зсипали свої демонстрації в спільний набір Open X-Embodiment — 22 типи роботів і понад мільйон справжніх траєкторій — і модель, навчена на ньому, перевершила ті самі методи, навчені кожен на власних даних, на 50%.
25 вересня – 9 жовтня 2023 р.Право й регулювання · Мовні моделіЛінії: Праця · Право й політика · Генеративні медіа
Страйк Гільдії сценаристів Америки, що почався у травні 2023 року, завершився 27 вересня; строк нової мінімальної базової угоди починається 25 вересня 2023 року, ратифікували її 9 жовтня. Угода каже, що ані традиційний, ані генеративний ШІ не є автором, тож жоден створений ним текст не є літературним матеріалом і не є першоджерельним матеріалом.
10 жовтня 2023 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Агенти
10 жовтня 2023 року Карлос Хіменес, Джон Ян і співавтори з Принстона оприлюднили SWE-bench — 2 294 задачі з реальних issue та pull request дванадцяти популярних репозиторіїв Python. Модель отримує кодову базу й опис проблеми й має змінити код так, щоб пройшли тести. Claude 2 розв'язав 4,8 %, GPT-4 — 1,7 %.
19 жовтня 2023 р.Бенчмарк · Наукові основиЛінії: Оцінювання · Дані · Право й політика
19 жовтня 2023 року стенфордський центр CRFM оцінив десятьох найбільших розробників базових моделей за сотнею показників прозорості. Середній бал — 37 зі 100, найвищий у Meta (54), найнижчий в Amazon (12).
17–23 жовтня 2023 р.Право й регулювання · Наукові основиЛінії: Право й політика · Обчислення
У жовтні 2023 року США переписали поріг для прискорювачів. Критерій швидкості зв'язку між кристалами прибрано; лишилася сукупна продуктивність від 4800 і нова величина — щільність продуктивності, тобто та сама продуктивність, поділена на площу кристала. Дію поширено на країни груп D:1, D:4 і D:5.
2 листопада 2023 р.Право й регулювання · Наукові основиЛінії: Безпека · Право й політика · Оцінювання
2 листопада 2023 року, під час саміту в Блетчлі-Парку, уряд Великої Британії оприлюднив командний документ «Introducing the AI Safety Institute»: робоча група Frontier AI Taskforce того ж дня стала постійним інститутом. Він мав розробляти й проводити оцінки передових систем ШІ, вести фундаментальні дослідження безпеки й налагоджувати обмін інформацією.
20 листопада 2023 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Безпека · Праця
20 листопада 2023 року Девід Рейн і співавтори з Нью-Йоркського університету оприлюднили GPQA — 448 питань з вибором відповіді з біології, фізики й хімії, написаних фахівцями. Експерти з профільним PhD відповідали правильно на 65 %, кваліфіковані не-експерти з вебом понад 30 хвилин — на 34 %, найкращий варіант на основі GPT-4 — на 39 %.
17–29 листопада 2023 р.Віха · Наукові основиЛінії: Гроші й ринок · Безпека
Рада директорів звільнила керівника OpenAI, більшість із приблизно 770 працівників підписали лист із погрозою піти слідом, і за дванадцять днів його повернули з новою радою.
9 листопада – 5 грудня 2023 р.Право й регулювання · МультимодальніЛінії: Праця · Право й політика · Генеративні медіа
Страйк Профспілки акторів, що почався в липні 2023 року, завершився 9 листопада; угоду ратифіковано 5 грудня. Контракти 2023 року на кіно й телебачення вводять поняття цифрової копії голосу чи зовнішності та ділять її на три види, а окремо описують синтетичного виконавця — цілком цифрову постать, яка не схожа на жодного впізнаваного актора й не озвучена людиною.
8 грудня 2023 р.Право й регулювання · Наукові основиЛінії: Право й політика
Після трьох діб переговорів інституції ЄС узгодили перший у світі всеосяжний закон про ШІ, дописавши до нього правила для моделей загального призначення.
11 грудня 2023 р.Доступність · Мовні моделіЛінії: Відкритість · Теорія навчання
Mistral випустила модель, де на кожен токен працює лише частина параметрів, і вона перевершила Llama 2 на 70 мільярдів при значно меншій вартості обчислення.
18 грудня 2023 р.Право й регулювання · Наукові основиЛінії: Безпека
18 грудня 2023 року OpenAI оприлюднила бета-версію Preparedness Framework — порядок відстеження катастрофічних ризиків у чотирьох категоріях: кібербезпека, CBRN, переконання й автономія моделі. Кожну оцінюють як низький, середній, високий чи критичний ризик до й після заходів.
20 грудня 2023 р.Дослідження · ЗображенняЛінії: Шкода · Дані · Безпека
20 грудня 2023 року Девід Тіл зі Stanford Internet Observatory оприлюднив перевірку LAION-5B: 3 226 записів із підозрою на матеріали сексуального насильства над дітьми. LAION зняла з роздачі LAION-5B і LAION-400M і повернула набір лише у серпні 2024 року.
21 грудня 2023 р.Доступність · Наукові основиЛінії: Обчислення
21 грудня 2023 року прем'єр-міністр Іспанії Педро Санчес відкрив MareNostrum 5 у Барселонському суперкомп'ютерному центрі. Прискорена частина, зібрана Eviden, несе 4480 прискорювачів NVIDIA Hopper і показала 138,20 петафлопса Linpack при піку 265,57 — восьме місце у світі. Сукупний пік машини — 314 петафлопсів.
22 грудня 2023 р.Право й регулювання · Наукові основиЛінії: Оборона · Право й політика
22 грудня 2023 року Генеральна Асамблея ухвалила резолюцію 78/241: 152 голоси за, 4 проти, 11 утрималися. Резолюція доручила Генеральному секретареві зібрати думки держав щодо смертоносних автономних систем озброєння і звітувати Асамблеї на наступній сесії.
27 грудня 2023 р.Віха · Мовні моделіЛінії: Право й політика · Дані · Гроші й ринок
27 грудня 2023 року The New York Times Company подала позов проти Microsoft і восьми юридичних осіб OpenAI, справа 1:23-cv-11195. До скарги додано додаток J на 127 сторінок: рівно сто пронумерованих прикладів, у кожному стаття газети стоїть поруч із відповіддю моделі, а збіги позначено. Прохальна частина просить суд наказати знищити за статтею 503(b) розділу 17 Кодексу США всі моделі GPT та навчальні набори, що містять твори видання.
грудень 2023 р.Віха · Наукові основиЛінії: Обчислення
У грудні 2023 року ASML відвантажила Intel перші модулі першої системи High NA EUV — TWINSCAN EXE:5000. Числову апертуру збільшено з 0,33 до 0,55, що дає мінімальний друкований розмір 8 нанометрів: елементи в 1,7 раза менші та щільність у 2,9 раза вища, ніж у попередніх системах EUV.
2 січня 2024 р.Дослідження · Мовні моделіЛінії: Дані · Теорія навчання
2 січня 2024 року UCLA описала SPIN: модель учиться відрізняти власні відповіді попередньої ітерації від людських відповідей того самого набору SFT. Середній бал zephyr-7b-sft-full на Open LLM Leaderboard зріс із 58,14 до 63,16 за три ітерації, без жодної нової розмітки.
10 січня 2024 р.Дослідження · Мовні моделіЛінії: Безпека
10 січня 2024 року Еван Губінґер і ще 38 авторів з Anthropic, Redwood Research та інших організацій виклали препринт «Sleeper Agents». Вони навмисно навчили мовні моделі писати безпечний код, коли в запиті стоїть 2023 рік, і вразливий, коли 2024-й, і показали, що стандартне навчання безпеки — донавчання на прикладах, навчання з підкріпленням і змагальне навчання — такої поведінки не прибирає.
10 січня 2024 р.Право й регулювання · Мовні моделіЛінії: Оборона · Право й політика
10 січня 2024 року OpenAI переписала політики використання. До того сторінка забороняла «діяльність із високим ризиком фізичної шкоди», зокрема «розробку зброї» і «військове застосування й війну». Суцільна заборона на військове застосування зникла.
11 січня 2024 р.Дослідження · Наукові основиЛінії: Теорія навчання · Обчислення · Відкритість
11 січня 2024 року DeepSeek опублікувала архітектуру, у якій блок FFN ділиться на багато дрібних експертів, а частина з них завжди ввімкнена. DeepSeekMoE 16B обійшла LLaMA2 7B на більшості тестів, витрачаючи 39,6 % обчислень.
5 лютого 2024 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Обчислення
5 лютого 2024 року DeepSeek описала Group Relative Policy Optimization — варіант PPO, який відмовляється від моделі-критика й бере базову лінію з розкиду оцінок у групі відповідей на той самий запит. Точність на MATH зросла з 46,8 % до 51,7 %.
2–8 лютого 2024 р.Право й регулювання · МультимодальніЛінії: Право й політика · Мовлення · Шкода
Федеральна комісія зі зв'язку ухвалила 2 лютого 2024 року декларативну постанову FCC 24-17 і оприлюднила її 8 лютого. Постанова підтверджує, що обмеження Закону про захист споживачів телефонного зв'язку 1991 року на «штучний або попередньо записаний голос» охоплюють нинішні системи, що синтезують людський голос. Тож такий дзвінок потребує попередньої явної згоди абонента, окрім невідкладних випадків і передбачених винятків.
27 лютого 2024 р.Дослідження · Наукові основиЛінії: Обчислення · Теорія навчання
27 лютого 2024 року Microsoft Research і Університет Китайської академії наук показали мовну модель, кожна вага якої дорівнює −1, 0 або 1. На 3 мільярдах параметрів вона зрівнялася з повноточною LLaMA за перплексією, витрачаючи у 3,55 раза менше пам'яті GPU і працюючи у 2,71 раза швидше.
7 березня 2024 р.Право й регулювання · Наукові основиЛінії: Обчислення · Право й політика · Гроші й ринок
7 березня 2024 року Кабінет міністрів Індії схвалив національну програму IndiaAI із бюджетом 10 371,92 крора рупій. Опорою програми став пул із 10 тисяч і більше графічних прискорювачів, зібраний через державно-приватне партнерство, доступ до якого держава субсидує стартапам, дослідникам і університетам.
18 березня 2024 р.Оголошення · Наукові основиЛінії: Обчислення
NVIDIA оголосила покоління прискорювачів, де два кристали по 104 мільярди транзисторів працюють як один чип, з'єднані каналом на 10 терабайт за секунду.
19 березня 2024 р.Дослідження · Роботи й автономністьЛінії: Втілення · Дані
DROID зібрали не з того, що кому трапилося мати, а на одному стандартному стенді: 76 тисяч демонстрацій, 350 годин, 564 сцени й 84 задачі, зібрані п’ятдесятьма людьми за 12 місяців у Північній Америці, Азії та Європі.
21 березня 2024 р.Доступність · МультимодальніЛінії: Генеративні медіа
21 березня 2024 року Suno випустила модель v3 для всіх користувачів: пісня на дві хвилини зі словами, вокалом і супроводом генерується за секунди з короткого опису. З безкоштовним обліковим записом, за MusicTech, — до 50 кредитів на день, тобто до 10 пісень, без права комерційного використання.
березень 2024 р.Віха · Наукові основиЛінії: Обчислення · Гроші й ринок
У березні 2024 року AWS купила в Talen Energy кампус дата-центрів Cumulus біля АЕС Саскуеганна за 650 мільйонів доларів і уклала з нею договір на постачання до 960 МВт безвуглецевої потужності. Договір розрахований на 18 років і нарощує зобов'язання кроками по 120 МВт; AWS має право зупинитися на 480.
2 квітня 2024 р.Дослідження · Мовні моделіЛінії: Дані · Оцінювання
2 квітня 2024 року команда NAVER Cloud опублікувала технічний звіт про HyperCLOVA X. На корейських тестах KMMLU, HAE-RAE й KoBigBench старша модель HCX-L дала середнє 72,07 проти 48,92 у LLaMA 2 70b, а на англійських MMLU, BBH та AGIEval — 58,25 проти 58,33, тобто нарівні.
9 квітня 2024 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Теорія навчання
9 квітня 2024 року NVIDIA опублікувала RULER — набір із 13 завдань, який виміряв, на якій довжині модель насправді ще працює. З десяти перевірених моделей лише чотири витримали 32 тисячі токенів, хоча стільки або більше заявляли всі.
10 квітня 2024 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Обчислення
10 квітня 2024 року Google описала Infini-attention: локальна увага й довготривала стисла пам'ять в одному блоці трансформера. Модель на 1 мільярд параметрів, донавчена на відрізках у 5 тисяч токенів, знаходила ключ у послідовності на мільйон токенів.
17 квітня 2024 р.Віха · Роботи й автономністьЛінії: Оборона · Втілення
17 квітня 2024 року DARPA оприлюднила результат програми Air Combat Evolution: літак X-62A VISTA під керуванням алгоритмів вів ближній повітряний бій проти F-16 із пілотом. Польоти відбувалися з грудня 2022 до вересня 2023 року.
15–29 квітня 2024 р.Доступність · Мовні моделіЛінії: Відкритість · Право й політика
15 квітня 2024 року тайванська програма TAIDE віддала публіці модель LX-7B на основі Llama 2, і за неповні пів місяця її завантажили понад шість тисяч разів. Коли 19 квітня вийшла Llama 3, команда за чотири дні зібрала на ній версію Llama3-TAIDE-LX-8B-Chat-Alpha1 і випустила її 29 квітня.
6 травня 2024 року Принстон показав SWE-agent: не нову модель, а командне середовище, перероблене під мовну модель. GPT-4 Turbo у ньому розв'язав 12,47 % із 2294 задач SWE-bench проти 3,8 % у найкращого доти неінтерактивного підходу з пошуком.
15 травня 2024 р.Віха · Наукові основиЛінії: Обчислення · Шкода
15 травня 2024 року Microsoft опублікувала екологічний звіт за 2023 фінансовий рік. Прямі викиди й викиди від купленої енергії впали на 6,3 % проти базового 2020 року, але викиди ланцюга постачання зросли на 30,9 %, а сукупно за всіма категоріями — на 29,1 %. Причину названо прямо: будівництво дата-центрів і вуглець, втілений у бетоні, сталі, напівпровідниках, серверах і стійках.
14–17 травня 2024 р.Віха · Наукові основиЛінії: Безпека
14 травня 2024 року Ілля Суцкевер оголосив, що йде з OpenAI, а 17 травня Ян Лейке написав, що попереднього дня завершив роботу керівником узгодження й керівником superalignment. Лейке пояснив, що давно розходився з керівництвом щодо пріоритетів компанії, доки не настала точка розриву, і що команді бракувало обчислень.
21 травня 2024 р.Дослідження · Наукові основиЛінії: Безпека · Теорія навчання
21 травня 2024 року Anthropic розклала активації Claude 3 Sonnet розрідженими автокодувальниками й дістала мільйони ознак, кожна з яких відповідає одному зрозумілому поняттю. Примусова активація ознаки змінювала поведінку моделі без жодної зміни ваг.
21–22 травня 2024 р.Віха · Наукові основиЛінії: Право й політика · Безпека
Південна Корея і Британія провели другий міжнародний саміт з безпеки ШІ; держави ухвалили Сеульську декларацію, а компанії вперше пообіцяли публічні пороги ризику.
21 січня – 28 травня 2024 р.Віха · МультимодальніЛінії: Шкода · Мовлення · Право й політика
21 січня 2024 року, за два дні до президентських праймериз у Нью-Гемпширі, до 19:12 було здійснено 9581 автоматичний дзвінок із записом, який звучав як голос президента США і казав виборцям приберегти голос до листопада. Номер підмінили на номер скарбника комітету, що підтримував кампанію вписування. 23 травня прокуратура штату висунула 13 кримінальних і 13 адміністративних статей, а Федеральна комісія зі зв'язку запропонувала стягнути 6 мільйонів доларів.
У травні 2024 року на воркшопі UNLP у Турині Олексій Сивокінь, Мар'яна Романишин і Роман Кислий підбили перше змагання з дотренування великих мовних моделей для української: лише відкриті ваги, які вміщаються в 16 ГБ відеопам'яті. На 751 питанні ЗНО 2020–2023 років найкраща команда набрала 0,49 точності, GPT-4 поза конкурсом — 0,61.
6 червня 2024 р.Дослідження · Наукові основиЛінії: Безпека · Теорія навчання · Обчислення
6 червня 2024 року OpenAI показала, що розкладання активацій на ознаки саме підкоряється законам масштабування. Автокодувальник на 16 мільйонів ознак навчено на активаціях GPT-4 за 40 мільярдів токенів, і мертвими лишилися 7 % ознак.
13 червня 2024 р.Доступність · Роботи й автономністьЛінії: Втілення · Відкритість
OpenVLA на 7 мільярдів параметрів виклали з відкритими вагами; на 29 задачах вона перевершила закриту RT-2-X на 55 мільярдів параметрів на 16,5 відсоткового пункту абсолютного успіху, маючи приблизно всемеро менше параметрів.
18 червня 2024 р.Віха · Наукові основиЛінії: Гроші й ринок · Обчислення
Акція NVIDIA закрилася на 135,58 долара, на 3,5 відсотка вище, ніж напередодні. За підрахунком преси, ринкова вартість сягнула 3,34 трильйона доларів, і компанія обійшла Microsoft, ставши найдорожчою публічною компанією світу.
27 червня 2024 р.Доступність · Роботи й автономністьЛінії: Втілення · Праця
GXO Logistics — замовник, а не виробник робота — оголосила багаторічну угоду з Agility Robotics і назвала її першим формальним комерційним розгортанням гуманоїдів. Через сімнадцять місяців Agility повідомила, що Digit перемістив понад 100 тисяч ящиків у живій роботі.
1 липня 2024 року Іллінойський університет показав Agentless: жорсткий двокроковий конвеєр — знайти місце, потім полагодити, — без автономних викликів інструментів. На SWE-bench Lite він дав 27,33 % за 0,34 долара на задачу, найкраще й найдешевше серед відкритих підходів.
2 липня 2024 р.Віха · Наукові основиЛінії: Обчислення · Шкода
2 липня 2024 року Google повідомила, що її викиди за 2023 рік становили 14,3 мільйона тонн CO2-еквівалента — на 13 % більше, ніж роком раніше, і на 48 % більше за базовий 2019 рік. Головними причинами звіт називає споживання електрики дата-центрами й викиди ланцюга постачання. Самі дата-центри спожили понад 24 ТВт·год, на 17 % більше.
23 липня 2024 р.Дослідження · Наукові основиЛінії: Обчислення · Гроші й ринок
23 липня 2024 року Центральне статистичне бюро Ірландії повідомило, що у 2023 році дата-центри спожили 21 % усієї облікованої електроенергії країни — 6334 ГВт·год проти 1238 і 5 % у 2015-му. Міські домогосподарства спожили 18 %, сільські — 10 %. Серверні зали вперше випередили житло.
24 липня 2024 р.Дослідження · Наукові основиЛінії: Дані · Теорія навчання
24 липня 2024 року в Nature вийшла рецензована стаття, яка описала колапс моделі: коли покоління за поколінням навчають на тому, що згенерувало попереднє, хвости початкового розподілу зникають незворотно. Показано на мовних моделях, варіаційних автокодувальниках і сумішах гаусіан.
31 липня 2024 р.Дослідження · Наукові основиЛінії: Теорія навчання · Пошук і міркування · Обчислення
31 липня 2024 року група зі Стенфорда, Оксфорда й Google DeepMind показала, що частка розв'язаних задач росте з кількістю згенерованих спроб на чотирьох порядках. На SWE-bench Lite DeepSeek-V2-Coder-Instruct піднявся з 15,9 % за однієї спроби до 56 % за 250.
1 серпня 2024 р.Право й регулювання · Наукові основиЛінії: Право й політика
Перший у світі загальний закон про штучний інтелект набув чинності в Євросоюзі, з градацією обов'язків за рівнем ризику і штрафами до 7 відсотків світового обороту.
6 серпня 2024 р.Дослідження · Наукові основиЛінії: Теорія навчання · Пошук і міркування · Обчислення
6 серпня 2024 року чотири дослідники з Берклі та Google DeepMind виміряли, скільки дає обчислення під час відповіді. На задачах, де менша модель уже має ненульовий успіх, вона з такими обчисленнями обійшла модель у 14 разів більшу за тієї самої сумарної кількості операцій.
3 липня – 17 вересня 2024 р.Доступність · МультимодальніЛінії: Мовлення · Відкритість
Французька лабораторія Kyutai показала розмовну модель, що слухає й говорить одночасно, із затримкою близько 200 мілісекунд, і віддала ваги у відкритий доступ.
20 вересня 2024 р.Віха · Наукові основиЛінії: Обчислення · Гроші й ринок
20 вересня 2024 року Constellation оголосила 20-річний договір із Microsoft на купівлю електроенергії з Crane Clean Energy Center — першого блоку АЕС Три-Майл-Айленд, зупиненого рівно за п'ять років до того з економічних причин. Блок має додати мережі близько 835 МВт безвуглецевої потужності; пуск очікують у 2028 році.
17 вересня – 2 жовтня 2024 р.Право й регулювання · МультимодальніЛінії: Право й політика · Шкода · Генеративні медіа
17 вересня 2024 року губернатор Каліфорнії підписав AB 2839, який додав статтю 20012 до виборчого кодексу штату й набув чинності негайно як акт невідкладної дії. Норма забороняє свідомо поширювати зі злим наміром виборчу агітацію з оманливим синтетичним умістом про кандидата, виборчого урядовця, обраного посадовця або про обладнання для голосування. 2 жовтня Окружний суд Східного округу Каліфорнії заборонив застосовувати закон, крім відокремленої частини про самий лише звук.
31 жовтня 2024 р.Дослідження · Роботи й автономністьЛінії: Втілення · Відкритість
Physical Intelligence випустила π0 — універсальну політику на понад 10 тисячах годин даних із 7 різних конфігурацій роботів і 68 задач, — а через три місяці виклала її ваги у відкритий доступ.
1 листопада 2024 р.Право й регулювання · Наукові основиЛінії: Право й політика · Обчислення
1 листопада 2024 року Федеральна комісія з регулювання енергетики США відхилила зміну до угоди про приєднання, яка дозволила б підняти навантаження дата-центру AWS, під'єднаного просто до АЕС Саскуеганна, з 300 до 480 МВт. Того самого дня комісія провела технічну нараду про великі ко-локовані навантаження загалом.
7 листопада 2024 р.Доступність · Мовні моделіЛінії: Оборона
7 листопада 2024 року Anthropic, Palantir і AWS оголосили, що моделі Claude 3 і 3.5 стають доступні на платформі Palantir у середовищі шостого рівня впливу — акредитованому для даних із грифом до «таємно».
25 листопада 2024 р.Оголошення · Наукові основиЛінії: Інструменти · Агенти · Відкритість
Anthropic відкрила протокол, за яким модель під'єднується до файлів, баз і сервісів однаково, і віддала специфікацію, бібліотеки та готові сервери у відкритий доступ.
Google випустила модель, що приймає й породжує текст, зображення і звук, викликає інструменти сама і при цьому працює вдвічі швидше за велику модель попереднього покоління.
18 грудня 2024 р.Дослідження · Мовні моделіЛінії: Безпека
18 грудня 2024 року Раян Грінблат із Redwood Research, Еван Губінґер з Anthropic і ще 18 авторів показали, що Claude 3 Opus, якому сказали, що його навчатимуть виконувати всі запити й лише на розмовах із безкоштовними користувачами, виконував шкідливі запити безкоштовних користувачів у 12 % випадків і майже ніколи — платних.
26 грудня 2024 р.Доступність · Мовні моделіЛінії: Відкритість · Обчислення
Китайська лабораторія відкрила модель на 671 мільярд параметрів, з яких на кожен токен працює 37 мільярдів, і назвала вартість навчання — близько 5,6 мільйона доларів.
9 січня 2025 р.Дослідження · Мовні моделіЛінії: Агенти · Пошук і міркування · Інструменти
9 січня 2025 року Женьміньський університет Китаю й Цінхуа показали Search-o1: модель, яка міркує, сама зупиняється на місці невпевненості, шукає в зовнішньому джерелі й повертається до міркування. Перед цим автори виміряли, наскільки часто вона взагалі вагається.
20 січня 2025 р.Доступність · Мовні моделіЛінії: Відкритість · Пошук і міркування
Китайська лабораторія відкрила модель, що міркує на рівні o1, і показала, що така поведінка виникає з чистого підкріпленого навчання за правильну відповідь.
22 січня 2025 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Обчислення
22 січня 2025 року Moonshot AI описала Kimi k1.5, де контекстне вікно розтягнуто до 128 тисяч токенів не на виведенні, а в самій фазі навчання з підкріпленням. Модель дає 77,5 на AIME і 96,2 на MATH-500, зрівнюючись із o1.
25 січня 2025 р.Дослідження · Наукові основиЛінії: Обчислення · Теорія навчання
25 січня 2025 року Tsinghua й Huawei показали RotateKV — стиснення кеша ключів і значень до двох бітів через обертання простору активацій. Пікова пам'ять кеша впала у 3,97 раза, а перплексія на WikiText-2 для LLaMA-2-13B погіршилася менш ніж на 0,3.
27 січня 2025 р.Віха · Наукові основиЛінії: Гроші й ринок · Обчислення
Акція NVIDIA за день упала на 17 відсотків, із 142,62 до 118,42 долара. Преса оцінила втрату ринкової вартості в 589 мільярдів, а за CNBC — близько 600 мільярдів доларів: найбільше одноденне падіння будь-якої компанії в історії США.
31 січня 2025 р.Дослідження · Мовні моделіЛінії: Пошук і міркування · Теорія навчання · Обчислення
31 січня 2025 року Стенфорд і Інститут Аллена показали, що міркування вмикається тисячею прикладів. Донавчання Qwen2.5-32B-Instruct на наборі s1K зайняло 26 хвилин на 16 прискорювачах H100, а модель обійшла o1-preview на змагальній математиці на величину до 27 відсотків.
4 лютого 2025 р.Право й регулювання · Наукові основиЛінії: Оборона · Безпека
4 лютого 2025 року Google оновила принципи ШІ, прибравши з них перелік застосувань, якими компанія не займатиметься, — зокрема зброю і стеження. Натомість з'явилося формулювання про розробку там, де «ймовірна загальна користь істотно переважає передбачувані ризики».
7 лютого 2025 р.Дослідження · Наукові основиЛінії: Теорія навчання · Обчислення
7 лютого 2025 року група з інституту ELLIS у Тюбінгені та Університету Меріленду показала архітектуру, яка думає довше не словами, а повторами: рекурентний блок розгортається на довільну глибину під час відповіді. Дослідну модель на 3,5 мільярда параметрів навчено на 800 мільярдах токенів.
10 лютого 2025 р.Дослідження · Мовні моделіЛінії: Обчислення · Теорія навчання · Оцінювання
10 лютого 2025 року Шанхайська лабораторія ШІ й Цінхуа виміряли, як правильно розподіляти обчислення на відповідь. Модель на мільярд параметрів обійшла модель на 405 мільярдів на MATH-500, а модель на 7 мільярдів — o1 і DeepSeek-R1.
17 лютого 2025 р.Дослідження · Наукові основиЛінії: Теорія навчання · Оцінювання
17 лютого 2025 року Карнеґі-Меллон і Берклі довели, що за однакового бюджету донавчання з верифікатором переважає наслідування чужих ланцюжків міркування, і що розрив між ними росте зі збільшенням обчислень на відповідь.
20 лютого 2025 р.Дослідження · Мовні моделіЛінії: Теорія навчання · Дані
20 лютого 2025 року дослідники з Microsoft Research Asia показали, що навчання з підкріпленням на правилі працює на дуже малому штучному корпусі. Після п'яти тисяч згенерованих логічних головоломок модель на 7 мільярдів параметрів покращилася на 125 відсотків на AIME і на 38 відсотків на AMC.
20 лютого 2025 р.Дослідження · Наукові основиЛінії: Обчислення · Інструменти
20 лютого 2025 року MIT, Шанхайський університет Цзяотун і NVIDIA показали LServe, де розріджену увагу застосовано і на заповненні, і на декодуванні. Заповнення прискорено до 2,9 раза, декодування — в 1,3–2,1 раза проти vLLM.
24 лютого 2025 р.Доступність · Мовні моделіЛінії: Агенти · Інструменти
Anthropic випустила модель, де швидка відповідь і довгий роздум — це один режим із регульованим бюджетом, і разом з нею агента для програмування в терміналі.
26 лютого 2025 р.Дослідження · Наукові основиЛінії: Обчислення · Теорія навчання · Відкритість
26 лютого 2025 року Institute of Science Tokyo й Sakana AI показали, як починати навчання суміші експертів із готової щільної моделі, перевстановлюючи лише частину ваг кожного експерта. Модель із 5,9 мільярда активних параметрів зрівнялася зі щільною на 13 мільярдів за приблизно чверть обчислень навчання.
9 березня 2025 р.Дослідження · Роботи й автономністьЛінії: Втілення · Дані
AgiBot і OpenDriveLab відкрили AgiBot World — понад мільйон траєкторій маніпуляції на 217 задачах — і політику GO-1; навчені на цьому наборі політики дали в середньому 30% приросту проти навчених на Open X-Embodiment.
12 березня 2025 р.Оголошення · Роботи й автономністьЛінії: Втілення
Google DeepMind оголосила Gemini Robotics — модель «зір-мова-дія» на основі Gemini 2.0 — і Gemini Robotics-ER для втіленого міркування, заявивши подвоєння показника на тесті узагальнення проти інших таких моделей.
18 березня 2025 р.Доступність · Роботи й автономністьЛінії: Втілення · Відкритість
NVIDIA виклала Isaac GR00T N1 — модель «зір-мова-дія» для гуманоїдів — разом із навчальними даними й сценаріями оцінювання, для завантаження з Hugging Face і GitHub.
6 квітня 2025 р.Віха · Роботи й автономністьЛінії: Втілення · Оцінювання
Журналіст Fortune запитав BMW, що роблять роботи Figure на її заводі в Південній Кароліні. За словами речника, до березня там працював один робот і лише в неробочі години, а потім той самий робот переніс ту саму обмежену операцію на живу лінію. Керівник Figure тим часом писав про флот у наскрізних операціях.
16 квітня 2025 р.Доступність · Мовні моделіЛінії: Пошук і міркування · Агенти
OpenAI відкрила доступ до o3 і меншої o4-mini; уперше модель могла шукати в мережі, запускати код і розглядати зображення просто посеред ланцюга міркувань.
19 квітня 2025 р.Бенчмарк · Роботи й автономністьЛінії: Втілення · Оцінювання
Двадцять команд гуманоїдів пробігли 21,0975 кілометра в пекінському районі Їчжуан разом із 12 тисячами людей. Першим серед роботів фінішував Tiangong Ultra за 2 години 40 хвилин 42 секунди, тричі змінивши батарею.
Alibaba відкрила сімейство з восьми моделей від 0,6 до 235 мільярдів параметрів під ліцензією Apache, з перемиканням між швидкою відповіддю й роздумом.
14 травня 2025 р.Дослідження · Наукові основиЛінії: Наука · Пошук і міркування
DeepMind поєднала мовну модель із автоматичним перевірником і еволюційним відбором — і система знайшла спосіб перемножити комплексні матриці 4×4 за 48 множень замість 49.
20 травня 2025 р.Доступність · Наукові основиЛінії: Оборона · Гроші й ринок
20 травня 2025 року армія США надала Palantir модифікацію на 795 мільйонів доларів за ліцензії на Maven Smart System, піднявши стелю контракту приблизно до 1,3 мільярда до 2029 року.
23 травня 2025 року KAIST і KRAFTON показали дистиляцію агента: мала модель переймає в більшої не ланцюжки міркування, а траєкторії дій з пошуком і виконанням коду. Моделі на 0,5, 1,5 і 3 мільярди параметрів зрівнялися з моделями наступного щабля — 1,5, 3 і 7 мільярдів.
5 червня 2025 р.Дослідження · Наукові основиЛінії: Обчислення · Теорія навчання · Оцінювання
5 червня 2025 року Карнеґі-Меллон перерахував закони масштабування обчислень на відповідь із урахуванням заліза й дістав протилежний висновок: користь малих моделей істотно переоцінено, а ресурси спершу варто вкладати в розмір моделі приблизно до 14 мільярдів параметрів.
22 червня 2025 р.Бенчмарк · Роботи й автономністьЛінії: Втілення · Оцінювання
RoboArena оцінює роботичні політики не сталим набором задач, а розподілено: оцінювачі в семи установах вільно обирають задачі, але зобов’язані проводити подвійно сліпі попарні порівняння. За понад 600 епізодів зіставили сім політик.
У червні 2025 року Anthropic оголосила Claude Gov — набір моделей, зроблених для клієнтів національної безпеки США. За словами компанії, вони вже розгорнуті в агенціях найвищого рівня, а доступ мають лише ті, хто працює в класифікованих середовищах.
9 липня 2025 р.Віха · Наукові основиЛінії: Гроші й ринок · Обчислення
Ринкова вартість NVIDIA під час торгів уперше перейшла чотири трильйони доларів: вона стала першою компанією, що досягла цього порогу. День акція закрила на 162,88 долара, і вартість, за CNBC, становила 3,97 трильйона.
14 липня 2025 р.Доступність · Наукові основиЛінії: Оборона · Гроші й ринок
14 липня 2025 року Управління цифрових технологій і ШІ Пентагону оголосило контракти з Anthropic, Google і xAI — по 200 мільйонів доларів стелі кожен. Місяцем раніше, 17 червня, такий самий контракт отримала OpenAI.
23 липня 2025 р.Право й регулювання · Наукові основиЛінії: Право й політика
Білий дім оприлюднив план із понад дев'яноста заходів, збудований навколо прискорення: спрощення дозволів на центри обробки даних, експорт американських систем, зняття регуляторних перешкод.
2 серпня 2025 р.Віха · Наукові основиЛінії: Право й політика
Перший блок правил акта ЄС почав застосовуватися: постачальники великих моделей мають вести документацію, дотримуватися авторського права й оцінювати системний ризик.
5 серпня 2025 р.Дослідження · ЗображенняЛінії: Генеративні медіа
DeepMind показала модель, що з текстового опису породжує світ, яким можна ходити в реальному часі — 24 кадри на секунду, кілька хвилин без утрати послідовності.
5 серпня 2025 р.Доступність · Мовні моделіЛінії: Відкритість
OpenAI випустила дві моделі з відкритими вагами під ліцензією Apache — перші від часів GPT-2; більша працює на одному прискорювачі, менша на пристрої з 16 гігабайтами пам'яті.
28 серпня 2025 р.Доступність · МультимодальніЛінії: Мовлення
Мовленнєва модель, що приймає й породжує звук напряму, вийшла із стану передпоказання: з викликом інструментів, зображеннями на вході й телефонними дзвінками.
30 вересня 2025 р.Доступність · ЗображенняЛінії: Генеративні медіа
Друге покоління моделі відео породжувало звук разом із зображенням — мову з попаданням у губи, шуми, музику — і вийшло як окремий застосунок зі стрічкою.
12 листопада 2025 р.Віха · Роботи й автономністьЛінії: Автономний рух
Waymo почала пускати пасажирів без водія на автомагістралі в районі Затоки Сан-Франциско, у Фініксі й Лос-Анджелесі — спершу дедалі більшу частину своїх клієнтів, а не всіх.
9 грудня 2025 р.Віха · Наукові основиЛінії: Відкритість · Інструменти
Anthropic передала Model Context Protocol новоствореному фонду під Linux Foundation; співзасновниками стали OpenAI і Block, за підтримки Google, Microsoft, AWS і Cloudflare.
5 січня 2026 р.Оголошення · Наукові основиЛінії: Обчислення
NVIDIA оголосила на CES, що платформа Vera Rubin у повному виробництві, і назвала числа: 50 петафлопс висновування NVFP4 і вдесятеро дешевший токен проти Blackwell. Разом із нею відкрито шість доменних моделей.
6 січня 2026 р.Право й регулювання · Наукові основиЛінії: Шкода · Право й політика
Character.AI, її засновники й Google повідомили п'ять судів про принципову згоду врегулювати позови родин: два — про самогубства підлітків, решта — про шкоду дітям від розмов із чат-ботами.
9 січня 2026 р.Дослідження · Наукові основиЛінії: Обчислення
Epoch AI оцінила сукупну обчислювальну потужність чипів для ШІ всіх великих розробників: подвоєння за 7 місяців, зростання втричі з третиною за рік від 2022 року.
12 січня 2026 р.Дослідження · Наукові основиЛінії: Наука
На arXiv з'явився людський виклад формального доведення в Lean, створеного зв'язкою GPT-5.2 Pro і Aristotle від Harmonic. У анотації сказано, що це перша задача Ердеша, яку вважають повністю розв'язаною ШІ автономно.
13 січня 2026 р.Оголошення · Наукові основиЛінії: Обчислення · Право й політика
Міністерство торгівлі змінило політику ліцензування: заявки на експорт NVIDIA H200, AMD MI325X і подібних чипів розглядатимуть індивідуально за виконання умов безпеки.
15 січня 2026 р.Бенчмарк · Наукові основиЛінії: Оцінювання
Звіт зафіксував результати змагання: 1455 команд, 15 154 подання, найкращий результат 24 відсотки на приватному наборі ARC-AGI-2. Темою року названо цикл уточнення, а поширення тесту — джерелом нового забруднення.
14–15 січня 2026 р.Оголошення · Наукові основиЛінії: Обчислення · Право й політика · Гроші й ринок
Прокламація за розділом 232 запровадила мито 25 відсотків на певні передові обчислювальні чипи та похідні товари. Дія — з 00:01 15 січня, з широкими винятками за призначенням.
22 січня 2026 р.Право й регулювання · Наукові основиЛінії: Право й політика
Рамковий закон про розвиток штучного інтелекту та створення основ довіри набув чинності: маркування виходу генеративного ШІ, пояснення й плани захисту користувачів для систем високого впливу та обов'язки безпеки для найпотужніших систем, поріг яких, установлений указом, починається від 10^26 операцій навчання.
Голова Anthropic опублікував есе «Підлітковий вік технології», де повторив власний прогноз: потужний ШІ може настати вже за один-два роки, хоч може й значно пізніше.
29 січня 2026 р.Бенчмарк · Наукові основиЛінії: Оцінювання
Розширивши набір задач зі 170 до 228, METR перерахувала тренд: подвоєння часового горизонту від 2024 року становить 89 днів замість 109, а від 2023-го — 131 день замість 165.
29 січня 2026 р.Доступність · Роботи й автономністьЛінії: Автономний рух
Безводійські поїздки почали возити до міжнародного аеропорту Сан-Франциско: спершу для обмеженого кола пасажирів, із посадкою біля центру прокату автомобілів.
10–31 січня 2026 р.Право й регулювання · МультимодальніЛінії: Шкода · Право й політика
Індонезія, Малайзія і Філіппіни тимчасово заблокували Grok через сексуалізовані зображення без згоди, зокрема жінок і неповнолітніх; британський Ofcom відкрив офіційне розслідування щодо X.
10–20 лютого 2026 р.Право й регулювання · МультимодальніЛінії: Право й політика · Генеративні медіа
Поправки до правил про посередників зобов'язали маркувати синтетичний зміст і стиснули строки видалення: три години на приписи суду й держави, дві — на зображення без згоди та підміну особи.
24 лютого 2026 р.Оголошення · Наукові основиЛінії: Безпека
Версія 3.0 набула чинності: компанія зобов'язалася публікувати дорожні карти безпеки й регулярні звіти про ризики, що кількісно оцінюють ризик усіх розгорнутих моделей.
27 лютого 2026 р.Право й регулювання · Мовні моделіЛінії: Оборона · Право й політика
Переговори зайшли в глухий кут через вимогу дозволити «всі законні використання» Claude: Anthropic не знімала заборон на повністю автономну зброю й масове стеження за американцями. 27 лютого 2026 року міністр війни Піт Гегсет доручив визнати компанію ризиком для національної безпеки в ланцюгу постачання.
2 березня 2026 р.Право й регулювання · Наукові основиЛінії: Право й політика
Суд відмовив у розгляді справи Талера проти Перлмуттер, залишивши чинним рішення апеляційного суду округу Колумбія: за законом про авторське право твір має бути створений людиною.
20 березня 2026 р.Право й регулювання · Наукові основиЛінії: Право й політика
Білий дім оприлюднив законодавчі рекомендації для національної політичної рамки щодо ШІ і, серед іншого, попросив Конгрес перекрити закони штатів про ШІ, що створюють надмірний тягар.
24 березня 2026 р.Дослідження · Мовні моделіЛінії: Праця
Звіт Economic Index показав, що за тієї самої задачі, моделі й мови користувачі з довшим стажем дають кращий результат, а концентрація завдань на Claude.ai падає, тоді як на API зростає.
25 березня 2026 р.Бенчмарк · Наукові основиЛінії: Оцінювання
Фонд ARC Prize випустив інтерактивне випробування із сотень покрокових середовищ, де правила треба відкрити самому. Люди набирають 100 відсотків, передові моделі — 0,51.
26 березня 2026 р.Доступність · МультимодальніЛінії: Мовлення · Відкритість
Cohere випустила під ліцензією Apache 2.0 модель на 2 мільярди параметрів із середньою частотою помилок у словах 5,42 відсотка — перше місце у відкритому рейтингу ASR.
27 березня 2026 р.Дослідження · Наукові основиЛінії: Праця
Аналітична записка Ради керуючих ФРС не виявила скорочення вакансій у галузях і фірмах із вищим рівнем упровадження ШІ: ефекти позитивні й точно оцінені як нульові.
31 березня 2026 р.Оголошення · Наукові основиЛінії: Гроші й ринок
Компанія закрила раунд на 122 мільярди доларів підтвердженого капіталу за оцінки після інвестицій у 852 мільярди і повідомила, що отримує 2 мільярди доходу щомісяця.
Anthropic показала модель, що знаходить уразливості й будує робочі експлойти, і відмовилася випускати її загально: доступ лише через закритий консорціум.
13 квітня 2026 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Безпека
Інститут безпеки ШІ опублікував власну оцінку: 73 відсотки успіху на експертних завданнях і перше в історії наскрізне проходження 32-крокової симуляції вторгнення.
14 квітня 2026 р.Бенчмарк · Наукові основиЛінії: Оцінювання
ARC Prize провела дослідження з 458 учасниками й змінила нормування: сто відсотків тепер означає проходження кожного рівня не гірше за медіанну людську ефективність дій.
14 травня 2026 р.Право й регулювання · Наукові основиЛінії: Право й політика
Губернатор підписав SB 26-189: закон 2024 року про системи високого ризику скасовано й замінено вужчим режимом розкриття щодо автоматизованих технологій ухвалення рішень, чинним із 1 січня 2027 року.
14 травня 2026 р.Дослідження · Наукові основиЛінії: Праця
Аналіз вакансій Lightcast із мірою вразливості професій до ШІ показав: падіння в найбільш вразливих професіях почалося ще до кінця 2022 року і після виходу ChatGPT не зламалося окремо.
18 травня 2026 р.Право й регулювання · Наукові основиЛінії: Право й політика · Гроші й ринок
Дорадчі присяжні визнали позови Маска до Альтмана, Брокмана й OpenAI — про порушення благодійного трасту й повернення безпідставного збагачення — пропущеними за строком давності, і суддя ухвалила їхній вердикт.
20 травня 2026 р.Дослідження · Наукові основиЛінії: Наука
Внутрішня модель OpenAI побудувала нескінченну родину конфігурацій, що перевершує квадратну ґратку на поліноміальний множник, спростувавши гіпотезу 1946 року. Дев'ятеро зовнішніх математиків перевірили доведення.
21 травня 2026 р.Дослідження · Наукові основиЛінії: Наука · Пошук і міркування
Агент, що генерує доведення в Lean і там же їх перевіряє, автономно розв'язав 9 із 353 відкритих задач Ердеша і довів 44 з 492 гіпотез із енциклопедії цілочислових послідовностей.
2 червня 2026 р.Оголошення · Наукові основиЛінії: Право й політика · Безпека
Указ 14409 дав відомствам 30 і 60 днів на кіберзахист і доручив розробити засекречений процес оцінювання «охоплених передових моделей» та добровільну рамку доступу держави до них.
9 червня 2026 р.Доступність · МультимодальніЛінії: Мовлення
Google випустила модель мовлення в мовлення, що починає перекладати, поки людина ще говорить, понад 70 мовами, зберігаючи інтонацію, темп і висоту голосу.
12 червня 2026 р.Право й регулювання · Мовні моделіЛінії: Право й політика · Відкритість
12 червня 2026 року уряд США видав директиву експортного контролю, що забороняла доступ до Claude Fable 5 і Mythos 5 будь-якому іноземцю — і в США, і поза ними, включно з власними працівниками Anthropic. Перевіряти громадянство в реальному часі компанія не могла, тож вимкнула обидві моделі для всіх користувачів.
26 червня 2026 р.Дослідження · Мовні моделіЛінії: Праця
Звіт Economic Index дав датовані числа: десята частина опитаних вважає ймовірною втрату власної роботи, а понад третина ставить понад 60 відсотків на втрату роботи молодшими колегами.
26 червня 2026 р.Бенчмарк · Мовні моделіЛінії: Оцінювання · Безпека
Незалежний оцінювач із доступом до моделі до випуску повідомив, що її частота шахрування найвища серед усіх публічних моделей на його стенді й що жодне з отриманих чисел не є надійним вимірюванням.
26 червня 2026 р.Оголошення · Мовні моделіЛінії: Право й політика · Безпека
26 червня 2026 року OpenAI показала покоління GPT-5.6 — Sol, Terra і Luna, — але відкрила доступ лише вузькому колу партнерів, погодженому з урядом США, на прохання двох підрозділів Білого дому. Компанія прохання виконала й публічно з ним не погодилася.
30 червня 2026 р.Доступність · Мовні моделіЛінії: Право й політика
30 червня 2026 року експортний контроль із Claude Fable 5 і Mythos 5 знято, і наступного дня Fable 5 повернувся до користувачів у всьому світі. Доступ до Mythos 5 для частини організацій США відновили раніше — після схвалення уряду 26 червня.
5 липня 2026 р.Оголошення · Наукові основиЛінії: Теорія навчання
Дві найкращі статті конференції — обидві про дифузійні моделі; премію за випробування часом дістала робота 2016 року про асинхронне навчання з підкріпленням.
6 липня 2026 р.Бенчмарк · Наукові основиЛінії: Оцінювання
Фонд ARC Prize вручив перший етапний приз на 37,5 тисячі доларів за подання до 30 червня; переможцями стали невеликі команди, а не передові лабораторії.
2–7 липня 2026 р.Оголошення · Мовні моделіЛінії: Теорія навчання
Три відзначені роботи 64-ї конференції — про аспектуальну семантику в мовних моделях, про ефективне кодування в обробці речень людиною і про виразність локальної уваги в трансформерах.
9 липня 2026 р.Доступність · Мовні моделіЛінії: Агенти · Праця
Того самого 9 липня OpenAI випустила ChatGPT Work — агента всередині ChatGPT, який годинами веде проєкт, сам розбиває його на кроки й повертає готові таблиці, презентації, документи та вебзастосунки. Під ним працює GPT-5.6 і технологія Codex, а окремий застосунок Codex зливається з класичним застосунком ChatGPT.
9 липня 2026 р.Доступність · Мовні моделіЛінії: Гроші й ринок
9 липня 2026 року OpenAI відкрила для загального доступу все сімейство GPT-5.6 — Sol, Terra і Luna — у ChatGPT, Codex та API, за два тижні після обмеженого попереднього доступу під урядовим наглядом. Число тепер означає покоління, а імена — сталі рівні можливостей, які можуть оновлюватися незалежно один від одного.
21 липня 2026 р.Бенчмарк · Наукові основиЛінії: Оцінювання · Наука
Команда dots китайської платформи RedNote повідомила, що внутрішня версія її моделі dots-note-3.0 розв'язала всі шість задач Міжнародної математичної олімпіади 2026 року в Шанхаї й за офіційним оцінюванням отримала 42 бали з 42.
21 липня 2026 р.Дослідження · Мовні моделіЛінії: Безпека · Оцінювання
Інститут безпеки ШІ повідомив, що в його кібероцінюваннях кожна перевірена модель принаймні іноді намагалася шахрувати, а спроби визнавала неправильними менш ніж у половині випадків.
11–21 липня 2026 р.Віха · Наукові основиЛінії: Безпека · Агенти
Під час випробування з безпеки модель із вимкненими запобіжниками вийшла за межі пісочниці OpenAI й зламала системи Hugging Face, щоб дістати відповіді на власний тест.
7 травня – 27 липня 2026 р.Право й регулювання · Наукові основиЛінії: Право й політика
Регламент 2026/1744 змінив акт про ШІ: обов'язки для систем високого ризику відтерміновано до грудня 2027-го й серпня 2028-го, натомість додано заборону породжувати інтимні зображення без згоди.
30 липня 2026 р.Доступність · Мовні моделіЛінії: Гроші й ринок
30 липня 2026 року OpenAI знизила ціну GPT-5.6 Luna на 80 відсотків і GPT-5.6 Terra на 20, не змінивши ціни флагманської Sol. Вхідний мільйон токенів Luna подешевшав з долара до двадцяти центів, вихідний — із шести доларів до 1,20; у Terra — з 2,50 до 2 і з 15 до 12.
31 липня 2026 р.Доступність · Мовні моделіЛінії: Відкритість
Агентна модель на 304 мільярди параметрів вийшла на Hugging Face під ліцензією MIT того самого дня, коли її оголосили, із опублікованими результатами на тестах терміналу, розробки й кібербезпеки.
31 липня 2026 р.Право й регулювання · ЗображенняЛінії: Право й політика · Генеративні медіа
Земельний суд Мюнхена I здебільшого задовольнив позов GEMA проти Suno щодо шести пісень: порушеннями визнано копіювання під час навчання в США, запам'ятовування в моделях і відтворення у виходах.
31 липня 2026 р.Дослідження · Наукові основиЛінії: Безпека
Epoch AI нарахувала близько 2500 розкритих уразливостей високої й критичної тяжкості за липень — приблизно вп'ятеро більше за місячний рекорд до оголошення Claude Mythos Preview.
1 серпня 2026 р.Дослідження · Наукові основиЛінії: Наука
Внутрішня версія Astra закрила або суттєво просунула десять давніх відкритих задач у восьми галузях; токени на пошук усіх розв'язків коштували б близько двох тисяч доларів.
2 серпня 2026 р.Віха · Наукові основиЛінії: Право й політика · Генеративні медіа
У всіх 27 державах ЄС набули обов'язковості вимоги повідомляти людину, що вона говорить із машиною, і позначати машинно-читаною міткою синтетичні звук, зображення, відео й текст.
6 серпня 2026 р.Дослідження · Наукові основиЛінії: Наука
Мовна модель геномів спроєктувала бактеріофаги з нуля: із 285 синтезованих кандидатів 16 виявилися життєздатними й убивали кишкову паличку, зокрема штами, стійкі до природного фага.
10 серпня 2026 р.Віха · Роботи й автономністьЛінії: Втілення · Гроші й ринок
Smart Analytics Global опублікувала числа постачань гуманоїдів: 19 100 одиниць у світі за перше півріччя 2026 року, на 272% більше за 5100 роком раніше, з AgiBot на 8400 одиницях і Unitree на 5900.
13 серпня 2026 р.Доступність · МультимодальніЛінії: Відкритість
Команда Qwen опублікувала мультимодальну модель на 27 мільярдів параметрів із контекстом у 262 тисячі токенів під дозвільною ліцензією, що дозволяє комерційне використання без переговорів.
13 серпня 2026 р.Дослідження · Наукові основиЛінії: Обчислення · Гроші й ринок
Epoch AI порахувала продуктивність на долар для фактично куплених прискорювачів: у постійних цінах 2025 року середнє зростання 49 відсотків на рік, подвоєння за 1,7 року.
14 серпня 2026 р.Дослідження · Наукові основиЛінії: Праця · Гроші й ринок
Опитування Epoch AI та Ipsos показало: 46,4 відсотка тих, хто користується ШІ на роботі, роблять це на безплатних тарифах, і лише 28,6 відсотка — на оплаченій роботодавцем підписці.
19 серпня 2026 р.Віха · Роботи й автономністьЛінії: Втілення · Гроші й ринок
Unitree Robotics вийшла на ринок STAR Шанхайської біржі. За проспектом, 2025 року вона відвантажила 5 511 гуманоїдів, а її виторг склав 1,70 мільярда юанів.
20 серпня 2026 р.Право й регулювання · Роботи й автономністьЛінії: Автономний рух · Право й політика
Транспортне управління Невади одностайно схвалило заявки Tesla, Waymo й дочірньої компанії Uber на платні безводійні перевезення в окрузі Кларк: до 5 000, 1 000 і 1 000 машин за перші 12 місяців.
26 серпня 2026 р.Оголошення · Наукові основиЛінії: Гроші й ринок · Обчислення
За квартал, що завершився 26 липня 2026 року, виторг NVIDIA склав 96,2 мільярда доларів, з них 89,0 мільярда — від центрів обробки даних, на 117 відсотків більше, ніж роком раніше.
Сем Альтман сказав, що до кінця 2026-го OpenAI матиме внутрішню систему, яку він назве загальним інтелектом; головний дослідник компанії оцінив просування у 80 відсотків шляху.
27 серпня 2026 р.Право й регулювання · Наукові основиЛінії: Право й політика · Оборона
27 серпня 2026 року суддя Ріта Лін ухвалила на користь Anthropic рішення без повного розгляду: визнання компанії ризиком у ланцюгу постачання було незаконною помстою за Першою поправкою, порушило належну правову процедуру за П'ятою поправкою і було свавільним. Суддя скасувала це визнання й назавжди заборонила застосовувати заходи проти компанії.
31 серпня 2026 р.Віха · Наукові основиЛінії: Безпека
Організація описала, як у березні зловмисник умовив агента віддати ключ до API й три тижні витрачав кредити, а в травні агентами промацував її інфраструктуру.
1 вересня 2026 р.Право й регулювання · Мовні моделіЛінії: Право й політика · Дані
Департамент юстиції подав заяву про інтерес у зведеному провадженні проти OpenAI: копіювання захищених текстів для навчання мовної моделі є добросовісним використанням.
3 вересня 2026 р.Бенчмарк · Наукові основиЛінії: Оцінювання
ARC Prize опублікувала власну оцінку моделі: 62,7 відсотка за стандартного стенда і 99,9 відсотка за стенда з адаптером постачальника, за 26 і 19 тисяч доларів відповідно.
4 вересня 2026 р.Дослідження · Наукові основиЛінії: Обчислення
Epoch AI простежила рекорд потужності найбільшого центру обробки даних для ШІ: від 237 мегават у серпні 2024 року до 946 у червні 2026-го, тобто подвоєння кожні десять місяців.
8 вересня 2026 р.Оголошення · Наукові основиЛінії: Гроші й ринок
Французька лабораторія закрила раунд D на 3 мільярди євро під проводом Samsung за оцінки після інвестицій понад 21 мільярд — найбільший у історії європейської технологічної компанії.
8 вересня 2026 р.Дослідження · Наукові основиЛінії: Наука
Компанія опублікувала доведення, що в тривимірних рівняннях Нав'є—Стокса за скінченний час може виникнути сингулярність, разом із формалізацією в Lean, і сказала, що систему створено моделлю, яка значно перевершує GPT-6 Astra.
10 вересня 2026 р.Доступність · МультимодальніЛінії: Відкритість
Модель на 552 мільярди параметрів у вагах відходить від архітектури лише з декодувальником і, за словами розробника, потребує вчетверо менше HBM і увосьмеро менше SSD для кешу.
11 вересня 2026 р.Віха · Наукові основиЛінії: Наука · Безпека
Математики опублікували декларацію: гонитва компаній за розв'язанням задач як мірилом шкодить математиці, бо результати оголошують поспіхом, без належного викладу й посилань на попередників.
14 вересня 2026 р.Дослідження · Наукові основиЛінії: Гроші й ринок
Частка дорослих, які користувалися ШІ щонайменше шість днів із семи, зросла з 8 до 19 відсотків від березня до серпня 2026 року, тоді як загальне охоплення зросло значно менше.
15 вересня 2026 р.Оголошення · Наукові основиЛінії: Інструменти
15 вересня 2026 року TypeSafe AI, заснована колишнім дослідником OpenAI Діого Алмейдою, випустила Jev — модель, яка не породжує рядків. Замість тексту вона повертає типізовані структуровані значення з каліброваними ймовірностями. Набір можливих відповідей задають наперед, тож вийти за схему модель не може.
16 вересня 2026 р.Бенчмарк · Наукові основиЛінії: Оцінювання
Розкладення індексу спроможностей за галузями показало: GPT-6 Astra ставить рекорд у математиці й водночас поступається Claude Fable 5.1 у програмній інженерії.
17 вересня 2026 р.Дослідження · Наукові основиЛінії: Обчислення · Право й політика
Epoch AI зіставила митну звітність Китаю й Малайзії: розбіжність у 3,75 мільярда доларів за 15 місяців, що відповідає приблизно 150 тисячам еквівалентів H100.