Gemini 1.0
Google випустила сімейство моделей трьох розмірів, навчених одразу на тексті, зображеннях, звуку і відео, а не зібраних із окремих частин.
Чому це важливо
Мультимодальність перестала бути надбудовою: модель від початку навчалася на всіх видах даних одночасно.
Три варіанти — Ultra, Pro і Nano — розраховані відповідно на складні задачі, широкий ужиток і роботу на пристрої. Компанія повідомила про перевищення людського рівня на наборі MMLU. Демонстраційне відео згодом визнали змонтованим так, що воно перебільшувало можливості, і це зашкодило довірі до анонсу. Модель об'єднала команди Google Brain і DeepMind, злиті у квітні 2023 року.