Повернутися до часової лінії

Доступність · 26 березня 2026 р.

Cohere відкриває провідну модель розпізнавання мовлення

Cohere випустила під ліцензією Apache 2.0 модель на 2 мільярди параметрів із середньою частотою помилок у словах 5,42 відсотка — перше місце у відкритому рейтингу ASR.

Чому це важливо

Найточніший спеціалізований розпізнавач мовлення став завантаженням на 2 мільярди параметрів під дозвільною ліцензією, тож транскрипція зійшла з мережі на власне залізо.

Модель cohere-transcribe-03-2026 опубліковано 26 березня 2026 року: 2 мільярди параметрів, ліцензія Apache 2.0, навчання на 14 мовах — англійській, французькій, німецькій, італійській, іспанській, португальській, грецькій, нідерландській, польській, китайській, японській, корейській, в'єтнамській та арабській. Середня частота помилок у словах — 5,42 відсотка, це перше місце в рейтингу Open ASR на Hugging Face. Для порівняння наведено Zoom Scribe v1 із 5,47, IBM Granite 4.0 1B Speech із 5,52, NVIDIA Canary Qwen 2.5B із 5,63 та OpenAI Whisper Large v3 із 7,44 відсотка. Модель доступна для завантаження, через безплатний API з обмеженням частоти або як виділене розгортання. Що каже лідерборд сьогодні. Файл результатів Open ASR Leaderboard, перебудований 27 травня 2026 року на очищених наборах, дає cohere-transcribe-03-2026 середню помилку 4,67 відсотка і ставить попереду zoom/scribe_v1 з 4,15 і nvidia/canary-qwen-2.5b з 4,43; whisper-large-v3 має там 5,78. Число 5,42 і перше місце належать стану лідерборда на 26 березня, який нині недоступний: до травня його дані лежали в закритому репозиторії, а архівні копії сторінки порожні.

Відомості про подію

Дата події
26 березня 2026 р.
Дата на часовій лінії
Дата події
Перевірка
Джерела зібрано автоматично · 22 вересня 2026 р.
Лінії
ID
evt-0374

День публікації оголошення Cohere.

Джерела

Пов’язані події