DeepSeek випускає V4.1-Flash із кодувальником і декодувальником
Модель на 552 мільярди параметрів у вагах відходить від архітектури лише з декодувальником і, за словами розробника, потребує вчетверо менше HBM і увосьмеро менше SSD для кешу.
Чому це важливо
Передова модель із відкритими вагами зійшла з архітектури, на якій трималися всі великі лінії від 2020 року, і розробник назвав наслідок у пам'яті, а не в балах.
Оголошення від 10 вересня 2026 року. DeepSeek-V4.1-Flash — суміш експертів на 552 мільярди параметрів кістяка з новою причинною архітектурою кодувальник-декодувальник: 40 шарів, із них 20 у кодувальнику й 20 у декодувальнику. Активується 8 мільярдів параметрів на токен під час попереднього заповнення і 16 мільярдів під час декодування. Кеш ключів і значень потребує чверті обсягу HBM і восьмої частини обсягу SSD проти попереднього покоління. Модель має власну мультимодальність і подається через API під ідентифікатором deepseek-flash; нові ціни почали діяти о 04:00 UTC 10 вересня 2026 року. Ваги опубліковано на Hugging Face під ліцензією MIT. Розробник повідомляє, що випробування кількох сторін ставлять V4.1-Flash попереду V4-Pro за продуктивністю, вартістю, швидкістю й сукупним часом виконання, і на цій підставі V4-Pro поетапно виводять із обігу.