Технологічний світ знову вражений інноваціями від DeepSeek, яка представила свою новітню мультимодальну модель штучного інтелекту — V4.1 Flash. Ця модель, хоч і є найменшою у своїй архітектурній родині, вражає своїми можливостями, зокрема нативною підтримкою тексту та зображень, попри загальну кількість у 552 мільярди параметрів. Особливістю V4.1 Flash є її здатність активувати лише певну частину параметрів під час роботи, що істотно зменшує потребу в пам’яті для зберігання контексту, роблячи її надзвичайно ефективною.
Інноваційна архітектура та її переваги
Нова модель побудована за принципом Mixture-of-Experts, що дозволяє використовувати для виконання конкретних завдань лише частину загальних параметрів. Завдяки асиметричній архітектурі Causal Encoder–Decoder, V4.1 Flash активує 8 мільярдів параметрів під час обробки вхідних даних та 16 мільярдів під час генерації відповіді. Це значно відрізняється від попередніх моделей: V4 Flash мала 284 мільярди параметрів із 13 мільярдами активних, а флагманська V4 Pro — 1.6 трильйона параметрів із 49 мільярдами одночасно використовуваних.
Оптимізація роботи з контекстом
Одним із ключових досягнень V4.1 Flash є суттєве скорочення KV-кешу, який відповідає за зберігання даних про вже опрацьований контекст. У порівнянні з V4 Flash, новій моделі потрібно вчетверо менше високошвидкісної пам’яті HBM та увосьмеро менше місця на SSD. Розмір глобального KV-кешу тепер становить лише 890 байтів на один токен, що має значно зменшити вартість обробки довгих запитів, особливо для ШІ-агентів, які інтенсивно працюють з великими обсягами даних. V4.1 Flash підтримує контекстне вікно обсягом до 1 мільйона токенів.
Продуктивність та доступність
DeepSeek стверджує, що завдяки вдосконаленим методам попереднього навчання та масштабнішому навчанню з підкріпленням, V4.1 Flash перевершує V4 Pro у внутрішніх тестах. Компанія також посилається на результати сторонніх досліджень, хоча конкретні організації не називаються. Модель V4.1 Flash вже доступна через API під ідентифікатором deepseek-flash. Варто зазначити, що попередні версії V4 Flash і V4 Flash Vision Experimental більше не підтримуються, хоча їхні старі назви тимчасово перенаправлятимуть запити до нової моделі.
З 14 вересня всі запити до deepseek-v4-pro також тимчасово перенаправлятимуться до V4.1 Flash за її тарифами. Ця схема діятиме до випуску V4.1 Pro, що свідчить про стратегічне планування компанії щодо виведення нових продуктів на ринок.
Відкритість та локальне розгортання
Ваги моделі DeepSeek були опубліковані на платформі Hugging Face під ліцензією MIT, що сприяє ширшому використанню та інтеграції. Для локального розгортання моделі доступна підтримка популярних інструментів, таких як Transformers, vLLM та SGLang. Це відкриває нові можливості для розробників та дослідників, які бажають впроваджувати передові ШІ-рішення у своїх проектах.
- DeepSeek представила мультимодальну ШІ-модель V4.1 Flash.
- Модель має нативну підтримку тексту та зображень.
- Використовується архітектура Mixture-of-Experts для ефективного розподілу ресурсів.
- Скорочено KV-кеш, що зменшує потребу в пам’яті для обробки контексту.
- Підтримується контекстне вікно до 1 мільйона токенів.
- Модель доступна через API та має відкриті ваги під ліцензією MIT.
Цікаво, що у квітні DeepSeek вже випускала моделі V4 Pro та V4 Flash з подібним контекстним вікном, а згодом суттєво знизила вартість використання V4 Pro, що свідчить про агресивну цінову політику компанії та прагнення зробити передові технології доступнішими.




