ШІ за копійки: DeepSeek представила нову модель V4.1 Flash
Китайська компанія DeepSeek представила нову модель штучного інтелекту V4.1 Flash із суттєво нижчими тарифами на API, ніж у конкурентів. Розробники стверджують, що новинка перевершує попередню V4-Pro у низці завдань, передає Bloomberg.
Ставка на дешевший ШІ
DeepSeek позиціює V4.1 Flash як модель, що поєднує вищу швидкість, нижчу вартість і ефективнішу архітектуру. За даними компанії, вона перевершує Kimi K3 від Moonshot та водночас залишається дешевшою за рішення конкурентів.
«V4.1-Flash дозволяє нам обслуговувати більше користувачів із меншими витратами. Ми передаємо цю економію вам», — заявили в компанії.
Чим відрізняється нова архітектура
Як повідомили розробники, Модель побудована на архітектурі «каузального енкодера-декодера» (causal encoder-decoder) та використовує підхід MoE («суміш експертів»). Загалом вона має 552 мільярда параметрів, але під час обробки запитів активує лише 8 мільярдів параметрів для вхідних даних і 16 мільярдів — для вихідних.
За даними DeepSeek, це дозволило скоротити споживання пам'яті: кеш KV потребує лише чверть обсягу HBM-пам'яті та восьму частину SSD-сховища порівняно з попереднім поколінням. Оскільки витрати на кешування становлять значну частину вартості роботи ШІ-агентів, таке рішення помітно знижує загальну ціну використання моделі.
Компанія також заявляє, що нові методи попереднього навчання та масштабне донавчання з підкріпленням допомогли V4.1 Flash перевершити V4-Pro у програмуванні та агентних завданнях, хоча вона все ще поступається флагманським моделям американських Anthropic і OpenAI.
DeepSeek відмовляється від V4-Pro
З 14 вересня DeepSeek припиняє підтримку V4-Pro. Всі запити до моделі deepseek-v4-pro автоматично перенаправлятимуться на V4.1 Flash із нижчими тарифами, доки не вийде V4.1 Pro.
Одночасно компанія припинила підтримку моделей V4-Flash і V4-Flash-Vision-Exp. Запити до них тимчасово також перенаправляються на нову версію.
Новинка підтримує мультимодальність і вже доступна через API під назвою deepseek-flash.
Цінова війна
DeepSeek запровадила диференційовану систему тарифів: у непікові години використання API коштує вдвічі дешевше, ніж у пікові періоди. Такий підхід має рівномірніше розподіляти навантаження й дозволяє розробникам економити під час виконання тривалих агентних завдань.
Аналітична компанія Artificial Analysis раніше назвала ситуацію на ринку «зоною смерті» DeepSeek. На її думку, інші розробники тепер змушені або пропонувати ще нижчі ціни, або суттєво перевершувати китайські моделі за функціональністю.
OpenAI вже розпочала зниження тарифів на власні моделі на тлі загострення цінової війни з Anthropic та посилення тиску з боку дешевших китайських розробок із відкритими вагами. Зокрема, через три тижні після презентації сімейства GPT-5.6, компанія знизила вартість використання найшвидшої моделі Luna приблизно на 80%, а версії Terra — на 20%.