ПозитивнаImpact 6/10🔬 Research🏛️ Від 200 людей🏭 Виробництво і Промисловість🏦 Фінанси і Банкінг

Deepseek випускає V4.1-Flash — мультимодальна модель з 552 млрд параметрів, що скорочує потребу в KV-пам’яті у чотири рази

The Decoder11 днів тому2 перегляди

Deepseek представив V4.1-Flash — мультимодальну модель з 552 млрд параметрів, що активує лише 16 млрд на токен, але зменшує KV-пам’ять у чотири рази. На тесті DeepSWE вона перевершила Opus 5 та GPT-5.6 Sol і поширюється на ліцензії MIT.

ВердиктПозитивнаImpact 6/10

🔬 Цікаво для дослідження, але не для продакшену. Для компаній до 200 людей — це прототип, який потребує серйозних інфраструктурних інвестицій перед використанням.

Ключові тези

  • Модель має 552 млрд параметрів у загалі, але активує лише 16 млрд на токен
  • Зменшує потребу в KV-пам’яті до 25% від попередньої версії
  • Перевершує Opus 5 та GPT-5.6 Sol на бенчмарку DeepSWE з кодом
  • Поширюється на ліцензі ліцензією MIT, орієнтована надешевших AI-агентів

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд

🔒 Підтекст (Insider)

Deepseek не продає доступ до моделі через API — це викладення ваг під MIT, орієнтоване на тих, хто може собі дозволити власний інференс. Це сигнал, що відкриті моделі наближаються до комерційних за якістю, але ще вимагають глибоких технічних команд для впровадження.

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
DeepseekV4.1-FlashKVcachemultimodalmodelMITlicenseAIagents

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live