Qwen3.8-Flash-Next-MXFP4-FP8 — експериментальна модель Qwen4 з гібридною увагою та квантуванням MXFP4/FP8
Опубліковано експериментальну архітектуру Qwen3.8-Flash-Next для Qwen4 з гібридною увагою, гейтованими залишковими потоками та n-gram ембедингами. Модель доступна у вигляді квантованого MXFP4/FP8 варіанту, оптимізованого під AMD AI PRO R9700 GPU.
ВердиктНейтральнаImpact 4/10
🔬 Цікаво, але не для вас. Це досліднювальний прототип без готового продукту — компанія на 10-50 людей не зможе його впровадити через відсутність підтримки, документації та стабільності.
Ключові тези
- Експериментальна архітектура Qwen4 з гібридною увагою та гейтованими залишковими потоками
- Квантована версія MXFP4/FP8, оптимізована під AMD AI PRO R9700 GPU
- Доступна на Hugging Face за посиланням tcclaviger/Qwen3.8-Flash-Next-MXFP4-FP8
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундТакий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
Shir-man Trending — оригіналQwenMXFP4FP8AMDGPUhybridattention
Навчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live