Випущено модель GLM-5.3-Flash-EXL3-3.0bpw
Випущено нову селективну конверсію моделі GLM-5.3-Flash у форматі EXL3 3.0 bpw, яка потребує кастомного завантажувача та очікує на повну валідацію сервера та MTP. Модель демонструє зростання перплексії поза межами контрольних груп.
🔬 Дослідницький реліз. Модель потребує кастомного завантажувача та валідації, що робить її непридатною для прямого використання в продакшені компаніями без власної R&D команди.
Ключові тези
- Селективна конверсія моделі GLM-5.3-Flash у форматі EXL3 3.0 bpw.
- Потребує кастомного завантажувача та очікує на повну валідацію сервера та MTP.
- Зростання перплексії на +9.3% поза межами контрольних груп Q4.
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секунд🔒 Підтекст (Insider)
Цей реліз є технічним оновленням, яке демонструє експерименти з оптимізацією моделей. Фокус на зниженні бітпрайсу (bpw) вказує на спроби зробити великі моделі менш вимогливими до ресурсів, що є важливим напрямком для майбутнього розгортання AI.
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Навчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live