Behemoth-128B-v3: Нова модель з 125Б параметрів на ліцензії Apache-2.0, базова на Mistral-Medium-3.5-128B
Опубліковано нову мовну модель Behemoth-128B-v3 з 125Б параметрів. Її базою служить Mistral-Medium-3.5-128B, а ліцензія Apache-2.0 дозволяє вільне використання та модифікацію.
🔬 Цікаво для досліджень, але не для продакшену. Модель ще не має стабільного інференсу, документації та підтримки — зачекайте 2-3 місяці перед оцінкою для бізнес-завдань.
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Модель Behemoth-128B-v3 має 125Б параметрів
- •Базою служить Mistral-Medium-3.5-128B
- •Ліцензія: Apache-2.0
- •Доступна на huggingface.co/TheDrummer/Behemoth-128B-v3
- •Не розгорнута жодним провайдером інференсу
Як це змінить ваш ринок?
Поки модель не має стабільного доступу через API чи інференс-провайдерів, її вплив на ринок обмежений дослідниками та ентузіастами. Для комерційного використання потрібна додаткова валідація продуктивності та безпеки.
Визначення:
Apache-2.0 — дозвольна ліцензія з відкритим кодом, яка дозволяє безкоштовно використовувати, змінювати та поширювати програмне забезпечення, включаючи комерційне використання, з обов’язком збереження відомостей про авторство та ліцензію.
Для кого це і за яких умов (ОБОВ'ЯЗКОВО: мін. обладнання/бюджет, потрібна команда чи ні, мін. масштаб, час на впровадження.
❌ «Підходить для компаній будь-якого розміру». ✅ "7B: MacBook 16GB, без IT-команди, 15 хв. 27B: GPU $2,000+ або хмара ~$0.5/год, IT-спеціаліст, 1-2 дні." Behemoth-128B-v3: потрібна GPU з 80GB+ пам’яті для інференсу, доступ до кластера або хмарних ресурсів (наприклад, 8x A100), IT-спеціаліст з досвідом роботи з LLM, 1-2 тижні на налаштування та тестування.
Альтернативи (ТАБЛИЦЯ: | | Продукт 1 | Продукт 2 | Продукт 3 | з колонками: Ціна, Де працює, Мін. вимоги, Ключова різниця. ОБОВ'ЯЗКОВО конкретні ціни. ❌ "Потужна модель" — нуль інформації. ✅ "$15/1M токенів" або "безкоштовно" або "ціна не розкрита".)
| Показник | Behemoth-128B-v3 | Llama 3 70B | Mistral Medium 3 |
|---|---|---|---|
| Ціна | дані не розкриті | $0.70/1M токенів (Together AI) | дані не розкриті |
| Де працює | Hugging Face (самостійне розгортання) | API, самостійне розгортання | API (La Plateforme), самостійне розгортання |
| Мін. вимоги | 80GB GPU RAM | 24GB GPU RAM для 70B | 48GB GPU RAM |
| Ключова різниця | Висока кількість параметрів, але невірфікована продуктивність | Перевірена якість, широке використання | Баланс розміру та ефективності, опенсорсна |
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
Shir-man Trending — оригіналНавчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live