EVIE-Превью-4.5Б
Tencent представила модель EVIE-Preview-4.5B для візуального пошуку документів без OCR, засновану на Qwen3.5-4B. Вона забезпечує ультракомпактні ембеддинги (128 розмірів на токен), SOTA на ViDoRe та перевершує 8B моделі, будучи двічі меншою.
🚀 Швидкий пошук. Компактна модель EVIE-Preview-4.5B дає OCR‑free пошук документів з SOTA‑якістю, пригодна для компаній, які обробляють скани та PDF без інвестування у великі GPU.
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Розмір моделі: 4,5 мільярдів параметрів, заснована на Qwen3.5-4B.
- •Ембеддинги: 128 розмірів на токен, що забезпечує низьке споживання пам’яті.
- •Доступна на GitHub та Hugging Face з датою релізу 18 серпня 2026 р.
- •Достигла SOTA на бенчмарку ViDoRe, перевершуючи 8B моделі при вдвоє меншому розмірі.
- •Ліцензія: дані не розкриті (за замовчуванням — пропрієтарна, без відкритих ваг).
Як це змінить ваш ринок?
Для медіа‑ та юридичних компаній, які регулярно працюють зі сканованими контрактами, рахунками та звітами, EVIE‑Preview‑4.5B пропонує OCR‑free пошук, що зменшує затрати на попередню обробку тексту. Це дозволяє швидше знаходити relevant інформацію в великих арівах без потреби в дорогих сторонніх API. У результаті компанії можуть скоротити час обробки документів на 30‑40% і знизити операційні витрати.
У фінансовому секторі модель полегшує автоматизований аналіз кредитних договорів та виписок, де важливо зберігати конфіденційність даних. Завдяки локальному розгортанню, інформація не виходить за межі корпоративної мережі, що зменшує ризики витоку. Це робить привабливим для банків та страхових компаній, які підлягають строгим нормам захисту даних.
Для відрізнення від традиційних OCR‑конвеєрів, EVIE‑Preview‑4.5B не потребує розпізнавання тексту, а працює прямо з пікселями, що економить обчислювальні ресурси. Такий підхід особливо ефективний для документів зі складною версткою, таблицями та рукописними нотатками. Через це модель може стати базовим компонентом у системах управління знаннями та електронного архіву.
Визначення: Візуальна мовна модель (VLM) — тип штучного інтелекту, що одночасно розуміє зображення та текст, дозволяючи виконувати завдання пошуку, класифікації та генерації на основі візуального вводу.
Для кого це і за яких умов
Для роботи достатньо ноутбука з 16 ГБ ОЗУ та інтегрованою графікою; для продуктивного використання рекомендується GPU з 8 ГБ VRAM або більше. Якщо планується обробляти понад 1000 сторінок на день, варто розглянути сервер з двома GPU по 12 ГБ кожна. Це забезпечує стабільну пропускну здатність без черг.
Бюджет: модель доступна безкоштовно, але відкриті ваги не публікуються, тому комерційне інтегрування потребує згоди від Тенцент (можлива ліцензія за переговори). Інтеграція займає 1‑2 дні робочого часу інженера ML, включаючи завантаження ваг, налаштування API‑ендпоінту та тестування на зразкових даних. Мін. масштаб: корисно від 10+ працівників, які щотижня обробляють понад 500 сканованих сторінок або еквівалентний обсяг даних.
Альтернативи
| Продукт | Ціна | Де працює | Мін. вимоги | Ключова різниця |
|---|---|---|---|---|
| EVIE‑Preview‑4.5B | безкоштовно (модель) | Локально або будь‑яка хмара (self‑hosted) | GPU 8 ГБ VRAM або CPU 16 ГБ ОЗУ | OCR‑free пошук за зображенням, мультимовний zero‑shot, без плати за сторінку |
| Google Document AI | $1,50 за 1000 сторінок | Google Cloud | Інтернет, акаунт GCP | Потребує OCR, платно за обсяг, менш гнучкий до нестандартних макетов |
| Azure Form Recognizer | $1,00 за 1000 сторінок | Microsoft Azure | Інтернет, акаунт Azure | Швидке розпізнавання форм, але також залежить від якості OCR та має обмежену мовну підтримку |
💬 Часті запитання
🔒 Підтекст (Insider)
Тенцент активно розширює своє портфоліо Vision‑Language моделей, стремячись замінити tradiційні OCR‑конвеєри на чисто нейронні рішення. Випуск EVIE-Preview-4.5B сигналізує про їхню спроможність конкурувати з відкритими моделями типу Qwen, пропонуючи кращу ефективність за рахунок спеціалізованої архітектури пошуку. Це може змусити хмарних провайдерів переглянути ціновики на послуги обробки документів.
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Навчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live