Tencent AI Open Sources Covo-Audio: A 7B Speech Language Model and Inference Pipeline for Real-Time Audio Conversations and Reasoning

MarkTechPost5 місяців тому0 переглядів

Tencent AI Lab випустила Covo-Audio, 7B-параметрову end-to-end велику аудіомовну модель, призначену для об'єднання обробки мовлення та мовного інтелекту. Модель безпосередньо обробляє безперервні аудіовходи та генерує аудіовиходи в єдиній архітектурі, маючи ієрархічну структуру для безшовної кросс-модальної взаємодії. Цей випуск з відкритим кодом є значним проривом у можливостях реального часу для аудіо розмов та міркувань.

ВердиктПозитивнаImpact 7/10

⚡ Помітна подія

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
TencentAIspeechlanguagemodelopensourceaudioprocessingreal-time

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live