Mistral AI Releases Voxtral TTS: A 4B Open-Weight Streaming Speech Model for Low-Latency Multilingual Voice Generation

MarkTechPost5 місяців тому0 переглядів

Mistral AI випустила Voxtral TTS, свою першу велику модель перетворення тексту в мову, призначену для багатомовного голосового генерації з низькою затримкою. Модель з 4 мільярдами параметрів з відкритими вагами надає можливості потокового мовлення та позиціонує Mistral як конкурента пропрієтарним голосовим API. Цей випуск завершує аудіо-стек Mistral після їхніх попередніх пропозицій з транскрипції та мовних моделей.

ВердиктПозитивнаImpact 7/10

⚡ Помітна подія

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
MistralAIVoxtralTTStext-to-speechmultilingualvoicegenerationopen-weightstreaming

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live