Google Releases Gemini 3.1 Flash Live: A Real-Time Multimodal Voice Model for Low-Latency Audio, Video, and Tool Use for AI Agents

MarkTechPost5 місяців тому0 переглядів

Google запустила Gemini 3.1 Flash Live у попередньому перегляді для розробників через Gemini Live API у Google AI Studio. Модель орієнтована на низьку затримку, природні та надійні голосові взаємодії в реальному часі, будучи найякіснішою аудіо та мовною моделлю Google на сьогодні. Вона обробляє мультимодальні потоки, надаючи технічну основу для створення просунутих AI-агентів.

ВердиктПозитивнаImpact 7/10

⚡ Помітна подія

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
GoogleGeminimultimodalvoiceAIreal-timelow-latency

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live