Google випустила моделі Gemini 3.8 Live та Live Extended Thinking
Google випустила Gemini 3.8 Live та Live Extended Thinking, нові моделі ШІ, що підтримують 97 мов та розуміють відео та зображення з камери, не перериваючи розмову. Нова функція Extended Thinking дозволяє моделі міркувати та говорити одночасно, виконуючи складні завдання у фоновому режимі, що вже встановило новий рекорд якості мовлення.
🚀 Прорив у мультимодальних моделях. Для розробників, які шукають передові рішення для обробки мови та відео з конкурентною ціною.
Ключові тези
- Моделі Gemini 3.8 Live та Live Extended Thinking підтримують 97 мов.
- Моделі можуть обробляти відео та зображення з камери.
- Інструменти можна викликати без зупинки розмови.
- Функція Extended Thinking дозволяє одночасно міркувати та говорити для складних фонових завдань.
- Gemini 3.8 Live досягла показника 82.6 у Speech to Speech Quality Index.
- Ціна API становить $3 за 1 млн токенів для аудіовходу та $12 за 1 млн для аудіовиходу.
- Ціна API для тексту становить $0.75 за 1 млн токенів для входу та $4.50 за 1 млн для виходу.
- Моделі доступні через Gemini API та AI Studio.
- Починається впровадження в Search Live, Gemini Live та Workspace.
Що це означає для вас
Оцініть нові можливості Gemini 3.8 Live для інтеграції в існуючі продукти та сервіси, звернувши увагу на підтримку 97 мов та обробку відео.
🕐 Зареєструйтеся в AI Studio та протестуйте базові функції Gemini 3.8 Live з обробкою аудіо та відео (1-2 години).
📊 З новини: $3 вхід / $12 вихід для аудіо🛠 Інструмент: Gemini API
Пропустіть, якщо: Якщо ваша компанія не планує інтегрувати мультимодальні ШІ-рішення найближчим часом.
Дослідіть потенціал Gemini 3.8 Live для створення більш інтерактивного та багатомовного контенту, використовуючи можливості обробки відео та розширеного мислення.
🕐 Спробуйте надіслати відеофрагмент або аудіозапис у Gemini API для отримання текстового опису або аналізу (30 хвилин).
📊 З новини: 97 мов🛠 Інструмент: Gemini API
Пропустіть, якщо: Якщо ваша маркетингова стратегія не передбачає використання відео або багатомовної комунікації.
Чи готові ваші продукти до нового рівня мультимодальної взаємодії?
Отримати карту AI-можливостей →🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секунд🔒 Підтекст (Insider)
Google активно інвестує в розвиток Gemini, щоб конкурувати з OpenAI на ринку передових мовних моделей. Випуск цих версій з покращеними можливостями аудіо та відео є частиною стратегії Google з домінування в галузі ШІ та залучення розробників до своєї екосистеми.
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
Machinelearning — оригіналНавчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live