Google запустив три нові моделі Gemini: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite та Gemini 3.5 Flash Cyber
Google запустив три нові моделі Gemini — 3.6 Flash, 3.5 Flash-Lite та 3.5 Flash Cyber, позиційуючи їх для агентних задач та ниzkой вартості. Це дозволяє компаніям знижувати витрати на AI-обробку та масштабувати агентні workflows через більш доступні та ефективні моделі.
🚀 Сильний запуск. Для бізнесу, що потребує ниzkокоштовних AI-моделей для агентних задач та кодування.
🟢 МОЖЛИВОСТІ
- Зниження витрат на токени до 70% порівняно з Gemini 3.5 Flash для агентних workflows
- Модель 3.6 Flash підтримує функцію виклику інструментів, що спрощує створення AI-агентів без додаткового коду
- Доступна через API з оплатой за фактичне використання, що дозволяє стартапам експериментувати без передплати
🔴 ЗАГРОЗИ
- Висока залежність від Google Cloud може обмежити мульти-хмарні стратегії компаній, що використовують кілька провайдерів
- Конкуренція з ниzkокоштовними моделями від Meta та Mistral може стиснуть маржі та заставити Google знижувати ціни далі
- Обмежена прозорість щодо даних навчання може викликати питання щодо сумісності з регулюванням EU AI Act у фінансовій та медичних галузях
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Gemini 3.6 Flash: вход $1,50 за 1M токен, вихід $7,50 за 1M токен.
- •Gemini 3.5 Flash-Lite: вход $0,30 за 1M токен, вихід $2,50 за 1M токен.
- •Gemini 3.5 Flash Cyber: дані не розкриті, позиціонується для спеціалізованих агентних задач.
- •Google розпочав pretraining Gemini 4, очікуванийrelease в 2027 році.
- •Моделі доступні через Google Cloud Vertex AI з регіональною доступністю в США, ЄС та Азії.
Як це змінить ваш ринок?
Запуск нових Gemini-моделей зменшує бар’єр входження для компаній, які хочуть інтегрувати AI-агенти без великих витрат на обчислювальні ресурси. Це особливо цінно для медіа- та маркетингових агентств, що потребують масштабного генерування тексту, коду та мультимедійного контенту. Зниження цін на токени робить можливим використання AI у реальному часі для чат-ботів та систем підтримки.
Визначення: Агентна задача — завдання, яке вимагає від моделі автономного планowania, виклику інструментів та послідовного виконання кроків без постійного людського втручання.
Для кого це і за яких умов (ОБОВ'ЯЗКОВО: мін. обладнання/бюджет, потрібна команда чи ні, мін. масштаб, час на впровадження)
- •Gemini 3.6 Flash: потрібен доступ до Google Cloud Vertex AI, бюджет від $50/міс для тестування, без спеціальної IT-команди, впровадження за 1-2 тижні.
- •Gemini 3.5 Flash-Lite: оптимальний для стартапів та SMB, може працювати на будь-якому плані з оплатой за використання, час впровадження менше 1 тижня.
- •Gemini 3.5 Flash Cyber: призначений для企業 з вимогами до безпеки, потребує консультації з безпеки та можливо виділеного середовища, час впровадження 2-4 тижні.
Альтернативи
| Продукт | Ціна | Де працює | Мін. вимоги | Ключова різниця |
|---|---|---|---|---|
| Gemini 3.6 Flash | $1,50 вхід / $7,50 вихід за 1M токен | Google Cloud Vertex AI | Інтернет-з’єднання, обліковий запис GCP | Найвища інтелектуальність серед Flash-моделей, підтримка виклику інструментів |
| Gemini 3.5 Flash-Lite | $0,30 вхід / $2,50 вихід за 1M токен | Google Cloud Vertex AI | Інтернет-з’єднання | Найнижча вартість, висока пропускна здатність для агентних навантажень |
| Claude 3 Haiku (Anthropic) | $0,25 вхід / $1,25 вихід за 1M токен | AWS Bedrock, Google Cloud | Інтернет-з’єднання | Краща безпека та відповідність, проте менша швидкість генерації коду |
| GPT-4o mini (OpenAI) | $0,15 вхід / $0,60 вихід за 1M токен | OpenAI API | Інтернет-з’єднання | Найнижча ціна, проте менша спеціалізація на агентних задачах |
💬 Часті запитання
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
Вайб-кодинг — оригіналНавчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live