Google запускає моделі Gemini 3.6 Flash та 3.5 Flash-Lite з низькими цінами, щоб конкурувати з Kimi-K3
Google представила нові моделі Gemini 3.6 Flash та 3.5 Flash-Lite з зниженими цінами на токени, що робить їх дешевшими за Kimi-K3. Це дозволяє компаніям знижувати витрати на розробку AI-агентів та збільшувати їх доступність для масштабного використання.
💰 Вигідна ціна. Для компаній, що створюють AI-агентів та потребують економії на токени, це оптимальний вибір.
🟢 МОЖЛИВОСТІ
- Зниження витрат на токени до 80% порівняно з Kimi-K3 для тих же завдань
- Швидкість до 350+ токенів/сек дозволяє обробляти документи в реальному часі для агентів
- Доступність моделей через Google Cloud спрощує інтеграцію для команд без спеціалізованої інфраструктури
🔴 ЗАГРОЗИ
- Нижчі ціни можуть призвести до зниження маржинальності Google у сегменті AI API
- Конкуренція з відкритими моделями (наприклад, Llama 3) може обмежити прибутковість навіть при низких цінах
- Залежність від одного постачальника збільшує ризик простоїв при збоях у Google Cloud
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Gemini 3.6 Flash: $1.50 за 1M вхідних токенів, $7.50 за 1M вихідних.
- •Gemini 3.5 Flash-Lite: $0.30 вхід, $2.50 вихід, швидкість до 350+ токенів/сек.
- •Дата анонсу: 21 липня 2026 року.
- •Контекстне вікно: 8K токенів для обох моделей.
- •Ліцензія: пропрієтарна, доступна через Google Cloud API.
Як це змінить ваш ринок?
Маркетинг та рекламні агентства часто стикаються з блоком високих витрат на токени при масштабному використанні AI-агентів для генерації контенту. Зниження цін на Gemini моделі дозволяє подвоїти обсяг створеного тексту без збільшення бюджету, що збільшує ROI кампаний.
Визначення: AI-агент — це програмна система, яка автономно виконує завдання за допомогою великих мовних моделей, таких як Gemini, для аналізу даних, генерації тексту та прийняття решень.
Для кого це і за яких умов
Для стартапів та SMB: достатньо ноутбука з доступом до інтернету, бюджету $50/міс на тестування, без потреби в окремій IT-команді, впровадження за kilka годин. Для середніх та великих компаній: потрібен обліковий запис Google Cloud, можливості масштабування до тисяч запитів/сек, рекомендована інтеграція через DevOps-команду, час впровадження від 1 до 3 днів.
Альтернативи
| Продукт | Ціна | Де працює | Мін. вимоги | Ключова різниця |
|---|---|---|---|---|
| Gemini 3.6 Flash | $1.50 вхід / $7.50 вихід за 1M токенів | Google Cloud API | Інтернет + обліковий запис | Найнижчі ціни серед пропрієтарних API, висока швидкість |
| Kimi-K3 | $3.00 вхід / $15.00 вихід за 1M токенів | Moonshot API | Інтернет + API‑ключ | Подібна продуктивність, але вдвічі дороже |
| Llama 3 8B (self‑hosted) | Безкоштовно (відкрита вага) | Локальний сервер / хмара | GPU 24GB+, навички DevOps | Повний контроль даних, витрати на обладнання та енергію |
💬 Часті запитання
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Навчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live