Google випустили Gemini 3.6 Flash та Gemini 3.5 Flash Lite
Google випустили оновлені моделі Gemini 3.6 Flash та Gemini 3.5 Flash Lite. Зміни вартості токенів на вихід та вхід роблять моделі дешевшими або дорожчими, впливаючи на витрати компаній на AI-обробку.
📊 Зміна цін. Для компаній, що використовують Gemini API, при оптимізації витрат на генерацію тексту.
🟢 МОЖЛИВОСТІ
- Знижка вихідних токенів Gemini 3.6 Flash до $7,5/млн токенів економія до 20% при великих об’ємах (>10M токенів/міс).
- Прозора структура цін дозволяє передбачати витрати для API-інтеграцій і оптимізувати бюджет на AI-обробку.
- Можливість вибирати між Flash та Lite залежно від балансу швидкості та точності дозволяє підібрати модель під конкретний кейс без переплати.
🔴 ЗАГРОЗИ
- Підвищення цін Gemini 3.5 Flash Lite до $2,5/млн токенів збільшує витрати на прості задачі на 67% порівняно з попередньою версією.
- Зростання вартості за задачу з $0,04 до $0,09 може робити модель менш конкурентоспроможною для стартапів з обмеженим бюджетом.
- Залежність від одного постачальника API збільшує риски при зміні тарифів без попередження, особливо для企业 с жесткими SLA.
🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Дата релізу: 21 липня 2026 р.
- •Gemini 3.6 Flash: вихідні токени $7,5/млн, вхідні $0,3/млн, контекст 32K токенів.
- •Gemini 3.5 Flash Lite: вихідні токени $2,5/млн, вхідні $0,3/млн, контекст 16K токенів.
- •Ліцензія: пропрієтарна API, доступ через Google Cloud з оплатой за використання.
- •Основні користувачі: розробники AI-додатків, корпоративні IT-команди, стартапи у сфері контенту та аналітики.
Як це змінить ваш ринок?
Зміна тарифної політики Google спрямована на приваблювання масових користувачів до Flash через зниження вартості великих об’ємів, одночасно монетизуючи нишеві використання Lite. Для маркетингових агентств, які генерують великі об’єми тексту, це може зменшити витрати на контент‑маркетинг на 15‑25% при збереженні якості. Натомість фінансові установи, що часто використовують Lite для швидкої обробки документів, повинні переглянути бюджет через підвищення цін на 67%.
Визначення: Токен — одиниця тексту, якою модель вимірює вхід та вихід (наприклад, слово або частина слова).
Для кого це і за яких умов
- •Flash 3.6: оптимально для компаній з об’ємом генерації понад 10 млн токенів на місяць; потрібен доступ до Google Cloud, без додаткової IT‑команди, час впровадження <1 годину.
- •Lite 3.5: сенс для простих завдань (класифікація, витяг даних) при об’ємах до 2 млн токенів/місяць; вимагає моніторингу витрат, можливо потрібен фінансовий аналітик для оптимізації.
- •Мін. масштаб: будь‑який, але економія виявляється при масштабному використанні.
Альтернативи
| Продукт | Ціна (за 1M вихідних токенів) | Де працює | Мін. вимоги | Ключова різниця |
|---|---|---|---|---|
| Gemini 3.6 Flash | $7,5 | Google Cloud API | Інтернет, обліковий запис GCP | Найнижча cena за великі об’єми серед пропрієтарних моделей |
| Gemini 3.5 Flash Lite | $2,5 | Google Cloud API | Інтернет, обліковий запис GCP | Найдешевіший варіант для низькооб’ємних задач, але з вищою вартістю за задачу |
| Claude 3 Haiku (Anthropic) | $8,0 | AWS / GCP / Azure | API‑ключ | Порівняна якості, але трохи вища цена за токен |
| GPT‑4o mini (OpenAI) | $6,0 | OpenAI API | API‑ключ | Баланс ціни та якості, підтримка функцій виклику інструментів |
| Llama 3 8B (власний розгортання) | $0 (власний) | Власний сервер | GPU 16GB+, навички DevOps | Повна контроль над даними, але витрати на інфраструктуру |
💬 Часті запитання
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
Силиконовый Мешок — оригіналНавчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live