Google випустили Gemini 3.6 Flash та Gemini 3.5 Flash Lite
Google випустили оновлені моделі Gemini 3.6 Flash та Gemini 3.5 Flash Lite. Зміни вартості токенів на вихід та вхід роблять моделі дешевшими або дорожчими, впливаючи на витрати компаній на AI-обробку.
💰 Ціна Gemini 3.6 Flash тепер $7.5 за мільйон токенів. Для тих, кому критична конфіденційність, це перша реальна альтернатива платним API.
Що це означає для вас
Перевірте, чи можна використовувати Gemini 3.6 Flash для генерації контенту
🕐 Відкрийте офіційний сайт Google і знайдіть інформацію про Gemini 3.6 Flash (15 хв)
📊 З новини: 7.5 за мільйон токенів🛠 Інструмент: Gemini 3.6 Flash
Пропустіть, якщо: якщо ваша команда не використовує AI для контенту
Перегляньте свої поточні проєкти на основі AI і подумайте, чи можна їх оптимізувати за допомогою Gemini 3.6 Flash
Отримати карту AI-можливостей →🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Дата релізу: 21 липня 2026 р.
- •Gemini 3.6 Flash: вихідні токени $7,5/млн, вхідні $0,3/млн, контекст 32K токенів.
- •Gemini 3.5 Flash Lite: вихідні токени $2,5/млн, вхідні $0,3/млн, контекст 16K токенів.
- •Ліцензія: пропрієтарна API, доступ через Google Cloud з оплатой за використання.
- •Основні користувачі: розробники AI-додатків, корпоративні IT-команди, стартапи у сфері контенту та аналітики.
Як це змінить ваш ринок?
Зміна тарифної політики Google спрямована на приваблювання масових користувачів до Flash через зниження вартості великих об’ємів, одночасно монетизуючи нишеві використання Lite. Для маркетингових агентств, які генерують великі об’єми тексту, це може зменшити витрати на контент‑маркетинг на 15‑25% при збереженні якості. Натомість фінансові установи, що часто використовують Lite для швидкої обробки документів, повинні переглянути бюджет через підвищення цін на 67%.
Визначення: Токен — одиниця тексту, якою модель вимірює вхід та вихід (наприклад, слово або частина слова).
Для кого це і за яких умов
- •Flash 3.6: оптимально для компаній з об’ємом генерації понад 10 млн токенів на місяць; потрібен доступ до Google Cloud, без додаткової IT‑команди, час впровадження <1 годину.
- •Lite 3.5: сенс для простих завдань (класифікація, витяг даних) при об’ємах до 2 млн токенів/місяць; вимагає моніторингу витрат, можливо потрібен фінансовий аналітик для оптимізації.
- •Мін. масштаб: будь‑який, але економія виявляється при масштабному використанні.
Альтернативи
| Продукт | Ціна (за 1M вихідних токенів) | Де працює | Мін. вимоги | Ключова різниця |
|---|---|---|---|---|
| Gemini 3.6 Flash | $7,5 | Google Cloud API | Інтернет, обліковий запис GCP | Найнижча cena за великі об’єми серед пропрієтарних моделей |
| Gemini 3.5 Flash Lite | $2,5 | Google Cloud API | Інтернет, обліковий запис GCP | Найдешевіший варіант для низькооб’ємних задач, але з вищою вартістю за задачу |
| Claude 3 Haiku (Anthropic) | $8,0 | AWS / GCP / Azure | API‑ключ | Порівняна якості, але трохи вища цена за токен |
| GPT‑4o mini (OpenAI) | $6,0 | OpenAI API | API‑ключ | Баланс ціни та якості, підтримка функцій виклику інструментів |
| Llama 3 8B (власний розгортання) | $0 (власний) | Власний сервер | GPU 16GB+, навички DevOps | Повна контроль над даними, але витрати на інфраструктуру |
💬 Часті запитання
🔒 Підтекст (Insider)
Google тратить на це стільки, бо програє OpenAI у B2B. Ціль — не технологія, а enterprise-контракти.
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
Силиконовый Мешок — оригіналНавчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live