ЗмішанаImpact 2/10✅ Production-Ready👤 Для всіх📺 Медіа і Контент🏦 Фінанси і Банкінг

Google випустили Gemini 3.6 Flash та Gemini 3.5 Flash Lite

Силиконовый Мешок2 місяці тому1 перегляд

Google випустили оновлені моделі Gemini 3.6 Flash та Gemini 3.5 Flash Lite. Зміни вартості токенів на вихід та вхід роблять моделі дешевшими або дорожчими, впливаючи на витрати компаній на AI-обробку.

ВердиктЗмішанаImpact 2/10

💰 Ціна Gemini 3.6 Flash тепер $7.5 за мільйон токенів. Для тих, кому критична конфіденційність, це перша реальна альтернатива платним API.

Що це означає для вас

Маркетингу

Перевірте, чи можна використовувати Gemini 3.6 Flash для генерації контенту

🕐 Відкрийте офіційний сайт Google і знайдіть інформацію про Gemini 3.6 Flash (15 хв)

📊 З новини: 7.5 за мільйон токенів

🛠 Інструмент: Gemini 3.6 Flash

Пропустіть, якщо: якщо ваша команда не використовує AI для контенту

Перегляньте свої поточні проєкти на основі AI і подумайте, чи можна їх оптимізувати за допомогою Gemini 3.6 Flash

Отримати карту AI-можливостей →

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд
Детальний розбір ↓

TL;DR

  • Дата релізу: 21 липня 2026 р.
  • Gemini 3.6 Flash: вихідні токени $7,5/млн, вхідні $0,3/млн, контекст 32K токенів.
  • Gemini 3.5 Flash Lite: вихідні токени $2,5/млн, вхідні $0,3/млн, контекст 16K токенів.
  • Ліцензія: пропрієтарна API, доступ через Google Cloud з оплатой за використання.
  • Основні користувачі: розробники AI-додатків, корпоративні IT-команди, стартапи у сфері контенту та аналітики.

Як це змінить ваш ринок?

Зміна тарифної політики Google спрямована на приваблювання масових користувачів до Flash через зниження вартості великих об’ємів, одночасно монетизуючи нишеві використання Lite. Для маркетингових агентств, які генерують великі об’єми тексту, це може зменшити витрати на контент‑маркетинг на 15‑25% при збереженні якості. Натомість фінансові установи, що часто використовують Lite для швидкої обробки документів, повинні переглянути бюджет через підвищення цін на 67%.

Визначення: Токен — одиниця тексту, якою модель вимірює вхід та вихід (наприклад, слово або частина слова).

Для кого це і за яких умов

  • Flash 3.6: оптимально для компаній з об’ємом генерації понад 10 млн токенів на місяць; потрібен доступ до Google Cloud, без додаткової IT‑команди, час впровадження <1 годину.
  • Lite 3.5: сенс для простих завдань (класифікація, витяг даних) при об’ємах до 2 млн токенів/місяць; вимагає моніторингу витрат, можливо потрібен фінансовий аналітик для оптимізації.
  • Мін. масштаб: будь‑який, але економія виявляється при масштабному використанні.

Альтернативи

ПродуктЦіна (за 1M вихідних токенів)Де працюєМін. вимогиКлючова різниця
Gemini 3.6 Flash$7,5Google Cloud APIІнтернет, обліковий запис GCPНайнижча cena за великі об’єми серед пропрієтарних моделей
Gemini 3.5 Flash Lite$2,5Google Cloud APIІнтернет, обліковий запис GCPНайдешевіший варіант для низькооб’ємних задач, але з вищою вартістю за задачу
Claude 3 Haiku (Anthropic)$8,0AWS / GCP / AzureAPI‑ключПорівняна якості, але трохи вища цена за токен
GPT‑4o mini (OpenAI)$6,0OpenAI APIAPI‑ключБаланс ціни та якості, підтримка функцій виклику інструментів
Llama 3 8B (власний розгортання)$0 (власний)Власний серверGPU 16GB+, навички DevOpsПовна контроль над даними, але витрати на інфраструктуру

💬 Часті запитання

Згідно з даними Google, архітектура моделей не змінена; оновлення торкнулося лише тарифної політики та невеликих оптимізацій токенізації. Якість генерації залишиється на попередньому рівні.

🔒 Підтекст (Insider)

Google тратить на це стільки, бо програє OpenAI у B2B. Ціль — не технологія, а enterprise-контракти.

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
GeminiFlashLLMpricingGoogleAI

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live