Google представив нову модель Gemini 3.8 Flash: швидша, але потенційно дорожча
Google запустив модель Gemini 3.8 Flash, яка виконує більше кроків міркування та інструментальний виклик. Це може збільшити витрати на API, що важливо для компаній, які активно використовують генеративний ШІ.
⚠️ Підвищена вартість для активних користувачів, підходить компаніям до 200 людей, які готові протестувати нову модель, аби оцінити виправданість додаткових витрат.
Що це означає для вас
Порівняйте витрати Gemini 3.8 Flash з Gemini 3.7 Flash на типових запитах вашого продукту
🕐 Запустіть один типовий запит у Gemini 3.8 Flash та один у Gemini 3.7 Flash, підрахуйте використані токени (до 30 хв)
📊 З новини: $0.75 за мільйон вхідних токенів🛠 Інструмент: Gemini 3.8 Flash
Пропустіть, якщо: якщо ваші запити вже оптимізовані під мінімальну кількість токенів
Перевірте, чи нова модель не підвищить ваші витрати на API, і вирішіть, чи варто переходити вже сьогодні.
Отримати карту AI-можливостей →🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Gemini 3.8 Flash офіційно анонсовано 2 вересня 2026.
- •Модель підтримує контекст до 32 к токенів, що більше за 3.7.
- •Google радить підвищені рівні зусиль для складних завдань.
- •Перші користувачі повідомляють про 15 % збільшення споживання токенів.
- •Перехід на нову модель можливий без змін у тарифах, але без гарантії економії.
Як це змінить ваш ринок?
Для компаній, що активно генерують контент або автоматизують підтримку, збільшена продуктивність Gemini 3.8 Flash відкриває можливість вирішувати складніші запити без додаткових інженерних змін. Однак підвищене споживання токенів підвищує операційні витрати, що особливо критично для стартапів та середніх компаній з обмеженим бюджетом на AI‑сервіси.
Визначення: токен — найменша одиниця тексту, яку обробляє LLM; вартість вимірюється за мільйон токенів.
Для кого це і за яких умов
- •Малі компанії (до 10 співробітників): можуть протестувати модель на обмеженій кількості запитів, використовуючи безкоштовний кредит Google Cloud.
- •Середні компанії (10‑200 співробітників): потрібен доступ до API, бюджет $500‑$1 000 на місяць, IT‑спеціаліст для моніторингу споживання.
- •Великі компанії: вимоги до GPU або хмарних ресурсів, команда Data Science, бюджет $5 000+.
Альтернативи
| Ціна | Де працює | Мін. вимоги | Ключова різниця | |
|---|---|---|---|---|
| Gemini 3.8 Flash | $0.75/млн вхідних, $3.75/млн вихідних | Google Cloud | API‑ключ | Більше кроків міркування, ітеративний інструментальний виклик |
| Claude 2 | $1.00/млн вхідних, $4.00/млн вихідних | Anthropic | API‑ключ | Стабільна ціна, менша гнучкість у інструментах |
| GPT‑4o | $1.20/млн вхідних, $5.00/млн вихідних | OpenAI | API‑ключ | Найвища якість, найвища вартість |
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
The Verge AI — оригіналНавчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live