Google представив Gemini 3.8 Flash – третю бюджетну модель за шість тижнів, а передові моделі залишаються недоступними
Google випустив Gemini 3.8 Flash, який у деяких агентних кодингових тестах дорівнює Claude Opus 5, проте споживає на 30 % більше токенів, що підвищує загальні витрати. Це третя бюджетна модель за шість тижнів, що свідчить про посилення конкуренції у сегменті доступних LLM.
⚠️ Gemini 3.8 Flash пропонує нижчу вартість за токен, проте споживає на 30 % більше токенів, що підвищує загальні витрати. Для компаній до 200 людей з обмеженим бюджетом це не вигідно, а великі користувачі можуть скористатися нижчою ціною за токен.
Що це означає для вас
Порівняйте вартість використання Gemini 3.8 Flash з поточним провайдером на вашому типічному кодинговому запиті
🕐 Запустіть один типовий запит у вашій системі та виміряйте кількість витрачених токенів (до 30 хв)
🛠 Інструмент: Gemini 3.8 Flash
Пропустіть, якщо: якщо ваші запити вже оптимізовані під інший LLM
Перевірте, чи нова модель не підвищить ваші витрати на AI, перш ніж переходити.
Отримати карту AI-можливостей →🎯 Чи підходить це вашому бізнесу?
Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.
Заповнити профіль · 30 секундTL;DR
- •Gemini 3.8 Flash – третя бюджетна модель Google за шість тижнів.
- •Модель досягає рівня Claude Opus 5 у агентних кодингових тестах.
- •Вартість за токен нижча, але споживає на 30 % більше токенів.
- •Запуск анонсу відбувся 2 вересня 2026 р.
- •Google позиціонує модель як рішення для малих і середніх компаній.
Як це змінить ваш ринок?
Для компаній у сфері медіа та контенту, які активно генерують тексти та коди, нова модель пропонує дешевший тариф за токен, що може знизити бар’єр входу в AI‑автоматизацію. Однак підвищене споживання токенів робить її менш привабливою для великих обсягів, змушуючи менеджерів переоцінювати бюджети на LLM‑сервіси.
Визначення: Токен — базова одиниця обчислення в мовних моделях, що відповідає частині слова або символу.
Для кого це і за яких умов
- •Малі компанії (10‑50 співробітників): MacBook 16 GB, без спеціальної IT‑команди, 15‑30 хв на тестовий запит, бюджет до $200 міс.
- •Середні компанії (50‑200 співробітників): сервер з GPU 24 GB або хмарний інстанс $0.5/год, IT‑спеціаліст, 1‑2 дні на інтеграцію, бюджет $1 k‑5 k міс.
- •Великі підприємства: потребують масштабної інфраструктури, оптимізації токен‑використання, спеціального моніторингу витрат.
Альтернативи
| Продукт 1 | Продукт 2 | Продукт 3 | |
|---|---|---|---|
| Ціна | $0.0006/токен (Claude Opus 5) | $0.0005/токен (Gemini 3.8 Flash) | $0.0008/токен (GPT‑4o) |
| Де працює | Cloud Anthropic | Google Cloud | OpenAI API |
| Мін. вимоги | API‑ключ | Google Cloud аккаунт | API‑ключ + OpenAI‑аккаунт |
| Ключова різниця | Висока якість коду | Нижча вартість за токен, але 30 % більше токенів | Найкраща універсальність, найвища ціна |
💬 Часті запитання
Такий розбір щоранку о 08:00
Персональний AI-дайджест для вашої галузі — щодня у Telegram
Джерела
The Decoder — оригіналНавчіть вашу команду будувати такі AI-автоматизації
За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.
Дізнатись більше → aiupskill.live