ЗмішанаImpact 5/10✅ Production-Ready👥 Від 10 людей📺 Медіа і Контент

Google представив Gemini 3.8 Flash – третю бюджетну модель за шість тижнів, а передові моделі залишаються недоступними

The Decoderблизько 2 годин тому0 переглядів

Google випустив Gemini 3.8 Flash, який у деяких агентних кодингових тестах дорівнює Claude Opus 5, проте споживає на 30 % більше токенів, що підвищує загальні витрати. Це третя бюджетна модель за шість тижнів, що свідчить про посилення конкуренції у сегменті доступних LLM.

ВердиктЗмішанаImpact 5/10

⚠️ Gemini 3.8 Flash пропонує нижчу вартість за токен, проте споживає на 30 % більше токенів, що підвищує загальні витрати. Для компаній до 200 людей з обмеженим бюджетом це не вигідно, а великі користувачі можуть скористатися нижчою ціною за токен.

Що це означає для вас

IT-команді

Порівняйте вартість використання Gemini 3.8 Flash з поточним провайдером на вашому типічному кодинговому запиті

🕐 Запустіть один типовий запит у вашій системі та виміряйте кількість витрачених токенів (до 30 хв)

🛠 Інструмент: Gemini 3.8 Flash

Пропустіть, якщо: якщо ваші запити вже оптимізовані під інший LLM

Перевірте, чи нова модель не підвищить ваші витрати на AI, перш ніж переходити.

Отримати карту AI-можливостей →

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд
Детальний розбір ↓

TL;DR

  • Gemini 3.8 Flash – третя бюджетна модель Google за шість тижнів.
  • Модель досягає рівня Claude Opus 5 у агентних кодингових тестах.
  • Вартість за токен нижча, але споживає на 30 % більше токенів.
  • Запуск анонсу відбувся 2 вересня 2026 р.
  • Google позиціонує модель як рішення для малих і середніх компаній.

Як це змінить ваш ринок?

Для компаній у сфері медіа та контенту, які активно генерують тексти та коди, нова модель пропонує дешевший тариф за токен, що може знизити бар’єр входу в AI‑автоматизацію. Однак підвищене споживання токенів робить її менш привабливою для великих обсягів, змушуючи менеджерів переоцінювати бюджети на LLM‑сервіси.

Визначення: Токен — базова одиниця обчислення в мовних моделях, що відповідає частині слова або символу.

Для кого це і за яких умов

  • Малі компанії (10‑50 співробітників): MacBook 16 GB, без спеціальної IT‑команди, 15‑30 хв на тестовий запит, бюджет до $200 міс.
  • Середні компанії (50‑200 співробітників): сервер з GPU 24 GB або хмарний інстанс $0.5/год, IT‑спеціаліст, 1‑2 дні на інтеграцію, бюджет $1 k‑5 k міс.
  • Великі підприємства: потребують масштабної інфраструктури, оптимізації токен‑використання, спеціального моніторингу витрат.

Альтернативи

Продукт 1Продукт 2Продукт 3
Ціна$0.0006/токен (Claude Opus 5)$0.0005/токен (Gemini 3.8 Flash)$0.0008/токен (GPT‑4o)
Де працюєCloud AnthropicGoogle CloudOpenAI API
Мін. вимогиAPI‑ключGoogle Cloud аккаунтAPI‑ключ + OpenAI‑аккаунт
Ключова різницяВисока якість кодуНижча вартість за токен, але 30 % більше токенівНайкраща універсальність, найвища ціна

💬 Часті запитання

Залежить від типу запитів: при низькому споживанні токенів – до 15 % дешевше, при інтенсивному – може бути дорожче через 30 % надлишкових токенів.

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
Gemini3.8FlashGoogleLLMClaudeOpus5AIbenchmarking

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live