НейтральнаImpact 5/10🚀 Early Adoption👥 Від 10 людей📺 Медіа і Контент

Google представив нову модель Gemini 3.8 Flash: швидша, але потенційно дорожча

The Verge AIблизько 2 годин тому0 переглядів

Google запустив модель Gemini 3.8 Flash, яка виконує більше кроків міркування та інструментальний виклик. Це може збільшити витрати на API, що важливо для компаній, які активно використовують генеративний ШІ.

ВердиктНейтральнаImpact 5/10

⚠️ Підвищена вартість для активних користувачів, підходить компаніям до 200 людей, які готові протестувати нову модель, аби оцінити виправданість додаткових витрат.

Що це означає для вас

IT-команді

Порівняйте витрати Gemini 3.8 Flash з Gemini 3.7 Flash на типових запитах вашого продукту

🕐 Запустіть один типовий запит у Gemini 3.8 Flash та один у Gemini 3.7 Flash, підрахуйте використані токени (до 30 хв)

📊 З новини: $0.75 за мільйон вхідних токенів

🛠 Інструмент: Gemini 3.8 Flash

Пропустіть, якщо: якщо ваші запити вже оптимізовані під мінімальну кількість токенів

Перевірте, чи нова модель не підвищить ваші витрати на API, і вирішіть, чи варто переходити вже сьогодні.

Отримати карту AI-можливостей →

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд
Детальний розбір ↓

TL;DR

  • Gemini 3.8 Flash офіційно анонсовано 2 вересня 2026.
  • Модель підтримує контекст до 32 к токенів, що більше за 3.7.
  • Google радить підвищені рівні зусиль для складних завдань.
  • Перші користувачі повідомляють про 15 % збільшення споживання токенів.
  • Перехід на нову модель можливий без змін у тарифах, але без гарантії економії.

Як це змінить ваш ринок?

Для компаній, що активно генерують контент або автоматизують підтримку, збільшена продуктивність Gemini 3.8 Flash відкриває можливість вирішувати складніші запити без додаткових інженерних змін. Однак підвищене споживання токенів підвищує операційні витрати, що особливо критично для стартапів та середніх компаній з обмеженим бюджетом на AI‑сервіси.

Визначення: токен — найменша одиниця тексту, яку обробляє LLM; вартість вимірюється за мільйон токенів.

Для кого це і за яких умов

  • Малі компанії (до 10 співробітників): можуть протестувати модель на обмеженій кількості запитів, використовуючи безкоштовний кредит Google Cloud.
  • Середні компанії (10‑200 співробітників): потрібен доступ до API, бюджет $500‑$1 000 на місяць, IT‑спеціаліст для моніторингу споживання.
  • Великі компанії: вимоги до GPU або хмарних ресурсів, команда Data Science, бюджет $5 000+.

Альтернативи

ЦінаДе працюєМін. вимогиКлючова різниця
Gemini 3.8 Flash$0.75/млн вхідних, $3.75/млн вихіднихGoogle CloudAPI‑ключБільше кроків міркування, ітеративний інструментальний виклик
Claude 2$1.00/млн вхідних, $4.00/млн вихіднихAnthropicAPI‑ключСтабільна ціна, менша гнучкість у інструментах
GPT‑4o$1.20/млн вхідних, $5.00/млн вихіднихOpenAIAPI‑ключНайвища якість, найвища вартість

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
Gemini3.8FlashGoogleAILLMpricingtokenusagegenerativeAI

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live