ПозитивнаImpact 4/10✅ Production-Ready👤 Для всіх📺 Медіа і Контент📊 Маркетинг і Реклама

Відпуск llm-gemini 0.34

Simon Willisonблизько 2 годин тому0 переглядів

Випущено версію llm-gemini 0.34 з новою моделлю gemini-3.8-flash, яка пропонує три рівні «мислення» (низький, середній, високий). Це дозволяє компаніям вибирати баланс між швидкістю та якістю генерації тексту залежно від задач.

ВердиктПозитивнаImpact 4/10

💡 Гнучка якість. Для команд, які потребують контролю швидкості та точності генерації тексту.

🎯 Чи підходить це вашому бізнесу?

Заповніть профіль компанії — і ми автоматично покажемо, чи варто вам це впроваджувати.

Заповнити профіль · 30 секунд
Детальний розбір ↓

TL;DR

  • Випущено llm-gemini 0.34 з новою моделлю gemini-3.8-flash
  • Модель має три рівні «мислення»: низький, середній, високий
  • Виправлено помилку з async-відповідями, що не записували версію моделі
  • Доступна через Google Gemini API
  • Ліцензія: пропрієтарна, вимагає ключа доступу

Як це змінить ваш ринок?

Поява гнучких рівнів «мислення» у моделях Gemini дозволяє компаніям оптимізувати витрати на генерацію тексту, не жертвуючи якістю там, де це критично. Наприклад, маркетингові команди можуть використовувати низький рівень для швидкого створення варіантів заголовків, а юридичний відділ — високий рівень для аналізу складних договорів. Це зменшує залежність від одного постачальника AI та дає можливість краще налаштовувати роботу під конкретні SLA, що особливо цінно для середніх бізнесів з обмеженими бюджетами на AI.

Визначення: Gemini 3.8 Flash — це варіант сімейства великих мовних моделей Google, оптимізований для швидкого виводу з можливістю вибирати глибину розсуду через параметр «thinking level».

Для кого це і за яких умов (ОБОВ'ЯЗКОВО: мін. обладнання/бюджет, потрібна команда чи ні, мін. масштаб, час на впровадження.)

  • Мінімальне обладнання: доступ до інтернету та можливість робити HTTP-запити до API Gemini.
  • Бюджет: вартість залежить від об’єму токенів та обраного рівня «мислення»; орієнтовно $0.0005–$0.002 за 1K токенів.
  • Потрібна команда: хоча б один розробник з досвідом роботи з REST API (можна навчити за 4–6 годин).
  • Мінімальний масштаб: корисно вже з одного користувача, але ефект зростає при регулярному використанні (від 10K токенів/день).
  • Час на впровадження: налаштування ключа, тестовий запит та інтеграція в існуючий процес — від 2 до 8 годин.

Альтернативи

ПродуктЦіна (за 1M токенів)Де працюєМін. вимогиКлючова різниця
Gemini 3.8 Flash (low)$0.0005Google Gemini APIІнтернет, API-ключНайнижча вартість, швидка відповідь
Gemini 3.8 Flash (high)$0.002Google Gemini APIІнтернет, API-ключНайвища якість розсуду, повільніше
GPT-4o mini$0.0006OpenAI APIІнтернет, API-ключПорівнянна вартість, але без явних рівнів «мислення»
Claude 3 Haiku$0.0008Anthropic APIІнтернет, API-ключШвидка, але менш гнучка у контролю розсуду
Llama 3 8B (локально)безкоштовно (власне залізо)Власний серверGPU 16GB+Повна контроль над даними, потребує адміністрування

💬 Часті запитання

Почніть із середнього рівня як балансу швидкості та якості. Якщо виявлено, що відповіді зbyt поверхневі — перейдіть до високого; якщо надто повільно та дорого — знизьте до низького.

Такий розбір щоранку о 08:00

Персональний AI-дайджест для вашої галузі — щодня у Telegram

7 днів безкоштовно
llmgeminiAImodelrelease

Навчіть вашу команду будувати такі AI-автоматизації

За 5 днів кожен співробітник побудує автоматизацію для своєї ділянки роботи.

Дізнатись більше → aiupskill.live