Gemini 3.8 Flash: третій Flash за шість тижнів — розумніший за 3.7 за тією ж ціною
Gemini 3.8 Flash: 1M контекст, $0,75/$3,75, повна мультимодальність, HLE-Verified 54,9%.

Google DeepMind випустила Gemini 3.8 — свій «найрозумніший» робочий кінь: значний стрибок від 3.7 Flash у software engineering, агентних задачах і багатокроковому reasoning — за тією ж ціною $0,75/$3,75 за мільйон токенів. Це вже третій Flash-реліз за шість тижнів.
Що це таке
Gemini 3.8 вийшла 2 вересня у двох варіантах: 3.8 Flash — загальнодоступна «робоча» модель, і 3.8 Flash Cyber — спеціалізована кіберзахисна версія для перевірених захисників через програму Fairwind. Обидві побудовані на одному фундаменті; частина приросту в кодінгу — наслідок тренувань у вимогливій кібер-домені.
- Контекст: 1 048 576 токенів, до 65K на відповідь.
- Модальності: текст + зображення + файли + аудіо + відео → текст — повний мультимодальний вхід у класі Flash.
- Reasoning: обовʼязковий, рівні high/medium/low (за замовчуванням medium); нижчі рівні — менше токенів, вище — ретельніші міркування.
- Ціна: $0,75/M вхід, $3,75/M вихід; кеш-читання — $0,075/M. Веб-пошук — ~1,4¢ за запит.
Що вміє
Головна фраза Google: «3.8 Flash працює старанніше» — на складних задачах модель виконує більше reasoning-кроків і ітеративно викликає інструменти. Вимірювані результати:
- DeepSWE v1.1 (long-horizon SWE): обійшла більшість більших фронтірних моделей автономного розв'язання інженерних задач — за частку їхньої ціни.
- HLE-Verified: 54,9% — багатокроковий reasoning у STEM, гуманітарних і професійних полях.
- Vals Finance Agent V2 і Harvey Legal Agent Benchmark: перевершує 3.7 Flash та інші фронтірні моделі в фінансі й праві.
- Coding-індекс Artificial Analysis: 76,3 — за $0,75/$3,75 (для порівняння: у GPT-6 Astra — 76,9 за $10/$50).
- Design Arena: топ-8 у 4 із 6 категорій — uicomponent (#5), gamedev (#7), website (#7), codecategories (#8).
Із 3.7 Flash Google збирається не знімати: вона залишається для «efficiency-first» навантажень, де кожен токен на рахунку.
Cyber-версія: захисникам — ширший набір
Gemini 3.8 Flash Cyber — фронтірний рівень у пошуку вразливостей і автоматичному патчингу, доступний через Fairwind Program (держави, критична інфраструктура, мейнтейнери ПЗ). Результати:
- CyberGym: фронтірний рівень автономного виявлення вразливостей; у внутрішньому бенчмарку на 20 мовах програмування — успішність понад 70%.
- CWE-Bench (патчинг): pass@1 47,2% проти 47,8% у «провідної фронтірної моделі» — на суттєво нижчій вартості. Тобто на межі Парето якість/ціна.
- Chrome Security: 2,6x більше правильних патчів, ніж у найкращих комерційних (значно більших) моделей.
- Wiz: +7,5–9,7% recall на внутрішньому pentest-бенчмарку при 2,3–5,2x меншій вартості.
- Cloud Vulnerability Research: критичну фундаментальну вразливість знайдено менше ніж за 2 години — замість місяців.
Обидві версії мають захисти від CBRN- та кібер-офензивного зловживань за Frontier Safety Framework; у 3.8 Flash — значний стрибок стійкості до prompt-інʼєкцій (оцінка Gray Swan).
Ціни і кому потрібна
Gemini 3.8 Flash доступна в Gemini API (AI Studio), Google Antigravity, Android Studio, Gemini Enterprise, а звичайним користувачам — у застосунку Gemini, AI Mode в Пошуку та Google Sheets (підписки Pro/Ultra). На OpenRouter — google/gemini-3.8-flash за $0,75/$3,75.
- Найкращий вибір для мультимодальних пайплайнів «транскрипція + відео + документи» в одному запиті — повний мультимодальний вхід у Flash-ціні.
- Кодінг і агентні задачі — 76,3 у coding-індексі AA за ціну в 13 разів нижчу за Astra. Для продакшн-цепів це найкраще співвідношення ціна/якість серед поточних Flash-моделей.
- Кому замало: якщо потрібен максимум у математиці/науці або довгі автономні агентні цикли — дивіться на флагмани (GPT-6 Astra, Claude Fable).
Щотижневий дайджест — у вашій пошті
Один лист на тиждень: головне зі світу AI українською. Без спаму, відписка одним кліком.



