Google’s Gemini 3.6 Flash зосереджується на зниженні витрат токенів для корпоративних агентів Зменшення витрат токенів для агентів підприємств за допомогою Google’s Gemini 3.6 Flash

Новий ривок від Google: запуск Gemini 3.6 Flash і 3.5 Flash-Lite для корпоративних AI-агентів

Світ технологій зазнає чергового витка розвитку, і у фокусі сьогодні Google. Компанія презентувала новітній Gemini 3.6 Flash та його легшу версію 3.5 Flash-Lite. Ці моделі покликані зменшити затримки та витрати на токени для корпоративних AI-агентів. У той час як ринок AI продовжує зростати, ефективність стає визначальним фактором для успіху.

Економіка AI: як заощадити на токенах

Автономні програмні агенти в умовах виробничого середовища стикаються з постійними викликами економії. Із кожним новим токеном, який вони генерують під час обробки задачі, ціна операцій зростає. І це не лише про кошти, але й про затримку у виконанні завдань, які можуть виконуватись тисячі разів на годину.

Обравши підхід з високою продуктивністю та зниженими параметрами, Google презентувала три нові моделі: Gemini 3.6 Flash для кодування та багатозадачності, Gemini 3.5 Flash-Lite для обробки великогабаритних завдань з низькою затримкою, і спеціалізовану модель Gemini 3.5 Flash Cyber для усунення вразливостей.

Технологічні переваги Gemini 3.6 Flash

У офіційній документації до 3.6 Flash Google наголошує на важливості збереження вихідних токенів — на 17% менше, ніж у попередньої версії 3.5 Flash. На синтетичних тестах, як-от Datacurve DeepSWE, показники зниження використання токенів досягають вражаючих 65%. Що це означає для користувачів? Більше швидкості, менше витрат.

Тестування на DeepSWE показало 49% успішності для 3.6 Flash, у порівнянні з 37% для попередньої версії. Інші показники також підтверджують перевагу нового продукту: на MLE Bench показник зріс з 49.7% до 63.9%, а на Google’s GDPval-AA v2 — 1421 проти 1349.

Практичне застосування: Figma, Hebbia і Harvey

Компанії швидко інтегрують нові технології у свою роботу. Figma вже впровадила 3.6 Flash до свого інфраструктурного прототипування, що значно прискорює процес ітерацій дизайну без втрати якості. З іншого боку, юридична платформа Harvey та дослідницький інструмент Hebbia використовують модель для багатозадачної роботи з документами.

Додатково до цього, Google інтегрувала інструмент роботи із комп’ютером на клієнтській стороні безпосередньо в платформи Gemini API та Gemini Enterprise, усунувши необхідність використання додаткового програмного забезпечення.

Бюджетний варіант для потужних фонових агентів: Gemini 3.5 Flash-Lite

Зацікавлені у високій продуктивності? Gemini 3.5 Flash-Lite може бути саме тим, що вам потрібно. Ця модель призначена для обробки документації та агентських пошуків великого об’єму з невеликими витратами: 350 вихідних токенів за секунду, вартість від $0.3 за 1M вхідних токенів, $2.5 за 1M вихідних.

На довготривалому тесті Google GDM-MRCR v2 Gemini 3.5 Flash-Lite показала успіх у 72.2% проти 60.1% у попередньої версії. Новий інструмент комп’ютерного використання працює так само ефективно, як і в 3.6 Flash.

Google також анонсує, що Gemini 3.5 Pro знаходиться на стадії партнерського тестування, а передпідготовка до архітектури Gemini 4 вже розпочалася.

Gemini 3.5 Flash Cyber: безпека коду на новому рівні

Захист ваших даних – це пріоритет для Google. Модель Gemini 3.5 Flash Cyber орієнтована на виявлення та виправлення вразливостей коду, ефективність якого підтверджують результати на тесті CyberGym.

Дистрибуція залишається обмеженою для урядів та перевірених партнерів у рамках пілотної програми, що забезпечує контроль над використанням моделі в захисних цілях. У середовищі CodeMender в агенті безпеки від Google одночасно працюють кілька екземплярів 3.5 Flash Cyber, перевіряючи один одного перед видачею єдиного звіту на розгляд людини.

Команди інженерів вже можуть інтегрувати нові моделі через Gemini API зі студій Google AI, Android або платформу Gemini Enterprise Agent. Окрім того, вони доступні й у додатку Gemini, а 3.5 Flash-Lite поступово з’являється і в Google Search.