GPT, Claude, Gemini — все модели через единый API. Работает в России без VPN.Начать бесплатно

Gemini 3.6 Flash обходит прошлогодний флагман Google на кодинге

Gemini 3.6 FlashGoogle DeepMindDeepSWEMLE-BenchOSWorld-VerifiedАгентный AIComputer use

Новая рабочая модель Google стоит дешевле своей предшественницы и на нескольких агентных бенчмарках опережает Gemini 3.1 Pro, флагман, который до сих пор стоит в разы дороже.

Gemini 3.6 Flash — обзор новой рабочей модели Google DeepMind, цены на API и тесты производительности

21 июля 2026 года Google выпустила Gemini 3.6 Flash, новую рабочую модель для агентов, кодинга и офисных задач. Цена ниже, чем у предыдущего Flash, а на части бенчмарков модель обгоняет не только своего предшественника, но и куда более дорогой прошлогодний флагман Gemini 3.1 Pro.

Возьмём один пример. На тесте программирования DeepSWE у Gemini 3.6 Flash 49 баллов из 100. У предыдущей модели, Gemini 3.5 Flash, было 37. А у флагмана прошлого года, Gemini 3.1 Pro, всего 12. Дорогая модель отстаёт от дешёвой в четыре раза.

Разберём, откуда взялся этот разрыв, куда делась экономия токенов и что Google предпочла не выпускать вместе с этой моделью.

Три модели в один день и одна модель, которую отложили

Google выпустила не одну модель, а сразу три. Кроме Gemini 3.6 Flash в тот же день вышли Gemini 3.5 Flash-Lite, самая быстрая модель в линейке 3.5 со скоростью 350 токенов в секунду и ценой $0.30/$2.50 за 1M токенов, и Gemini 3.5 Flash Cyber, модель для поиска и закрытия уязвимостей внутри системы CodeMender. Доступ к Cyber ограничен правительствами и доверенными партнёрами — Google называет это пилотной программой с контролируемым доступом.

Флагмана Gemini 3.5 Pro в этом релизе нет. По данным DataNorth AI, модель не дотянула до внутренних требований компании по кодингу и сложным рассуждениям, поэтому её широкий релиз отложили. Google при этом подтвердила, что уже запустила самый масштабный претрейнинг за свою историю — на этот раз для Gemini 4.

Получилась не совсем обычная ситуация для индустрии: вместо новой версии флагмана компания выкатила обновление рабочей лошадки, и именно она стала главной новостью месяца.

Где Flash обходит прошлогодний Pro

Google строит презентацию вокруг четырёх бенчмарков и сравнивает на них сразу три модели: старый флагман Gemini 3.1 Pro, прошлый Flash и новый Gemini 3.6 Flash. Вот как это выглядит по каждому тесту.

  • DeepSWE v1.1 (программирование в агентных сессиях): 12% у Gemini 3.1 Pro, 37% у Gemini 3.5 Flash, 49% у Gemini 3.6 Flash.
  • MLE-Bench (задачи машинного обучения): 42.6%, 49.7%, 63.9%.
  • GDPval-AA v2 (офисная работа, баллы): 965, 1349, 1421.
  • OSWorld-Verified (управление рабочим столом): 76.2%, 78.4%, 83.0%.
Gemini 3.6 Flash обходит Gemini 3.1 Pro и 3.5 Flash на бенчмарках DeepSWE, MLE-Bench, GDPval-AA v2 и OSWorld-Verified
Сравнение Gemini 3.1 Pro, 3.5 Flash и 3.6 Flash по четырём бенчмаркам. Источник: Google DeepMind.

На всех четырёх строчках порядок один и тот же: новый Flash впереди, старый Flash посередине, прошлогодний Pro в конце. На DeepSWE разрыв между Pro и новым Flash получился четырёхкратным.

Есть и другие цифры, которые Google не вынесла на главный график, но упомянула в материалах релиза. На SWE-Bench Pro результат выше на пару пунктов, 58.7% против 55.1%. На Terminal-Bench 2.1 — 78.0% против 76.2%. А на тесте длинного контекста GDM-MRCR v2, где модель ищет нужный фрагмент в миллионе токенов, результат 54.0% — вдвое больше обеих предыдущих моделей на той же глубине.

Есть и сводный балл — индекс интеллекта Artificial Analysis, 50 пунктов. Само число не выглядит рекордным, но оно достигнуто при цене $7.50 за 1M выходных токенов, а не в разы дороже, как у флагманов.

Экономия токенов вместо роста цены

Главный тезис Google в анонсе не про интеллект, а про эффективность. В среднем по индексу Artificial Analysis модель расходует на 17% меньше выходных токенов, чем Gemini 3.5 Flash, на тех же задачах. На отдельных тестах, включая DeepSWE, экономия доходит до 65%. Причина простая: модели требуется меньше шагов рассуждения и меньше вызовов инструментов, чтобы дойти до финального ответа.

Google иллюстрирует эффект конкретным примером: в задаче на OSWorld-Verified модель показывает не только более высокий результат, но и заметно менее многословный ответ по сравнению с Gemini 3.5 Flash при том же запросе. Меньше токенов на выходе означает меньше циклов лишних правок кода и меньше повторных попыток там, где предыдущая модель зацикливалась.

Клиенты Hebbia и Harvey уже используют модель для мультимодальных задач — разбора документов, анализа графиков и таблиц, составления отчётов. Обе компании работают с большими объёмами документов, где экономия токенов на выходе конвертируется напрямую в счёт за инференс, а не остаётся абстрактной метрикой из презентации.

Контекст скорость и защита от джейлбрейков

Контекстное окно осталось на отметке 1 миллион токенов, лимит на выходе — 64 000. Модель принимает текст, изображения, видео, аудио и документы, знания обновлены до марта 2026 года — раньше у Gemini 3.5 Flash был январь 2025. По данным DataNorth AI, модель выдаёт около 280 токенов в секунду, что делает её одной из быстрых в своём классе для интерактивных сценариев.

Computer use теперь встроен как клиентский инструмент прямо в Gemini API и Gemini Enterprise, без отдельной настройки инфраструктуры под него. В день релиза модель стала доступна в GitHub Copilot — параллельно с анонсом, а не с задержкой в несколько недель, как это часто бывает у новых моделей.

Google усилила защиту Frontier Safety в двух направлениях — химическом, биологическом, радиологическом и ядерном риске (CBRN) и в киберугрозах. Модель стала устойчивее к джейлбрейкам, но при этом компания специально тренировала её реже отказывать в легитимных запросах — обычный компромисс между безопасностью и полезностью здесь решили не в пользу перестраховки.

Подключение Gemini 3.6 Flash из России без VPN

Google не принимает платежи из России и не даёт прямого доступа к Gemini API с российских IP-адресов. AITUNNEL открывает доступ к Gemini 3.6 Flash по OpenAI-совместимому API с оплатой в рублях и без обхода блокировок — 300 ₽ за 1M входных токенов и 1500 ₽ за 1M выходных.

Для перехода достаточно поменять base_url на https://api.aitunnel.ru/v1/ и указать модель gemini-3.6-flash. Остальной код — стриминг, вызов функций, работа с изображениями и документами — остаётся без изменений, потому что API совместим с OpenAI SDK.

Регистрация занимает пару минут, оплата проходит картой российского банка или по счёту для юрлиц. Курс и наценку к базовой цене $1.50/$7.50 за 1M токенов стоит проверять в калькуляторе на странице провайдера — условия могут обновляться.

Gemini 3.6 Flash

Новый workhorse Gemini
21 июля 2026Контекст: 1 000 000 токеновВывод: 64 000 токенов

Рабочая модель Google для агентных сценариев, кодинга и работы со знаниями. Построена на основе Gemini 3.5 Flash, но обрабатывает многошаговые задачи за меньшее число шагов и вызовов инструментов. Знания обновлены до марта 2026 года, входные данные — текст, изображения, аудио, видео и документы. Доступна через Gemini API, Google AI Studio, Android Studio, Google Antigravity и платформу Gemini Enterprise.

Ключевые преимущества

  • 49% на DeepSWE v1.1 против 37% у Gemini 3.5 Flash и 12% у флагманского Gemini 3.1 Pro
  • 63.9% на MLE-Bench против 49.7% у предшественника
  • 83.0% на OSWorld-Verified — лучший результат по работе с рабочим столом в линейке
  • 1421 балл на GDPval-AA v2 против 1349 у Gemini 3.5 Flash
  • На 17% меньше выходных токенов на задачу по индексу Artificial Analysis, на отдельных бенчмарках экономия доходит до 65%
  • Встроенный computer use как клиентский инструмент через Gemini API без дополнительной настройки

Подходит для

  • Агентное программирование и рефакторинг в многошаговых сессиях
  • Разбор финансовых документов, транскриптов и отчётов
  • Работа с рабочим столом и браузером через computer use
  • Высоконагруженные production-агенты, где счёт за токены имеет значение
Ввод / 1M300 ₽
Вывод / 1M1500 ₽
Подробнее о модели

Итог

Gemini 3.6 Flash показывает то, что на рынке моделей случается редко: рабочая версия обгоняет флагмана из той же линейки, выпущенного годом раньше. 49% на DeepSWE против 12% у Gemini 3.1 Pro, 17% экономии токенов на типовых задачах и цена $1.50/$7.50 за 1M токенов делают модель практичным выбором для агентов, которые считают не пиковый балл на одном тесте, а суммарный счёт за тысячи запросов в день. Флагмана Gemini 3.5 Pro Google так и не выпустила, сославшись на недостаточное качество на кодинге, а вместо него анонсировала старт претрейнинга Gemini 4. Для команд, которым нужна рабочая модель здесь и сейчас, а не обещание будущего флагмана, Gemini 3.6 Flash — сильный вариант уже сегодня.

Часто задаваемые вопросы

Чем Gemini 3.6 Flash отличается от Gemini 3.5 Flash

Gemini 3.6 Flash показывает выше результаты на всех ключевых бенчмарках, включая программирование, работу с данными и управление рабочим столом, и при этом расходует на 17% меньше выходных токенов на типовых задачах. Цена ниже, а знания обновлены до марта 2026 года вместо января 2025.

Сколько стоит Gemini 3.6 Flash в API

$1.50 за 1M входных токенов и $7.50 за 1M выходных через Gemini API. Выходная цена ниже, чем у Gemini 3.5 Flash, где она составляла $9.00 за 1M токенов. На AITUNNEL модель доступна по цене 300 рублей за 1M входных токенов и 1500 рублей за 1M выходных.

Правда ли что Gemini 3.6 Flash обгоняет Gemini 3.1 Pro

На четырёх бенчмарках из собственной презентации Google да: программирование, машинное обучение, офисная работа и управление рабочим столом. Разрыв везде в пользу дешёвой модели, местами в несколько раз. Это сравнение по конкретным опубликованным тестам, а не заявление о превосходстве во всех задачах без исключения.

Что случилось с Gemini 3.5 Pro

Google не выпустила модель в этом релизе. По данным DataNorth AI, Gemini 3.5 Pro не показала ожидаемого качества на кодинге и сложных рассуждениях, поэтому широкий релиз отложили. Компания подтвердила, что параллельно уже начала претрейнинг Gemini 4.

Как подключить Gemini 3.6 Flash из России без VPN

Через AITUNNEL: зарегистрируйтесь, пополните баланс в рублях, получите API-ключ и укажите base_url = "https://api.aitunnel.ru/v1/", модель — gemini-3.6-flash. Код на OpenAI SDK меняется на одну переменную, обхода блокировок не требуется.

Доступ к этому провайдеру через AITUNNEL

Все модели провайдера доступны через единый API. Работает из России без VPN, оплата в рублях.

Единый APIОплата картой РФБез VPN
Начать работуРегистрация за 1 минуту

Статьи по теме

ПопробоватьВсе модели