МоделиБизнес и рынок 🇷🇺 22.07.2026 14:02

Gemini 3.6 Flash не стала умнее, но работает вдвое быстрее

Google/DeepMindGoogle/DeepMind
Google выпустила Gemini 3.6 Flash, которая не показывает прироста в общем интеллекте, но выполняет задачи примерно вдвое быстрее за счёт более экономного рассуждения. Также анонсированы Gemini 3.5 Flash-Lite для массовых операций и Gemini 3.5 Flash Cyber для кибербезопасности.
21 июля Google выпустила сразу три модели: Gemini 3.6 Flash (стабильная версия), Gemini 3.5 Flash-Lite (для массовой обработки) и Gemini 3.5 Flash Cyber (для задач кибербезопасности). В независимом индексе Artificial Analysis новая Flash и предыдущая 3.5 набрали одинаковые 50 баллов, то есть общий уровень интеллекта не вырос. Однако время выполнения средней задачи сократилось с 2,7 минуты до 1,3 минуты, а стоимость задачи снизилась с $0,59 до $0,50. Ускорение достигается за счёт более экономного рассуждения: модель использует в среднем 23 тыс. выходных токенов вместо 28 тыс., а во внутренних тестах Google разрыв ещё больше (97 тыс. против 276 тыс.). Gemini 3.6 Flash поддерживает до 1 048 576 токенов контекста и выдаёт до 65 536 токенов, принимает текст, изображения, видео, аудио и PDF, но генерирует только текст. Параметры temperature, top_p и top_k для неё больше не влияют на ответ. Прежнюю Flash 2.5 планируют отключить 16 октября 2026 года. Flash-Lite стоит $0,30 за входной миллион токенов и $2,50 за выходной, имеет скорость до 350 токенов в секунду и набрала 36 баллов в индексе Artificial Analysis. Flash Cyber пока доступна только государственным органам и доверенным партнёрам. Google подчёркивает, что при создании интерфейсов иногда требуется давать более точные инструкции по дизайну.
Источник: Habr — хаб ИИ — оригинал

Наши прошлые публикации по теме

Есть свежие новости