← На главную

Google запустила мощный Gemini 3.6 Flash и самую быструю Flash-Lite

21.07.2026 21:27 · hackernews

Google выпустила две новые модели — Gemini 3.6 Flash и Gemini 3.5 Flash-Lite — и они уже доступны в продакшене. Gemini 3.6 Flash (модель gemini-3.6-flash) показывает более сильные результаты на сложных агентных и мультимодальных задачах, но при этом использует меньше токенов и стоит дешевле, чем 3.5 Flash. Его цена — $1.50 за миллион входных токенов и $7.50 за миллион выходных. Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) — самая быстрая и дешёвая модель в семействе, она обходит предыдущие поколения Flash-Lite по производительности. Стоит $0.30 за миллион входных токенов и $2.50 за миллион выходных.

Обе модели поддерживают контекстное окно в 1 миллион токенов, до 64 тысяч выходных токенов и полный набор встроенных инструментов, включая Computer Use.

У Gemini 3.6 Flash много улучшений. Он быстрее завершает многошаговые сценарии — делает меньше шагов рассуждений, диалоговых витков и вызовов инструментов. Он лучше генерирует код, реже делает лишние правки и тратит меньше времени на отладку. Модель точнее следует инструкциям и реже изменяет не те файлы. Она сильнее в мультимодальных и пространственных рассуждениях: лучше читает графики, преобразует визуальные чертежи и генерирует веб-макеты с несколькими элементами. Ещё модель предпочитает сначала запускать диагностические скрипты, а потом вносить изменения — это повышает точность на сложных задачах, но на простых может добавить лишних шагов. Качество UI-стилизации, правда, по мнению людей, стало хуже — это можно компенсировать явными дизайн-гайдами. Уровень размышлений по умолчанию — medium, как и у предшественника.

Gemini 3.5 Flash-Lite даёт самую низкую задержку в семействе, особенно на задачах вроде парсинга данных и извлечения документов. Он показывает сильные результаты на бенчмарках: HLE — 18.0% против 11.0% у предшественника, CharXIV — 74.5% против 63.7%. Модель надёжнее работает с инструментами (код, поиск, MCP) и лучше понимает документы. Для сложных автономных сценариев рекомендуется повышать уровень размышлений. Есть и улучшения в поддержке чат-ботов: модель лучше держит личность на протяжении нескольких витков диалога.

Важные новости и по API. Параметры temperature, top_p и top_k объявлены устаревшими — начиная с этих моделей API их игнорирует, а в будущих версиях начнёт возвращать ошибку 400. Вместо них нужно использовать system instruction или Structured Outputs. Также больше нельзя передавать в запросе завершающий ответ модели — API вернёт ошибку 400. Если раньше это использовалось для подавления преамбулы, теперь нужно применять system_instruction.

Из-за улучшений Gemini 3.6 Flash стал моделью по умолчанию для агента Antigravity в Gemini Managed Agents, но это можно переопределить в настройках API. Для автоматизации миграции Google предлагает использовать skills — можно установить их через npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global.

Читать оригинал →