Что нового в Gemini 3.6 Flash и 3.5 Flash-Lite

Новейшая модель Другие модели

Модели Gemini 3.6 Flash (gemini-3.6-flash) и Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) общедоступны и готовы к использованию в рабочих целях.

  • Gemini 3.6 Flash: более высокая производительность при выполнении сложных задач, требующих использования агентов и нескольких способов взаимодействия, при меньшем количестве токенов и более низкой цене, чем у 3.5 Flash.
  • Gemini 3.5 Flash-Lite – самая быстрая и недорогая модель в семействе 3.5. Превосходит предыдущие поколения Flash-Lite по скорости выполнения задач.

В этом руководстве рассказывается о том, что нового в каждой модели, какие изменения в API повлияют на ваш код и как выполнить переход.

Gemini 3.6 Flash

  1. Установите навык:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Как применить навык

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Установите навык:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Как применить навык

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Новые модели

Модель Идентификатор модели Уровень рассуждений по умолчанию Цены Описание
Gemini 3.6 Flash gemini-3.6-flash medium 1,50 долл. США за 1 млн входных токенов и 7,50 долл. США за 1 млн выходных токенов. Сочетает скорость и интеллектуальные возможности для выполнения задач агента и мультимодальных задач.
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal 0,30 долл. США за 1 млн входных токенов и 2,50 долл. США за 1 млн выходных токенов. Самая быстрая и недорогая модель 3.5 для выполнения большого количества задач.

Обе модели поддерживают окно контекста на 1 млн токенов, максимальное количество выходных токенов – 64 000, рассуждения и полный набор встроенных инструментов, включая использование компьютера.

Полные характеристики приведены на страницах моделей:

Подробную информацию о ценах можно найти на странице цен.

Краткое руководство

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions"       -H "x-goog-api-key: $GEMINI_API_KEY"       -H 'Content-Type: application/json'       -X POST       -d '{
    "model": "gemini-3.6-flash",
    "input": "Write a three.js script that renders an interactive 3D robot."
  }'

Что нового в Gemini 3.6 Flash

  • Сокращение количества токенов и шагов. Выполняет многоэтапные рабочие процессы с меньшим количеством шагов рассуждения, диалогов и вызовов инструментов, чем Gemini 3.5. Это также позволяет избежать зацикливания.
  • Улучшенная генерация кода. Создает более качественный код, готовый к использованию, с меньшим количеством ненужных изменений и циклов отладки.
  • Более точное следование инструкциям. Уменьшает количество нежелательных изменений файлов во время диагностических задач.
  • Улучшенное мультимодальное и пространственное мышление. Улучшена интерпретация диаграмм, преобразование визуальных чертежей и создание многоэлементных макетов веб-страниц.
  • Программная проверка на начальном этапе. Чаще, чем Gemini 3.5 Flash, предпочитает выполнять диагностические скрипты до внесения изменений. Это повышает точность при выполнении сложных задач, но может привести к дополнительным исследовательским шагам при выполнении рутинных задач на интерфейсе.
  • Поддержка использования компьютера. Поддерживается как встроенный инструмент для автоматизации интерфейса агента.
  • Предпочтения в отношении стиля интерфейса. Модель лучше создает функциональный код, хотя люди-оценщики предпочитали более ранние модели для визуального макета и стиля. Чтобы этого избежать, предоставьте четкие инструкции по дизайну.
  • Уровень мышления по умолчанию (средний). Используется тот же уровень мышления по умолчанию medium, что и в Gemini 3.5 Flash.
  • Сниженная цена. Стоимость выходных токенов ниже, чем у 3.5 Flash (7,50 долл. США за 1 млн токенов против 9,00 долл. США за 1 млн токенов). Стоимость входных токенов останется прежней – 1,50 долл.США за 1 млн.

Что нового в Gemini 3.5 Flash-Lite

  • Сокращенная задержка выполнения задач. Самая высокая пропускная способность в семействе 3.5 для обработки больших объемов данных и извлечения документов.
  • Улучшенное рассуждение и мультимодальная производительность. Улучшенная версия Gemini 2.5 Flash с более высокими оценками в задачах на рассуждение, таких как HLE (18,0% против 11,0%), и мультимодальных тестах, таких как CharXIV (74,5% против 63,7%).
  • Оркестрация суб-агентов и надежность инструментов. Повышена надежность выполнения инструментов для выполнения кода, поиска и рабочих процессов MCP. Повысьте уровень мышления для автономного планирования и сложных задач для вспомогательных агентов.
  • Улучшенное понимание документов. Повышена точность при анализе документов и извлечении структурированных данных. Экспериментируйте с минимальным и высоким уровнями мышления в зависимости от сложности документа.
  • Интерактивное веб-программирование и обработка табличных данных. Модель хорошо справляется с обработкой табличных данных и JavaScript на стороне клиента, планируя с помощью легковесного выполнения кода.
  • Сохранение контекста чат-бота и его личности. Более точное следование инструкциям в многошаговых запросах и сохранение личности чат-бота по сравнению с Gemini 3.1 Flash-Lite.
  • Поддержка использования компьютера. Поддерживается как встроенный инструмент для автоматизации интерфейса агента.

Как выбрать подходящую модель Flash или Flash-Lite

Используйте эту таблицу, чтобы выбрать подходящую модель и путь переноса для ваших рабочих нагрузок.

Обе модели требуют удаления устаревших параметров выборки (temperature, top_p, top_k) и готовых реплик модели. Подробнее об изменениях в API…

Модель Основные примеры использования Рекомендуемый целевой продукт для переноса
Gemini 3.6 Flash
gemini-3.6-flash
Генерация кода, пространственное/мультимодальное рассуждение, многоэтапные рабочие процессы агентов Gemini 3.5 Flash, Gemini 3 Flash (предварительная версия) или Gemini 3.1 Pro
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Автономное выполнение вспомогательных агентов, анализ больших объемов данных и извлечение документов, структурированный анализ JSON Gemini 3.1 Flash-Lite или Gemini 2.5 Flash

Поддержка агента Antigravity

В Gemini 3.6 Flash добавлена поддержка агента Antigravity в управляемых агентах Gemini.

Примеры кода и последнюю конфигурацию агента по умолчанию можно найти в руководстве по агенту Antigravity и руководстве по Gemini 3.8 Flash.

Изменения в API и параметрах

Начиная с Gemini 3.6 Flash и Gemini 3.5 Flash-Lite, следующие изменения API применяются к этим моделям и всем будущим выпускам моделей Gemini.

  • Прекращение поддержки параметров выборки. Параметры temperature, top_p и top_k больше не поддерживаются. API игнорирует эти параметры и возвращает ошибку в будущих поколениях моделей.
  • Проверка готовых реплик модели. Готовые реплики модели больше не поддерживаются. Если последний непустой ход в запросе – это ход model, API возвращает ошибку 400.

В следующих разделах приведены подробные объяснения и примеры кода для каждого изменения API.

1. Прекращение поддержки параметров выборки (temperature, top_p, top_k)

temperature, top_p и top_k устарели и игнорируются. В будущих поколениях моделей передача этих параметров будет приводить к ошибке HTTP 400. Удалите эти параметры из всех запросов.

# ⚠️ Remove these parameters (deprecated)
generation_config = {
     "temperature": 0.7,
     "top_p": 0.9,
     "top_k": 40,
}

Чтобы повысить детерминированность, задайте системную инструкцию с четкими правилами для вашего варианта использования.

2. Проверка готовой реплики модели

Запросы к API, заканчивающиеся непустым ходом с ролью модели, запрещены и возвращают ошибку HTTP 400.

⚠️ Исключить

В устаревших полезных нагрузках generateContent или необработанных полезных нагрузках REST теперь запрещено завершать разговор ролью модели:

/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
  "contents": [
    {"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
    {"role": "model", "parts": [{"text": "Translation:"}]}  /* ❌ Returns error */
  ]
}

В API взаимодействий ответы модели не заполняются заранее вручную. Если ваше приложение ранее заполняло ход модели, чтобы подавить преамбулы или принудительно использовать формат JSON, вместо этого используйте system_instruction или структурированные выходные данные.

# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Translate 'Hello world' to Spanish.",
    system_instruction="Output only the translation without introductory text.",
)

Контрольный список для переноса

Gemini 3.6 Flash

  1. Установите навык:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Как применить навык

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Установите навык:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Как применить навык

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Переход на gemini-3.6-flash

  • Изменить идентификатор модели: измените целевую строку модели на gemini-3.6-flash.
  • Примените изменения параметров. Удалите устаревшие параметры выборки (temperature, top_p, top_k), параметр candidate_count (не поддерживается в Gemini 3 и более поздних версиях) и предварительно заполненные ходы модели, как описано в разделе Изменения API и параметров.
  • Настройте уровень мышления. Замените thinking_budget на thinking_level ("medium" или "high").
  • Аудит вызовов функций:
    • Размещайте мультимодальные объекты в полезной нагрузке ответа.
    • Форматируйте встроенные инструкции с помощью тега \n\n.
    • Если вы видите ошибки Malformed_Function_Call, связанные с текстом до инструмента, ознакомьтесь с решениями для требований к тексту до инструмента.
  • Базовые требования Gemini 3.x. Чтобы узнать, как обновить SDK и сохранить подпись рассуждений, ознакомьтесь с контрольным списком для перехода на Gemini 3.5.

Переход на gemini-3.5-flash-lite

  • Изменить идентификатор модели: измените целевую строку модели на gemini-3.5-flash-lite.
  • Как настроить уровень сложности
    • Для извлечения, маршрутизации или классификации большого объема данных оставьте значение thinking_level на уровне "minimal" (по умолчанию), чтобы обеспечить максимальную пропускную способность.
    • Для автономных вспомогательных агентов с вызовами инструментов, выполнением кода или многоэтапными рассуждениями задайте для параметра thinking_level значение "medium" или "high", чтобы предотвратить преждевременное завершение работы инструмента.
  • Удаление устаревших параметров и проверка вызова функций. Применяются те же правила, что и для Flash 3.6.
  • Базовые требования Gemini 3.x. См. контрольный список перехода на Gemini 3.5.

Дальнейшие действия