Модели Gemini 3.6 Flash (gemini-3.6-flash) и Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) общедоступны и готовы к использованию в рабочих целях.
- Gemini 3.6 Flash: более высокая производительность при выполнении сложных задач, требующих использования агентов и нескольких способов взаимодействия, при меньшем количестве токенов и более низкой цене, чем у 3.5 Flash.
- Gemini 3.5 Flash-Lite – самая быстрая и недорогая модель в семействе 3.5. Превосходит предыдущие поколения Flash-Lite по скорости выполнения задач.
В этом руководстве рассказывается о том, что нового в каждой модели, какие изменения в API повлияют на ваш код и как выполнить переход.
Gemini 3.6 Flash
Установите навык:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalКак применить навык
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Установите навык:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalКак применить навык
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Новые модели
| Модель | Идентификатор модели | Уровень рассуждений по умолчанию | Цены | Описание |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
1,50 долл. США за 1 млн входных токенов и 7,50 долл. США за 1 млн выходных токенов. | Сочетает скорость и интеллектуальные возможности для выполнения задач агента и мультимодальных задач. |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
0,30 долл. США за 1 млн входных токенов и 2,50 долл. США за 1 млн выходных токенов. | Самая быстрая и недорогая модель 3.5 для выполнения большого количества задач. |
Обе модели поддерживают окно контекста на 1 млн токенов, максимальное количество выходных токенов – 64 000, рассуждения и полный набор встроенных инструментов, включая использование компьютера.
Полные характеристики приведены на страницах моделей:
Подробную информацию о ценах можно найти на странице цен.
Краткое руководство
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Что нового в Gemini 3.6 Flash
- Сокращение количества токенов и шагов. Выполняет многоэтапные рабочие процессы с меньшим количеством шагов рассуждения, диалогов и вызовов инструментов, чем Gemini 3.5. Это также позволяет избежать зацикливания.
- Улучшенная генерация кода. Создает более качественный код, готовый к использованию, с меньшим количеством ненужных изменений и циклов отладки.
- Более точное следование инструкциям. Уменьшает количество нежелательных изменений файлов во время диагностических задач.
- Улучшенное мультимодальное и пространственное мышление. Улучшена интерпретация диаграмм, преобразование визуальных чертежей и создание многоэлементных макетов веб-страниц.
- Программная проверка на начальном этапе. Чаще, чем Gemini 3.5 Flash, предпочитает выполнять диагностические скрипты до внесения изменений. Это повышает точность при выполнении сложных задач, но может привести к дополнительным исследовательским шагам при выполнении рутинных задач на интерфейсе.
- Поддержка использования компьютера. Поддерживается как встроенный инструмент для автоматизации интерфейса агента.
- Предпочтения в отношении стиля интерфейса. Модель лучше создает функциональный код, хотя люди-оценщики предпочитали более ранние модели для визуального макета и стиля. Чтобы этого избежать, предоставьте четкие инструкции по дизайну.
- Уровень мышления по умолчанию (средний). Используется тот же уровень мышления по умолчанию
medium, что и в Gemini 3.5 Flash. - Сниженная цена. Стоимость выходных токенов ниже, чем у 3.5 Flash (7,50 долл. США за 1 млн токенов против 9,00 долл. США за 1 млн токенов). Стоимость входных токенов останется прежней – 1,50 долл.США за 1 млн.
Что нового в Gemini 3.5 Flash-Lite
- Сокращенная задержка выполнения задач. Самая высокая пропускная способность в семействе 3.5 для обработки больших объемов данных и извлечения документов.
- Улучшенное рассуждение и мультимодальная производительность. Улучшенная версия Gemini 2.5 Flash с более высокими оценками в задачах на рассуждение, таких как HLE (18,0% против 11,0%), и мультимодальных тестах, таких как CharXIV (74,5% против 63,7%).
- Оркестрация суб-агентов и надежность инструментов. Повышена надежность выполнения инструментов для выполнения кода, поиска и рабочих процессов MCP. Повысьте уровень мышления для автономного планирования и сложных задач для вспомогательных агентов.
- Улучшенное понимание документов. Повышена точность при анализе документов и извлечении структурированных данных. Экспериментируйте с минимальным и высоким уровнями мышления в зависимости от сложности документа.
- Интерактивное веб-программирование и обработка табличных данных. Модель хорошо справляется с обработкой табличных данных и JavaScript на стороне клиента, планируя с помощью легковесного выполнения кода.
- Сохранение контекста чат-бота и его личности. Более точное следование инструкциям в многошаговых запросах и сохранение личности чат-бота по сравнению с Gemini 3.1 Flash-Lite.
- Поддержка использования компьютера. Поддерживается как встроенный инструмент для автоматизации интерфейса агента.
Как выбрать подходящую модель Flash или Flash-Lite
Используйте эту таблицу, чтобы выбрать подходящую модель и путь переноса для ваших рабочих нагрузок.
Обе модели требуют удаления устаревших параметров выборки (temperature, top_p, top_k) и готовых реплик модели. Подробнее об изменениях в API…
| Модель | Основные примеры использования | Рекомендуемый целевой продукт для переноса |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
Генерация кода, пространственное/мультимодальное рассуждение, многоэтапные рабочие процессы агентов | Gemini 3.5 Flash, Gemini 3 Flash (предварительная версия) или Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
Автономное выполнение вспомогательных агентов, анализ больших объемов данных и извлечение документов, структурированный анализ JSON | Gemini 3.1 Flash-Lite или Gemini 2.5 Flash |
Поддержка агента Antigravity
В Gemini 3.6 Flash добавлена поддержка агента Antigravity в управляемых агентах Gemini.
Примеры кода и последнюю конфигурацию агента по умолчанию можно найти в руководстве по агенту Antigravity и руководстве по Gemini 3.8 Flash.
Изменения в API и параметрах
Начиная с Gemini 3.6 Flash и Gemini 3.5 Flash-Lite, следующие изменения API применяются к этим моделям и всем будущим выпускам моделей Gemini.
- Прекращение поддержки параметров выборки. Параметры
temperature,top_pиtop_kбольше не поддерживаются. API игнорирует эти параметры и возвращает ошибку в будущих поколениях моделей. - Проверка готовых реплик модели. Готовые реплики модели больше не поддерживаются. Если последний непустой ход в запросе – это ход
model, API возвращает ошибку400.
В следующих разделах приведены подробные объяснения и примеры кода для каждого изменения API.
1. Прекращение поддержки параметров выборки (temperature, top_p, top_k)
temperature, top_p и top_k устарели и игнорируются. В будущих поколениях моделей передача этих параметров будет приводить к ошибке HTTP 400. Удалите эти параметры из всех запросов.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
Чтобы повысить детерминированность, задайте системную инструкцию с четкими правилами для вашего варианта использования.
2. Проверка готовой реплики модели
Запросы к API, заканчивающиеся непустым ходом с ролью модели, запрещены и возвращают ошибку HTTP 400.
⚠️ Исключить
В устаревших полезных нагрузках generateContent или необработанных полезных нагрузках REST теперь запрещено завершать разговор ролью модели:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ Рекомендуемый вариант перехода (Interactions API)
В API взаимодействий ответы модели не заполняются заранее вручную. Если ваше приложение ранее заполняло ход модели, чтобы подавить преамбулы или принудительно использовать формат JSON, вместо этого используйте system_instruction или структурированные выходные данные.
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
Контрольный список для переноса
Gemini 3.6 Flash
Установите навык:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalКак применить навык
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Установите навык:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalКак применить навык
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Переход на gemini-3.6-flash
- Изменить идентификатор модели: измените целевую строку модели на
gemini-3.6-flash. - Примените изменения параметров. Удалите устаревшие параметры выборки (
temperature,top_p,top_k), параметрcandidate_count(не поддерживается в Gemini 3 и более поздних версиях) и предварительно заполненные ходы модели, как описано в разделе Изменения API и параметров. - Настройте уровень мышления. Замените
thinking_budgetнаthinking_level("medium"или"high"). - Аудит вызовов функций:
- Размещайте мультимодальные объекты в полезной нагрузке ответа.
- Форматируйте встроенные инструкции с помощью тега
\n\n. - Если вы видите ошибки
Malformed_Function_Call, связанные с текстом до инструмента, ознакомьтесь с решениями для требований к тексту до инструмента.
- Базовые требования Gemini 3.x. Чтобы узнать, как обновить SDK и сохранить подпись рассуждений, ознакомьтесь с контрольным списком для перехода на Gemini 3.5.
Переход на gemini-3.5-flash-lite
- Изменить идентификатор модели: измените целевую строку модели на
gemini-3.5-flash-lite. - Как настроить уровень сложности
- Для извлечения, маршрутизации или классификации большого объема данных оставьте значение
thinking_levelна уровне"minimal"(по умолчанию), чтобы обеспечить максимальную пропускную способность. - Для автономных вспомогательных агентов с вызовами инструментов, выполнением кода или многоэтапными рассуждениями задайте для параметра
thinking_levelзначение"medium"или"high", чтобы предотвратить преждевременное завершение работы инструмента.
- Для извлечения, маршрутизации или классификации большого объема данных оставьте значение
- Удаление устаревших параметров и проверка вызова функций. Применяются те же правила, что и для Flash 3.6.
- Базовые требования Gemini 3.x. См. контрольный список перехода на Gemini 3.5.
Дальнейшие действия
- Ознакомьтесь со спецификациями API в обзоре моделей.
- Подробнее об оркестрации нескольких агентов рассказывается в руководстве по Interactions API.
- Протестируйте и улучшите запросы в Google AI Studio.