Вспышки Gemini 3.6 Flash ( gemini-3.6-flash ) и Gemini 3.5 Flash-Lite ( gemini-3.5-flash-lite ) общедоступны (GA) и готовы к использованию в производстве.
- Gemini 3.6 Flash : Более высокая производительность при решении сложных агентных и мультимодальных задач при одновременном снижении расхода токенов по более низкой цене, чем 3.5 Flash.
- Gemini 3.5 Flash-Lite : Самая быстрая и недорогая модель в семействе 3.5. Превосходит предыдущие поколения Flash-Lite по производительности при выполнении задач с высокой пропускной способностью.
В этом руководстве объясняется, что нового в каждой модели, какие изменения API влияют на ваш код и как выполнить миграцию.
Вспышка Gemini 3.6
Установите навык:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalПримените навык:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Фонарь Gemini 3.5 Flash-Lite
Установите навык:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalПримените навык:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Новые модели
| Модель | Идентификатор модели | Уровень мышления по умолчанию | Цены | Описание |
|---|---|---|---|---|
| Вспышка Gemini 3.6 | gemini-3.6-flash | medium | Входные токены номиналом 1,50 долл. США/1 млн. долларов США и выходные токены номиналом 7,50 долл. США/1 млн. долларов США. | Обеспечивает баланс между скоростью и интеллектом для выполнения задач, требующих активного участия и мультимодального взаимодействия. |
| Фонарь Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite | minimal | Входные токены: $0,30/1 млн, выходные токены: $2,50/1 млн. | Самая быстрая и экономичная модель 3.5 для высокопроизводительного выполнения. |
Обе модели поддерживают контекстное окно с 1 миллионом токенов, максимальное количество выходных токенов — 64 тысячи, функцию мышления и полный набор встроенных инструментов, включая использование компьютера .
Полные технические характеристики см. на страницах моделей:
Подробную информацию о ценах смотрите на странице с ценами .
Быстрый старт
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
ОТДЫХ
curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"model": "gemini-3.6-flash",
"input": {
"parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
}
}'
Что нового в Gemini 3.6 Flash?
- Сокращение количества токенов и ходов: Завершает многоэтапные рабочие процессы с меньшим количеством этапов рассуждений, ходов диалога и вызовов инструментов, чем Gemini 3.5. Также уменьшает зацикливание выполнения.
- Улучшенная генерация кода: создает более качественный, готовый к использованию в производстве код с меньшим количеством нежелательных правок и меньшим количеством циклов отладки.
- Улучшенное следование инструкциям : уменьшает количество нежелательных изменений файлов во время диагностических задач.
- Уверенное многомодальное и пространственное мышление: улучшена производительность при интерпретации диаграмм, преобразовании визуальных схем и генерации многоэлементных веб-макетов.
- Предварительная программная проверка: Предпочтительнее запускать диагностические скрипты перед внесением изменений чаще, чем в Gemini 3.5 Flash. Это повышает точность при выполнении сложных задач, но может добавить дополнительные этапы исследования при работе с простым интерфейсом.
- Поддержка использования компьютера: Поддерживается как встроенный инструмент для автоматизации пользовательского интерфейса агента.
- Предпочтения в стилизации пользовательского интерфейса : Лучше подходит для создания функционального кода, хотя эксперты-люди предпочитали более ранние модели с точки зрения визуального оформления и стиля. Это можно компенсировать, предоставив четкие рекомендации по дизайну.
- Уровень мыслительной нагрузки по умолчанию (средний): Используется тот же
mediumуровень мыслительной нагрузки по умолчанию, что и в Gemini 3.5 Flash. - Сниженная цена : уменьшена стоимость выходных токенов (7,50 долл. США/1 млн против 9,00 долл. США/1 млн для 3,5 Flash). Стоимость входных токенов остается на уровне 1,50 долл. США/1 млн.
Что нового в фонарике Gemini 3.5 Flash-Lite?
- Сниженная задержка выполнения задач: максимальная пропускная способность в семействе 3.5 для обработки больших объемов данных и извлечения документов.
- Улучшенная производительность в задачах логического мышления и мультимодальных тестах: Уверенный переход с Gemini 2.5 Flash, с более высокими показателями в задачах логического мышления, таких как HLE (18,0% против 11,0%), и в мультимодальных бенчмарках, таких как CharXIV (74,5% против 63,7%).
- Оркестрация субагентов и надежность инструментов: повышает надежность выполнения инструментов для выполнения кода, поиска и рабочих процессов MCP. Повышает уровень мышления для автономного планирования и сложных задач субагентов.
- Улучшенное понимание документа: повышает точность анализа документов и извлечения структурированных данных. Можно экспериментировать как с минимальным, так и с высоким уровнем сложности в зависимости от сложности документа.
- Интерактивное веб-программирование и обработка табличных данных: демонстрирует высокую производительность при работе с JavaScript на стороне клиента и обработке табличных данных благодаря планированию выполнения кода с использованием облегченных методов.
- Сохранение чат-бота и персоны: более эффективное следование инструкциям в нескольких ходах и согласованность персон по сравнению с Gemini 3.1 Flash-Lite.
- Поддержка использования компьютера: Поддерживается как встроенный инструмент для автоматизации пользовательского интерфейса агента.
Выбор подходящей модели вспышки или фонарика
Используйте эту таблицу, чтобы выбрать подходящую модель и путь миграции для ваших рабочих нагрузок.
Обе модели требуют удаления устаревших параметров выборки ( temperature , top_p , top_k ) и предварительно заполненных поворотов модели. Подробности см. в разделе «Изменения API» .
| Модель | Основные варианты использования | Рекомендуемая целевая миграция |
|---|---|---|
Вспышка Gemini 3.6gemini-3.6-flash | Генерация кода, пространственное/мультимодальное мышление, многоэтапные рабочие процессы с участием агентов. | Gemini 3.5 Flash , Gemini 3 Flash (Preview) или Gemini 3.1 Pro |
Фонарь Gemini 3.5 Flash-Litegemini-3.5-flash-lite | Автономное выполнение подсистем, анализ больших объемов данных и извлечение документов, структурированный анализ JSON. | Вспышка Gemini 3.1 Flash-Lite или Gemini 2.5 Flash |
Обновленный антигравитационный агент
Благодаря улучшенной производительности, Gemini 3.6 Flash теперь является новой моделью по умолчанию для агента Antigravity в Gemini Managed Agents. Это можно изменить, установив новое поле в API.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
agent="antigravity-preview-05-2026",
input="Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
environment="remote",
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
agent: "antigravity-preview-05-2026",
input: "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
environment: "remote",
}, { timeout: 300000 });
console.log(interaction.output_text);
ОТДЫХ
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{
"agent": "antigravity-preview-05-2026",
"input": "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
"environment": "remote"
}'
Изменения в API и обновления параметров
Начиная с Gemini 3.6 Flash и Gemini 3.5 Flash-Lite, следующие изменения API применяются к этим моделям и всем будущим версиям моделей Gemini.
- Устаревшие параметры выборки :
temperature,top_pиtop_kустарели. API игнорирует эти параметры и возвращает ошибку при последующих поколениях модели. - Проверка предварительно заполненных полей поворотов модели : Предварительное заполнение полей поворотов модели больше не поддерживается. Если последний непустой поворот в запросе является поворотом
model, API возвращает ошибку400.
Ниже приведены подробные пояснения и примеры кода для каждого изменения API.
1. Устаревание параметров выборки ( temperature , top_p , top_k )
temperature , top_p и top_k устарели и игнорируются. В будущих поколениях моделей передача этих параметров приводит к ошибке HTTP 400. Удалите эти параметры из всех запросов.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
To improve determinism, define a system instruction with explicit rules for your specific use case.
2. Предварительно заполненная проверка поворота модели
Запросы к API, заканчивающиеся непустым значением model role turn, не допускаются и возвращают ошибку HTTP 400 .
⚠️ Избегайте
В устаревших generateContent или в необработанных REST-запросах завершение запроса изменением роли модели теперь запрещено:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ Рекомендуемая миграция (API взаимодействий)
В API взаимодействий поля ввода данных модели не заполняются вручную. Если ваше приложение ранее заполняло поля ввода данных модели для подавления преамбул или принудительного форматирования JSON, используйте вместо этого system_instruction или структурированные выходные данные .
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
Контрольный список миграции
Вспышка Gemini 3.6
Установите навык:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalПримените навык:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Фонарь Gemini 3.5 Flash-Lite
Установите навык:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalПримените навык:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Перейти на gemini-3.6-flash
- Обновите идентификатор модели: измените строку с целевой моделью на
gemini-3.6-flash. - Удалите устаревшие параметры выборки:
- Удалите параметры
temperature,top_pиtop_kиз конфигураций поколений. - Замените
thinking_budgetстроковым перечислениемthinking_levelсо значением"medium"или"high". - Удалить
candidate_count(не поддерживается в Gemini 3.x).
- Удалите параметры
- Внедрить правила проверки поворотов:
- Стандартизировать многоэтапные диалоги на стороне сервера,
previous_interaction_id. - Удалите предварительно заполненные повороты модели.
- Стандартизировать многоэтапные диалоги на стороне сервера,
- Вызов функции аудита:
- Разместите мультимодальные ресурсы внутри полезной нагрузки ответа.
- Форматируйте встроенные инструкции с помощью
\n\n. - Если вы видите ошибки
Malformed_Function_Callсвязанные с текстом, предшествующим обработке, см. раздел «Обходные пути для требований к тексту, предшествующему обработке» . - Только при использовании API generateContent: убедитесь, что все объекты
FunctionResponseсодержатcall_idиname.
- Базовые требования Gemini 3.x: информацию об обновлениях SDK и сохранении сигнатур см. в контрольном списке миграции Gemini 3.5 .
Перейти на gemini-3.5-flash-lite
- Обновите идентификатор модели: измените строку с целевой моделью на
gemini-3.5-flash-lite. - Настройте уровень мыслительных усилий:
- Для извлечения, маршрутизации или классификации больших объемов данных оставьте
thinking_levelна"minimal"(по умолчанию) для максимальной пропускной способности. - Для автономных субагентов, использующих вызовы инструментов, выполняющих код или осуществляющих многоэтапное рассуждение: установите
thinking_levelв значение"medium"или"high"чтобы предотвратить преждевременное завершение работы инструментов.
- Для извлечения, маршрутизации или классификации больших объемов данных оставьте
- Удалите устаревшие параметры и проверьте вызов функции: примените те же правила, что и в версии 3.6 Flash .
- Базовые требования для Gemini 3.x: см. контрольный список миграции Gemini 3.5 .
Следующие шаги
- Ознакомьтесь со спецификациями API в разделе «Обзор моделей» .
- Подробнее об оркестровке нескольких агентов см. в Руководстве по API взаимодействий .
- Тестируйте и дорабатывайте подсказки в Google AI Studio .