Используя новейшие модели Gemini

Эта страница 3.5 Flash

Вспышки Gemini 3.6 Flash ( gemini-3.6-flash ) и Gemini 3.5 Flash-Lite ( gemini-3.5-flash-lite ) общедоступны (GA) и готовы к использованию в производстве.

  • Gemini 3.6 Flash : Более высокая производительность при решении сложных агентных и мультимодальных задач при одновременном снижении расхода токенов по более низкой цене, чем 3.5 Flash.
  • Gemini 3.5 Flash-Lite : Самая быстрая и недорогая модель в семействе 3.5. Превосходит предыдущие поколения Flash-Lite по производительности при выполнении задач с высокой пропускной способностью.

В этом руководстве объясняется, что нового в каждой модели, какие изменения API влияют на ваш код и как выполнить миграцию.

Вспышка Gemini 3.6

  1. Установите навык:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Примените навык:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Фонарь Gemini 3.5 Flash-Lite

  1. Установите навык:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Примените навык:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Новые модели

Модель Идентификатор модели Уровень мышления по умолчанию Цены Описание
Вспышка Gemini 3.6 gemini-3.6-flash medium Входные токены номиналом 1,50 долл. США/1 млн. долларов США и выходные токены номиналом 7,50 долл. США/1 млн. долларов США. Обеспечивает баланс между скоростью и интеллектом для выполнения задач, требующих активного участия и мультимодального взаимодействия.
Фонарь Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal Входные токены: $0,30/1 млн, выходные токены: $2,50/1 млн. Самая быстрая и экономичная модель 3.5 для высокопроизводительного выполнения.

Обе модели поддерживают контекстное окно с 1 миллионом токенов, максимальное количество выходных токенов — 64 тысячи, функцию мышления и полный набор встроенных инструментов, включая использование компьютера .

Полные технические характеристики см. на страницах моделей:

Подробную информацию о ценах смотрите на странице с ценами .

Быстрый старт

Python

from google import genai

client = genai.Client()

response = client.models.generate_content(
    model="gemini-3.6-flash",
    contents="Write a three.js script that renders an interactive 3D robot.",
)

print(response.text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const response = await ai.models.generateContent({
    model: "gemini-3.6-flash",
    contents: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(response.text);
}

main();

ОТДЫХ

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "contents": [{
      "parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
    }]
  }'

Что нового в Gemini 3.6 Flash?

  • Сокращение количества токенов и ходов: Завершает многоэтапные рабочие процессы с меньшим количеством этапов рассуждений, ходов диалога и вызовов инструментов, чем Gemini 3.5. Также уменьшает зацикливание выполнения.
  • Улучшенная генерация кода: создает более качественный, готовый к использованию в производстве код с меньшим количеством нежелательных правок и меньшим количеством циклов отладки.
  • Улучшенное следование инструкциям : уменьшает количество нежелательных изменений файлов во время диагностических задач.
  • Уверенное многомодальное и пространственное мышление: улучшена производительность при интерпретации диаграмм, преобразовании визуальных схем и генерации многоэлементных веб-макетов.
  • Предварительная программная проверка: Предпочтительнее запускать диагностические скрипты перед внесением изменений чаще, чем в Gemini 3.5 Flash. Это повышает точность при выполнении сложных задач, но может добавить дополнительные этапы исследования при работе с простым интерфейсом.
  • Поддержка использования компьютера: Поддерживается как встроенный инструмент для автоматизации пользовательского интерфейса агента.
  • Предпочтения в стилизации пользовательского интерфейса : Лучше подходит для создания функционального кода, хотя эксперты-люди предпочитали более ранние модели с точки зрения визуального оформления и стиля. Это можно компенсировать, предоставив четкие рекомендации по дизайну.
  • Уровень мыслительной нагрузки по умолчанию (средний): Используется тот же medium уровень мыслительной нагрузки по умолчанию, что и в Gemini 3.5 Flash.
  • Сниженная цена : уменьшена стоимость выходных токенов (7,50 долл. США/1 млн против 9,00 долл. США/1 млн для 3,5 Flash). Стоимость входных токенов остается на уровне 1,50 долл. США/1 млн.

Что нового в фонарике Gemini 3.5 Flash-Lite?

  • Сниженная задержка выполнения задач: максимальная пропускная способность в семействе 3.5 для обработки больших объемов данных и извлечения документов.
  • Улучшенная производительность в задачах логического мышления и мультимодальных тестах: Уверенный переход с Gemini 2.5 Flash, с более высокими показателями в задачах логического мышления, таких как HLE (18,0% против 11,0%), и в мультимодальных бенчмарках, таких как CharXIV (74,5% против 63,7%).
  • Оркестрация субагентов и надежность инструментов: повышает надежность выполнения инструментов для выполнения кода, поиска и рабочих процессов MCP. Повышает уровень мышления для автономного планирования и сложных задач субагентов.
  • Улучшенное понимание документа: повышает точность анализа документов и извлечения структурированных данных. Можно экспериментировать как с минимальным, так и с высоким уровнем сложности в зависимости от сложности документа.
  • Интерактивное веб-программирование и обработка табличных данных: демонстрирует высокую производительность при работе с JavaScript на стороне клиента и обработке табличных данных благодаря планированию выполнения кода с использованием облегченных методов.
  • Сохранение чат-бота и персоны: более эффективное следование инструкциям в нескольких ходах и согласованность персон по сравнению с Gemini 3.1 Flash-Lite.
  • Поддержка использования компьютера: Поддерживается как встроенный инструмент для автоматизации пользовательского интерфейса агента.

Выбор подходящей модели вспышки или фонарика

Используйте эту таблицу, чтобы выбрать подходящую модель и путь миграции для ваших рабочих нагрузок.

Обе модели требуют удаления устаревших параметров выборки ( temperature , top_p , top_k ) и предварительно заполненных поворотов модели. Подробности см. в разделе «Изменения API» .

Модель Основные варианты использования Рекомендуемая целевая миграция
Вспышка Gemini 3.6
gemini-3.6-flash
Генерация кода, пространственное/мультимодальное мышление, многоэтапные рабочие процессы с участием агентов. Gemini 3.5 Flash , Gemini 3 Flash (Preview) или Gemini 3.1 Pro
Фонарь Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Автономное выполнение подсистем, анализ больших объемов данных и извлечение документов, структурированный анализ JSON. Вспышка Gemini 3.1 Flash-Lite или Gemini 2.5 Flash

Обновленный антигравитационный агент

Благодаря улучшенной производительности, Gemini 3.6 Flash теперь является новой моделью по умолчанию для агента Antigravity в Gemini Managed Agents. Это можно изменить, установив новое поле в API.

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    agent="antigravity-preview-05-2026",
    input="Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    environment="remote",
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
    agent: "antigravity-preview-05-2026",
    input: "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    environment: "remote",
}, { timeout: 300000 });

console.log(interaction.output_text);

ОТДЫХ

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{
    "agent": "antigravity-preview-05-2026",
    "input": "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    "environment": "remote"
}'

Изменения в API и обновления параметров

Начиная с Gemini 3.6 Flash и Gemini 3.5 Flash-Lite, следующие изменения API применяются к этим моделям и всем будущим версиям моделей Gemini.

  • Устаревшие параметры выборки : temperature , top_p и top_k устарели. API игнорирует эти параметры и возвращает ошибку при последующих поколениях модели.
  • Проверка предварительно заполненных полей поворотов модели : Предварительное заполнение полей поворотов модели больше не поддерживается. Если последний непустой поворот в запросе является поворотом model , API возвращает ошибку 400 .

Ниже приведены подробные пояснения и примеры кода для каждого изменения API.

1. Устаревание параметров выборки ( temperature , top_p , top_k )

temperature , top_p и top_k устарели и игнорируются. В будущих поколениях моделей передача этих параметров приводит к ошибке HTTP 400. Удалите эти параметры из всех запросов.

# ⚠️ Remove these parameters (deprecated)
generation_config = {
     "temperature": 0.7,
     "top_p": 0.9,
     "top_k": 40,
}

To improve determinism, define a system instruction with explicit rules for your specific use case.

2. Предварительно заполненная проверка поворота модели

Запросы к API, заканчивающиеся непустым значением model role turn, не допускаются и возвращают ошибку HTTP 400 .

⚠️ Избегайте

В устаревших generateContent или в необработанных REST-запросах завершение запроса изменением роли модели теперь запрещено:

/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
  "contents": [
    {"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
    {"role": "model", "parts": [{"text": "Translation:"}]}  /* ❌ Returns error */
  ]
}

Если в вашем приложении ранее автоматически заполнялся шаблон модели для подавления преамбул или принудительного форматирования в формате JSON, используйте вместо этого выходные данные system_instruction или Structured .

# ✅ RECOMMENDED: Use system_instruction to specify output format
response = client.models.generate_content(
    model="gemini-3.6-flash",
    contents="Translate 'Hello world' to Spanish.",
    config={"system_instruction": "Output only the translation without introductory text."},
)

Контрольный список миграции

Вспышка Gemini 3.6

  1. Установите навык:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Примените навык:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Фонарь Gemini 3.5 Flash-Lite

  1. Установите навык:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Примените навык:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Перейти на gemini-3.6-flash

  • Обновите идентификатор модели: измените строку с целевой моделью на gemini-3.6-flash .
  • Удалите устаревшие параметры выборки:
    • Удалите параметры temperature , top_p и top_k из конфигураций поколений.
    • Замените thinking_budget строковым перечислением thinking_level со значением "medium" или "high" .
    • Удалить candidate_count (не поддерживается в Gemini 3.x).
  • Внедрить правила проверки поворотов:
    • Удалите предварительно заполненные повороты модели.
    • Убедитесь, что в последнем ходу пользователя содержится непустой текст.
  • Вызов функции аудита:
  • Базовые требования Gemini 3.x: информацию об обновлениях SDK и сохранении сигнатур см. в контрольном списке миграции Gemini 3.5 .

Перейти на gemini-3.5-flash-lite

  • Обновите идентификатор модели: измените строку с целевой моделью на gemini-3.5-flash-lite .
  • Настройте уровень мыслительных усилий:
    • Для извлечения, маршрутизации или классификации больших объемов данных оставьте thinking_level на "minimal" (по умолчанию) для максимальной пропускной способности.
    • Для автономных субагентов, использующих вызовы инструментов, выполняющих код или осуществляющих многоэтапное рассуждение: установите thinking_level в значение "medium" или "high" чтобы предотвратить преждевременное завершение работы инструментов.
  • Удалите устаревшие параметры и проверьте вызов функции: примените те же правила, что и в версии 3.6 Flash .
  • Базовые требования для Gemini 3.x: см. контрольный список миграции Gemini 3.5 .

Следующие шаги