Gemini 3.8 Flash ( gemini-3.8-flash ) общедоступен (GA) и готов к использованию в производственной среде. Это наша самая интеллектуальная модель Flash, разработанная для долгосрочной разработки программного обеспечения, автономных агентов и сложных корпоративных рабочих процессов.
В этом руководстве объясняется, что нового в Gemini 3.8 Flash, приводятся изменения в API, примеры кода и рекомендации по миграции.
Новая модель
| Модель | Идентификатор модели | Уровень мышления по умолчанию | Цены | Описание |
|---|---|---|---|---|
| Вспышка Gemini 3.8 | gemini-3.8-flash | medium | 3.8 Flash доступен до конца года по ознакомительной цене 0,75 долл. США за 1 млн входных токенов и 3,75 долл. США за 1 млн выходных токенов; подробности см. в разделе «Цены» . | Наша самая интеллектуальная модель Flash, разработанная для долгосрочной разработки программного обеспечения, автономных агентов и сложных корпоративных рабочих процессов. |
Gemini 3.8 Flash поддерживает контекстное окно размером 1 млн токенов, максимальное количество выходных токенов — 64 тыс., настраиваемые уровни мышления ( low , medium , high ) и тот же полный набор встроенных инструментов.
Полные технические характеристики см. на странице модели Gemini 3.8 Flash . Подробную информацию о ценах для ознакомления см. в разделе «Цены» ниже или на странице с ценами .
Быстрый старт
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Write a three.js script that renders a realistic 3D black hole."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
model: "gemini-3.8-flash",
input: "Write a three.js script that renders a realistic 3D black hole.",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
.model(Model.of("gemini-3.8-flash"))
.input(InteractionsInput.of("Hello world"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
ОТДЫХ
curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"model": "gemini-3.8-flash",
"input": "Write a three.js script that renders a realistic 3D black hole."
}'
Что нового в Gemini 3.8 Flash?
- Разработка программного обеспечения с долгосрочным горизонтом: демонстрирует высокие результаты в реальных тестах кодирования, при сложной рефакторизации многофайловых проектов и при детерминированном выполнении инструментов. Подробности см. в методологии оценки .
- Автономные агенты: позволяют создавать отказоустойчивые многоэтапные рабочие процессы планирования и оркестровки инструментов, существенно сокращая количество сбоев и ошибок.
- Сложные корпоративные рабочие процессы: Обеспечивает высочайшую точность, глубокую аргументацию и высокую фактическую строгость при решении сложных задач в предметной области и обработке крупномасштабных конвейеров данных.
- Модель по умолчанию для управляемых агентов: Агент по умолчанию для управляемых агентов: агент Antigravity , теперь использует Gemini 3.8 Flash. SDK Antigravity также по умолчанию использует Gemini 3.8 Flash.
- Вводная цена: Gemini 3.8 Flash доступен по вводной цене 0,75 долл. США за 1 млн входных токенов и 3,75 долл. США за 1 млн выходных токенов до 31 декабря 2026 года. Стандартная цена 1,50 долл. США за 1 млн входных токенов и 7,50 долл. США за 1 млн выходных токенов вступит в силу 1 января 2027 года.
В Gemini 3.8 Flash предусмотрено использование большего количества токенов при выполнении длительных и сложных задач. Для достижения более качественных результатов в сложных многоэтапных задачах модель выполняет меньшие шаги рассуждений, итеративно вызывает инструменты и проверяет свою работу на каждом этапе. Не каждый рабочий процесс требует такого уровня проверки. Для повседневных задач можно уменьшить объем рассуждений , чтобы сократить потребление токенов. В качестве альтернативы, Gemini 3.7 Flash остается полностью поддерживаемым.
Понимание уровней рассуждения
Gemini 3.8 Flash предоставляет гибкий контроль над задержкой и интеллектом, регулируя уровень мышления модели:
- Минимальные умственные усилия : сокращает время ответа на критически важные задачи, такие как конвейеры реагирования на инциденты, чат в реальном времени, написание черновиков и быстрый анализ данных.
- Средний (по умолчанию): Наилучшее качество для большинства задач. Рекомендуется для сложных сценариев использования кода и агентов, обеспечивая более высокую точность с первого раза.
- Высокая мыслительная нагрузка : Максимально использует возможности модели по рассуждениям и координации инструментов. Лучше всего подходит для глубокого анализа, математических вычислений и сложных многоэтапных задач.
В следующем примере для запроса на сложный анализ кода thinking_level устанавливается на medium :
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
generation_config={
"thinking_level": "medium" # Balanced reasoning effort for complex tasks
}
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
model: "gemini-3.8-flash",
input: "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
generation_config: {
thinking_level: "medium"
}
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
.model(Model.of("gemini-3.8-flash"))
.input(InteractionsInput.of("Hello world"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
ОТДЫХ
curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"model": "gemini-3.8-flash",
"input": "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
"generation_config": {
"thinking_level": "medium"
}
}'
Обновленный антигравитационный агент
Благодаря улучшенной производительности и логике, агент Antigravity в Gemini Managed Agents теперь по умолчанию собирается с использованием Gemini 3.8 Flash.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
agent="antigravity-preview-05-2026",
input=(
"Audit https://web.dev for performance, Core Web Vitals, and SEO. "
"Query Google's PageSpeed Insights API for both Mobile and Desktop strategies. "
"Check search indexing with Google Search for site:web.dev. "
"Format the output as a side-by-side scorecard table with prioritized fixes."
),
environment="remote",
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
agent: "antigravity-preview-05-2026",
input: "Audit https://web.dev for performance, Core Web Vitals, and SEO. Query Google's PageSpeed Insights API for both Mobile and Desktop strategies. Check search indexing with Google Search for site:web.dev. Format the output as a side-by-side scorecard table with prioritized fixes.",
environment: "remote",
}, { timeout: 300000 });
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
.model(Model.of("gemini-3.8-flash"))
.input(InteractionsInput.of("Hello world"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
ОТДЫХ
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{
"agent": "antigravity-preview-05-2026",
"input": "Audit https://web.dev for performance, Core Web Vitals, and SEO. Query Google'\''s PageSpeed Insights API for both Mobile and Desktop strategies. Check search indexing with Google Search for site:web.dev. Format the output as a side-by-side scorecard table with prioritized fixes.",
"environment": "remote"
}'
Базовую модель Gemini можно настроить с помощью agent_config .
Контрольный список миграции
`/gemini-api-dev migrate my app to Gemini 3.8 Flash`
Перейти на gemini-3.8-flash
- Обновите идентификатор модели: измените строку с целевой моделью на
gemini-3.8-flash. - Удалите устаревшие параметры выборки:
- Удалите параметры
temperature,top_pиtop_kиз конфигураций поколений. - Замените
thinking_budgetна строковое перечислениеthinking_level. Обратите внимание, чтоminimalне поддерживается в Flash версии 3.8. - Удалите
candidate_count(не поддерживается в Gemini 3 и более поздних версиях).
- Удалите параметры
- Внедрить правила проверки поворотов:
- Стандартизировать многоэтапные диалоги на стороне сервера,
previous_interaction_id. - Удалите предварительно заполненные повороты модели.
- Стандартизировать многоэтапные диалоги на стороне сервера,
- Вызов функции аудита:
- Разместите мультимодальные ресурсы внутри полезной нагрузки ответа.
- Форматируйте встроенные инструкции с помощью
\n\n. - Если вы видите ошибки
Malformed_Function_Callсвязанные с текстом, предшествующим обработке, см. раздел «Обходные пути для требований к тексту, предшествующему обработке» . - Только при использовании API generateContent: убедитесь, что все объекты
FunctionResponseсодержатcall_idиname.
- Базовые требования Gemini 3: Для обновления SDK и сохранения сигнатур мысли см. контрольный список миграции Gemini 3.5 .
Цены
Воспользуйтесь льготными ценами на Google AI Studio и Gemini Enterprise Agent Platform до 31 декабря 2026 года для версий Gemini 3.8 Flash, Gemini 3.7 Flash и Gemini 3.6 Flash. Стандартные цены вступят в силу 1 января 2027 года. Полный список ценовых категорий смотрите на странице с ценами .
Следующие шаги
- Ознакомьтесь со спецификациями API в разделе «Обзор моделей» .
- Изучите возможности оркестрации нескольких агентов в разделе «Обзор API взаимодействий» .
- Тестируйте и дорабатывайте подсказки в Google AI Studio .