Что нового в Gemini 3.8 Flash?

Посмотреть все модели

Gemini 3.8 Flash ( gemini-3.8-flash ) общедоступен (GA) и готов к использованию в производственной среде. Это наша самая интеллектуальная модель Flash, разработанная для долгосрочной разработки программного обеспечения, автономных агентов и сложных корпоративных рабочих процессов.

В этом руководстве объясняется, что нового в Gemini 3.8 Flash, приводятся изменения в API, примеры кода и рекомендации по миграции.

Новая модель

Модель Идентификатор модели Уровень мышления по умолчанию Цены Описание
Вспышка Gemini 3.8 gemini-3.8-flash medium 3.8 Flash доступен до конца года по ознакомительной цене 0,75 долл. США за 1 млн входных токенов и 3,75 долл. США за 1 млн выходных токенов; подробности см. в разделе «Цены» . Наша самая интеллектуальная модель Flash, разработанная для долгосрочной разработки программного обеспечения, автономных агентов и сложных корпоративных рабочих процессов.

Gemini 3.8 Flash поддерживает контекстное окно размером 1 млн токенов, максимальное количество выходных токенов — 64 тыс., настраиваемые уровни мышления ( low , medium , high ) и тот же полный набор встроенных инструментов.

Полные технические характеристики см. на странице модели Gemini 3.8 Flash . Подробную информацию о ценах для ознакомления см. в разделе «Цены» ниже или на странице с ценами .

Быстрый старт

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.8-flash",
    input="Write a three.js script that renders a realistic 3D black hole."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
  model: "gemini-3.8-flash",
  input: "Write a three.js script that renders a realistic 3D black hole.",
});

console.log(interaction.output_text);

Java

import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;

Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
    .model(Model.of("gemini-3.8-flash"))
    .input(InteractionsInput.of("Hello world"))
    .build();
Interaction interaction =
    client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));

ОТДЫХ

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.8-flash",
    "input": "Write a three.js script that renders a realistic 3D black hole."
  }'

Что нового в Gemini 3.8 Flash?

  • Разработка программного обеспечения с долгосрочным горизонтом: демонстрирует высокие результаты в реальных тестах кодирования, при сложной рефакторизации многофайловых проектов и при детерминированном выполнении инструментов. Подробности см. в методологии оценки .
  • Автономные агенты: позволяют создавать отказоустойчивые многоэтапные рабочие процессы планирования и оркестровки инструментов, существенно сокращая количество сбоев и ошибок.
  • Сложные корпоративные рабочие процессы: Обеспечивает высочайшую точность, глубокую аргументацию и высокую фактическую строгость при решении сложных задач в предметной области и обработке крупномасштабных конвейеров данных.
  • Модель по умолчанию для управляемых агентов: Агент по умолчанию для управляемых агентов: агент Antigravity , теперь использует Gemini 3.8 Flash. SDK Antigravity также по умолчанию использует Gemini 3.8 Flash.
  • Вводная цена: Gemini 3.8 Flash доступен по вводной цене 0,75 долл. США за 1 млн входных токенов и 3,75 долл. США за 1 млн выходных токенов до 31 декабря 2026 года. Стандартная цена 1,50 долл. США за 1 млн входных токенов и 7,50 долл. США за 1 млн выходных токенов вступит в силу 1 января 2027 года.

В Gemini 3.8 Flash предусмотрено использование большего количества токенов при выполнении длительных и сложных задач. Для достижения более качественных результатов в сложных многоэтапных задачах модель выполняет меньшие шаги рассуждений, итеративно вызывает инструменты и проверяет свою работу на каждом этапе. Не каждый рабочий процесс требует такого уровня проверки. Для повседневных задач можно уменьшить объем рассуждений , чтобы сократить потребление токенов. В качестве альтернативы, Gemini 3.7 Flash остается полностью поддерживаемым.

Понимание уровней рассуждения

Gemini 3.8 Flash предоставляет гибкий контроль над задержкой и интеллектом, регулируя уровень мышления модели:

  • Минимальные умственные усилия : сокращает время ответа на критически важные задачи, такие как конвейеры реагирования на инциденты, чат в реальном времени, написание черновиков и быстрый анализ данных.
  • Средний (по умолчанию): Наилучшее качество для большинства задач. Рекомендуется для сложных сценариев использования кода и агентов, обеспечивая более высокую точность с первого раза.
  • Высокая мыслительная нагрузка : Максимально использует возможности модели по рассуждениям и координации инструментов. Лучше всего подходит для глубокого анализа, математических вычислений и сложных многоэтапных задач.

В следующем примере для запроса на сложный анализ кода thinking_level устанавливается на medium :

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.8-flash",
    input="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
    generation_config={
        "thinking_level": "medium"  # Balanced reasoning effort for complex tasks
    }
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
  model: "gemini-3.8-flash",
  input: "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
  generation_config: {
    thinking_level: "medium"
  }
});

console.log(interaction.output_text);

Java

import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;

Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
    .model(Model.of("gemini-3.8-flash"))
    .input(InteractionsInput.of("Hello world"))
    .build();
Interaction interaction =
    client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));

ОТДЫХ

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.8-flash",
    "input": "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
    "generation_config": {
      "thinking_level": "medium"
    }
  }'

Обновленный антигравитационный агент

Благодаря улучшенной производительности и логике, агент Antigravity в Gemini Managed Agents теперь по умолчанию собирается с использованием Gemini 3.8 Flash.

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    agent="antigravity-preview-05-2026",
    input=(
        "Audit https://web.dev for performance, Core Web Vitals, and SEO. "
        "Query Google's PageSpeed Insights API for both Mobile and Desktop strategies. "
        "Check search indexing with Google Search for site:web.dev. "
        "Format the output as a side-by-side scorecard table with prioritized fixes."
    ),
    environment="remote",
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
  agent: "antigravity-preview-05-2026",
  input: "Audit https://web.dev for performance, Core Web Vitals, and SEO. Query Google's PageSpeed Insights API for both Mobile and Desktop strategies. Check search indexing with Google Search for site:web.dev. Format the output as a side-by-side scorecard table with prioritized fixes.",
  environment: "remote",
}, { timeout: 300000 });

console.log(interaction.output_text);

Java

import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;

Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
    .model(Model.of("gemini-3.8-flash"))
    .input(InteractionsInput.of("Hello world"))
    .build();
Interaction interaction =
    client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));

ОТДЫХ

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{
    "agent": "antigravity-preview-05-2026",
    "input": "Audit https://web.dev for performance, Core Web Vitals, and SEO. Query Google'\''s PageSpeed Insights API for both Mobile and Desktop strategies. Check search indexing with Google Search for site:web.dev. Format the output as a side-by-side scorecard table with prioritized fixes.",
    "environment": "remote"
}'

Базовую модель Gemini можно настроить с помощью agent_config .

Контрольный список миграции

  `/gemini-api-dev migrate my app to Gemini 3.8 Flash`

Перейти на gemini-3.8-flash

  • Обновите идентификатор модели: измените строку с целевой моделью на gemini-3.8-flash .
  • Удалите устаревшие параметры выборки:
    • Удалите параметры temperature , top_p и top_k из конфигураций поколений.
    • Замените thinking_budget на строковое перечисление thinking_level . Обратите внимание, что minimal не поддерживается в Flash версии 3.8.
    • Удалите candidate_count (не поддерживается в Gemini 3 и более поздних версиях).
  • Внедрить правила проверки поворотов:
    • Стандартизировать многоэтапные диалоги на стороне сервера, previous_interaction_id .
    • Удалите предварительно заполненные повороты модели.
  • Вызов функции аудита:
    • Разместите мультимодальные ресурсы внутри полезной нагрузки ответа.
    • Форматируйте встроенные инструкции с помощью \n\n .
    • Если вы видите ошибки Malformed_Function_Call связанные с текстом, предшествующим обработке, см. раздел «Обходные пути для требований к тексту, предшествующему обработке» .
    • Только при использовании API generateContent: убедитесь, что все объекты FunctionResponse содержат call_id и name .
  • Базовые требования Gemini 3: Для обновления SDK и сохранения сигнатур мысли см. контрольный список миграции Gemini 3.5 .

Цены

Воспользуйтесь льготными ценами на Google AI Studio и Gemini Enterprise Agent Platform до 31 декабря 2026 года для версий Gemini 3.8 Flash, Gemini 3.7 Flash и Gemini 3.6 Flash. Стандартные цены вступят в силу 1 января 2027 года. Полный список ценовых категорий смотрите на странице с ценами .

Следующие шаги