Novidades do Gemini 3.8 Flash

Ver todos os modelos

O Gemini 3.8 Flash (gemini-3.8-flash) está disponível para uso geral (GA) e pronto para produção. Ele é nosso modelo Flash mais inteligente, projetado para engenharia de software de longo prazo, agentes autônomos e fluxos de trabalho empresariais complexos.

Este guia explica as novidades do Gemini 3.8 Flash, as mudanças na API, os exemplos de código e as orientações de migração.

Novo modelo

Modelo ID do modelo Nível de raciocínio padrão Preços Descrição
Gemini 3.8 Flash gemini-3.8-flash medium O 3.8 Flash está disponível até o final do ano com um preço promocional de US $0,75/1 milhão de tokens de entrada e US $3,75/1 milhão de tokens de saída. Consulte os preços para mais detalhes. Nosso modelo Flash mais inteligente, projetado para engenharia de software de longo prazo, agentes autônomos e fluxos de trabalho empresariais complexos.

O Gemini 3.8 Flash oferece uma janela de contexto de 1 milhão de tokens, 64 mil tokens de saída máximos, níveis de raciocínio ajustáveis (low, medium, high) e o mesmo conjunto de ferramentas integradas.

Para conferir as especificações completas, acesse a página do modelo Gemini 3.8 Flash. Para detalhes sobre os preços promocionais, consulte a seção de preços abaixo ou a página de preços.

Guia de início rápido

Python

from google import genai

client = genai.Client()

response = client.models.generate_content(
    model="gemini-3.8-flash",
    contents="Write a three.js script that renders a realistic 3D black hole."
)

print(response.text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

const response = await ai.models.generateContent({
  model: "gemini-3.8-flash",
  contents: "Write a three.js script that renders a realistic 3D black hole.",
});

console.log(response.text);

REST

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "contents": [{
      "parts": [{"text": "Write a three.js script that renders a realistic 3D black hole."}]
    }]
  }'

Novidades do Gemini 3.8 Flash

  • Engenharia de software de longo prazo:alcança resultados de última geração em benchmarks de programação do mundo real, refatoração complexa de vários arquivos e execução determinística de ferramentas. Consulte a metodologia de avaliação para mais detalhes.
  • Agentes autônomos:permite criar fluxos de trabalho resilientes de planejamento de várias etapas e orquestração de ferramentas, reduzindo substancialmente loops e erros.
  • Fluxos de trabalho empresariais complexos:oferece precisão superior, raciocínio profundo e rigor factual em tarefas de domínio exigentes e pipelines de dados em grande escala.
  • Modelo padrão para Agentes Gerenciados: o agente padrão para Agentes Gerenciados, o agente do Antigravity, agora usa o Gemini 3.8 Flash. O SDK do Antigravity também usa o Gemini 3.8 Flash por padrão.
  • Preços promocionais:o Gemini 3.8 Flash está disponível com uma taxa promocional de US $0,75/1 milhão de tokens de entrada e US $3,75/1 milhão de tokens de saída até 31 de dezembro de 2026. Os preços padrão de US $1,50/1 milhão de tokens de entrada e US $7,50/1 milhão de tokens de saída entram em vigor em 1º de janeiro de 2027.

O Gemini 3.8 Flash pode usar mais tokens em tarefas mais longas e complexas, por design. Para oferecer resultados de maior qualidade em metas difíceis de várias etapas, o modelo realiza etapas de raciocínio menores, chama ferramentas de forma iterativa e verifica o trabalho ao longo do processo. Nem todo fluxo de trabalho precisa desse nível de verificação. Para tarefas diárias, é possível reduzir o esforço de raciocínio para diminuir o consumo de tokens. Como alternativa, o Gemini 3.7 Flash continua totalmente compatível.

Noções básicas sobre níveis de raciocínio

O Gemini 3.8 Flash oferece controle flexível sobre a latência e a inteligência ajustando o nível de raciocínio do modelo:

  • Esforço de raciocínio baixo: reduz o tempo de resposta para tarefas com latência crítica, como pipelines de resposta a incidentes, chat em tempo real, redação de rascunhos e análise rápida de dados.
  • Médio (padrão) : melhor qualidade para a maioria das tarefas. Recomendado para casos de uso complexos de código e agentes, oferecendo maior precisão na primeira passagem.
  • Nível de raciocínio alto: maximiza os recursos de raciocínio e orquestração de ferramentas do modelo. Ideal para raciocínio profundo, matemática e tarefas difíceis de várias etapas.

O exemplo a seguir define thinking_level como medium para uma solicitação complexa de análise de código:

Python

from google import genai
from google.genai import types

client = genai.Client()

response = client.models.generate_content(
    model="gemini-3.8-flash",
    contents="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
    config=types.GenerateContentConfig(
        thinking_config=types.ThinkingConfig(
            thinking_level="medium"  # Balanced reasoning effort for complex tasks
        ),
    ),
)

print(response.text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

const response = await ai.models.generateContent({
  model: "gemini-3.8-flash",
  contents: "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
  config: {
    thinkingConfig: {
      thinkingLevel: "medium", // Balanced reasoning effort for complex tasks
    },
  },
});

console.log(response.text);

REST

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "contents": [{
      "parts": [{"text": "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely."}]
    }],
    "generationConfig": {
      "thinkingConfig": {
        "thinkingLevel": "medium"
      }
    }
  }'

Agente do Antigravity atualizado

Lista de verificação de migração

  `/gemini-api-dev migrate my app to Gemini 3.8 Flash`

Migrar para o gemini-3.8-flash

  • Atualizar o ID do modelo:mude a string do modelo de destino para gemini-3.8-flash.
  • Remover parâmetros de amostragem descontinuados:
    • Remova temperature, top_p e top_k das configurações de geração.
    • Substitua thinking_budget pelo enum de string thinking_level. Observe que minimal não é compatível com o 3.8 Flash.
    • Remova candidate_count (não compatível com o Gemini 3 e versões mais recentes).
  • Aplicar regras de validação de turno:
    • Remova os turnos de modelo pré-preenchidos.
    • Verifique se o turno do usuário final contém texto não vazio.
  • Auditoria de chamadas de função
    • Coloque recursos multimodais no payload da resposta.
    • Formate as instruções inline usando \n\n.
    • Se você encontrar erros Malformed_Function_Call vinculados ao texto pré-ferramenta, consulte Soluções alternativas para requisitos de texto pré-ferramenta.
    • Somente se você estiver usando a API generateContent: verifique se todos os objetos FunctionResponse incluem call_id e name.
  • Requisitos básicos do Gemini 3:para atualizações do SDK e preservação da assinatura de pensamento, consulte a lista de verificação de migração do Gemini 3.5.

Preços

Aproveite os preços promocionais no Google AI Studio e na Gemini Enterprise Agent Platform até 31 de dezembro de 2026 para o Gemini 3.8 Flash, o Gemini 3.7 Flash e o Gemini 3.6 Flash. Os preços padrão entram em vigor em 1º de janeiro de 2027. Para conferir os níveis de preços completos, acesse a página de preços.

Próximas etapas