O Gemini 3.8 Flash (gemini-3.8-flash) está disponível para uso geral (GA) e pronto para produção. Ele é nosso modelo Flash mais inteligente, projetado para engenharia de software de longo prazo, agentes autônomos e fluxos de trabalho empresariais complexos.
Este guia explica as novidades do Gemini 3.8 Flash, as mudanças na API, os exemplos de código e as orientações de migração.
Novo modelo
| Modelo | ID do modelo | Nível de raciocínio padrão | Preços | Descrição |
|---|---|---|---|---|
| Gemini 3.8 Flash | gemini-3.8-flash |
medium |
O 3.8 Flash está disponível até o final do ano com um preço promocional de US $0,75/1 milhão de tokens de entrada e US $3,75/1 milhão de tokens de saída. Consulte os preços para mais detalhes. | Nosso modelo Flash mais inteligente, projetado para engenharia de software de longo prazo, agentes autônomos e fluxos de trabalho empresariais complexos. |
O Gemini 3.8 Flash oferece uma janela de contexto de 1 milhão de tokens, 64 mil tokens de saída máximos, níveis de raciocínio ajustáveis (low, medium, high) e o mesmo conjunto de ferramentas integradas.
Para conferir as especificações completas, acesse a página do modelo Gemini 3.8 Flash. Para detalhes sobre os preços promocionais, consulte a seção de preços abaixo ou a página de preços.
Guia de início rápido
Python
from google import genai
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.8-flash",
contents="Write a three.js script that renders a realistic 3D black hole."
)
print(response.text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const response = await ai.models.generateContent({
model: "gemini-3.8-flash",
contents: "Write a three.js script that renders a realistic 3D black hole.",
});
console.log(response.text);
REST
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"contents": [{
"parts": [{"text": "Write a three.js script that renders a realistic 3D black hole."}]
}]
}'
Novidades do Gemini 3.8 Flash
- Engenharia de software de longo prazo:alcança resultados de última geração em benchmarks de programação do mundo real, refatoração complexa de vários arquivos e execução determinística de ferramentas. Consulte a metodologia de avaliação para mais detalhes.
- Agentes autônomos:permite criar fluxos de trabalho resilientes de planejamento de várias etapas e orquestração de ferramentas, reduzindo substancialmente loops e erros.
- Fluxos de trabalho empresariais complexos:oferece precisão superior, raciocínio profundo e rigor factual em tarefas de domínio exigentes e pipelines de dados em grande escala.
- Modelo padrão para Agentes Gerenciados: o agente padrão para Agentes Gerenciados, o agente do Antigravity, agora usa o Gemini 3.8 Flash. O SDK do Antigravity também usa o Gemini 3.8 Flash por padrão.
- Preços promocionais:o Gemini 3.8 Flash está disponível com uma taxa promocional de US $0,75/1 milhão de tokens de entrada e US $3,75/1 milhão de tokens de saída até 31 de dezembro de 2026. Os preços padrão de US $1,50/1 milhão de tokens de entrada e US $7,50/1 milhão de tokens de saída entram em vigor em 1º de janeiro de 2027.
O Gemini 3.8 Flash pode usar mais tokens em tarefas mais longas e complexas, por design. Para oferecer resultados de maior qualidade em metas difíceis de várias etapas, o modelo realiza etapas de raciocínio menores, chama ferramentas de forma iterativa e verifica o trabalho ao longo do processo. Nem todo fluxo de trabalho precisa desse nível de verificação. Para tarefas diárias, é possível reduzir o esforço de raciocínio para diminuir o consumo de tokens. Como alternativa, o Gemini 3.7 Flash continua totalmente compatível.
Noções básicas sobre níveis de raciocínio
O Gemini 3.8 Flash oferece controle flexível sobre a latência e a inteligência ajustando o nível de raciocínio do modelo:
- Esforço de raciocínio baixo: reduz o tempo de resposta para tarefas com latência crítica, como pipelines de resposta a incidentes, chat em tempo real, redação de rascunhos e análise rápida de dados.
- Médio (padrão) : melhor qualidade para a maioria das tarefas. Recomendado para casos de uso complexos de código e agentes, oferecendo maior precisão na primeira passagem.
- Nível de raciocínio alto: maximiza os recursos de raciocínio e orquestração de ferramentas do modelo. Ideal para raciocínio profundo, matemática e tarefas difíceis de várias etapas.
O exemplo a seguir define thinking_level como medium para uma solicitação complexa de análise de código:
Python
from google import genai
from google.genai import types
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.8-flash",
contents="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
config=types.GenerateContentConfig(
thinking_config=types.ThinkingConfig(
thinking_level="medium" # Balanced reasoning effort for complex tasks
),
),
)
print(response.text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const response = await ai.models.generateContent({
model: "gemini-3.8-flash",
contents: "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
config: {
thinkingConfig: {
thinkingLevel: "medium", // Balanced reasoning effort for complex tasks
},
},
});
console.log(response.text);
REST
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"contents": [{
"parts": [{"text": "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely."}]
}],
"generationConfig": {
"thinkingConfig": {
"thinkingLevel": "medium"
}
}
}'
Agente do Antigravity atualizado
Lista de verificação de migração
`/gemini-api-dev migrate my app to Gemini 3.8 Flash`
Migrar para o gemini-3.8-flash
- Atualizar o ID do modelo:mude a string do modelo de destino para
gemini-3.8-flash. - Remover parâmetros de amostragem descontinuados:
- Remova
temperature,top_petop_kdas configurações de geração. - Substitua
thinking_budgetpelo enum de stringthinking_level. Observe queminimalnão é compatível com o 3.8 Flash. - Remova
candidate_count(não compatível com o Gemini 3 e versões mais recentes).
- Remova
- Aplicar regras de validação de turno:
- Remova os turnos de modelo pré-preenchidos.
- Verifique se o turno do usuário final contém texto não vazio.
- Auditoria de chamadas de função
- Coloque recursos multimodais no payload da resposta.
- Formate as instruções inline usando
\n\n. - Se você encontrar erros
Malformed_Function_Callvinculados ao texto pré-ferramenta, consulte Soluções alternativas para requisitos de texto pré-ferramenta. - Somente se você estiver usando a API generateContent: verifique se todos os objetos
FunctionResponseincluemcall_idename.
- Requisitos básicos do Gemini 3:para atualizações do SDK e preservação da assinatura de pensamento, consulte a lista de verificação de migração do Gemini 3.5.
Preços
Aproveite os preços promocionais no Google AI Studio e na Gemini Enterprise Agent Platform até 31 de dezembro de 2026 para o Gemini 3.8 Flash, o Gemini 3.7 Flash e o Gemini 3.6 Flash. Os preços padrão entram em vigor em 1º de janeiro de 2027. Para conferir os níveis de preços completos, acesse a página de preços.
Próximas etapas
- Consulte as especificações da API na visão geral dos modelos.
- Saiba mais sobre a orquestração de vários agentes na visão geral da API Interactions.
- Teste e refine comandos no Google AI Studio.