Modelo mais recente Outros modelos
O Gemini 3.6 Flash (gemini-3.6-flash) e o Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) são versões da geração anterior da série Gemini 3 e continuam disponíveis para uso em produção. Para conhecer nosso modelo Flash mais recente, consulte Gemini 3.8 Flash.
- Gemini 3.6 Flash: melhor desempenho em tarefas complexas de agentes e multimodais, além de reduzir o uso de tokens a um preço menor do que o 3.5 Flash.
- Gemini 3.5 Flash-Lite: o modelo mais rápido e de menor custo da família 3.5. Supera as gerações anteriores do Flash-Lite para execução de alta capacidade de processamento.
Este guia explica o que foi introduzido em cada modelo, quais mudanças na API afetam seu código e como migrar.
Gemini 3.6 Flash
Instale a habilidade:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplique a habilidade:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash Lite
Instale a habilidade:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplique a habilidade:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Novos modelos
| Modelo | ID do modelo | Nível de raciocínio padrão | Preços | Descrição |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
US$ 1,50/1 milhão de tokens de entrada e US $7,50/1 milhão de tokens de saída | Equilibra velocidade e inteligência para tarefas agênticas e multimodais. |
| Gemini 3.5 Flash Lite | gemini-3.5-flash-lite |
minimal |
US$ 0,30/1 milhão de tokens de entrada e US $2,50/1 milhão de tokens de saída | O modelo 3.5 mais rápido e de menor custo para execução de alta taxa de transferência. |
Os dois modelos oferecem suporte à janela de contexto de 1 milhão de tokens, 64 mil tokens de saída máxima, raciocínio e o conjunto completo de ferramentas integradas, incluindo Uso do computador.
Para especificações completas, consulte as páginas do modelo:
Para saber os preços detalhados, consulte a página de preços.
Guia de início rápido
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Novidades do Gemini 3.6 Flash
- Redução de tokens e turnos:conclui fluxos de trabalho de várias etapas com menos etapas de raciocínio, turnos de conversa e chamadas de ferramentas do que o Gemini 3.5. Isso também reduz a espiral do loop de execução.
- Geração de código aprimorada:produz código pronto para produção de alta qualidade com menos edições indesejadas e menos loops de depuração.
- Melhor compreensão de comandos: reduz as mudanças indesejadas em arquivos durante tarefas de diagnóstico.
- Raciocínio espacial e multimodal avançado:melhoria na performance de interpretação de gráficos, conversão de projetos visuais e geração de layouts da Web com vários elementos.
- Inspeção programática inicial:prefere executar scripts de código de diagnóstico antes de fazer mudanças com mais frequência do que o Gemini 3.5 Flash. Isso melhora a acurácia em tarefas complexas, mas pode adicionar etapas exploratórias extras ao trabalho rotineiro de front-end.
- Suporte ao uso de computadores:compatível como uma ferramenta integrada para automação de interface do usuário com agentes.
- Preferência de estilo da interface: melhor na criação de código funcional, embora os avaliadores humanos tenham preferido modelos anteriores para layout visual e estilo. Você pode reduzir esse problema fornecendo diretrizes de design explícitas.
- Esforço de raciocínio padrão (médio): usa o mesmo nível de raciocínio padrão
mediumdo Gemini 3.5 Flash. - Preços reduzidos: custos mais baixos de tokens de saída (US$ 7,50/1 milhão em vez de US $9,00/1 milhão para o 3.5 Flash). Os tokens de entrada permanecem em US $1,50/1 milhão.
Novidades do Gemini 3.5 Flash-Lite
- Latência de execução de tarefas reduzida:maior capacidade de processamento na família 3.5 para análise de dados de alto volume e extração de documentos.
- Raciocínio aprimorado e desempenho multimodal:caminho de migração forte do Gemini 2.5 Flash, com pontuações mais altas em tarefas de raciocínio, como HLE (18,0% x 11,0%) e comparativos multimodais, como CharXIV (74,5% x 63,7%).
- Orquestração de subagentes e confiabilidade das ferramentas:melhora a confiabilidade da execução de ferramentas para execução de código, pesquisa e fluxos de trabalho do MCP. Aumentar o nível de pensamento para planejamento autônomo e tarefas complexas de subagentes.
- Melhoria na compreensão de documentos: melhora a acurácia na análise de documentos e na extração de dados estruturados. Teste níveis de pensamento mínimos e altos, dependendo da complexidade do documento.
- Programação interativa na Web e processamento de dados tabulares:tem um bom desempenho em JavaScript de front-end e processamento de dados tabulares ao planejar usando execução de código leve.
- Persistência do chatbot e da persona:melhor acompanhamento de instruções multiturno e consistência da persona em relação ao Gemini 3.1 Flash-Lite.
- Suporte ao uso de computadores:compatível como uma ferramenta integrada para automação de interface do usuário com agentes.
Como escolher o modelo certo do Flash ou do Flash-Lite
Use esta tabela para selecionar o modelo e o caminho de migração certos para suas cargas de trabalho.
Os dois modelos exigem a remoção de parâmetros de amostragem descontinuados (temperature, top_p, top_k) e turnos de modelo pré-preenchidos. Consulte
Mudanças na API para mais detalhes.
| Modelo | Principais casos de uso | Destino de migração recomendado |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
Geração de código, raciocínio espacial/multimodal, fluxos de trabalho agênticos de várias etapas | Gemini 3.5 Flash, Gemini 3 Flash (pré-lançamento) ou Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
Execução autônoma de subagentes, análise de dados e extração de documentos de alto volume, análise JSON estruturada | Gemini 3.1 Flash-Lite ou Gemini 2.5 Flash |
Suporte ao agente do Antigravity
O Gemini 3.6 Flash passou a oferecer suporte ao agente do Antigravity nos Agentes Gerenciados do Gemini.
Para conferir exemplos de código atuais e a configuração padrão mais recente do agente, consulte o guia do agente Antigravity e o guia do Gemini 3.8 Flash.
Mudanças na API e atualizações de parâmetros
A partir do Gemini 3.6 Flash e do Gemini 3.5 Flash Lite, as seguintes mudanças na API se aplicam a esses modelos e a todas as versões futuras do modelo do Gemini.
- Descontinuação do parâmetro de amostragem:
temperature,top_petop_kforam descontinuados. A API ignora esses parâmetros e retorna um erro em gerações futuras de modelos. - Validação de turnos de modelo preenchidos automaticamente: não há mais suporte para o preenchimento automático de turnos de modelo. Se a última interação não vazia na solicitação for uma interação
model, a API vai retornar um erro400.
As seções a seguir fornecem explicações detalhadas e exemplos de código para cada mudança na API.
1. Descontinuação do parâmetro de amostragem (temperature, top_p, top_k)
temperature, top_p e top_k estão descontinuados e são ignorados. Em gerações futuras de modelos, fornecer esses parâmetros vai retornar um erro HTTP 400. Remova esses parâmetros de todas as solicitações.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
Para melhorar o determinismo, defina uma instrução do sistema com regras explícitas para seu caso de uso específico.
2. Validação de turno de modelo preenchido automaticamente
As solicitações de API que terminam com uma ação de função de modelo não vazia não são permitidas e retornam um erro HTTP 400.
⚠️ Evite
Em payloads REST brutos ou generateContent legados, não é mais permitido terminar com uma troca de função do modelo:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ Migração recomendada (API Interactions)
Na API Interactions, as respostas do modelo não são pré-preenchidas manualmente. Se o aplicativo tiver preenchido previamente uma ação do modelo para suprimir preâmbulos ou forçar a formatação JSON, use system_instruction ou Saídas estruturadas.
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
Checklist de migração
Gemini 3.6 Flash
Instale a habilidade:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplique a habilidade:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash Lite
Instale a habilidade:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplique a habilidade:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Migrar para o gemini-3.6-flash
- Atualizar ID do modelo:mude a string do modelo de destino para
gemini-3.6-flash. - Aplicar atualizações de parâmetros:remova os parâmetros de amostragem descontinuados (
temperature,top_p,top_k),candidate_count(sem suporte no Gemini 3 e versões mais recentes) e as rodadas de modelo pré-preenchidas, conforme detalhado em Atualizações de parâmetros e mudanças na API. - Configurar o nível de pensamento:substitua
thinking_budgetporthinking_level("medium"ou"high"). - Auditoria de chamadas de função:
- Coloque recursos multimodais no payload da resposta.
- Formate as instruções inline usando
\n\n. - Se você encontrar erros
Malformed_Function_Callrelacionados a texto anterior à ferramenta, consulte Soluções alternativas para requisitos de texto anterior à ferramenta.
- Requisitos básicos do Gemini 3.x:para atualizações do SDK e preservação da assinatura de pensamento, consulte Assinaturas de pensamento.
Migrar para o gemini-3.5-flash-lite
- Atualizar ID do modelo:mude a string do modelo de destino para
gemini-3.5-flash-lite. - Configurar o nível de esforço de pensamento:
- Para extração, encaminhamento ou classificação de alto volume, deixe
thinking_levelem"minimal"(padrão) para maximizar a capacidade de processamento. - Para subagentes autônomos com chamadas de função, execução de código ou raciocínio em várias etapas: defina
thinking_levelcomo"medium"ou"high"para evitar o encerramento prematuro da ferramenta.
- Para extração, encaminhamento ou classificação de alto volume, deixe
- Remover parâmetros descontinuados e validar chamadas de função:aplique as mesmas regras do Flash 3.6.
- Requisitos básicos do Gemini 3.x:consulte Assinaturas de pensamento.
Outros modelos
A seguir
- Revise as especificações da API na Visão geral dos modelos.
- Conheça a orquestração de vários agentes no guia da API Interactions.
- Teste e refine comandos no Google AI Studio.