Novidades do Gemini 3.6 Flash e 3.5 Flash-Lite

Modelo mais recente Outros modelos

O Gemini 3.6 Flash (gemini-3.6-flash) e o Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) são versões da geração anterior da série Gemini 3 e continuam disponíveis para uso em produção. Para conhecer nosso modelo Flash mais recente, consulte Gemini 3.8 Flash.

  • Gemini 3.6 Flash: melhor desempenho em tarefas complexas de agentes e multimodais, além de reduzir o uso de tokens a um preço menor do que o 3.5 Flash.
  • Gemini 3.5 Flash-Lite: o modelo mais rápido e de menor custo da família 3.5. Supera as gerações anteriores do Flash-Lite para execução de alta capacidade de processamento.

Este guia explica o que foi introduzido em cada modelo, quais mudanças na API afetam seu código e como migrar.

Gemini 3.6 Flash

  1. Instale a habilidade:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Aplique a habilidade:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash Lite

  1. Instale a habilidade:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Aplique a habilidade:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Novos modelos

Modelo ID do modelo Nível de raciocínio padrão Preços Descrição
Gemini 3.6 Flash gemini-3.6-flash medium US$ 1,50/1 milhão de tokens de entrada e US $7,50/1 milhão de tokens de saída Equilibra velocidade e inteligência para tarefas agênticas e multimodais.
Gemini 3.5 Flash Lite gemini-3.5-flash-lite minimal US$ 0,30/1 milhão de tokens de entrada e US $2,50/1 milhão de tokens de saída O modelo 3.5 mais rápido e de menor custo para execução de alta taxa de transferência.

Os dois modelos oferecem suporte à janela de contexto de 1 milhão de tokens, 64 mil tokens de saída máxima, raciocínio e o conjunto completo de ferramentas integradas, incluindo Uso do computador.

Para especificações completas, consulte as páginas do modelo:

Para saber os preços detalhados, consulte a página de preços.

Guia de início rápido

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions"       -H "x-goog-api-key: $GEMINI_API_KEY"       -H 'Content-Type: application/json'       -X POST       -d '{
    "model": "gemini-3.6-flash",
    "input": "Write a three.js script that renders an interactive 3D robot."
  }'

Novidades do Gemini 3.6 Flash

  • Redução de tokens e turnos:conclui fluxos de trabalho de várias etapas com menos etapas de raciocínio, turnos de conversa e chamadas de ferramentas do que o Gemini 3.5. Isso também reduz a espiral do loop de execução.
  • Geração de código aprimorada:produz código pronto para produção de alta qualidade com menos edições indesejadas e menos loops de depuração.
  • Melhor compreensão de comandos: reduz as mudanças indesejadas em arquivos durante tarefas de diagnóstico.
  • Raciocínio espacial e multimodal avançado:melhoria na performance de interpretação de gráficos, conversão de projetos visuais e geração de layouts da Web com vários elementos.
  • Inspeção programática inicial:prefere executar scripts de código de diagnóstico antes de fazer mudanças com mais frequência do que o Gemini 3.5 Flash. Isso melhora a acurácia em tarefas complexas, mas pode adicionar etapas exploratórias extras ao trabalho rotineiro de front-end.
  • Suporte ao uso de computadores:compatível como uma ferramenta integrada para automação de interface do usuário com agentes.
  • Preferência de estilo da interface: melhor na criação de código funcional, embora os avaliadores humanos tenham preferido modelos anteriores para layout visual e estilo. Você pode reduzir esse problema fornecendo diretrizes de design explícitas.
  • Esforço de raciocínio padrão (médio): usa o mesmo nível de raciocínio padrão medium do Gemini 3.5 Flash.
  • Preços reduzidos: custos mais baixos de tokens de saída (US$ 7,50/1 milhão em vez de US $9,00/1 milhão para o 3.5 Flash). Os tokens de entrada permanecem em US $1,50/1 milhão.

Novidades do Gemini 3.5 Flash-Lite

  • Latência de execução de tarefas reduzida:maior capacidade de processamento na família 3.5 para análise de dados de alto volume e extração de documentos.
  • Raciocínio aprimorado e desempenho multimodal:caminho de migração forte do Gemini 2.5 Flash, com pontuações mais altas em tarefas de raciocínio, como HLE (18,0% x 11,0%) e comparativos multimodais, como CharXIV (74,5% x 63,7%).
  • Orquestração de subagentes e confiabilidade das ferramentas:melhora a confiabilidade da execução de ferramentas para execução de código, pesquisa e fluxos de trabalho do MCP. Aumentar o nível de pensamento para planejamento autônomo e tarefas complexas de subagentes.
  • Melhoria na compreensão de documentos: melhora a acurácia na análise de documentos e na extração de dados estruturados. Teste níveis de pensamento mínimos e altos, dependendo da complexidade do documento.
  • Programação interativa na Web e processamento de dados tabulares:tem um bom desempenho em JavaScript de front-end e processamento de dados tabulares ao planejar usando execução de código leve.
  • Persistência do chatbot e da persona:melhor acompanhamento de instruções multiturno e consistência da persona em relação ao Gemini 3.1 Flash-Lite.
  • Suporte ao uso de computadores:compatível como uma ferramenta integrada para automação de interface do usuário com agentes.

Como escolher o modelo certo do Flash ou do Flash-Lite

Use esta tabela para selecionar o modelo e o caminho de migração certos para suas cargas de trabalho.

Os dois modelos exigem a remoção de parâmetros de amostragem descontinuados (temperature, top_p, top_k) e turnos de modelo pré-preenchidos. Consulte Mudanças na API para mais detalhes.

Modelo Principais casos de uso Destino de migração recomendado
Gemini 3.6 Flash
gemini-3.6-flash
Geração de código, raciocínio espacial/multimodal, fluxos de trabalho agênticos de várias etapas Gemini 3.5 Flash, Gemini 3 Flash (pré-lançamento) ou Gemini 3.1 Pro
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Execução autônoma de subagentes, análise de dados e extração de documentos de alto volume, análise JSON estruturada Gemini 3.1 Flash-Lite ou Gemini 2.5 Flash

Suporte ao agente do Antigravity

O Gemini 3.6 Flash passou a oferecer suporte ao agente do Antigravity nos Agentes Gerenciados do Gemini.

Para conferir exemplos de código atuais e a configuração padrão mais recente do agente, consulte o guia do agente Antigravity e o guia do Gemini 3.8 Flash.

Mudanças na API e atualizações de parâmetros

A partir do Gemini 3.6 Flash e do Gemini 3.5 Flash Lite, as seguintes mudanças na API se aplicam a esses modelos e a todas as versões futuras do modelo do Gemini.

  • Descontinuação do parâmetro de amostragem: temperature, top_p e top_k foram descontinuados. A API ignora esses parâmetros e retorna um erro em gerações futuras de modelos.
  • Validação de turnos de modelo preenchidos automaticamente: não há mais suporte para o preenchimento automático de turnos de modelo. Se a última interação não vazia na solicitação for uma interação model, a API vai retornar um erro 400.

As seções a seguir fornecem explicações detalhadas e exemplos de código para cada mudança na API.

1. Descontinuação do parâmetro de amostragem (temperature, top_p, top_k)

temperature, top_p e top_k estão descontinuados e são ignorados. Em gerações futuras de modelos, fornecer esses parâmetros vai retornar um erro HTTP 400. Remova esses parâmetros de todas as solicitações.

# ⚠️ Remove these parameters (deprecated)
generation_config = {
     "temperature": 0.7,
     "top_p": 0.9,
     "top_k": 40,
}

Para melhorar o determinismo, defina uma instrução do sistema com regras explícitas para seu caso de uso específico.

2. Validação de turno de modelo preenchido automaticamente

As solicitações de API que terminam com uma ação de função de modelo não vazia não são permitidas e retornam um erro HTTP 400.

⚠️ Evite

Em payloads REST brutos ou generateContent legados, não é mais permitido terminar com uma troca de função do modelo:

/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
  "contents": [
    {"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
    {"role": "model", "parts": [{"text": "Translation:"}]}  /* ❌ Returns error */
  ]
}

Na API Interactions, as respostas do modelo não são pré-preenchidas manualmente. Se o aplicativo tiver preenchido previamente uma ação do modelo para suprimir preâmbulos ou forçar a formatação JSON, use system_instruction ou Saídas estruturadas.

# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Translate 'Hello world' to Spanish.",
    system_instruction="Output only the translation without introductory text.",
)

Checklist de migração

Gemini 3.6 Flash

  1. Instale a habilidade:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Aplique a habilidade:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash Lite

  1. Instale a habilidade:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Aplique a habilidade:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Migrar para o gemini-3.6-flash

  • Atualizar ID do modelo:mude a string do modelo de destino para gemini-3.6-flash.
  • Aplicar atualizações de parâmetros:remova os parâmetros de amostragem descontinuados (temperature, top_p, top_k), candidate_count (sem suporte no Gemini 3 e versões mais recentes) e as rodadas de modelo pré-preenchidas, conforme detalhado em Atualizações de parâmetros e mudanças na API.
  • Configurar o nível de pensamento:substitua thinking_budget por thinking_level ("medium" ou "high").
  • Auditoria de chamadas de função:
  • Requisitos básicos do Gemini 3.x:para atualizações do SDK e preservação da assinatura de pensamento, consulte Assinaturas de pensamento.

Migrar para o gemini-3.5-flash-lite

  • Atualizar ID do modelo:mude a string do modelo de destino para gemini-3.5-flash-lite.
  • Configurar o nível de esforço de pensamento:
    • Para extração, encaminhamento ou classificação de alto volume, deixe thinking_level em "minimal" (padrão) para maximizar a capacidade de processamento.
    • Para subagentes autônomos com chamadas de função, execução de código ou raciocínio em várias etapas: defina thinking_level como "medium" ou "high" para evitar o encerramento prematuro da ferramenta.
  • Remover parâmetros descontinuados e validar chamadas de função:aplique as mesmas regras do Flash 3.6.
  • Requisitos básicos do Gemini 3.x:consulte Assinaturas de pensamento.

Outros modelos

A seguir