Este guia apresenta todos os modelos disponíveis na API Gemini.
Gemini 3
Estável
Gemini 3.8 Flash
Nosso modelo Flash mais inteligente, projetado para engenharia de software de longo prazo, agentes autônomos e fluxos de trabalho empresariais complexos.
Nova estável
Gemini 3.7 Flash
Nosso modelo Flash de geração anterior para programação complexa, fluxos de trabalho agênticos e execução confiável em várias etapas.
Estável
Gemini 3.6 Flash
Nosso modelo Flash de geração anterior, que equilibra velocidade e recursos multimodais em tarefas gerais e cotidianas.
Estável
Gemini 3.5 Flash
Nosso modelo Flash legado, que oferece velocidade básica e desempenho fundamental para cargas de trabalho rotineiras e de alta capacidade de processamento.
Estável
Gemini 3.5 Flash Lite
Nosso modelo 3.5 mais rápido e econômico para execução de alta capacidade.
Estável
Gemini 3.1 Flash-Lite
Desempenho de classe Frontier rivalizando com modelos maiores a uma fração do custo.
Estável
Nano Banana 2
Geração e edição de imagens potentes e de alta eficiência, otimizadas para velocidade e casos de uso de alto volume.
Estável
Nano Banana 2 Lite
Geração e edição de imagens com latência ultrabaixa e econômica, projetada para casos de uso interativos de alto volume.
Estável
Nano Banana Pro
Modelos de edição e geração de imagens de última geração para criação de imagens nativas altamente contextuais.
Estável
Gemini 3.5 Transcribe
Modelo de conversão de voz em texto de baixa latência com detecção de idioma baseada em enunciados, diarização de locutor e carimbos de data/hora por palavra.
Nova estável
Visualizar
Gemini 3.1 Pro
Inteligência avançada, habilidades complexas de resolução de problemas e recursos avançados de codificação de agentes e de vibe.
Visualizar
Gemini 3 Flash
Desempenho de classe Frontier rivalizando com modelos maiores a uma fração do custo.
Visualizar
Gemini 3.5 Live Translate
Modelo de tradução de voz para voz em tempo real e com baixa latência que oferece suporte a mais de 70 idiomas.
Nova
Gemini 3.1 Flash Live
Modelo de API Live de alta qualidade e baixa latência para aplicativos de IA que priorizam a voz e diálogos em tempo real.
Nova
Gemini 3.1 Flash TTS
Geração de fala avançada e com baixa latência.
Nova
Gemini Omni Flash
Geração, edição, interpolação de quadros-chave e extensão de vídeo rápidos com áudio nativo.
Nova
Todos os modelos do Gemini 3
| Modelo | Endpoint |
|---|---|
| Gemini 3.8 Flash | gemini-3.8-flash |
| Gemini 3.7 Flash | gemini-3.7-flash |
| Gemini 3.6 Flash | gemini-3.6-flash |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.5 Live Translate | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | gemini-3.1-flash-tts-preview |
| Gemini Omni Flash | gemini-omni-1.1-flash |
| Gemini 3.5 Transcribe | gemini-3.5-transcribe |
Gemini 2.5 Flash
| Modelo | Descrição | Endpoint |
|---|---|---|
| Gemini 2.5 Flash | Nosso melhor modelo de custo-benefício para tarefas de baixa latência e alto volume que exigem raciocínio. | gemini-2.5-flash |
| Nano Banana | Geração e edição de imagens nativas de última geração projetadas para fluxos de trabalho rápidos e criativos. | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | Otimizado para agentes de conversa em tempo real com streaming de áudio nativo em menos de um segundo. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Geração de áudio de conversão de texto em voz controlável com controle refinado sobre estilo e ritmo. | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash Lite
| Modelo | Descrição | Endpoint |
|---|---|---|
| Gemini 2.5 Flash-Lite | O modelo multimodal mais rápido e econômico da família 2.5. | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| Modelo | Descrição | Endpoint |
|---|---|---|
| Gemini 2.5 Pro | Nosso modelo mais avançado para tarefas complexas, com recursos de raciocínio e programação avançados na família 2.5. | gemini-2.5-pro |
| Gemini 2.5 Pro TTS | Síntese de voz de alta fidelidade otimizada para qualidade em fluxos de trabalho estruturados, como podcasts e audiolivros. | gemini-2.5-pro-preview-tts |
Modelos de áudio
Esta seção contém todos os modelos de áudio, incluindo aqueles que já podem estar listados em outras seções.
| Modelo | Descrição | Endpoint |
|---|---|---|
| Gemini 3.1 Flash Live | Nosso modelo de áudio para áudio (A2A) de alta qualidade e baixa latência foi projetado para diálogos em tempo real e aplicativos de IA com foco na voz. | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | Geração de fala potente e de baixa latência, com saídas naturais, comandos direcionáveis e novas tags de áudio expressivas para controle preciso da narração. | gemini-3.1-flash-tts-preview |
| Gemini 3.5 Transcribe | Modelo de conversão de voz em texto de baixa latência com detecção de idioma baseada em enunciados, diarização de locutor, carimbos de data/hora no nível da palavra e polarização de vocabulário personalizado. | gemini-3.5-transcribe |
| Gemini 2.5 Flash Live | Nosso principal modelo de API Live para agentes de voz e vídeo bidirecionais de baixa latência com raciocínio de áudio nativo. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Text-to-speech rápido e controlável para aplicativos econômicos e de baixa latência e assistentes em tempo real. | gemini-2.5-flash-preview-tts |
| Gemini 2.5 Pro TTS | Síntese de voz de alta fidelidade otimizada para qualidade em fluxos de trabalho estruturados, como podcasts e audiolivros. | gemini-2.5-pro-preview-tts |
Modelos de mídia generativa
Esta seção contém todos os modelos de mídia generativa, incluindo aqueles que já podem estar listados em outras seções.
| Modelo | Descrição | Endpoint |
|---|---|---|
| Nano Banana 2 | Criação visual de alta eficiência e em escala de produção, combinando a inteligência da série Gemini 3 com velocidades de geração extremamente rápidas. | gemini-3.1-flash-image |
| Nano Banana 2 Lite | Projetado como especialista em eficiência da família de geração de imagens, oferecendo latência ultrabaixa e geração e edição de imagens econômicas. | gemini-3.1-flash-lite-image |
| Veo 3.1 | Geração de vídeos cinematográficos de última geração com controles criativos avançados e áudio sincronizado nativamente. | veo-3.1-generate-preview |
| Nano Banana Pro | Um mecanismo de design profissional com um núcleo de raciocínio para recursos visuais 4K com qualidade de estúdio, layouts complexos e renderização de texto precisa. | gemini-3-pro-image |
| Veo 3.1 Lite | Geração, edição e controle cinematográfico de vídeo de alta eficiência, baixo custo e prioridade para desenvolvedores da família Veo 3.1. | veo-3.1-lite-generate-preview |
| Gemini Omni Flash | Geração, edição, interpolação de quadros-chave e extensão de vídeo rápidos com áudio nativo. | gemini-omni-1.1-flash |
| Nano Banana | Geração e edição de imagens nativas de última geração projetadas para fluxos de trabalho rápidos e criativos. | gemini-2.5-flash-image |
| Imagen 4 (descontinuado) | Modelo de texto para imagem com geração rápida e ultrarrápida e clareza excepcional em resoluções de até 2K. | imagen-4.0-generate |
Modelos de geração de música
Esta seção contém todos os modelos de geração de música, incluindo aqueles que já podem estar listados em outras seções.
| Modelo | Descrição | Endpoint |
|---|---|---|
| Lyria 3.5 | Nosso modelo principal de geração de música, otimizado para músicas completas com coerência estrutural complexa. | lyria-3.5 |
| Lyria 3 Clip | Otimizado para gerar clipes musicais curtos, loops e prévias de até 30 segundos. | lyria-3-clip-preview |
| Lyria 3 Pro | Modelo de geração de músicas de geração anterior para músicas completas. | lyria-3-pro-preview |
| Lyria RealTime | Modelo de geração de música de alta fidelidade que oferece controle criativo granular e recursos de streaming em tempo real. | lyria-realtime-exp |
Modelos de ferramentas e agentes
| Modelo | Descrição | Endpoint |
|---|---|---|
| Uso do computador | Um modelo especializado que pode "ver" uma tela digital e realizar ações de interface, como clicar, digitar e navegar para automatizar tarefas complexas do navegador. | gemini-2.5-computer-use-preview-10-2025 |
| Deep Research do Gemini | Um modelo agêntico que planeja e executa de forma autônoma pesquisas de várias etapas em centenas de fontes para produzir relatórios interativos com citações. | deep-research-preview-04-2026 |
| Deep Research Max do Gemini | Máxima abrangência para coleta e síntese automatizadas de contexto em centenas de fontes. | deep-research-max-preview-04-2026 |
| Agente do Antigravity | Um agente gerenciado de uso geral que planeja, raciocina, executa código, gerencia arquivos e navega na Web de forma autônoma em um sandbox do Linux seguro e isolado. | antigravity-preview-05-2026 |
Modelos de tarefas especializadas
| Modelo | Descrição | Endpoint |
|---|---|---|
| Gemini Embedding 2 | Nosso primeiro modelo de embedding multimodal, que mapeia texto, imagens, vídeo, áudio e PDFs em um espaço de embedding unificado para pesquisa semântica avançada e sistemas RAG. | gemini-embedding-2-preview |
| Embedding do Gemini | Representações vetoriais de alta dimensão para pesquisa semântica avançada, classificação de texto e sistemas RAG. | gemini-embedding-001 |
| Gemini Robotics ER 2 | Modelo de raciocínio incorporado que oferece compreensão avançada de vídeo, raciocínio espacial, orquestração de ferramentas de várias etapas e colaboração entre vários robôs para tarefas de robótica. | gemini-robotics-er-2-preview |
| Gemini Robotics ER 1.6 | Modelo avançado de raciocínio incorporado que entende espaços físicos e planeja tarefas de várias etapas para agentes robóticos com novos recursos, como leitura de instrumentos e raciocínio espacial e físico aprimorado. | gemini-robotics-er-1.6-preview |
Modelos anteriores
| Modelo | Descrição | Endpoint |
|---|---|---|
| Gemini 2.0 Flash (desativado) | Nosso modelo de segunda geração, com recursos de última geração e capacidades aprimoradas, incluindo velocidade superior, uso de ferramentas nativas e uma janela de contexto de 1 milhão de tokens. | gemini-2.0-flash |
| Gemini 2.0 Flash-Lite (desativado) | Nosso modelo de segunda geração mais rápido, otimizado para eficiência de custo e baixa latência. | gemini-2.0-flash-lite |
| Pré-lançamento do Gemini 3.1 Flash-Lite (desativado) | Nosso modelo multimodal mais econômico, que oferece o desempenho mais rápido para tarefas leves e de alta frequência. | gemini-3.1-flash-lite-preview |
| Pré-lançamento do Gemini 3 Pro (desativado) | Nosso modelo de raciocínio de última geração, com compreensão multimodal avançada. | gemini-3-pro-preview |
Padrões de nome da versão do modelo
Os modelos do Gemini estão disponíveis nas versões estável, prévia, mais recente ou experimental.
Estável
Aponta para um modelo estável específico. Modelos estáveis geralmente não mudam. A maioria dos apps de produção precisa usar um modelo estável específico.
Por exemplo, gemini-3.6-flash.
Visualizar
Aponta para um modelo de prévia que pode ser usado na produção. Normalmente, os modelos de prévia têm o faturamento ativado, podem vir com limites de taxa mais restritivos e são descontinuados com um aviso de pelo menos duas semanas.
Por exemplo, gemini-2.5-flash-preview-09-2025.
Mais recentes
Aponta para a versão mais recente de uma variação de modelo específica. Ela pode ser uma versão estável, de prévia ou experimental. Esse alias será trocado a quente com cada nova versão de uma variação de modelo específica. Para mudanças interruptivas, um aviso de duas semanas será enviado por e-mail antes da mudança da versão anterior à mais recente.
Por exemplo, gemini-flash-latest.
Experimental
Aponta para um modelo experimental que normalmente não é adequado para uso em produção e vem com limites de taxa mais restritivos. Lançamos modelos experimentais para coletar feedback e disponibilizar nossas atualizações mais recentes para os desenvolvedores rapidamente.
Os modelos experimentais não são estáveis, e a disponibilidade dos endpoints de modelo está sujeita a mudanças.
Suspensões de uso de modelos
Para informações sobre descontinuações de modelos, acesse a página Descontinuações do Gemini.