En esta guía, se presentan todos los modelos disponibles a través de la API de Gemini.
Gemini 3
Estable
Gemini 3.6 Flash
Es nuestro modelo más reciente, que equilibra la velocidad con la inteligencia para ofrecer un rendimiento sólido en tareas de agentes y multimodales.
Estable
Gemini 3.5 Flash
Es el modelo más inteligente para un rendimiento de vanguardia sostenido en tareas de programación y con agentes.
Estable
Gemini 3.5 Flash-Lite
Es nuestro modelo 3.5 más rápido y rentable para la ejecución de alta capacidad de procesamiento.
Estable
Gemini 3.1 Flash-Lite
Rendimiento de clase Frontier que compite con modelos más grandes a una fracción del costo.
Estable
Nano Banana 2
Generación y edición de imágenes potentes y de alta eficiencia, optimizadas para la velocidad y los casos de uso de gran volumen.
Estable
Nano Banana 2 Lite
Generación y edición de imágenes rentables y de latencia ultrabaja, diseñadas para casos de uso interactivos de gran volumen.
Estable
Nano Banana Pro
Modelos de estado del arte de generación y edición de imágenes para la creación de imágenes nativas altamente contextuales.
Estable
Vista previa
Gemini 3.1 Pro
Inteligencia avanzada, habilidades para resolver problemas complejos y potentes capacidades de codificación de agentes y de ambiente.
Vista previa
Gemini 3 Flash
Rendimiento de clase Frontier que compite con modelos más grandes a una fracción del costo.
Vista previa
Gemini 3.5 Live Translate
Modelo de traducción de voz a voz en tiempo real y de baja latencia que admite más de 70 idiomas.
Vista previa Nueva
Gemini 3.1 Flash Live
Modelo de API de Live de alta calidad y baja latencia para aplicaciones de IA que privilegian la voz y el diálogo en tiempo real.
Vista previa Nueva
TTS de Gemini 3.1 Flash
Generación de voz potente y de baja latencia
Vista previa Nueva
Gemini Omni Flash
Generación y edición de videos rápidas y conversacionales. Convierte imágenes y texto en videos, y define los resultados con lenguaje natural.
Vista previa Nueva
Todos los modelos de Gemini 3
| Modelo | Extremo |
|---|---|
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.5 Live Translate | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| TTS de Gemini 3.1 Flash | gemini-3.1-flash-tts-preview |
Gemini 2.5 Flash
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 2.5 Flash | Nuestro mejor modelo de relación precio-rendimiento para tareas de gran volumen y baja latencia que requieren razonamiento. | gemini-2.5-flash |
| Nano Banana | Generación y edición de imágenes nativas de estado del arte diseñadas para flujos de trabajo creativos y rápidos. | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | Se optimizó para agentes conversacionales en tiempo real con transmisión de audio nativa de menos de un segundo. | gemini-2.5-flash-native-audio-preview-12-2025 |
| TTS de Gemini 2.5 Flash | Generación de audio de texto a voz controlable con un control preciso sobre el estilo y el ritmo. | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 2.5 Flash-Lite | Es el modelo multimodal más rápido y económico de la familia 2.5. | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 2.5 Pro | Nuestro modelo más avanzado para tareas complejas, que incluye capacidades de razonamiento y programación profundas en la familia 2.5. | gemini-2.5-pro |
| TTS de Gemini 2.5 Pro | Síntesis de voz de alta fidelidad optimizada para la calidad en flujos de trabajo estructurados, como podcasts y audiolibros. | gemini-2.5-pro-preview-tts |
Modelos de audio
En esta sección, se incluyen todos los modelos de audio, incluidos los que ya se pueden encontrar en otras secciones
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 3.1 Flash Live | Nuestro modelo de audio a audio (A2A) de alta calidad y baja latencia diseñado para diálogos en tiempo real y aplicaciones de IA centradas en la voz. | gemini-3.1-flash-live-preview |
| TTS de Gemini 3.1 Flash | Potente generación de voz de baja latencia, con resultados naturales, instrucciones guiadas y nuevas etiquetas de audio expresivas para un control preciso de la narración. | gemini-3.1-flash-tts-preview |
| Gemini 2.5 Flash Live | Nuestro modelo de API de Live insignia para agentes de voz y video bidireccionales de baja latencia con razonamiento de audio nativo. | gemini-2.5-flash-native-audio-preview-12-2025 |
| TTS de Gemini 2.5 Flash | Text-to-Speech rápido y controlable para aplicaciones rentables y de baja latencia, y asistentes en tiempo real. | gemini-2.5-flash-preview-tts |
| TTS de Gemini 2.5 Pro | Síntesis de voz de alta fidelidad optimizada para la calidad en flujos de trabajo estructurados, como podcasts y audiolibros. | gemini-2.5-pro-preview-tts |
Modelos de contenido multimedia generativo
En esta sección, se incluyen todos los modelos de medios generativos, incluidos los que ya se pueden enumerar en otras secciones
| Modelo | Descripción | Extremo |
|---|---|---|
| Nano Banana 2 | Creación visual a escala de producción y alta eficiencia, que combina la inteligencia de la serie Gemini 3 con velocidades de generación ultrarrápidas. | gemini-3.1-flash-image |
| Nano Banana 2 Lite | Diseñado como el especialista en eficiencia de la familia de generación de imágenes, ofrece generación y edición de imágenes rentables y de latencia ultrabaja. | gemini-3.1-flash-lite-image |
| Veo 3.1 | Generación de videos cinematográficos de estado del arte con controles creativos avanzados y audio sincronizado de forma nativa. | veo-3.1-generate-preview |
| Nano Banana Pro | Un motor de diseño profesional con un núcleo de razonamiento para imágenes 4K de calidad de estudio, diseños complejos y renderización de texto precisa. | gemini-3-pro-image |
| Veo 3.1 Lite | Generación, edición y control cinematográfico de video de alta eficiencia, bajo costo y con enfoque en los desarrolladores de la familia Veo 3.1. | veo-3.1-lite-generate-preview |
| Gemini Omni Flash | Generación y edición de videos rápidas y conversacionales. Convierte imágenes y texto en videos, y define los resultados con lenguaje natural. | gemini-omni-flash |
| Nano Banana | Generación y edición de imágenes nativas de estado del arte diseñadas para flujos de trabajo creativos y rápidos. | gemini-2.5-flash-image |
| Imagen 4 (obsoleta) | Modelo de texto a imagen que ofrece una generación rápida y ultrarrápida, y una claridad excepcional con una resolución de hasta 2K. | imagen-4.0-generate |
Modelos de generación de música
En esta sección, se incluyen todos los modelos de generación de música, incluidos los que ya se pueden enumerar en otras secciones
| Modelo | Descripción | Extremo |
|---|---|---|
| Lyria 3 Pro | Es nuestro modelo insignia de generación de música, optimizado para canciones de larga duración con coherencia estructural compleja. | lyria-3-pro-preview |
| Lyria 3 Clip | Está optimizado para generar clips musicales cortos, bucles y vistas previas de hasta 30 segundos. | lyria-3-clip-preview |
| Lyria RealTime | Modelo de generación de música de alta fidelidad que proporciona control creativo detallado y capacidades de transmisión en tiempo real. | lyria-realtime-exp |
Modelos de herramientas y agentes
| Modelo | Descripción | Extremo |
|---|---|---|
| Uso de computadoras | Es un modelo especializado que puede "ver" una pantalla digital y realizar acciones de la IU, como hacer clic, escribir y navegar, para automatizar tareas complejas del navegador. | gemini-2.5-computer-use-preview-10-2025 |
| Deep Research de Gemini | Es un modelo basado en agentes que planifica y ejecuta de forma autónoma investigaciones de varios pasos en cientos de fuentes para producir informes interactivos con citas. | deep-research-preview-04-2026 |
| Gemini Deep Research Max | Máxima exhaustividad para la recopilación y síntesis automatizadas de contexto en cientos de fuentes | deep-research-max-preview-04-2026 |
| Agente de Antigravity | Es un agente administrado de uso general que planifica, razona, ejecuta código, administra archivos y navega por la Web de forma autónoma dentro de una zona de pruebas de Linux segura y aislada. | antigravity-preview-05-2026 |
Modelos especializados para tareas
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini Embedding 2 | Nuestro primer modelo de embedding multimodal, que asigna texto, imágenes, videos, audio y PDFs a un espacio de embedding unificado para sistemas avanzados de búsqueda semántica y RAG. | gemini-embedding-2-preview |
| Embedding de Gemini | Representaciones vectoriales de alta dimensión para la búsqueda semántica avanzada, la clasificación de texto y los sistemas RAG. | gemini-embedding-001 |
| Gemini Robotics ER 2 | Modelo de razonamiento incorporado que ofrece comprensión avanzada de videos, razonamiento espacial, organización de herramientas de varios pasos y colaboración entre varios robots para tareas de robótica. | gemini-robotics-er-2-preview |
| Gemini Robotics ER 1.6 | Modelo avanzado de razonamiento incorporado que comprende los espacios físicos y planifica tareas de varios pasos para agentes robóticos con nuevas capacidades, como la lectura de instrumentos y un razonamiento espacial y físico mejorado. | gemini-robotics-er-1.6-preview |
Modelos anteriores
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 2.0 Flash (cerrado) | Nuestro modelo de segunda generación, con funciones de nueva generación y capacidades mejoradas, como velocidad superior, uso de herramientas nativas y una ventana de contexto de 1 millón de tokens. | gemini-2.0-flash |
| Gemini 2.0 Flash-Lite (cerrado) | Es nuestro modelo de segunda generación más rápido, optimizado para la rentabilidad y la baja latencia. | gemini-2.0-flash-lite |
| Versión preliminar de Gemini 3.1 Flash-Lite (cerrada) | Es nuestro modelo multimodal más rentable, que ofrece el rendimiento más rápido para tareas ligeras y de alta frecuencia. | gemini-3.1-flash-lite-preview |
| Versión preliminar de Gemini 3 Pro (cerrada) | Nuestro modelo de razonamiento de vanguardia, con comprensión multimodal avanzada. | gemini-3-pro-preview |
Patrones de nombres de versiones del modelo
Los modelos de Gemini están disponibles en versiones estables, preliminares, más recientes o experimentales.
Estable
Apunta a un modelo estable específico. Los modelos estables no suelen cambiar. La mayoría de las apps de producción deben usar un modelo estable específico.
Por ejemplo: gemini-3.6-flash.
Vista previa
Apunta a un modelo de vista previa que se puede usar para la producción. Por lo general, los modelos de vista previa tendrán habilitada la facturación, podrían tener límites de frecuencia más restrictivos y se dejarán de usar con una notificación de, al menos, 2 semanas de anticipación.
Por ejemplo: gemini-2.5-flash-preview-09-2025.
Más recientes
Apunta a la versión más reciente de una variación de modelo específica. Puede ser una versión estable, de vista previa o experimental. Este alias se intercambiará en caliente con cada nuevo lanzamiento de una variación de modelo específica. En el caso de los cambios rotundos, se proporcionará un aviso de 2 semanas por correo electrónico antes de que se cambie la versión anterior a la más reciente.
Por ejemplo: gemini-flash-latest.
Experimental
Apunta a un modelo experimental que, por lo general, no será adecuado para el uso en producción y tendrá límites de frecuencia más restrictivos. Lanzamos modelos experimentales para recopilar comentarios y poner nuestras actualizaciones más recientes en manos de los desarrolladores rápidamente.
Los modelos experimentales no son estables y la disponibilidad de los extremos de los modelos está sujeta a cambios.
Bajas de modelos
Para obtener información sobre las bajas de modelos, visita la página Bajas de Gemini.