En esta guía, se presentan todos los modelos disponibles a través de la API de Gemini.
Gemini 3
Estable
Gemini 3.8 Flash
Nuestro modelo Flash más inteligente, diseñado para ingeniería de software a largo plazo, agentes autónomos y flujos de trabajo empresariales complejos.
Nuevo Estable
Gemini 3.8 Live
Modelo de API de Live predeterminado para la mayoría de las experiencias de agentes de voz con baja latencia y sin demoras en el razonamiento.
Nuevo Estable
Gemini 3.8 Live Extended Thinking
Modelo de la API de Live con alta capacidad de razonamiento para interacciones por voz, recomendado cuando se requiere un mayor razonamiento en segundo plano.
Nuevo Estable
Gemini 3.7 Flash
Es nuestro modelo Flash de generación anterior para la programación compleja, los flujos de trabajo de agentes y la ejecución confiable de varios pasos.
Estable
Gemini 3.6 Flash
Es nuestro modelo Flash de generación anterior, que equilibra la velocidad y las capacidades multimodales en las tareas generales y cotidianas.
Estable
Gemini 3.5 Flash
Es nuestro modelo Flash heredado, que proporciona velocidad de referencia y rendimiento básico para cargas de trabajo rutinarias de alta capacidad de procesamiento.
Estable
Gemini 3.5 Flash-Lite
Nuestro modelo 3.5 más rápido y rentable para la ejecución de alto rendimiento.
Estable
Gemini 3.1 Flash-Lite
Rendimiento de clase Frontier que compite con modelos más grandes a una fracción del costo.
Estable
Nano Banana 2
Generación y edición de imágenes potentes y de alta eficiencia, optimizadas para la velocidad y los casos de uso de gran volumen.
Estable
Nano Banana 2 Lite
Generación y edición de imágenes rentables y de latencia ultrabaja, diseñadas para casos de uso interactivos de alto volumen.
Estable
Nano Banana Pro
Modelos de estado del arte de generación y edición de imágenes para la creación de imágenes nativas altamente contextuales.
Estable
Gemini 3.5 Transcribe
Modelo de voz a texto de baja latencia con detección de idiomas basada en expresiones, identificación de interlocutores y marcas de tiempo de palabras.
Nuevo Estable
Vista previa
Gemini 3.1 Pro
Inteligencia avanzada, habilidades para resolver problemas complejos y potentes capacidades de codificación de agentes y de ambiente.
Vista previa
Gemini 3 Flash
Rendimiento de clase Frontier que compite con modelos más grandes a una fracción del costo.
Vista previa
Gemini 3.5 Live Translate
Modelo de traducción de voz a voz en tiempo real y de baja latencia que admite más de 70 idiomas.
Nuevo
Gemini 3.1 Flash Live
Es el modelo de vista previa de la API de Live heredada. Te recomendamos que actualices a Gemini Live 3.8.
Nuevo
TTS de Gemini 3.1 Flash
Generación de voz potente y de baja latencia
Nuevo
Gemini Omni Flash
Generación y edición de videos rápidas, interpolación de fotogramas clave y extensión con audio nativo
Nuevo
Todos los modelos de Gemini 3
| Modelo | Extremo |
|---|---|
| Gemini 3.8 Flash | gemini-3.8-flash |
| Gemini 3.8 Live | gemini-3.8-live |
| Gemini 3.8 Live Extended Thinking | gemini-3.8-live-extended-thinking |
| Gemini 3.7 Flash | gemini-3.7-flash |
| Gemini 3.6 Flash | gemini-3.6-flash |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.5 Live Translate | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| TTS de Gemini 3.1 Flash | gemini-3.1-flash-tts-preview |
| Gemini Omni Flash | gemini-omni-1.1-flash |
| Gemini 3.5 Transcribe | gemini-3.5-transcribe |
Gemini 2.5 Flash
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 2.5 Flash | Nuestro mejor modelo de relación precio-rendimiento para tareas de gran volumen y baja latencia que requieren razonamiento. | gemini-2.5-flash |
| Nano Banana | Generación y edición de imágenes nativas de vanguardia diseñadas para flujos de trabajo creativos y rápidos. | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | Se optimizó para agentes conversacionales en tiempo real con transmisión de audio nativa de menos de un segundo. | gemini-2.5-flash-native-audio-preview-12-2025 |
| TTS de Gemini 2.5 Flash | Generación de audio de texto a voz controlable con un control preciso sobre el estilo y el ritmo. | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 2.5 Flash-Lite | Es el modelo multimodal más rápido y económico de la familia 2.5. | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 2.5 Pro | Nuestro modelo más avanzado para tareas complejas, que incluye capacidades de razonamiento y programación profundas en la familia 2.5. | gemini-2.5-pro |
| TTS de Gemini 2.5 Pro | Síntesis de voz de alta fidelidad optimizada para la calidad en flujos de trabajo estructurados, como podcasts y audiolibros. | gemini-2.5-pro-preview-tts |
Modelos de audio
En esta sección, se incluyen todos los modelos de audio, incluidos los que ya se pueden encontrar en otras secciones
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 3.8 Live | Es la opción predeterminada para la mayoría de las experiencias de agentes de voz de baja latencia y diálogos en tiempo real sin demoras en el razonamiento. | gemini-3.8-live |
| Gemini 3.8 Live Extended Thinking | Nuestro modelo de audio a audio de alta capacidad de razonamiento, recomendado cuando se requiere un mayor razonamiento en segundo plano durante las interacciones en vivo. | gemini-3.8-live-extended-thinking |
| Gemini 3.1 Flash Live | Es el modelo heredado de vista previa de audio a audio. Te recomendamos que actualices a Gemini Live 3.8. | gemini-3.1-flash-live-preview |
| TTS de Gemini 3.1 Flash | Generación de voz potente y de baja latencia, con resultados naturales, instrucciones guiadas y nuevas etiquetas de audio expresivas para un control preciso de la narración. | gemini-3.1-flash-tts-preview |
| Gemini 3.5 Transcribe | Modelo de voz a texto de baja latencia con detección de idioma basada en expresiones, identificación de interlocutores, marcas de tiempo a nivel de palabra y ponderación de vocabulario personalizado. | gemini-3.5-transcribe |
| Gemini 2.5 Flash Live | Nuestro modelo insignia de la API de Live para agentes de voz y video bidireccionales con baja latencia y razonamiento de audio nativo. | gemini-2.5-flash-native-audio-preview-12-2025 |
| TTS de Gemini 2.5 Flash | Text-to-Speech rápido y controlable para aplicaciones rentables y de baja latencia, y asistentes en tiempo real. | gemini-2.5-flash-preview-tts |
| TTS de Gemini 2.5 Pro | Síntesis de voz de alta fidelidad optimizada para la calidad en flujos de trabajo estructurados, como podcasts y audiolibros. | gemini-2.5-pro-preview-tts |
Modelos de contenido multimedia generativo
En esta sección, se incluyen todos los modelos de medios generados por IA, incluidos los que ya se pueden enumerar en otras secciones
| Modelo | Descripción | Extremo |
|---|---|---|
| Nano Banana 2 | Creación visual a escala de producción y alta eficiencia, que combina la inteligencia de la serie Gemini 3 con velocidades de generación ultrarrápidas. | gemini-3.1-flash-image |
| Nano Banana 2 Lite | Diseñado como el especialista en eficiencia de la familia de modelos de generación de imágenes, ofrece generación y edición de imágenes rentables y con latencia ultrabaja. | gemini-3.1-flash-lite-image |
| Veo 3.1 | Generación de videos cinematográficos de estado del arte con controles creativos avanzados y audio sincronizado de forma nativa. | veo-3.1-generate-preview |
| Nano Banana Pro | Un motor de diseño profesional con un núcleo de razonamiento para imágenes 4K de calidad de estudio, diseños complejos y renderización de texto precisa. | gemini-3-pro-image |
| Veo 3.1 Lite | Generación, edición y control cinematográfico de video de alta eficiencia, bajo costo y con enfoque en los desarrolladores de la familia Veo 3.1. | veo-3.1-lite-generate-preview |
| Gemini Omni Flash | Generación y edición de videos rápidas, interpolación de fotogramas clave y extensión con audio nativo | gemini-omni-1.1-flash |
| Nano Banana | Generación y edición de imágenes nativas de vanguardia diseñadas para flujos de trabajo creativos y rápidos. | gemini-2.5-flash-image |
| Imagen 4 (obsoleta) | Modelo de texto a imagen que ofrece una generación rápida y ultrarrápida, y una claridad excepcional con una resolución de hasta 2K. | imagen-4.0-generate |
Modelos de generación de música
En esta sección, se incluyen todos los modelos de generación de música, incluidos los que ya se pueden enumerar en otras secciones
| Modelo | Descripción | Extremo |
|---|---|---|
| Lyria 3.5 | Nuestro modelo insignia de generación de música, optimizado para canciones de larga duración con coherencia estructural compleja. | lyria-3.5 |
| Lyria 3 Clip | Está optimizado para generar clips musicales cortos, bucles y vistas previas de hasta 30 segundos. | lyria-3-clip-preview |
| Lyria 3 Pro | Modelo de generación de música de generación anterior para canciones completas. | lyria-3-pro-preview |
| Lyria RealTime | Modelo de generación de música de alta fidelidad que proporciona control creativo detallado y capacidades de transmisión en tiempo real. | lyria-realtime-exp |
Modelos de herramientas y agentes
| Modelo | Descripción | Extremo |
|---|---|---|
| Uso de computadoras | Es un modelo especializado que puede "ver" una pantalla digital y realizar acciones de IU, como hacer clic, escribir y navegar, para automatizar tareas complejas del navegador. | gemini-2.5-computer-use-preview-10-2025 |
| Deep Research de Gemini | Es un modelo basado en agentes que planifica y ejecuta de forma autónoma investigaciones de varios pasos en cientos de fuentes para producir informes interactivos y citados. | deep-research-preview-04-2026 |
| Gemini Deep Research Max | Máxima exhaustividad para la recopilación y síntesis automatizadas de contexto en cientos de fuentes | deep-research-max-preview-04-2026 |
| Agente de Antigravity | Es un agente administrado de uso general que planifica, razona, ejecuta código, administra archivos y navega por la Web de forma autónoma dentro de una zona de pruebas de Linux segura y aislada. | antigravity-preview-05-2026 |
Modelos especializados para tareas
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini Embedding 2 | Nuestro primer modelo de embedding multimodal, que asigna texto, imágenes, videos, audio y PDFs a un espacio de embedding unificado para sistemas avanzados de búsqueda semántica y RAG. | gemini-embedding-2-preview |
| Embedding de Gemini | Representaciones vectoriales de alta dimensión para la búsqueda semántica avanzada, la clasificación de texto y los sistemas RAG. | gemini-embedding-001 |
| Gemini Robotics ER 2 | Modelo de razonamiento incorporado que ofrece comprensión avanzada de videos, razonamiento espacial, organización de herramientas de varios pasos y colaboración entre varios robots para tareas de robótica. | gemini-robotics-er-2-preview |
| Gemini Robotics ER 1.6 | Modelo avanzado de razonamiento incorporado que comprende los espacios físicos y planifica tareas de varios pasos para agentes robóticos con nuevas capacidades, como la lectura de instrumentos y un razonamiento espacial y físico mejorado. | gemini-robotics-er-1.6-preview |
Modelos anteriores
| Modelo | Descripción | Extremo |
|---|---|---|
| Gemini 2.0 Flash (cerrado) | Nuestro modelo de segunda generación, con funciones de nueva generación y capacidades mejoradas, como mayor velocidad, uso de herramientas nativas y una ventana de contexto de 1 millón de tokens. | gemini-2.0-flash |
| Gemini 2.0 Flash-Lite (cerrado) | Es nuestro modelo de segunda generación más rápido, optimizado para ser rentable y tener una baja latencia. | gemini-2.0-flash-lite |
| Versión preliminar de Gemini 3.1 Flash-Lite (cerrada) | Es nuestro modelo multimodal más rentable, que ofrece el rendimiento más rápido para tareas ligeras y de alta frecuencia. | gemini-3.1-flash-lite-preview |
| Versión preliminar de Gemini 3 Pro (cerrada) | Nuestro modelo de razonamiento de vanguardia, con comprensión multimodal avanzada. | gemini-3-pro-preview |
Patrones de nombres de versiones del modelo
Los modelos de Gemini están disponibles en versiones estables, preliminares, más recientes o experimentales.
Estable
Apunta a un modelo estable específico. Los modelos estables no suelen cambiar. La mayoría de las apps de producción deben usar un modelo estable específico.
Por ejemplo: gemini-3.6-flash.
Vista previa
Apunta a un modelo de vista previa que se puede usar para la producción. Por lo general, los modelos de vista previa tendrán habilitada la facturación, podrían tener límites de frecuencia más restrictivos y se dejarán de usar con una notificación con al menos 2 semanas de anticipación.
Por ejemplo: gemini-2.5-flash-preview-09-2025.
Más recientes
Apunta a la versión más reciente de una variación de modelo específica. Puede ser una versión estable, de vista previa o experimental. Este alias se intercambiará en caliente con cada nuevo lanzamiento de una variación de modelo específica. En el caso de los cambios rotundos, se proporcionará un aviso de 2 semanas por correo electrónico antes de que se cambie la versión anterior a la más reciente.
Por ejemplo: gemini-flash-latest.
Experimental
Apunta a un modelo experimental que, por lo general, no será adecuado para el uso en producción y tendrá límites de frecuencia más restrictivos. Lanzamos modelos experimentales para recopilar comentarios y poner nuestras actualizaciones más recientes en manos de los desarrolladores rápidamente.
Los modelos experimentales no son estables y la disponibilidad de los extremos de los modelos está sujeta a cambios.
Bajas de modelos
Para obtener información sobre las bajas de modelos, visita la página Bajas de Gemini.