模型

本指南将介绍可通过 Gemini API 使用的所有模型。


Gemini 3

稳定

预览

所有 Gemini 3 模型

模型 端点
Gemini 3.1 Pro
gemini-3.1-pro-preview
Gemini 3.5 Flash
gemini-3.5-flash
Gemini 3 Flash
gemini-3-flash-preview
Gemini 3.1 Flash-Lite
gemini-3.1-flash-lite
Nano Banana 2
gemini-3.1-flash-image
Nano Banana 2 Lite
gemini-3.1-flash-lite-image
Nano Banana Pro
gemini-3-pro-image
Gemini 3.5 实时翻译
gemini-3.5-live-translate-preview
Gemini 3.1 Flash Live
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS
gemini-3.1-flash-tts-preview

Gemini 2.5 Flash

模型 说明 端点
Gemini 2.5 Flash 在性价比方面表现出色的模型,适合需要推理的低延迟、高数据量任务。
gemini-2.5-flash
Nano Banana 前沿的原生图片生成和编辑功能,专为快速创意工作流而设计。
gemini-2.5-flash-image
Gemini 2.5 Flash Live 经过优化,可用于亚秒级原生音频流式传输的实时对话代理。
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS 可控的文字转语音音频生成,可精细控制风格和节奏。
gemini-2.5-flash-preview-tts

Gemini 2.5 Flash-Lite

模型 说明 端点
Gemini 2.5 Flash-Lite 2.5 系列中最快且最具预算友好性的多模态模型。
gemini-2.5-flash-lite

Gemini 2.5 Pro

模型 说明 端点
Gemini 2.5 Pro Google 旗下最先进的模型,可用于处理复杂任务,在 2.5 系列中具有出色的深度推理和编码能力。
gemini-2.5-pro
Gemini 2.5 Pro TTS 高保真语音合成,针对播客和有声读物等结构化工作流程中的质量进行了优化。
gemini-2.5-pro-preview-tts

音频模型

此部分包含所有音频模型,包括可能已在其他部分列出的模型

模型 说明 端点
Gemini 3.1 Flash Live Google 的高品质低延迟音频转音频 (A2A) 模型,专为实时对话和语音优先 AI 应用而设计。
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS 强大的低延迟语音生成能力,语音输出自然流畅,提示可引导,并新增了富有表现力的音频标记,可实现精准的旁白控制。
gemini-3.1-flash-tts-preview
Gemini 2.5 Flash Live 我们的旗舰版 Live API 模型,适用于低延迟、双向语音和视频代理,具有原生音频推理功能。
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS 快速且可控的文字转语音功能,适用于低延迟、经济实惠的应用和实时助理。
gemini-2.5-flash-preview-tts
Gemini 2.5 Pro TTS 高保真语音合成,针对播客和有声读物等结构化工作流程中的质量进行了优化。
gemini-2.5-pro-preview-tts

生成式媒体模型

此部分包含所有生成式媒体模型,包括可能已在其他部分列出的模型

模型 说明 端点
Nano Banana 2 高效的生产级视觉内容创作,将 Gemini 3 系列的智能与极快的生成速度相结合。
gemini-3.1-flash-image
Nano Banana 2 Lite 作为图像生成系列中的效率专家,可提供超低延迟且经济实惠的图像生成和编辑功能。
gemini-3.1-flash-lite-image
Veo 3.1 前沿电影级视频生成功能,支持高级创意控制和原生同步音频。
veo-3.1-generate-preview
Nano Banana Pro 一款专业的设计引擎,具有推理核心,可实现影棚级 4K 视觉效果、复杂布局和精准的文字渲染。
gemini-3-pro-image
Veo 3.1 Lite Veo 3.1 系列产品可高效、低成本地为开发者提供视频生成、编辑和电影级控制功能。
veo-3.1-lite-generate-preview
Gemini Omni Flash 快速生成和编辑视频,并支持对话式操作。将文字和图片转换为视频,并通过自然语言优化结果。
gemini-omni-flash
Nano Banana 前沿的原生图片生成和编辑功能,专为快速创意工作流而设计。
gemini-2.5-flash-image
Imagen 4(已弃用) 文生图模型,可快速和超快速生成图片,清晰度最高可达 2K 分辨率。
imagen-4.0-generate

音乐创作模型

此部分包含所有音乐创作模型,包括可能已在其他部分中列出的模型

模型 说明 端点
Lyria 3 Pro Google 的旗舰级音乐创作模型,经过优化,可生成结构连贯的完整歌曲。
lyria-3-pro-preview
Lyria 3 Clip 经过优化,可生成时长不超过 30 秒的短音乐片段、循环播放片段和预览片段。
lyria-3-clip-preview
Lyria RealTime 高保真音乐生成模型,可提供精细的创作控制和实时流式传输功能。
lyria-realtime-exp

工具和代理模型

模型 说明 端点
计算机使用 一种可以“看到”数字屏幕并执行点击、输入和导航等界面操作的专用模型,可自动执行复杂的浏览器任务。
gemini-2.5-computer-use-preview-10-2025
Gemini Deep Research 一种智能体模型,可自主规划和执行跨数百个来源的多步研究,以生成注明引用来源的交互式报告。
deep-research-preview-04-2026
Gemini Deep Research Max 可自动从数百个来源收集和整合上下文信息,实现最全面的信息覆盖。
deep-research-max-preview-04-2026
Antigravity Agent 一种通用型托管式智能体,可在安全、隔离的 Linux 沙盒中自主规划、推理、运行代码、管理文件和浏览网页。
antigravity-preview-05-2026

专业任务模型

模型 说明 端点
Gemini Embedding 2 Google 的首款多模态嵌入模型,可将文本、图片、视频、音频和 PDF 映射到统一的嵌入空间中,以用于高级语义搜索和 RAG 系统。
gemini-embedding-2-preview
Gemini Embedding 用于高级语义搜索、文本分类和 RAG 系统的高维向量表示法。
gemini-embedding-001
Gemini Robotics ER 2 一种具身推理模型,可提供高级视频理解、空间推理、多步工具编排和多机器人协作功能,以完成机器人任务。
gemini-robotics-er-2-preview
Gemini Robotics ER 1.6 先进的具身推理模型,可理解物理空间并为机器人代理规划多步任务,还具备读取仪器、改进空间和物理推理等新功能。
gemini-robotics-er-1.6-preview

之前的模型

模型 说明 端点
Gemini 2.0 Flash(已关闭) 我们的第二代主力模型,具备新一代特性和改进功能,包括卓越的速度、原生工具使用和 100 万个 token 的上下文窗口。
gemini-2.0-flash
Gemini 2.0 Flash-Lite(已关闭) Google 速度最快的第二代模型,经过优化,提高了成本效益并缩短了延迟时间。
gemini-2.0-flash-lite
Gemini 3.1 Flash-Lite 预览版(已关闭) Google 最具成本效益的多模态模型,可为高频轻量级任务提供最快的性能。
gemini-3.1-flash-lite-preview
Gemini 3 Pro 预览版(已关闭) 我们前沿的推理模型,具有先进的多模态理解能力。
gemini-3-pro-preview

模型版本名称模式

Gemini 模型有稳定版预览版最新版实验版

稳定

指向特定的稳定模型。稳定模型通常不会发生变化。大多数正式版应用都应使用特定的稳定模型。

例如:gemini-3.6-flash

预览

指向可用于生产的预览版模型。预览版模型通常会启用结算功能,可能具有更严格的速率限制,并且会在至少提前 2 周通知的情况下被弃用。

例如:gemini-2.5-flash-preview-09-2025

最新

指向特定模型变体的最新版本。可以是稳定版、预览版或实验版。此别名将随着特定型号变体的每次新发布而进行热交换。对于破坏性更改,我们会在版本落后于最新版本之前通过电子邮件提供两周的通知

例如:gemini-flash-latest

实验性

指向实验性模型,该模型通常不适合用于生产环境,并且速率限制更为严格。我们会发布实验性模型,以便收集反馈并快速将最新更新交付给开发者。

实验性模型不稳定,模型端点的可用性可能会发生变化。

模型弃用

如需了解模型弃用,请访问 Gemini 弃用页面。