模型

本指南将介绍可通过 Gemini API 使用的所有模型。


Gemini 3

稳定

Gemini 3.8 Flash

Google 最智能的 Flash 模型,专为长流程软件工程、自主智能体和复杂的企业工作流而打造。

稳定

Gemini 3.8 Live

大多数低延迟语音代理体验的默认 Live API 模型,没有推理延迟。

稳定

Gemini 3.8 Live(扩展思考)

用于语音互动的高推理 Live API 模型,建议在需要更高程度的背景推理时使用。

稳定

Gemini 3.7 Flash

上一代 Flash 模型,擅长处理复杂的编码、智能体工作流,并能可靠地执行多步任务。

稳定

Gemini 3.6 Flash

上一代 Flash 模型,可在一般智能体任务和日常任务中平衡速度和多模态功能。

稳定

Gemini 3.5 Flash

Google 的旧版 Flash 模型,可为日常高吞吐量工作负载提供基准速度和基础性能。

稳定

Gemini 3.5 Flash-Lite

我们速度最快、最具成本效益的 3.5 模型,可实现高吞吐量执行。

稳定

Gemini 3.1 Flash-Lite

以远低于大型模型的成本,实现可与 Frontier 级模型相媲美的性能。

稳定

Nano Banana 2

功能强大、高效的图片生成和编辑模型,专为极致速度与大规模量产场景而优化。

稳定

Nano Banana 2 Lite

超低延迟且经济高效的图片生成和编辑功能,专为高流量互动应用场景而设计。

稳定

Nano Banana Pro

前沿图片生成和编辑模型,可根据上下文高度相关地创建原生图片。

稳定

Gemini 3.5 Transcribe

低延迟语音转文字模型,支持基于话语的语言检测、讲话人区分和字词时间戳。

稳定

预览

所有 Gemini 3 模型

模型 端点
Gemini 3.8 Flash
gemini-3.8-flash
Gemini 3.8 Live
gemini-3.8-live
Gemini 3.8 Live Extended Thinking
gemini-3.8-live-extended-thinking
Gemini 3.7 Flash
gemini-3.7-flash
Gemini 3.6 Flash
gemini-3.6-flash
Gemini 3.5 Flash
gemini-3.5-flash
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Gemini 3.1 Flash-Lite
gemini-3.1-flash-lite
Nano Banana 2
gemini-3.1-flash-image
Nano Banana 2 Lite
gemini-3.1-flash-lite-image
Nano Banana Pro
gemini-3-pro-image
Gemini 3.1 Pro
gemini-3.1-pro-preview
Gemini 3 Flash
gemini-3-flash-preview
Gemini 3.5 实时翻译
gemini-3.5-live-translate-preview
Gemini 3.1 Flash Live
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS
gemini-3.1-flash-tts-preview
Gemini Omni Flash
gemini-omni-1.1-flash
Gemini 3.5 Transcribe
gemini-3.5-transcribe
gemini-3.5-transcribe-live

Gemini 2.5 Flash

模型 说明 端点
Gemini 2.5 Flash 在性价比方面表现出色的模型,适合需要推理的低延迟、高数据量任务。
gemini-2.5-flash
Nano Banana 前沿的原生图片生成和编辑功能,专为快速创意工作流而设计。
gemini-2.5-flash-image
Gemini 2.5 Flash Live 经过优化,可用于亚秒级原生音频流式传输的实时对话代理。
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS 可控的文字转语音音频生成,可精细控制风格和节奏。
gemini-2.5-flash-preview-tts

Gemini 2.5 Flash-Lite

模型 说明 端点
Gemini 2.5 Flash-Lite 2.5 系列中最快且最具预算友好性的多模态模型。
gemini-2.5-flash-lite

Gemini 2.5 Pro

模型 说明 端点
Gemini 2.5 Pro Google 旗下最先进的模型,可用于处理复杂任务,在 2.5 系列中具有出色的深度推理和编码能力。
gemini-2.5-pro
Gemini 2.5 Pro TTS 高保真语音合成,针对播客和有声读物等结构化工作流程中的质量进行了优化。
gemini-2.5-pro-preview-tts

音频模型

此部分包含所有音频模型,包括可能已在其他部分列出的模型

模型 说明 端点
Gemini 3.8 Live 大多数低延迟语音代理体验和实时对话的默认选项,不会出现推理延迟。
gemini-3.8-live
Gemini 3.8 Live Extended Thinking 我们的高推理音频转音频模型,建议在直播互动期间需要更高程度的背景推理时使用。
gemini-3.8-live-extended-thinking
Gemini 3.1 Flash Live 旧版音频转音频预览模型。我们建议您更新到 Gemini 3.8 Live。
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS 强大的低延迟语音生成能力,语音输出自然流畅,提示可引导,并新增了富有表现力的音频标记,可实现精准的旁白控制。
gemini-3.1-flash-tts-preview
Gemini 3.5 Transcribe 低延迟语音转文字模型,支持基于话语的语言检测、讲话人区分、字词级时间戳和自定义词汇纠偏。
gemini-3.5-transcribe
gemini-3.5-transcribe-live
Gemini 2.5 Flash Live 我们的旗舰版 Live API 模型,适用于低延迟、双向语音和视频代理,具有原生音频推理功能。
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS 快速且可控的文字转语音,适用于低延迟、经济实惠的应用和实时助理。
gemini-2.5-flash-preview-tts
Gemini 2.5 Pro TTS 高保真语音合成,针对播客和有声读物等结构化工作流程中的质量进行了优化。
gemini-2.5-pro-preview-tts

生成式媒体模型

此部分包含所有生成式媒体模型,包括可能已在其他部分列出的模型

模型 说明 端点
Nano Banana 2 高效的生产级视觉内容创作,将 Gemini 3 系列的智能与闪电般的生成速度相结合。
gemini-3.1-flash-image
Nano Banana 2 Lite 作为图片生成系列中的效率专家,可提供超低延迟且经济实惠的图片生成和编辑功能。
gemini-3.1-flash-lite-image
Veo 3.1 前沿电影级视频生成功能,支持高级创意控制和原生同步音频。
veo-3.1-generate-preview
Nano Banana Pro 一款专业的设计引擎,具有推理核心,可实现录音室品质的 4K 视觉效果、复杂的布局和精准的文字渲染。
gemini-3-pro-image
Veo 3.1 Lite Veo 3.1 系列提供高效、低成本、开发者优先的视频生成、编辑和电影级控制功能。
veo-3.1-lite-generate-preview
Gemini Omni Flash 快速生成视频、编辑视频、进行关键帧插值,以及使用原生音频进行扩展。
gemini-omni-1.1-flash
Nano Banana 前沿的原生图片生成和编辑功能,专为快速创意工作流而设计。
gemini-2.5-flash-image
Imagen 4(已弃用) 文生图模型,可快速和超快速生成图片,清晰度最高可达 2K 分辨率。
imagen-4.0-generate

音乐创作模型

此部分包含所有音乐创作模型,包括可能已在其他部分中列出的模型

模型 说明 端点
Lyria 3.5 Google 的旗舰版音乐创作模型,经过优化,可生成结构连贯复杂的完整歌曲。
lyria-3.5
Lyria 3 Clip 经过优化,可生成时长不超过 30 秒的短音乐片段、循环播放片段和预览片段。
lyria-3-clip-preview
Lyria 3 Pro 用于生成完整歌曲的上一代音乐生成模型。
lyria-3-pro-preview
Lyria RealTime 高保真音乐生成模型,可提供精细的创作控制和实时流式传输功能。
lyria-realtime-exp

工具和代理模型

模型 说明 端点
计算机使用 一种可以“看到”数字屏幕并执行点击、输入和导航等界面操作的专用模型,可自动执行复杂的浏览器任务。
gemini-2.5-computer-use-preview-10-2025
Gemini Deep Research 一种智能体模型,可自主规划和执行跨数百个来源的多步研究,以生成注明引用来源的交互式报告。
deep-research-preview-04-2026
Gemini Deep Research Max 可自动从数百个来源收集和整合上下文信息,实现最全面的信息覆盖。
deep-research-max-preview-04-2026
Antigravity Agent 一种通用托管式智能体,可在安全、隔离的 Linux 沙盒中自主规划、推理、运行代码、管理文件和浏览网页。
antigravity-preview-05-2026

专业任务模型

模型 说明 端点
Gemini Embedding 2 Google 的首款多模态嵌入模型,可将文本、图片、视频、音频和 PDF 映射到统一的嵌入空间中,以用于高级语义搜索和 RAG 系统。
gemini-embedding-2-preview
Gemini Embedding 高维向量表示法,适用于高级语义搜索、文本分类和 RAG 系统。
gemini-embedding-001
Gemini Robotics ER 2 具身推理模型,可提供高级视频理解、空间推理、多步工具编排和多机器人协作功能,以完成机器人任务。
gemini-robotics-er-2-preview
Gemini Robotics ER 1.6 先进的具身推理模型,可理解物理空间并为机器人代理规划多步任务,还具备读取仪器、改进空间和物理推理等新功能。
gemini-robotics-er-1.6-preview

之前的模型

模型 说明 端点
Gemini 2.0 Flash(已关闭) 我们的第二代主力模型,具备新一代特性和改进功能,包括卓越的速度、原生工具使用和 100 万个 token 的上下文窗口。
gemini-2.0-flash
Gemini 2.0 Flash-Lite(已关闭) Google 速度最快的第二代模型,经过优化,提高了成本效益并缩短了延迟时间。
gemini-2.0-flash-lite
Gemini 3.1 Flash-Lite 预览版(已关闭) Google 最具成本效益的多模态模型,可为高频轻量级任务提供最快的性能。
gemini-3.1-flash-lite-preview
Gemini 3 Pro 预览版(已关闭) 我们前沿的推理模型,具有先进的多模态理解能力。
gemini-3-pro-preview

模型版本名称模式

Gemini 模型有稳定版预览版最新版实验版

稳定

指向特定的稳定模型。稳定版模型通常不会发生变化。大多数正式版应用都应使用特定的稳定模型。

例如:gemini-3.6-flash

预览

指向可用于生产的预览版模型。预览版模型通常会启用结算功能,可能具有更严格的速率限制,并且会在至少提前 2 周通知的情况下被弃用。

例如:gemini-2.5-flash-preview-09-2025

最新

指向特定模型变体的最新版本。可以是稳定版、预览版或实验版。此别名将随着特定型号变体的每次新发布而进行热交换。对于破坏性更改,我们会在更改倒数第二个版本之前通过电子邮件提供两周的通知

例如:gemini-flash-latest

实验性

指向实验性模型,该模型通常不适合用于生产环境,并且具有更严格的速率限制。我们会发布实验性模型,以便收集反馈并快速将最新更新提供给开发者。

实验性模型不稳定,模型端点的可用性可能会发生变化。

模型弃用

如需了解模型弃用,请访问 Gemini 弃用页面。