模型

本指南將介紹 Gemini API 提供的所有模型。


Gemini 3

穩定

Gemini 3.8 Flash

這是我們最聰明的 Flash 模型,專為長期軟體工程、自主代理和複雜的企業工作流程而設計。

穩定版

Gemini 3.8 Live

大多數低延遲語音代理程式體驗的預設 Live API 模型,不會有推論延遲。

穩定版

Gemini 3.8 Live Extended Thinking

高推理 Live API 模型,適用於語音互動,建議在需要較高背景推論時使用。

穩定版

Gemini 3.7 Flash

Google 前一代的 Flash 模型,適用於複雜的程式設計、代理工作流程,以及可靠的多步驟執行作業。

穩定

Gemini 3.6 Flash

上一代 Flash 模型,可在一般代理和日常工作之間,兼顧速度和多模態功能。

穩定

Gemini 3.5 Flash

這是我們舊版的 Flash 模型,可為例行的高處理量工作負載提供基本速度和基礎效能。

穩定

Gemini 3.5 Flash-Lite

這是 Google 速度最快、最具成本效益的 3.5 模型,適合執行高輸送量作業。

穩定

Gemini 3.1 Flash-Lite

效能可與大型模型匹敵,但成本遠低於大型模型。

穩定

Nano Banana 2

功能強大且效率極高的圖像生成和編輯工具,可快速處理大量用途。

穩定

Nano Banana 2 Lite

超低延遲且符合成本效益的圖像生成和編輯模型,專為高流量互動式用途設計。

穩定

Nano Banana Pro

最先進的圖像生成和編輯模型,可根據情境建立原生圖像。

穩定

Gemini 3.5 Transcribe

低延遲語音轉文字模型,可根據語句偵測語言、進行說話者分段標記,並提供字詞時間戳記。

穩定版

預覽

所有 Gemini 3 模型

模型 端點
Gemini 3.8 Flash
gemini-3.8-flash
Gemini 3.8 Live
gemini-3.8-live
Gemini 3.8 Live Extended Thinking
gemini-3.8-live-extended-thinking
Gemini 3.7 Flash
gemini-3.7-flash
Gemini 3.6 Flash
gemini-3.6-flash
Gemini 3.5 Flash
gemini-3.5-flash
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Gemini 3.1 Flash-Lite
gemini-3.1-flash-lite
Nano Banana 2
gemini-3.1-flash-image
Nano Banana 2 Lite
gemini-3.1-flash-lite-image
Nano Banana Pro
gemini-3-pro-image
Gemini 3.1 Pro
gemini-3.1-pro-preview
Gemini 3 Flash
gemini-3-flash-preview
Gemini 3.5 Live Translate
gemini-3.5-live-translate-preview
Gemini 3.1 Flash Live
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS
gemini-3.1-flash-tts-preview
Gemini Omni Flash
gemini-omni-1.1-flash
Gemini 3.5 Transcribe
gemini-3.5-transcribe
gemini-3.5-transcribe-live

Gemini 2.5 Flash

模型 說明 端點
Gemini 2.5 Flash 我們提供最佳成本效益的模型,適用於需要推論能力的大量低延遲工作。
gemini-2.5-flash
Nano Banana 最先進的原生圖像生成和編輯功能,可快速完成創作工作流程。
gemini-2.5-flash-image
Gemini 2.5 Flash Live 專為即時對話式代理程式設計,可串流原生音訊,延遲時間不到一秒。
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS 可控制的文字轉語音音訊生成,可精細控制風格和節奏。
gemini-2.5-flash-preview-tts

Gemini 2.5 Flash-Lite

模型 說明 端點
Gemini 2.5 Flash-Lite 2.5 系列中速度最快、最經濟實惠的多模態模型。
gemini-2.5-flash-lite

Gemini 2.5 Pro

模型 說明 端點
Gemini 2.5 Pro 這是 Google 最先進的模型,專為處理複雜任務而設計,具備 2.5 系列的深度推論和程式設計能力。
gemini-2.5-pro
Gemini 2.5 Pro TTS 高傳真語音合成技術,可針對 Podcast 和有聲書等結構化工作流程,生成高品質語音。
gemini-2.5-pro-preview-tts

音訊模型

這個部分包含所有音訊模型,包括可能已列在其他部分中的模型

模型 說明 端點
Gemini 3.8 Live 適用於大多數低延遲語音代理體驗,以及沒有推論延遲的即時對話。
gemini-3.8-live
Gemini 3.8 Live Extended Thinking 高推理語音轉語音模型,建議在即時互動時需要較高背景推論能力時使用。
gemini-3.8-live-extended-thinking
Gemini 3.1 Flash Live 舊版音訊轉音訊預覽模型。建議更新至 Gemini 3.8 Live。
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS 生成語音的延遲時間短,輸出內容自然,可使用提示詞控制,並提供新的生動音訊標記,精準控制旁白。
gemini-3.1-flash-tts-preview
Gemini 3.5 Transcribe 低延遲的語音轉文字模型,可根據語句偵測語言、進行說話者分段標記、提供字詞層級的時間戳記,以及優先辨識自訂詞彙。
gemini-3.5-transcribe
gemini-3.5-transcribe-live
Gemini 2.5 Flash Live 我們的旗艦 Live API 模型,適用於低延遲的雙向語音和視訊代理程式,並具備原生音訊推論功能。
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS 快速生成可控制的文字轉語音音訊,適用於延遲時間短、經濟實惠的應用程式和即時助理。
gemini-2.5-flash-preview-tts
Gemini 2.5 Pro TTS 高傳真語音合成技術,可針對 Podcast 和有聲書等結構化工作流程,生成高品質語音。
gemini-2.5-pro-preview-tts

生成式媒體模型

這個部分包含所有生成式媒體模型,包括可能已列在其他部分中的模型

模型 說明 端點
Nano Banana 2 結合 Gemini 3 系列的智慧功能和極快的生成速度,高效製作大量圖片。
gemini-3.1-flash-image
Nano Banana 2 Lite 專為圖像生成系列設計的效率專家,提供超低延遲和具成本效益的圖像生成及編輯功能。
gemini-3.1-flash-lite-image
Veo 3.1 運用最先進的技術生成電影風格影片,並提供進階創作控制選項,以及原生同步音訊。
veo-3.1-generate-preview
Nano Banana Pro 專業設計引擎,具備推論核心,可生成攝影棚品質的 4K 影像、複雜版面配置,以及精確的文字算繪。
gemini-3-pro-image
Veo 3.1 Lite Veo 3.1 系列模型可供開發人員高效益、低成本地生成及編輯影片,並控制電影風格。
veo-3.1-lite-generate-preview
Gemini Omni Flash 快速生成及編輯影片、關鍵影格插補,以及搭配原生音訊擴充。
gemini-omni-1.1-flash
Nano Banana 最先進的原生圖像生成和編輯功能,可快速完成創作工作流程。
gemini-2.5-flash-image
Imagen 4 (已淘汰) 文字轉圖像模型,可快速和超快速生成圖像,解析度最高可達 2K,畫質極為清晰。
imagen-4.0-generate

音樂生成模型

這個專區包含所有音樂生成模型,包括可能已列在其他專區的模型

模型 說明 端點
Lyria 3.5 Google 的旗艦音樂生成模型,可生成結構複雜且連貫的完整歌曲。
lyria-3.5
Lyria 3 Clip 最適合生成短音樂片段、循環和試聽內容,最長 30 秒。
lyria-3-clip-preview
Lyria 3 Pro 前一代音樂生成模型,可生成完整歌曲。
lyria-3-pro-preview
Lyria RealTime 高擬真音樂生成模型,可提供精細的創作控制選項和即時串流功能。
lyria-realtime-exp

工具和代理模型

模型 說明 端點
電腦使用 這個專門模型可以「看到」數位螢幕,並執行點按、輸入和瀏覽等 UI 動作,自動執行複雜的瀏覽器工作。
gemini-2.5-computer-use-preview-10-2025
Gemini Deep Research 自主規劃並執行多步驟研究的代理模型,可從數百個來源取得資訊,並生成附帶出處的互動式報告。
deep-research-preview-04-2026
Gemini Deep Research Max 自動從數百個來源收集和統整情境資訊,盡可能提供最全面的資訊。
deep-research-max-preview-04-2026
Antigravity Agent 這項功能是用途廣泛的受管理代理,可在安全隔離的 Linux 沙箱中自主規劃、推論、執行程式碼、管理檔案及瀏覽網路。
antigravity-preview-05-2026

專用工作模型

模型 說明 端點
Gemini Embedding 2 這是我們第一個多模態嵌入模型,可將文字、圖片、影片、音訊和 PDF 檔案對應至統一的嵌入空間,以供進階語意搜尋和 RAG 系統使用。
gemini-embedding-2-preview
Gemini Embedding 高維度向量表示法,適用於進階語意搜尋、文字分類和 RAG 系統。
gemini-embedding-001
Gemini Robotics ER 2 具身推論模型可提供進階影片理解、空間推論、多步驟工具調度管理,以及多機器人協作功能,協助執行機器人工作。
gemini-robotics-er-2-preview
Gemini Robotics ER 1.6 進階具體化推理模型,可瞭解實體空間,並為機器人代理程式規劃多步驟工作,具備儀器讀取、空間和實體推理等新功能。
gemini-robotics-er-1.6-preview

舊款機型

模型 說明 端點
Gemini 2.0 Flash (已關閉) 這是我們的第二代主力模型,具備新一代功能和改良能力,包括速度更快、可使用原生工具,以及 100 萬個詞元的脈絡窗口。
gemini-2.0-flash
Gemini 2.0 Flash-Lite (已關閉) 這是我們速度最快的第二代模型,延遲時間最短,成本效益最高。
gemini-2.0-flash-lite
Gemini 3.1 Flash-Lite 預先發布版 (已關閉) 這是我們成本效益最高的多模態模型,可快速執行輕量型工作,且執行頻率高。
gemini-3.1-flash-lite-preview
Gemini 3 Pro 預先發布版 (已關閉) Google 最先進的推論模型,具備進階多模態理解能力。
gemini-3-pro-preview

模型版本名稱模式

Gemini 模型提供穩定預先發布最新實驗版本。

穩定

指向特定穩定版模型。穩定模型通常不會變更。大多數正式版應用程式應使用特定穩定模型。

例如:gemini-3.6-flash

預覽

指向可用於正式環境的預覽模型。預先發布版模型通常會啟用帳單功能,可能會有更嚴格的速率限制,且至少會提前 2 週通知停用。

例如:gemini-2.5-flash-preview-09-2025

最新

指向特定模型變體的最新版本。可以是穩定版、預覽版或實驗版。每當特定模型變體發布新推出時,這個別名就會熱切換。如有破壞性變更,我們會在變更最新版本之前的版本時,提前 2 週透過電子郵件通知您。

例如:gemini-flash-latest

實驗功能

指向實驗模型,通常不適合用於正式版,且有更嚴格的速率限制。我們發布實驗模型是為了收集意見回饋,並快速將最新更新內容提供給開發人員。

實驗性模型不穩定,模型端點的可用性可能會有所變動。

模型淘汰

如要瞭解模型淘汰項目,請前往「Gemini 淘汰項目」頁面。