Gemini 3.6 Flash (gemini-3.6-flash) 和 Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) 已正式發布,可供正式環境使用。
- Gemini 3.6 Flash:在複雜的代理功能和多模態任務上提供更強大的效能,同時減少詞元用量,價格也比 3.5 Flash 更低。
- Gemini 3.5 Flash-Lite:3.5 系列中速度最快、成本最低的模型。 執行高處理量工作時,效能優於先前的 Flash-Lite 版本。
本指南說明各模型的新功能、影響程式碼的 API 變更,以及如何遷移。
Gemini 3.6 Flash
安裝技能:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global套用技能:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
安裝技能:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global套用技能:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
全新模型
| 模型 | 模型 ID | 預設思考程度 | 定價 | 說明 |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
每 100 萬個輸入權杖 $1.50 美元,每 100 萬個輸出權杖 $7.50 美元 | 兼顧速度和智慧,適用於代理式和多模態工作。 |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
每 100 萬個輸入權杖 $0.30 美元,每 100 萬個輸出權杖 $2.50 美元 | 速度最快、成本最低的 3.5 模型,適合執行高輸送量作業。 |
這兩款模型都支援 100 萬個詞元的脈絡窗口、最多 64,000 個輸出詞元、思考功能,以及全套內建工具,包括電腦使用。
如需完整規格,請參閱以下型號頁面:
如需詳細定價資訊,請參閱定價頁面。
快速入門導覽課程
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Gemini 3.6 Flash 最新消息
- 減少詞元和對話輪數:與 Gemini 3.5 相比,完成多步驟工作流程時,推論步驟、對話輪數和工具呼叫次數都較少。這也有助於減少執行迴圈螺旋。
- 提升程式碼生成品質:生成可直接用於正式環境的程式碼,減少不必要的編輯和偵錯迴圈。
- 更準確地遵循指令:減少診斷工作期間不必要的檔案變更。
- 強大的多模態和空間推論能力:提升圖表解讀、視覺藍圖轉換和多元素網頁版面配置生成效能。
- 預先進行程式檢查:與 Gemini 3.5 Flash 相比,Gemini 2.0 Flash 更常在進行變更前執行診斷程式碼指令碼。這項功能可提高複雜工作的準確度,但可能會在例行前端工作增加額外的探索步驟。
- 電腦使用支援:支援做為代理 UI 自動化的內建工具。
- UI 樣式偏好設定:更擅長建立實用程式碼,但就視覺版面配置和樣式而言,人類評估人員偏好先前的模型。您可以提供明確的設計準則,藉此減輕這類問題。
- 預設思考強度 (中):使用與 Gemini 3.5 Flash 相同的
medium預設思考強度。 - 價格更低:輸出權杖費用較低 (每 100 萬個權杖 $7.50 美元,相較於 3.5 Flash 的每 100 萬個權杖 $9.00 美元)。輸入權杖的價格仍為每 100 萬個 $1.50 美元。
Gemini 3.5 Flash-Lite 最新消息
- 縮短工作執行延遲時間:在 3.5 系列中,這個模型的處理量最高,適合用於大量資料剖析和文件擷取作業。
- 提升推論和多模態效能:從 Gemini 2.5 Flash 順利遷移,在 HLE (18.0% 對 11.0%) 等推論工作和 CharXIV (74.5% 對 63.7%) 等多模態基準測試中,獲得更高的分數。
- 子代理自動化調度管理和工具穩定性:提升執行程式碼、搜尋和 MCP 工作流程的工具執行穩定性。提高自主規劃和複雜子代理程式任務的思考層次。
- 提升文件理解能力:提升文件剖析和結構化資料擷取的準確度。視文件複雜度,嘗試使用最低和最高思考程度。
- 互動式網頁程式設計和表格資料處理:透過使用輕量型執行程式碼作業進行規劃,在前端 JavaScript 和表格資料處理方面表現出色。
- 聊天機器人和角色設定持續性:相較於 Gemini 3.1 Flash-Lite,Gemini 1.5 Pro 在多輪對話中能更準確地遵循指令,並維持角色設定一致性。
- 電腦使用支援:支援做為代理 UI 自動化的內建工具。
選擇合適的 Flash 或 Flash-Lite 模型
請參閱下表,為工作負載選擇合適的模型和遷移路徑。
這兩個模型都必須移除已淘汰的取樣參數 (temperature、top_p、top_k) 和預先填入的模型輪流。詳情請參閱「API 變更」。
| 模型 | 主要應用實例 | 建議遷移目標 |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
程式碼生成、空間/多模態推論、多步驟代理工作流程 | Gemini 3.5 Flash、Gemini 3 Flash (預先發布版) 或 Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
自主執行子代理程式、大量資料分析和文件擷取、結構化 JSON 剖析 | Gemini 3.1 Flash-Lite 或 Gemini 2.5 Flash |
Antigravity 代理程式支援
Gemini 3.6 Flash 在 Gemini Managed Agents 中導入 Antigravity 代理程式支援。
如需目前的程式碼範例和最新的預設代理程式設定,請參閱 Antigravity 代理程式指南和 Gemini 3.8 Flash 指南。
API 變更和參數更新
從 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 開始,下列 API 變更將適用於這些模型和所有未來的 Gemini 模型版本。
- 淘汰取樣參數:已淘汰
temperature、top_p和top_k。API 會忽略這些參數,並在日後產生模型時傳回錯誤。 - 預填模型輪次驗證:系統已不再支援預填模型輪次。如果要求中最後一個非空白的輪替是
model輪替,API 會傳回400錯誤。
以下各節會詳細說明每項 API 變更,並提供程式碼範例。
1. 取樣參數已淘汰 (temperature、top_p、top_k)
temperature、top_p 和 top_k 已淘汰並遭到忽略。在未來的模型世代中,提供這些參數會傳回 HTTP 400 錯誤。從所有要求中移除這些參數。
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
如要提升確定性,請根據特定用途定義系統指令,並加入明確規則。
2. 預填模型輪次驗證
如果 API 要求以非空白的模型角色回合結尾,系統會禁止這類要求,並傳回 HTTP 400 錯誤。
⚠️ 避免
在舊版 generateContent 或原始 REST 酬載中,現在不允許以模型角色回合結尾:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ 建議的遷移方式 (Interactions API)
在 Interactions API 中,模型回合不會手動預先填入。如果應用程式先前預先填入模型回合,以抑制前言或強制採用 JSON 格式,請改用 system_instruction 或結構化輸出內容。
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
遷移檢查清單
Gemini 3.6 Flash
安裝技能:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global套用技能:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
安裝技能:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global套用技能:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
遷移至 gemini-3.6-flash
- 更新模型 ID:將目標模型字串變更為
gemini-3.6-flash。 - 套用參數更新:移除已淘汰的取樣參數 (
temperature、top_p、top_k)、candidate_count(Gemini 3 以上版本不支援),以及預先填入的模型輪流,詳情請參閱「API 異動和參數更新」。 - 設定思考程度:將
thinking_budget替換為thinking_level("medium"或"high")。 - 稽核函式呼叫:
- 將多模態資產放在回應酬載中。
- 使用
\n\n格式化內嵌指令。 - 如果看到與前工具文字相關的
Malformed_Function_Call錯誤,請參閱「前工具文字規定解決方法」。
- Gemini 3.x 基準需求:如要瞭解 SDK 更新和思維簽章保留作業,請參閱 Gemini 3.5 遷移檢查清單。
遷移至 gemini-3.5-flash-lite
- 更新模型 ID:將目標模型字串變更為
gemini-3.5-flash-lite。 - 設定思考深度:
- 如要大量擷取、轉送或分類:請將
thinking_level設為"minimal"(預設),以達到最大處理量。 - 如果是具有工具呼叫、執行程式碼或多步驟推論功能的自主子代理,請將
thinking_level設為"medium"或"high",避免工具過早終止。
- 如要大量擷取、轉送或分類:請將
- 移除已淘汰的參數並驗證函式呼叫:套用與 3.6 Flash 相同的規則。
- Gemini 3.x 基準需求:請參閱 Gemini 3.5 遷移檢查清單。
後續步驟
- 在「模型總覽」中查看 API 規格。
- 請參閱互動式 API 指南,瞭解多代理自動化調度管理。
- 在 Google AI Studio 測試及調整提示。