Gemini 3.6 Flash 和 3.5 Flash-Lite 最新消息

最新型號 其他型號

Gemini 3.6 Flash (gemini-3.6-flash) 和 Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) 已正式發布,可供正式環境使用。

  • Gemini 3.6 Flash:在複雜的代理功能和多模態任務上提供更強大的效能,同時減少詞元用量,價格也比 3.5 Flash 更低。
  • Gemini 3.5 Flash-Lite:3.5 系列中速度最快、成本最低的模型。 執行高處理量工作時,效能優於先前的 Flash-Lite 版本。

本指南說明各模型的新功能、影響程式碼的 API 變更,以及如何遷移。

Gemini 3.6 Flash

  1. 安裝技能:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. 套用技能:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. 安裝技能:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. 套用技能:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

全新模型

模型 模型 ID 預設思考程度 定價 說明
Gemini 3.6 Flash gemini-3.6-flash medium 每 100 萬個輸入權杖 $1.50 美元,每 100 萬個輸出權杖 $7.50 美元 兼顧速度和智慧,適用於代理式和多模態工作。
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal 每 100 萬個輸入權杖 $0.30 美元,每 100 萬個輸出權杖 $2.50 美元 速度最快、成本最低的 3.5 模型,適合執行高輸送量作業。

這兩款模型都支援 100 萬個詞元的脈絡窗口、最多 64,000 個輸出詞元、思考功能,以及全套內建工具,包括電腦使用。

如需完整規格,請參閱以下型號頁面:

如需詳細定價資訊,請參閱定價頁面。

快速入門導覽課程

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions"       -H "x-goog-api-key: $GEMINI_API_KEY"       -H 'Content-Type: application/json'       -X POST       -d '{
    "model": "gemini-3.6-flash",
    "input": "Write a three.js script that renders an interactive 3D robot."
  }'

Gemini 3.6 Flash 最新消息

  • 減少詞元和對話輪數:與 Gemini 3.5 相比,完成多步驟工作流程時,推論步驟、對話輪數和工具呼叫次數都較少。這也有助於減少執行迴圈螺旋。
  • 提升程式碼生成品質:生成可直接用於正式環境的程式碼,減少不必要的編輯和偵錯迴圈。
  • 更準確地遵循指令:減少診斷工作期間不必要的檔案變更。
  • 強大的多模態和空間推論能力:提升圖表解讀、視覺藍圖轉換和多元素網頁版面配置生成效能。
  • 預先進行程式檢查:與 Gemini 3.5 Flash 相比,Gemini 2.0 Flash 更常在進行變更前執行診斷程式碼指令碼。這項功能可提高複雜工作的準確度,但可能會在例行前端工作增加額外的探索步驟。
  • 電腦使用支援:支援做為代理 UI 自動化的內建工具。
  • UI 樣式偏好設定:更擅長建立實用程式碼,但就視覺版面配置和樣式而言,人類評估人員偏好先前的模型。您可以提供明確的設計準則,藉此減輕這類問題。
  • 預設思考強度 (中):使用與 Gemini 3.5 Flash 相同的medium預設思考強度。
  • 價格更低:輸出權杖費用較低 (每 100 萬個權杖 $7.50 美元,相較於 3.5 Flash 的每 100 萬個權杖 $9.00 美元)。輸入權杖的價格仍為每 100 萬個 $1.50 美元。

Gemini 3.5 Flash-Lite 最新消息

  • 縮短工作執行延遲時間:在 3.5 系列中,這個模型的處理量最高,適合用於大量資料剖析和文件擷取作業。
  • 提升推論和多模態效能:從 Gemini 2.5 Flash 順利遷移,在 HLE (18.0% 對 11.0%) 等推論工作和 CharXIV (74.5% 對 63.7%) 等多模態基準測試中,獲得更高的分數。
  • 子代理自動化調度管理和工具穩定性:提升執行程式碼、搜尋和 MCP 工作流程的工具執行穩定性。提高自主規劃和複雜子代理程式任務的思考層次。
  • 提升文件理解能力:提升文件剖析和結構化資料擷取的準確度。視文件複雜度,嘗試使用最低和最高思考程度。
  • 互動式網頁程式設計和表格資料處理:透過使用輕量型執行程式碼作業進行規劃,在前端 JavaScript 和表格資料處理方面表現出色。
  • 聊天機器人和角色設定持續性:相較於 Gemini 3.1 Flash-Lite,Gemini 1.5 Pro 在多輪對話中能更準確地遵循指令,並維持角色設定一致性。
  • 電腦使用支援:支援做為代理 UI 自動化的內建工具。

選擇合適的 Flash 或 Flash-Lite 模型

請參閱下表,為工作負載選擇合適的模型和遷移路徑。

這兩個模型都必須移除已淘汰的取樣參數 (temperature、top_p、top_k) 和預先填入的模型輪流。詳情請參閱「API 變更」。

模型 主要應用實例 建議遷移目標
Gemini 3.6 Flash
gemini-3.6-flash
程式碼生成、空間/多模態推論、多步驟代理工作流程 Gemini 3.5 Flash、Gemini 3 Flash (預先發布版) 或 Gemini 3.1 Pro
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
自主執行子代理程式、大量資料分析和文件擷取、結構化 JSON 剖析 Gemini 3.1 Flash-Lite 或 Gemini 2.5 Flash

Antigravity 代理程式支援

Gemini 3.6 Flash 在 Gemini Managed Agents 中導入 Antigravity 代理程式支援。

如需目前的程式碼範例和最新的預設代理程式設定,請參閱 Antigravity 代理程式指南和 Gemini 3.8 Flash 指南。

API 變更和參數更新

從 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 開始,下列 API 變更將適用於這些模型和所有未來的 Gemini 模型版本。

  • 淘汰取樣參數:已淘汰 temperature、top_p 和 top_k。API 會忽略這些參數,並在日後產生模型時傳回錯誤。
  • 預填模型輪次驗證:系統已不再支援預填模型輪次。如果要求中最後一個非空白的輪替是 model 輪替,API 會傳回 400 錯誤。

以下各節會詳細說明每項 API 變更,並提供程式碼範例。

1. 取樣參數已淘汰 (temperature、top_p、top_k)

temperature、top_p 和 top_k 已淘汰並遭到忽略。在未來的模型世代中,提供這些參數會傳回 HTTP 400 錯誤。從所有要求中移除這些參數。

# ⚠️ Remove these parameters (deprecated)
generation_config = {
     "temperature": 0.7,
     "top_p": 0.9,
     "top_k": 40,
}

如要提升確定性,請根據特定用途定義系統指令,並加入明確規則。

2. 預填模型輪次驗證

如果 API 要求以非空白的模型角色回合結尾,系統會禁止這類要求,並傳回 HTTP 400 錯誤。

⚠️ 避免

在舊版 generateContent 或原始 REST 酬載中,現在不允許以模型角色回合結尾:

/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
  "contents": [
    {"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
    {"role": "model", "parts": [{"text": "Translation:"}]}  /* ❌ Returns error */
  ]
}

在 Interactions API 中,模型回合不會手動預先填入。如果應用程式先前預先填入模型回合,以抑制前言或強制採用 JSON 格式,請改用 system_instruction 或結構化輸出內容。

# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Translate 'Hello world' to Spanish.",
    system_instruction="Output only the translation without introductory text.",
)

遷移檢查清單

Gemini 3.6 Flash

  1. 安裝技能:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. 套用技能:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. 安裝技能:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. 套用技能:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

遷移至 gemini-3.6-flash

  • 更新模型 ID:將目標模型字串變更為 gemini-3.6-flash。
  • 套用參數更新:移除已淘汰的取樣參數 (temperature、top_p、top_k)、candidate_count (Gemini 3 以上版本不支援),以及預先填入的模型輪流,詳情請參閱「API 異動和參數更新」。
  • 設定思考程度:將 thinking_budget 替換為 thinking_level ("medium" 或 "high")。
  • 稽核函式呼叫:
    • 將多模態資產放在回應酬載中。
    • 使用 \n\n 格式化內嵌指令。
    • 如果看到與前工具文字相關的 Malformed_Function_Call 錯誤,請參閱「前工具文字規定解決方法」。
  • Gemini 3.x 基準需求:如要瞭解 SDK 更新和思維簽章保留作業,請參閱 Gemini 3.5 遷移檢查清單。

遷移至 gemini-3.5-flash-lite

  • 更新模型 ID:將目標模型字串變更為 gemini-3.5-flash-lite。
  • 設定思考深度:
    • 如要大量擷取、轉送或分類:請將 thinking_level 設為 "minimal" (預設),以達到最大處理量。
    • 如果是具有工具呼叫、執行程式碼或多步驟推論功能的自主子代理,請將 thinking_level 設為 "medium" 或 "high",避免工具過早終止。
  • 移除已淘汰的參數並驗證函式呼叫:套用與 3.6 Flash 相同的規則。
  • Gemini 3.x 基準需求:請參閱 Gemini 3.5 遷移檢查清單。

後續步驟