Gemini API 是從提示到製作的最快途徑,可使用 Gemini、Veo、Nano Banana 等模型。您可將這些生成模型整合至應用程式,生成文字和圖片、分析多模態輸入內容,以及建構對話式代理程式。
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
按照入門指南操作,幾分鐘內即可取得 API 金鑰並發出第一個 API 呼叫。
認識各款機型
查看全部Gemini 3.8 Flash 新模型
這是我們最聰明的 Flash 模型,專為長期軟體工程、自主代理和複雜的企業工作流程而設計。
Gemini 3.5 Flash-Lite
這款模型符合成本效益,專為低延遲高處理量的子代理工作設計,適合處理大量資料。
Gemini 3.1 Pro
這是 Google 最聰明的模型,也是全球最出色的多模態理解模型,一切都建立在最先進的推論技術基礎。
Nano Banana 2 和 Nano Banana Pro
最先進的圖像生成及編輯模型。
Gemini Omni Flash
Google 最先進的影片生成和編輯模型。
Gemini 3.5 Transcribe 新功能
低延遲語音轉文字模型,可根據語句偵測語言、辨識說話者,並提供個別字詞的時間戳記。
Gemini Robotics
這款視覺語言模型 (VLM) 可將 Gemini 的代理功能帶入機器人領域,並在實體世界中進行進階推理。
探索各種功能
圖像生成
使用 Nano Banana 原生生成及編輯高度情境化的圖像。
長篇脈絡資訊
將數百萬個權杖輸入 Gemini 模型,從非結構化圖片、影片和文件中取得理解。
結構化輸出內容
限制 Gemini 只能以 JSON 回覆,這是一種適合自動處理的結構化資料格式。
呼叫函式
將 Gemini 連結至外部 API 和工具,建構代理工作流程。
使用 Veo 3.1 生成影片
使用最先進的模型,根據文字或圖像提示詞製作高品質影片內容。
使用 Live API 建立語音代理程式
使用 Live API 建構即時語音應用程式和代理程式。
工具
透過 Google 搜尋、網址背景資訊、Google 地圖、程式碼執行和電腦使用等內建工具,讓 Gemini 連結到世界。
文件解讀
處理最多 1000 頁的 PDF 檔案,並充分理解多模態內容或其他文字型檔案。
思考型
瞭解思考功能如何提升複雜工作和代理程式的推理能力。
Interactions API
自 2026 年 6 月起,Interactions API 已成為預設介面,也是未來使用 Gemini 模型和代理程式的最佳方式。如要開始新專案,請使用 Interactions API。雖然仍支援 generateContent API,但現在已視為舊版。