借助 Gemini、Veo、Nano Banana 等,Gemini API 可让您以最快的速度从提示词到生产部署。您可以将这些生成式模型集成到应用中,以生成文本和图片、分析多模态输入,以及构建对话型智能体。
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
了解模型
查看全部Gemini 3.8 Flash 新
Google 最智能的 Flash 模型,专为长期软件工程、自主智能体和复杂的企业工作流而设计。
Gemini 3.5 Flash-Lite
经济高效的模型,适合处理大量任务,并针对低延迟、高吞吐量的子智能体任务进行了优化。
Gemini 3.1 Pro
Google 最智能的模型,也是全球领先的多模态理解能力模型,建立在前沿推理技术基础上。
Nano Banana 2 和 Nano Banana Pro
前沿的图片生成和编辑模型。
Gemini Omni Flash
我们前沿的视频生成和编辑模型。
speech_to_text Gemini 3.5 Transcribe 新
低延迟语音转文本模型,支持基于话语的语言检测、讲话人区分和字词时间戳。
Gemini Robotics
视觉-语言模型 (VLM),可将 Gemini 的智能体功能引入机器人技术,并支持在物理世界中进行高级推理。
探索各项功能
图片生成
使用 Nano Banana 原生生成和编辑高度情境化的图片。
长上下文
向 Gemini 模型输入数百万个令牌,并从非结构化的图片、视频和文档中提取理解。
结构化输出
将 Gemini 限制为使用 JSON(一种适合自动处理的结构化数据格式)进行响应。
函数调用
将 Gemini 连接到外部 API 和工具,以构建智能体工作流。
使用 Veo 3.1 生成视频
使用我们前沿的模型,根据文本或图片提示创建高质量的视频内容。
使用 Live API 构建语音智能体
使用 Live API 构建实时语音应用和智能体。
工具
通过 Google 搜索、网址上下文、Google 地图、代码执行和计算机使用等内置工具,将 Gemini 连接到世界。
文档理解
处理最多 1000 页的 PDF 文件,并支持完整的多模态理解能力或其他基于文本的文件类型。
思考
了解思考功能如何改进复杂任务和智能体的推理能力。
Interactions API
自 2026 年 6 月起,Interactions API 已成为 Google 的默认接口,也是未来使用 Gemini 模型和智能体的最佳方式。如果您要开始一个新项目,则应使用 Interactions API。虽然 generateContent API 仍受支持,但现在被视为旧版 API。