Gemini API は、Gemini、Veo、Nano Banana などを使用して、プロンプトから運用までを最速で実現します。これらの生成モデルをアプリケーションに統合して、テキストや画像の生成、マルチモーダル入力の分析、会話型エージェントの構築を行うことができます。
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
スタートガイドに沿って API キーを取得し、数分で最初の API 呼び出しを行います。
各モデルについて
すべて表示Gemini 3.8 Flash New
長期的なソフトウェア エンジニアリング、自律型エージェント、複雑なエンタープライズ ワークフロー向けに設計された、最もインテリジェントな Flash モデル。
Gemini 3.5 Flash-Lite
低レイテンシ、高スループットのサブエージェント タスク向けに最適化された、大量のデータを処理できる費用対効果の高いモデル。
Gemini 3.1 Pro
最先端の推論技術を基盤として構築された、マルチモーダル理解において世界最高水準の最もインテリジェントなモデル。
🍌 Nano Banana 2 と Nano Banana Pro
画像の生成と編集のための最先端モデル。
Gemini Omni Flash
最先端の動画生成・編集モデル。
Gemini 3.5 Transcribe New
発話ベースの言語検出、話者ダイアライゼーション、単語のタイムスタンプを備えた、低レイテンシの音声テキスト変換モデル。
Gemini Robotics
Gemini のエージェント機能をロボットに導入し、現実世界での高度な推論を可能にする視覚言語モデル(VLM)。
機能を確認する
画像生成
Nano Banana を使用して、コンテキストに沿った画像をネイティブに生成、編集します。
長いコンテキスト
Gemini モデルに数百万のトークンを入力し、非構造化画像、動画、ドキュメントから理解を得ます。
構造化された出力
Gemini が JSON(自動処理に適した構造化データ形式)で応答するように制約します。
関数呼び出し
Gemini を外部 API やツールに接続して、エージェント ワークフローを構築します。
Veo 3.1 による動画生成
最先端のモデルを使用して、テキストまたは画像のプロンプトから高品質の動画コンテンツを作成します。
Live API を使用した音声エージェント
Live API を使用して、リアルタイムの音声アプリケーションとエージェントを構築します。
ツール
Google 検索、URL コンテキスト、Google マップ、コード実行、コンピュータの使用などの組み込みツールを使用して、Gemini を世界に接続します。
ドキュメント理解
完全なマルチモーダル理解またはその他のテキストベースのファイル形式で、最大 1,000 ページの PDF ファイルを処理します。
思考
思考能力が複雑なタスクやエージェントの推論をどのように改善するかを確認します。
Interactions API
2026 年 6 月より、Interactions API がデフォルトのインターフェースとなり、Gemini モデルとエージェントを構築する最適な方法となります。新しいプロジェクトを開始する場合は、Interactions API を使用する必要があります。generateContent API は引き続きサポートされますが、現在はレガシーと見なされています。