Gemini API は、Gemini、Veo、Nano Banana などを活用して、プロンプトから運用までを最速で実現する手段です。これらの生成モデルをアプリケーションに統合して、テキストと画像を生成したり、マルチモーダル入力を分析したり、会話型エージェントを構築したりできます。
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.7-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.7-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.7-flash",
"input": "Explain how AI works in a few words"
}'
スタートガイドに沿って、API キーを取得し、最初の API 呼び出しを数分で行います。
各モデルについて
すべて表示Gemini 3.1 Pro 新機能
最先端の推論に基づいて構築された、Google の最もインテリジェントなモデルであり、マルチモーダル理解において世界最高水準のモデルです。
Gemini 3.7 Flash 新モデル
複雑なコーディング、エージェント ワークフロー、信頼性の高い複数ステップの実行向けに構築された、Google の最新かつ最も高性能な Flash モデル。
Gemini 3.6 Flash
前世代の Flash モデル。一般的なエージェント タスクと日常的なタスクで、速度とマルチモーダル機能をバランスよく実現します。
Gemini 3.5 Flash
Google の従来の Flash モデル。ルーチンで高スループットのワークロードに対して、ベースラインの速度と基本的なパフォーマンスを提供します。
Gemini 3.5 Flash-Lite 新モデル
低レイテンシの高スループット サブエージェント タスク向けに最適化された、大量のトラフィックを処理するコスト重視のモデル。
Gemini 3.1 Flash-Lite
Gemini 3 シリーズのパフォーマンスと品質を備えた、大量のトラフィックをコスト重視で処理するモデル。
Gemini 3 Flash
大規模モデルに匹敵するパフォーマンスを、わずかな費用で実現します。
Nano Banana 2 と Nano Banana Pro
最先端の画像生成および編集モデル。
Veo 3.1
ネイティブ オーディオを備えた最先端の動画生成モデル。
Gemini Robotics
Gemini のエージェント機能をロボット工学に導入し、物理世界での高度な推論を可能にする視覚言語モデル(VLM)。
機能を確認する
ネイティブ画像生成(Nano Banana)
Gemini 2.5 Flash Image を使用して、コンテキストを高度に認識した画像をネイティブに生成、編集します。
長いコンテキスト
Gemini モデルに数百万個のトークンを入力し、非構造化画像、動画、ドキュメントから理解を導き出します。
構造化出力
Gemini が JSON(自動処理に適した構造化データ形式)で応答するように制約します。
関数呼び出し
Gemini を外部 API やツールに接続して、エージェント ワークフローを構築します。
Veo 3.1 による動画生成
Google の最先端モデルを使用して、テキストや画像のプロンプトから高品質な動画コンテンツを作成できます。
Live API を使用した音声エージェント
Live API を使用して、リアルタイム音声アプリケーションとエージェントを構築します。
ツール
Google 検索、URL コンテキスト、Google マップ、コード実行、コンピュータの使用などの組み込みツールを使用して、Gemini を世界に接続します。
ドキュメントの理解
最大 1,000 ページの PDF ファイルや、その他のテキストベースのファイル形式を、マルチモーダル理解で完全に理解して処理します。
思考中
思考能力が複雑なタスクとエージェントの推論をどのように改善するかについて説明します。
Interactions API
Interactions API は 2026 年 6 月にデフォルトのインターフェースとなり、今後 Gemini モデルとエージェントを構築する最善の方法となります。新しいプロジェクトを開始する場合は、Interactions API を使用する必要があります。generateContent API は引き続きサポートされますが、現在はレガシーと見なされています。