モデル

このガイドでは、Gemini API で利用できるすべてのモデルについて説明します。


Gemini 3

Stable

プレビュー


Gemini 2.5 Flash

Gemini 2.5 Flash

推論を必要とする低レイテンシかつ大量のタスクに最適な価格性能モデル。

Nano Banana

高速でクリエイティブなワークフロー向けに設計された、最先端のネイティブ画像生成と編集。

Gemini 2.5 Flash Live プレビュー

サブ秒のネイティブ音声ストリーミングを備えたリアルタイムの会話型エージェント向けに最適化されています。

Gemini 2.5 Flash TTS プレビュー

スタイルとペースを細かく制御できる、制御可能なテキスト読み上げ音声生成。


Gemini 2.5 Flash-Lite

Gemini 2.5 Flash-Lite

2.5 ファミリーで最も高速かつ費用対効果の高いマルチモーダル モデル。


Gemini 2.5 Pro

Gemini 2.5 Pro

複雑なタスク向けの最先端モデル。深い推論とコーディング機能を備えています。

Gemini 2.5 Pro TTS プレビュー

ポッドキャストやオーディオブックなどの構造化されたワークフローで品質を最適化する、高忠実度の音声合成。


音声モデル

このセクションには、他のセクションにすでに記載されているものも含め、すべての音声モデルが含まれています。

Gemini 3.1 Flash Live プレビュー

リアルタイムの対話と音声優先の AI アプリケーション向けに設計された、高品質かつ低レイテンシの音声から音声(A2A)モデル。

Gemini 3.1 Flash TTS プレビュー

強力かつ低レイテンシの音声生成。自然な出力、ステアリング可能なプロンプト、正確なナレーション制御のための新しい表現力豊かな音声タグを備えています。

Gemini 2.5 Flash Live プレビュー

ネイティブ音声推論を備えた低レイテンシの双方向音声および動画エージェント向けの、Google の主力 Live API モデル。

Gemini 2.5 Flash TTS プレビュー

低レイテンシかつ費用対効果の高いアプリケーションとリアルタイム アシスタント向けの、高速で制御可能なテキスト読み上げ。

Gemini 2.5 Pro TTS プレビュー

ポッドキャストやオーディオブックなどの構造化されたワークフローで品質を最適化する、高忠実度の音声合成。


生成メディアモデル

このセクションには、他のセクションにすでに記載されているものも含め、すべての生成メディアモデルが含まれています。

Nano Banana 2

Gemini 3 シリーズのインテリジェンスと超高速の生成速度を組み合わせた、高効率のプロダクション スケールのビジュアル作成。

Nano Banana 2 Lite

画像生成ファミリーの効率化スペシャリストとして設計されており、超低レイテンシかつ費用対効果の高い画像生成と編集を実現します。

Veo 3.1 プレビュー

高度なクリエイティブ コントロールとネイティブに同期された音声による、最先端のシネマティック動画生成。

Nano Banana Pro

スタジオ品質の 4K ビジュアル、複雑なレイアウト、正確なテキスト レンダリングのための推論コアを備えたプロフェッショナル デザイン エンジン。

Veo 3.1 Lite プレビュー

Veo 3.1 ファミリーの、高効率、低コスト、デベロッパー ファーストの動画生成、編集、シネマティック コントロール。

Gemini Omni Flash プレビュー

高速な会話型動画の生成と編集。テキストや画像を動画に変換し、自然言語で結果を絞り込むことができます。

Nano Banana

高速でクリエイティブなワークフロー向けに設計された、最先端のネイティブ画像生成と編集。

Imagen 4(非推奨)

高速かつ超高速の生成と、最大 2K 解像度の優れた鮮明さを備えた、テキスト画像変換モデル。


音楽生成モデル

このセクションには、他のセクションにすでに記載されているものも含め、すべての音楽生成モデルが含まれています。

Lyria 3 Pro プレビュー

複雑な構造の一貫性を持つフルレングスの曲向けに最適化された、Google の主力音楽生成モデル。

Lyria 3 Clip プレビュー

最大 30 秒の短い音楽クリップ、ループ、プレビューの生成に最適化されています。

Lyria RealTime 試験運用版

きめ細かいクリエイティブ コントロールとリアルタイム ストリーミング機能を提供する、高忠実度の音楽生成モデル。


ツールモデルとエージェント モデル

コンピュータ使用プレビュー

デジタル画面を「見て」、クリック、入力、移動などの UI アクションを実行して、複雑なブラウザ タスクを自動化できる特殊モデル。

Gemini Deep Research プレビュー

数百のソースにわたる複数ステップのリサーチを自律的に計画して実行し、引用付きのインタラクティブなレポートを作成するエージェント モデル。

Gemini Deep Research Max プレビュー

数百のソースにわたるコンテキストの自動収集と統合を最大限に包括的に行うことができます。

Antigravity Agent プレビュー

安全で隔離された Linux サンドボックス内で、自律的に計画、推論、コードの実行、ファイルの管理、ウェブの閲覧を行う汎用マネージド エージェント。


特殊なタスクモデル

Gemini Embedding 2

Google 初のマルチモーダル エンベディング モデル。テキスト、画像、動画、音声、PDF を統合されたエンベディング空間にマッピングし、高度なセマンティック検索と RAG システムを実現します。

Gemini Embedding

高度なセマンティック検索、テキスト分類、RAG システムのための高次元ベクトル表現。

Gemini Robotics-ER 1.6プレビュー

物理空間を理解し、ロボット エージェントの複数ステップのタスクを計画する高度なエンボディード推論モデル。機器の読み取り、空間的および物理的な推論の改善などの新機能を備えています。


以前のモデル

Gemini 2.0 Flash シャットダウン

第 2 世代の主力モデル。優れたスピード、ネイティブ ツールの使用、100 万トークンのコンテキスト ウィンドウなど、次世代の機能と強化された機能を備えています。

Gemini 2.0 Flash-Lite Shut down

費用対効果と低レイテンシを重視して最適化された、Google の最速の第 2 世代モデル。

Gemini 3.1 Flash-Lite プレビュー(シャットダウン

最も費用対効果の高いマルチモーダル モデル。高頻度の軽量タスクで最速のパフォーマンスを実現します。

Gemini 3 Pro プレビュー(シャットダウン

高度なマルチモーダル理解を備えた、最先端の推論モデル。


モデル バージョン名のパターン

Gemini モデルは、 安定版プレビュー版最新版 、または 試験運用版 のいずれかのバージョンで利用できます。

Stable

特定の安定版モデルを参照します。通常、安定版モデルは変更されません。ほとんどの本番環境アプリでは、特定の安定版モデルを使用する必要があります。

例: gemini-3.5-flash

プレビュー

本番環境で使用できるプレビュー モデルを参照します。通常、プレビュー モデルでは課金が有効になっており、レート上限が厳しくなる可能性があります。また、少なくとも 2 週間前に通知されて非推奨になります。

例: gemini-2.5-flash-preview-09-2025

最新

特定のモデル バリアントの最新リリースを参照します。安定版、プレビュー版、試験運用版のいずれかのリリースになります。このエイリアスは、特定のモデル バリアントの新しいリリースごとにホットスワップされます。互換性を破る変更については、最新バージョンの変更前にメールで2 週間前に通知 されます。

例: gemini-flash-latest

試験運用版

試験運用版モデルを参照します。通常、本番環境での使用には適しておらず、レート上限が厳しくなります。試験運用版モデルをリリースしてフィードバックを収集し、最新のアップデートをデベロッパーに迅速に提供します。

試験運用版モデルは安定しておらず、モデル エンドポイントの可用性は変更される可能性があります。

モデル(非推奨)

モデルの非推奨については、Gemini の非推奨のページをご覧ください。