Gemini 3.6 Flash(gemini-3.6-flash)と Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)は一般提供(GA)されており、本番環境で使用できます。
- Gemini 3.6 Flash: 複雑なエージェント タスクとマルチモーダル タスクでより高いパフォーマンスを発揮し、トークン使用量を削減しながら、3.5 Flash よりも低価格を実現します。
- Gemini 3.5 Flash-Lite: 3.5 ファミリーの中で最も高速で低コストのモデル。高スループットの実行において、以前の Flash-Lite 世代よりも優れたパフォーマンスを発揮します。
このガイドでは、各モデルの新機能、コードに影響する API の変更点、移行方法について説明します。
Gemini 3.6 Flash
スキルをインストールします。
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalスキルを適用します。
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
スキルをインストールします。
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalスキルを適用します。
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
新モデル
| モデル | モデル ID | デフォルトの思考レベル | 料金 | 説明 |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
入力トークン 100 万個あたり $1.50、出力トークン 100 万個あたり $7.50 | エージェント タスクとマルチモーダル タスクの速度とインテリジェンスのバランスを取ります。 |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
入力トークン 100 万個あたり $0.30、出力トークン 100 万個あたり $2.50 | 高スループット実行に最適な、最も高速で低コストの 3.5 モデル。 |
どちらのモデルも、100 万トークンのコンテキスト ウィンドウ、最大 64,000 個の出力トークン、思考、コンピュータの使用を含む組み込みツールのフルパッケージをサポートしています。
完全な仕様については、モデルのページをご覧ください。
料金の詳細については、料金ページをご覧ください。
クイックスタート
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Gemini 3.6 Flash の新機能
- トークンとターンの削減: Gemini 3.5 よりも少ない推論ステップ、会話ターン、ツール呼び出しでマルチステップ ワークフローを完了します。また、実行ループのスパイルも軽減されます。
- コード生成の改善: 不要な編集やデバッグ ループが少なく、高品質で本番環境に対応したコードを生成します。
- 指示の遵守の改善: 診断タスク中の不要なファイル変更を減らします。
- 強力なマルチモーダルと空間推論: チャートの解釈、ビジュアル ブループリントの変換、マルチ要素のウェブ レイアウトの生成のパフォーマンスが向上しました。
- 事前プログラマティック検査: Gemini 3.5 Flash よりも頻繁に、変更を行う前に診断コード スクリプトを実行することを優先します。これにより、複雑なタスクの精度は向上しますが、ルーティン フロントエンド作業で余分な探索手順が追加される可能性があります。
- パソコンの使用のサポート: エージェント UI 自動化の組み込みツールとしてサポートされています。
- UI スタイルの設定: 機能的なコードの作成には優れていますが、人間の評価者はビジュアル レイアウトとスタイルの点で以前のモデルを好みました。明示的な設計ガイドラインを提供することで、この問題を軽減できます。
- デフォルトの思考労力(中): Gemini 3.5 Flash と同じ
mediumデフォルトの思考レベルを使用します。 - 料金の引き下げ: 出力トークンの費用を削減(3.5 Flash の 100 万トークンあたり $9.00 に対して $7.50)。入力トークンは 100 万個あたり $1.50 のままです。
Gemini 3.5 Flash-Lite の新機能
- タスク実行レイテンシの短縮: 大量のデータ解析とドキュメント抽出で 3.5 ファミリー最高のスループットを実現します。
- 推論とマルチモーダル パフォーマンスの向上: Gemini 2.5 Flash からの強力な移行パス。HLE(18.0% 対 11.0%)などの推論タスクや、CharXIV(74.5% 対 63.7%)などのマルチモーダル ベンチマークで高いスコアを達成しています。
- サブエージェントのオーケストレーションとツールの信頼性: コード実行、検索、MCP ワークフローのツール実行の信頼性が向上します。自律的な計画と複雑なサブエージェント タスクの思考レベルを高めます。
- ドキュメントの理解度の向上: ドキュメントの解析と構造化されたデータ抽出の精度が向上します。ドキュメントの複雑さに応じて、最小限の思考レベルと高い思考レベルの両方を試します。
- インタラクティブなウェブ コーディングと表形式のデータ処理: 軽量なコード実行によるプランニングにより、フロントエンドの JavaScript と表形式のデータ処理で高いパフォーマンスを発揮します。
- Chatbot とペルソナの永続性: Gemini 3.1 Flash-Lite よりも、複数ターンの指示の遵守とペルソナの一貫性が向上しています。
- パソコンの使用のサポート: エージェント UI 自動化の組み込みツールとしてサポートされています。
適切な Flash または Flash-Lite モデルの選択
この表を使用して、ワークロードに適したモデルと移行パスを選択します。
どちらのモデルでも、非推奨のサンプリング パラメータ(temperature、top_p、top_k)と事前入力されたモデルのターンを削除する必要があります。詳しくは、API の変更をご覧ください。
| モデル | 主なユースケース: | 移行先として推奨される一般提供版 |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
コード生成、空間/マルチモーダル推論、マルチステップ エージェント ワークフロー | Gemini 3.5 Flash、Gemini 3 Flash(プレビュー)、Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
自律型サブエージェントの実行、大量のデータ分析とドキュメント抽出、構造化された JSON 解析 | Gemini 3.1 Flash-Lite または Gemini 2.5 Flash |
Antigravity エージェントのサポート
Gemini 3.6 Flash では、Gemini Managed Agents で Antigravity エージェントのサポートが導入されました。
現在のコードサンプルと最新のデフォルト エージェント構成については、Antigravity エージェント ガイドと Gemini 3.8 Flash ガイドをご覧ください。
API の変更とパラメータの更新
Gemini 3.6 Flash と Gemini 3.5 Flash-Lite 以降、次の API の変更がこれらのモデルと今後のすべての Gemini モデルのリリースに適用されます。
- サンプリング パラメータのサポート終了:
temperature、top_p、top_kのサポートが終了しました。API はこれらのパラメータを無視し、将来のモデル生成でエラーを返します。 - 事前入力済みモデルターンの検証: 事前入力済みモデルターンはサポートされなくなりました。リクエスト内の最後の空でないターンが
modelターンである場合、API は400エラーを返します。
以降のセクションでは、各 API の変更について詳しく説明し、コードサンプルを示します。
1. サンプリング パラメータの非推奨(temperature、top_p、top_k)
temperature、top_p、top_k は非推奨となり、無視されます。今後のモデル世代では、これらのパラメータを指定すると HTTP 400 エラーが返されます。すべてのリクエストからこれらのパラメータを削除します。
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
決定論を改善するには、特定のユースケースの明示的なルールを含むシステム指示を定義します。
2. 事前入力済みモデルターンの検証
空でないモデルロールで終わる API リクエストは許可されず、HTTP 400 エラーが返されます。
⚠️ 避ける
以前の generateContent または未加工の REST ペイロードでは、モデルロールのターンで終わることは禁止されています。
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ 推奨される移行(Interactions API)
Interactions API では、モデルのターンは手動で事前入力されません。アプリケーションで以前にモデルのターンを事前入力して、前文を抑制したり、JSON 形式を強制したりしていた場合は、代わりに system_instruction または構造化された出力を使用します。
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
移行チェックリスト
Gemini 3.6 Flash
スキルをインストールします。
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalスキルを適用します。
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
スキルをインストールします。
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalスキルを適用します。
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
gemini-3.6-flash に移行する
- モデル ID を更新: ターゲット モデル文字列を
gemini-3.6-flashに変更します。 - パラメータの更新を適用する: 非推奨のサンプリング パラメータ(
temperature、top_p、top_k)、candidate_count(Gemini 3 以降ではサポートされていません)、事前入力されたモデルターンを削除します。詳しくは、API の変更とパラメータの更新をご覧ください。 - 思考レベルを設定する:
thinking_budgetをthinking_level("medium"または"high")に置き換えます。 - 関数呼び出しの監査:
- マルチモーダル アセットをレスポンス ペイロード内に配置します。
- インライン指示は
\n\nを使用してフォーマットします。 - ツール前のテキストに関連する
Malformed_Function_Callエラーが表示された場合は、ツール前のテキストの要件の回避策をご覧ください。
- Gemini 3.x のベースライン要件: SDK の更新と思考シグネチャの保持については、Gemini 3.5 移行チェックリストをご覧ください。
gemini-3.5-flash-lite に移行する
- モデル ID を更新: ターゲット モデル文字列を
gemini-3.5-flash-liteに変更します。 - 思考労力レベルを構成する:
- 大量の抽出、ルーティング、分類の場合: 最大スループットを得るために、
thinking_levelを"minimal"(デフォルト)のままにします。 - ツール呼び出し、コード実行、複数ステップの推論を行う自律型サブエージェントの場合は、
thinking_levelを"medium"または"high"に設定して、ツールの早期終了を防ぎます。
- 大量の抽出、ルーティング、分類の場合: 最大スループットを得るために、
- 非推奨のパラメータを削除し、関数呼び出しを検証する: 3.6 Flash と同じルールを適用します。
- Gemini 3.x のベースライン要件: Gemini 3.5 移行チェックリストを参照してください。
次のステップ
- モデルの概要で API 仕様を確認します。
- マルチ エージェントのオーケストレーションについては、Interactions API ガイドをご覧ください。
- Google AI Studio でプロンプトをテストして調整する。