Gemini 3.6 Flash(gemini-3.6-flash)と Gemini 3.5 Flash-Lite(gemini-3.5-flash-lite)は一般提供(GA)されており、本番環境で使用できます。
- Gemini 3.6 Flash: 複雑なエージェント タスクとマルチモーダル タスクのパフォーマンスが向上し、トークン使用量が削減され、3.5 Flash よりも低価格です。
- Gemini 3.5 Flash-Lite: 3.5 ファミリーで最も高速で低コストのモデルです。高スループットの実行において、以前の Flash-Lite 世代よりも優れています。
このガイドでは、各モデルの新機能、コードに影響する API の変更、移行方法について説明します。
Gemini 3.6 Flash
スキルをインストールする
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalスキルを適用する
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
スキルをインストールする
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalスキルを適用する
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
新モデル
| モデル | モデル ID | デフォルトの思考レベル | 料金 | 説明 |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
入力トークン 100 万個あたり $1.50、出力トークン 100 万個あたり $7.50 | エージェント タスクとマルチモーダル タスクの速度とインテリジェンスのバランスを取ります。 |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
入力トークン 100 万個あたり $0.30、出力トークン 100 万個あたり $2.50 | 高スループット実行向けの最速かつ低コストの 3.5 モデル。 |
どちらのモデルも、100 万トークンのコンテキスト ウィンドウ、最大 64,000 個の出力トークン、思考、Computer Use を含む組み込みツールのフルパッケージをサポートしています。
完全な仕様については、次のモデルページをご覧ください。
料金の詳細については、料金ページをご覧ください。
クイックスタート
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"model": "gemini-3.6-flash",
"input": {
"parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
}
}'
Gemini 3.6 Flash の新機能
- トークンとターンの削減: Gemini 3.5 よりも少ない推論ステップ、会話ターン、ツール呼び出しで、複数ステップのワークフローを完了します。実行ループの増加も軽減されます。
- コード生成の改善: 不要な編集やデバッグ ループを減らし、高品質で本番環境に対応したコードを生成します。
- 指示の遵守の改善: 診断タスク中の不要なファイル変更を減らします。
- 強力なマルチモーダル推論と空間推論: チャートの解釈、ビジュアル ブループリントの変換、マルチ要素のウェブ レイアウト生成のパフォーマンスが向上しました。
- 事前プログラムによる検査: Gemini 3.5 Flash よりも頻繁に、変更を行う前に診断コード スクリプトを実行します。これにより、複雑なタスクの精度が向上しますが、簡単なフロントエンド作業で追加の探索ステップが必要になる場合があります。
- Computer Use のサポート: エージェント UI 自動化のネイティブ ツールとしてサポートされています。
- UI スタイルの設定: 機能コードの作成には優れていますが、人間の評価者はビジュアル レイアウトとスタイリングで以前のモデルを好んでいました。明示的なデザイン ガイドラインを提供することで、この問題を軽減できます。
- デフォルトの思考労力(中): Gemini 3.5 Flash と同じ
mediumのデフォルトの思考レベルを使用します。 - 値下げ: 出力トークンの費用が削減されました(3.5 Flash の場合 $9.00/100 万トークンに対し、$7.50/100 万トークン)。入力トークンは $1.50/100 万トークンのままです。
Gemini 3.5 Flash-Lite の新機能
- タスク実行レイテンシの短縮: 大量のデータ解析とドキュメント抽出において、3.5 ファミリーで最高のスループットを実現します。
- 推論とマルチモーダル パフォーマンスの強化: Gemini 2.5 Flash からの強力な移行パス。HLE(18.0% 対 11.0%)などの推論タスクや、CharXIV(74.5% 対 63.7%)などのマルチモーダル ベンチマークで高いスコアを獲得しています。
- サブエージェントのオーケストレーションとツールの信頼性: コード実行、検索、MCP ワークフローのツール実行の信頼性が向上します。自律的なプランニングと複雑なサブエージェント タスクの思考レベルを上げます。
- ドキュメント理解の改善: ドキュメントの解析と構造化データの抽出の精度が向上します。ドキュメントの複雑さに応じて、最小限の思考レベルと高い思考レベルの両方を試してください。
- インタラクティブなウェブ コーディングと表形式のデータ処理: 軽量なコード実行によるプランニングにより、フロントエンド JavaScript と表形式のデータ処理で優れたパフォーマンスを発揮します。
- chatbot とペルソナの永続性: Gemini 3.1 Flash-Lite よりも、複数ターンの指示の遵守とペルソナの一貫性が向上しています。