Gemini 3.6 Flash API
Gemini 3.6 Flash を選択
Google 最新の Flash 系高効率主力モデルで、コスト効率の高いコーディング、エージェントワークフロー、ナレッジワーク、マルチモーダル推論に対応し、Gemini 3.5 Flash より高いトークン効率と 100万 Token のコンテキストウィンドウを備えています。
Gemini 3.6 Flash
Google の Flash 系高効率主力モデル
gemini-3.6-flash本番コーディングとフルスタックのリファクタリング、多段階エージェントとオーケストレーション、文書やグラフの分析、そして高いトークン効率が完了タスクあたりのコストを下げる大量処理。
Gemini 3.6 Flash pricing
Estimate a request with the interactive pricing calculator. All user groups use the official Gemini 3.6 Flash rate.
Token calculator
Enter the token mix for one request.Estimated request cost
Gemini 3.6 FlashMinimum charge: 0.01 credits per request.
EvoLink vs Google direct
Same token mix, default group price.Budget guide
Approximate requests using the current token mix.For quick testing
For regular development
For production evaluation
Model pricing
| Model | Context | Input tokens | Cache read tokens | Output tokens |
|---|---|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash | All context sizes | $1.350 / 1M-10% 91.8 cr / 1M$1.500official price | $0.136 / 1M-10% 9.2 cr / 1M$0.150official price | $6.750 / 1M-10% 459 cr / 1M$7.500official price |
Gemini 3.6 Flash
All context sizesUSD and credits are shown per 1M tokens. Live backend pricing takes priority over these frozen fallback rates.
コスト効率の高いコーディングとエージェント向け Gemini 3.6 Flash API
Google 最新の Flash クラス主力モデルを EvoLink の統一 API で利用できます。Gemini 3.6 Flash は Gemini 3.5 Flash より高いトークン効率で、コーディング、ナレッジワーク、マルチモーダル推論を改善し、1,048,576 Token のコンテキスト、プロンプトキャッシュ、構造化出力、ツール利用に対応します。料金は入力 / 出力 100 万 Token あたり $1.50 / $7.50 です。

本番モデル構成で Gemini 3.6 Flash が価値を発揮する場所
Google は Gemini 3.6 Flash を主力モデルと位置づけています。Gemini 3.5 Flash より大幅に高いトークン効率で、コーディング、ナレッジワーク、マルチモーダル性能を高めます。十分に良い推論を低いトークンコストで得られることが、プレミアム層に支払うより有利になる本番作業に最も適しています。
コスト効率の高いコーディングとリファクタリング
Gemini 3.6 Flash は日常的なコーディング、プロトタイピング、フルスタックのリファクタリングを、Gemini 3.5 Flash より少ないトークンと少ない呼び出し回数で狙います。Google Antigravity の既定エージェントモデルでもあります。評価は単独スニペットの品質ではなく、採用されたパッチとレビュー時間で行います。
エージェントワークフローとオーケストレーション
多段のオーケストレーション、ツール選択、構造化出力、コード実行に適し、1 回あたりの低コストが長いエージェント実行を通じて積み上がります。ターン間でアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を完全に保持してください。
ナレッジワークとマルチモーダル推論
100 万 Token のコンテキストで、文書分析、チャート解釈、複数要素の Web レイアウト生成に使えます。検索と文書構造は依然として重要で、100 万 Token の窓があっても無関係なコンテキストが有用になるわけではありません。
別のルートが適している場合
単純、低遅延が重要、または超大量の分類・抽出は、通常より安価な Gemini 3.5 Flash-Lite が適しています。最も難しい推論は Pro 層モデルに回します。3.6 Flash への引き上げは、その効率が採用タスク当たりのコストを実際に下げるときだけにします。
Gemini 3.6 Flash の初期反応が示すことと、まだ検証が必要なこと
Gemini 3.6 Flash は 2026-07-21 に公開されました。公開初日のコミュニティ反応は、確定したベンチマークではなく、自分のタスク、ツール、予算、受け入れ基準で検証すべき仮説として扱ってください。
トークン効率と低い出力コストが最大の見どころ
Google と第三者の API ページは、より少ないトークン、より少ない呼び出し、より少ない曖昧表現を強調しており、出力は 100 万あたり $7.50 で、Gemini 3.5 Flash の $9.00 を下回ります。同じワークロードでは、品質が同等でも完了タスク当たりのコストを下げられます。
これは Flash クラスの主力モデルであり、最上位のエンジニアリングモデルではない
公開初日の一部の議論では、難しいソフトウェアエンジニアリングのベンチマークで、より大きなフロンティアモデルに後れを取るとされています。深いリポジトリのリファクタリングや長時間の自律コーディングが目的なら、既定にする前に Pro 層またはプレミアムモデルと比較してください。
自分のプロンプトで出力規律とフォーマットを検証する
一部のタスクで冗長、または過度に整形された応答が報告されています。代表的なプロンプトで応答長、指示遵守、ツール呼び出しの規律を確認し、冗長さが出力コストを密かに押し上げないようにしてください。
これはクローズドで API 専用の Google モデル
Gemini 3.6 Flash にはオープンウェイトがなく、セルフホストもできません。アクセスは Gemini API と、Google AI Studio、Antigravity、EvoLink のような統一ゲートウェイを通じて行うため、ローカル配置ではなくコストと信頼性でルーティングしてください。
Gemini 3.6 Flash が複雑なワークロードを処理できる理由
Gemini 3.6 Flash は、大きなコンテキストウィンドウ、向上したトークン効率、再利用可能なプロンプトのプレフィックスが組み合わさったときに最も役立ちます。コンテキスト容量だけでは回答は良くならず、関連する根拠、明確な構造、出力予算が依然として必要です。
100 万 Token は作業領域であり、埋める目標ではない
1,048,576 Token のウィンドウは、関連コード、仕様、過去のツール結果を過度な分割なしに保持できます。無関係な入力は注意を奪い処理コストを増やすため、検索とコンテキスト圧縮は引き続き重要です。
3.5 Flash より向上したトークン効率
Gemini 3.6 Flash は多段ワークフローをより少ないターンと少ないトークンで完了することを目指します。コスト優位の源泉は呼び出し回数の削減と安価な出力なので、単発リクエストの価格ではなく、採用タスク当たりの総トークンを追跡してください。
プロンプトキャッシュはプレフィックスが安定すると効く
リポジトリ指示、システムプロンプト、参照資料、ツールスキーマは、順序が一貫していれば最も強いキャッシュ機会を生みます。モデルやプロンプト構造を頻繁に変えると、長いプレフィックスの再処理を招くことがあります。
Gemini 3.6 Flash に本番トラフィックを送る前に確認すること
適切なワークロードでも、統合が誤った識別子を使う、非対応パラメータを送る、ターン間でエージェント状態を失うと失敗します。モデル品質を評価する前に、リクエスト面と会話契約を確認してください。
正確なモデル ID gemini-3.6-flash を使用
EvoLink API ルートでは model に "gemini-3.6-flash"(ドット付き)を送信します。ハイフン形式の gemini-3-6-flash はページ URL であり、API のモデルパラメータではありません。
OpenAI Chat Completions または Gemini ネイティブ API を使用
EvoLink は OpenAI 互換の /v1/chat/completions と Gemini ネイティブの generateContent エンドポイントで Gemini 3.6 Flash を提供します。どちらのプロトコルでも同じ EvoLink API キーを使います。
破壊的なパラメータ変更に注意
カスタムの temperature、top-K、top-P は無視され、カスタムの frequency / presence penalty はエラーを返し、最後のターンが model ロールのリクエストは拒否されます。古い Gemini のリクエスト構築を適宜更新してください。
アシスタントとツールの状態を完全に再送
マルチターンのエージェントは、完全なアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を保持すべきです。最終テキストだけを残すと状態の連続性が崩れ、コンテキストウィンドウが十分でも後続ステップが失敗することがあります。
トークン単価ではなく、採用タスク当たりのコストを比較
Gemini 3.6 Flash が経済的に勝つのは、同じワークロードで効率がトークン、モデル呼び出し、再試行、人手のやり直しを減らすときです。孤立したプロンプト価格を比べるのではなく、同一のタスクセットで評価してください。
Gemini 3.6 Flash が少ないトークンと少ないレビュー工数で使える結果を出すなら、低い単価は積み重なって実際のコスト優位になります。最も難しいタスクで品質が落ちるなら、それらは Pro 層モデルに引き上げ、3.6 Flash は効率の高い大多数に使ってください。
実ワークロードの検証後に長文コンテキストモデルを比較
EvoLinkまず Gemini 3.6 Flash が再試行とレビューを減らすか確認し、その後に料金、コンテキスト、キャッシュ、用途を比較して本番ルートを選びます。
| モデル | Gemini 3.6 Flash | Gemini 3.5 Flash Lite | Gemini 3.1 Pro |
|---|---|---|---|
| 入力 / 出力 | $1.35 / $6.75 | $0.3 / $2.5 | $1.68 / $10.08 |
| コンテキスト | 1M | 1M | 1M |
| キャッシュ | 自動キャッシュ読み取り | コンテキストキャッシュ | コンテキストキャッシュ |
| 適した用途 | 本番コーディングとフルスタックのリファクタリング、多段階エージェントとオーケストレーション、文書やグラフの分析、そして高いトークン効率が完了タスクあたりのコストを下げる大量処理。 | Flash 系では対応しきれない最も深い推論タスク向けの Pro 系 Gemini。 | Flash 系では対応しきれない最も深い推論タスク向けの Pro 系 Gemini。 |
EvoLink の他の Gemini モデル

Gemini 3.5 Flash
The previous-generation Flash workhorse that 3.6 Flash improves on for token efficiency and output cost.
モデルを見る
Gemini 3.5 Flash Lite
The cheapest, fastest 3.5-class route for classification, extraction, and high-throughput subagents.
モデルを見る
Gemini 3.1 Pro
The Pro-tier step up when a task needs deeper reasoning than the Flash line can deliver.
モデルを見る
Gemini 3.1 Flash Lite
The lightweight 3.1 route for high-volume, cost-sensitive, and low-latency workloads.
モデルを見るOther text models

GPT-5.6
OpenAI’s tiered frontier family (Sol/Terra/Luna) for capability, latency, and cost-routing flexibility.
モデルを見る
Claude Opus 4.8
Anthropic’s premium baseline for long-running coding agents and judgment-heavy review.
モデルを見る
DeepSeek V4
Cost-sensitive open baseline for high-volume coding, reasoning, and agent workloads.
モデルを見る
Kimi K3
Moonshot’s long-context reasoning route for repository-scale coding and multi-document work.
モデルを見る本番導入に役立つ関連記事

Gemini 3.6 Flash release date & rollout
What launched, the model ID, official pricing, and where the model is available.
ガイドを読むGemini 3.6 Flash API よくある質問
Gemini 3.6 Flash API は EvoLink で利用できますか?
はい。本番モデルとして利用でき、ライブ料金と公式フォールバック料金に対応しています。
Gemini 3.6 Flash API ではどのモデル ID を使うべきですか?
モデルには "gemini-3.6-flash"(ドット区切り)を指定します。ハイフン区切りの gemini-3-6-flash はページの URL であり、API のモデルパラメータではありません。
Gemini 3.6 Flash ではどのプロトコルと SDK が使えますか?
OpenAI 互換の Chat Completions エンドポイント、または Gemini ネイティブの generateContent エンドポイントを、同じ EvoLink API Key で利用できます。このモデルには Anthropic の Messages API 経由のルートはありません。
Gemini 3.6 Flash API は 1M コンテキストに対応していますか、それとも 256K だけですか?
EvoLink ルートは 1,048,576 Token を記録します。より小さい上限は通常、特定の Gemini 製品面やクライアント設定に由来し、API モデル自体ではありません。
Gemini 3.6 Flash の 1M Token コンテキストウィンドウはどう使うべきですか?
関連するコード、文書、ツールの結果はまとめて保持しつつ、既定で窓を埋めるのではなく、検索、安定したキャッシュ済みプレフィックス、コンテキスト圧縮を活用してください。
Gemini 3.6 Flash は Gemini 3.5 Flash や 3.5 Flash-Lite とどう違いますか?
3.6 Flash は新しい主力モデルで、3.5 Flash よりコーディングとトークン効率に優れます(出力は 100万あたり $7.50 対 $9.00)。3.5 Flash-Lite は分類や高スループットのタスク向けに、より安価で高速なルートです。
なぜ Gemini 3.6 Flash は Gemini 3.5 Flash より運用コストが低いのですか?
タスクあたりのトークン数とモデル呼び出し回数を抑え、出力単価も低いためです。リクエスト単価だけでなく、受理タスクあたりの総トークン数を追跡してください。
Gemini 3.6 Flash へ移行する際に対応すべき破壊的変更は何ですか?
カスタムの temperature、top-K、top-P は無視され、カスタムの frequency / presence ペナルティはエラーになり、最後のターンが model ロールのリクエストは拒否されます。
Gemini 3.6 Flash の出力予算はどう設定すべきですか?
タスクの複雑さに応じて出力を制限し、推論トークンと最終回答トークンの両方を監視します。65,536 Token の上限は容量であり、通常の目標ではありません。
Gemini 3.6 Flash はリアルタイムや大量リクエストの既定として適していますか?
最も安く低レイテンシな分類と抽出には Gemini 3.5 Flash-Lite を使います。コーディングと推論の品質がやや高い料金を正当化する場合に 3.6 Flash を使ってください。
Gemini 3.6 Flash を GPT、Claude、GLM、DeepSeek とどう比較すべきですか?
Gemini 3.6 Flash は効率的なコーディングとエージェント経済性で、GPT と Claude は最先端の能力基準として、GLM や DeepSeek はコスト重視のオープン基準として評価します。
本番評価では何を計測すべきですか?
初回成功率、採用成果物、再試行、出力 Token、キャッシュヒット率、有効なツール呼び出し、所要時間、人手修正、フォールバック率を計測します。