Gemini 3.7 Flash API
Gemini 3.7 Flash を選択
Google 最新の Flash 系高効率主力モデルで、コスト効率の高いコーディング、エージェントワークフロー、ナレッジワーク、マルチモーダル推論に対応し、Gemini 3.6 Flash より高いトークン効率と 100万 Token のコンテキストウィンドウを備えています。
Gemini 3.7 Flash
Google の Flash 系高効率主力モデル
gemini-3.7-flash本番コーディングとフルスタックのリファクタリング、多段階エージェントとオーケストレーション、文書やグラフの分析、そして高いトークン効率が完了タスクあたりのコストを下げる大量処理。
Gemini 3.7 Flash pricing
Estimate a request with the interactive pricing calculator. All user groups use the official Gemini 3.7 Flash rate.
Token calculator
Enter the token mix for one request.Estimated request cost
Gemini 3.7 FlashMinimum charge: 0.01 credits per request.
EvoLink vs Google direct
Same token mix, default group price.Budget guide
Approximate requests using the current token mix.For quick testing
For regular development
For production evaluation
Model pricing
| Model | Context | Input tokens | Cache read tokens | Output tokens |
|---|---|---|---|---|
Gemini 3.7 Flashgemini-3.7-flash | All context sizes | $0.675 / 1M-55% 45.9 cr / 1M$1.500official price | $0.068 / 1M-55% 4.6 cr / 1M$0.150official price | $3.375 / 1M-55% 229.5 cr / 1M$7.500official price |
Gemini 3.7 Flash
All context sizesUSD and credits are shown per 1M tokens. Live backend pricing takes priority over these frozen fallback rates.
コスト効率の高いコーディングとエージェント向け Gemini 3.7 Flash API
Google 最新の Flash クラス主力モデルを EvoLink の統一 API で利用できます。Gemini 3.7 Flash は Gemini 3.6 Flash より高いトークン効率で、コーディング、ナレッジワーク、マルチモーダル推論を改善し、1,048,576 Token のコンテキスト、プロンプトキャッシュ、構造化出力、ツール利用に対応します。料金は Google の公式導入価格として入力 / 出力 100 万 Token あたり $0.75 / $3.75(2026 年 12 月 31 日まで)です。
本番モデル構成で Gemini 3.7 Flash が価値を発揮する場所
Google は Gemini 3.7 Flash を主力モデルと位置づけています。Gemini 3.6 Flash より大幅に高いトークン効率で、コーディング、ナレッジワーク、マルチモーダル性能を高めます。十分に良い推論を低いトークンコストで得られることが、プレミアム層に支払うより有利になる本番作業に最も適しています。
コスト効率の高いコーディングとリファクタリング
Gemini 3.7 Flash は日常的なコーディング、プロトタイピング、フルスタックのリファクタリングを、Gemini 3.6 Flash より少ないトークンと少ない呼び出し回数で狙います。Google の Antigravity エージェント環境でも利用できます。評価は単独スニペットの品質ではなく、採用されたパッチとレビュー時間で行います。
エージェントワークフローとオーケストレーション
多段のオーケストレーション、ツール選択、構造化出力、コード実行に適し、1 回あたりの低コストが長いエージェント実行を通じて積み上がります。ターン間でアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を完全に保持してください。
ナレッジワークとマルチモーダル推論
100 万 Token のコンテキストで、文書分析、チャート解釈、複数要素の Web レイアウト生成に使えます。検索と文書構造は依然として重要で、100 万 Token の窓があっても無関係なコンテキストが有用になるわけではありません。
別のルートが適している場合
単純、低遅延が重要、または超大量の分類・抽出は、通常より安価な Gemini 3.5 Flash-Lite が適しています。最も難しい推論は Pro 層モデルに回します。3.7 Flash への引き上げは、その効率が採用タスク当たりのコストを実際に下げるときだけにします。
Gemini 3.7 Flash の初期反応が示すことと、まだ検証が必要なこと
Gemini 3.7 Flash は 2026-08-13 に公開されました。公開初日のコミュニティ反応は、確定したベンチマークではなく、自分のタスク、ツール、予算、受け入れ基準で検証すべき仮説として扱ってください。
3.6 Flash と同価格で、より強力なエージェント実行
Google は 3.7 Flash を Gemini 3 ファミリーのエージェント主力と位置づけ、コーディングとエージェント向けとしてこれまでで最も高性能な主力モデルと紹介しています。コード生成とターミナル実行が大きく向上しながら、価格は Gemini 3.6 Flash と完全に同じです。同じワークロードでの利点は、単価の安さではなく、リトライの減少とエージェントループの短縮から生まれます。
これは Flash クラスの主力モデルであり、最上位のエンジニアリングモデルではない
公開初日の一部の議論では、難しいソフトウェアエンジニアリングのベンチマークで、より大きなフロンティアモデルに後れを取るとされています。深いリポジトリのリファクタリングや長時間の自律コーディングが目的なら、既定にする前に Pro 層またはプレミアムモデルと比較してください。
自分のプロンプトでタスクあたりの Token 用量を検証する
公開初日の一部報告では、同じタスクでの Token 使用量が Gemini 3.6 Flash より多いと観察されています。代表的なプロンプトで応答長、指示遵守、ツール呼び出しの規律を確認し、追加の推論が出力コストを密かに押し上げないようにしてください。
これはクローズドで API 専用の Google モデル
Gemini 3.7 Flash にはオープンウェイトがなく、セルフホストもできません。アクセスは Gemini API と、Google AI Studio、Antigravity、EvoLink のような統一ゲートウェイを通じて行うため、ローカル配置ではなくコストと信頼性でルーティングしてください。
Gemini 3.7 Flash が複雑なワークロードを処理できる理由
Gemini 3.7 Flash は、大きなコンテキストウィンドウ、向上したトークン効率、再利用可能なプロンプトのプレフィックスが組み合わさったときに最も役立ちます。コンテキスト容量だけでは回答は良くならず、関連する根拠、明確な構造、出力予算が依然として必要です。
100 万 Token は作業領域であり、埋める目標ではない
1,048,576 Token のウィンドウは、関連コード、仕様、過去のツール結果を過度な分割なしに保持できます。無関係な入力は注意を奪い処理コストを増やすため、検索とコンテキスト圧縮は引き続き重要です。
3.6 Flash より向上したトークン効率
Gemini 3.7 Flash は多段ワークフローをより少ないターンと少ないトークンで完了することを目指します。コスト優位の源泉は呼び出し回数の削減と総トークンの削減なので、単発リクエストの価格ではなく、採用タスク当たりの総トークンを追跡してください。
プロンプトキャッシュはプレフィックスが安定すると効く
リポジトリ指示、システムプロンプト、参照資料、ツールスキーマは、順序が一貫していれば最も強いキャッシュ機会を生みます。モデルやプロンプト構造を頻繁に変えると、長いプレフィックスの再処理を招くことがあります。
Gemini 3.7 Flash に本番トラフィックを送る前に確認すること
適切なワークロードでも、統合が誤った識別子を使う、非対応パラメータを送る、ターン間でエージェント状態を失うと失敗します。モデル品質を評価する前に、リクエスト面と会話契約を確認してください。
正確なモデル ID gemini-3.7-flash を使用
EvoLink API ルートでは model に "gemini-3.7-flash"(ドット付き)を送信します。ハイフン形式の gemini-3-7-flash はページ URL であり、API のモデルパラメータではありません。
OpenAI Chat Completions または Gemini ネイティブ API を使用
EvoLink は OpenAI 互換の /v1/chat/completions と Gemini ネイティブの generateContent エンドポイントで Gemini 3.7 Flash を提供します。どちらのプロトコルでも同じ EvoLink API キーを使います。
破壊的なパラメータ変更に注意
Google の公式移行チェックリストに従い、カスタムの temperature、top-P、top-K、candidate_count を削除し、数値の thinking_budget を thinking_level 文字列に置き換え、事前入力された model ターンを削除してください。既存の Gemini リクエスト構築処理もあわせて更新します。
アシスタントとツールの状態を完全に再送
マルチターンのエージェントは、完全なアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を保持すべきです。最終テキストだけを残すと状態の連続性が崩れ、コンテキストウィンドウが十分でも後続ステップが失敗することがあります。
トークン単価ではなく、採用タスク当たりのコストを比較
Gemini 3.7 Flash が経済的に勝つのは、同じワークロードで効率がトークン、モデル呼び出し、再試行、人手のやり直しを減らすときです。孤立したプロンプト価格を比べるのではなく、同一のタスクセットで評価してください。
Gemini 3.7 Flash が少ないトークンと少ないレビュー工数で使える結果を出すなら、その高いトークン効率は積み重なって実際のコスト優位になります。最も難しいタスクで品質が落ちるなら、それらは Pro 層モデルに引き上げ、3.7 Flash は効率の高い大多数に使ってください。
実ワークロードの検証後に長文コンテキストモデルを比較
EvoLinkまず Gemini 3.7 Flash が再試行とレビューを減らすか確認し、その後に料金、コンテキスト、キャッシュ、用途を比較して本番ルートを選びます。
| モデル | Gemini 3.7 Flash | Gemini 3.5 Flash Lite | Gemini 3.1 Pro |
|---|---|---|---|
| 入力 / 出力 | $0.675 / $3.375 | $0.3 / $2.5 | $1.68 / $10.08 |
| コンテキスト | 1M | 1M | 1M |
| キャッシュ | 自動キャッシュ読み取り | コンテキストキャッシュ | コンテキストキャッシュ |
| 適した用途 | 本番コーディングとフルスタックのリファクタリング、多段階エージェントとオーケストレーション、文書やグラフの分析、そして高いトークン効率が完了タスクあたりのコストを下げる大量処理。 | Flash 系では対応しきれない最も深い推論タスク向けの Pro 系 Gemini。 | Flash 系では対応しきれない最も深い推論タスク向けの Pro 系 Gemini。 |
EvoLink の他の Gemini モデル

Gemini 3.5 Flash
The previous-generation Flash workhorse that 3.7 Flash improves on for token efficiency and output cost.
モデルを見る
Gemini 3.5 Flash Lite
The cheapest, fastest 3.5-class route for classification, extraction, and high-throughput subagents.
モデルを見る
Gemini 3.1 Pro
The Pro-tier step up when a task needs deeper reasoning than the Flash line can deliver.
モデルを見る
Gemini 3.1 Flash Lite
The lightweight 3.1 route for high-volume, cost-sensitive, and low-latency workloads.
モデルを見るその他のテキストモデル

GPT-5.6
OpenAI’s tiered frontier family (Sol/Terra/Luna) for capability, latency, and cost-routing flexibility.
モデルを見る
Claude Opus 4.8
Anthropic’s premium baseline for long-running coding agents and judgment-heavy review.
モデルを見る
DeepSeek V4
Cost-sensitive open baseline for high-volume coding, reasoning, and agent workloads.
モデルを見る
Kimi K3
Moonshot’s long-context reasoning route for repository-scale coding and multi-document work.
モデルを見る本番導入に役立つ関連記事



Gemini API ファミリーを比較
ルーティング前に、3.7 Flash、3.5 Flash-Lite、3.6 Flash、3.1 Pro が価格、コンテキスト、ワークロード適合でどう異なるかを確認します。
ガイドを読む
Gemini 3.7 Flash API よくある質問
Gemini 3.7 Flash API は EvoLink で利用できますか?
はい。本番モデルとして利用でき、ライブ料金と公式フォールバック料金に対応しています。
Gemini 3.7 Flash API ではどのモデル ID を使うべきですか?
モデルには "gemini-3.7-flash"(ドット区切り)を指定します。ハイフン区切りの gemini-3-7-flash はページの URL であり、API のモデルパラメータではありません。
Gemini 3.7 Flash ではどのプロトコルと SDK が使えますか?
OpenAI 互換の Chat Completions エンドポイント、または Gemini ネイティブの generateContent エンドポイントを、同じ EvoLink API Key で利用できます。このモデルには Anthropic の Messages API 経由のルートはありません。
Gemini 3.7 Flash API は本当に 1M コンテキスト全体に対応していますか?
はい。Google のドキュメントに基づき、ルートは 1,048,576 入力 Token を記録します。より小さい上限は通常、特定の Gemini 製品面やクライアント設定に由来し、API モデル自体のものではありません。
Gemini 3.7 Flash の 1M Token コンテキストウィンドウはどう使うべきですか?
関連するコード、文書、ツールの結果はまとめて保持しつつ、既定で窓を埋めるのではなく、検索、安定したキャッシュ済みプレフィックス、コンテキスト圧縮を活用してください。
Gemini 3.7 Flash は Gemini 3.6 Flash や 3.5 Flash-Lite とどう違いますか?
3.7 Flash は 3.6 Flash と同価格ですが、Google の公表では FrontierCode や Terminal-bench などのコーディング・エージェント系ベンチマークで公式スコアが高くなっています。3.5 Flash-Lite は引き続き、分類や高スループットタスク向けのより安価で高速なルートです。
Gemini 3.7 Flash は Token 使用量が増えても実際に安くなりますか?
Token 単価は Gemini 3.6 Flash と同じです。Google は 3.7 Flash がより少ないターンでタスクを完了すると位置づけていますが、公開初日の一部報告ではタスクあたりの Token 使用量が多いという観察もあります。リクエスト単価ではなく、自分のワークロードで受理タスクあたりの総 Token を比較してください。
Gemini 3.7 Flash へ移行する際に対応すべき破壊的変更は何ですか?
Google の公式移行チェックリストに従い、生成設定からカスタムの temperature、top-P、top-K、candidate_count を削除し、数値の thinking_budget を thinking_level 文字列に置き換え、事前入力された model ターンを削除してください。
Gemini 3.7 Flash の minimal 思考レベルはどうなりましたか?
Google が削除しました。利用できるのは low、medium(デフォルト)、high で、Gemini API に minimal を送るとエラーになります。EvoLink は reasoning_effort の none や minimal を low に自動降格するため、移行済みリクエストは失敗しません。高スループットの分類パイプラインには、より低コストな Gemini 3.5 Flash-Lite が下限として適しています。
Gemini 3.7 Flash の思考 Token はどう課金されますか?
Google の料金では思考 Token は出力単価で課金されるため、冗長な推論は見えている回答よりも請求額を大きくすることがあります。タスクに合った思考レベルを設定し、推論と最終回答の Token を監視してください。
Gemini 3.7 Flash は動画や音声を分析できますか?
はい。テキスト、画像、動画、音声、PDF の入力を受け付けてテキストを出力するため、動画・音声理解ワークロードでよく選ばれます。画像生成、音声生成、ライブストリーム生成には対応していません。
Gemini 3.7 Pro はありますか?
ありません。3.7 Flash のリリース時点で、Google の Pro 系最新モデルは gemini-3.1-pro-preview のままで、3.5 や 3.7 の Pro は公式チャネルで発表されていません。
Gemini 3.7 Flash の導入価格はいつまで続きますか?
Google は 100 万 Token あたり入力 $0.75、出力 $3.75 を 2026 年 12 月 31 日までの導入価格として掲載しており、2027 年 1 月 1 日からは標準価格の $1.50 と $7.50 になります。EvoLink の現在の料金は本ページの料金セクションをご覧ください。
Gemini 3.7 Flash は 3.6 Flash より指示遵守が信頼できますか?
Google は 3.6 Flash と同程度の安全性とトーンを報告していますが、ある独立系トラッカーは公開時により高いハルシネーション率を測定しました。本番投入の前に、自分の代表的なタスクで指示遵守と事実面の規律を検証してください。
本番評価では何を計測すべきですか?
初回成功率、採用成果物、再試行、出力 Token、キャッシュヒット率、有効なツール呼び出し、所要時間、人手修正、フォールバック率を計測します。