Seedance 2.5がEvoLinkで利用可能にSeedance 2.5を試す

Gemini 3.7 Flash API

Google-テキスト生成-$0.675 / 100万入力 Token から$1.500 公式料金-利用可能
100万コンテキスト最大出力 6.5万プロンプトキャッシュChat + Gemini API
API ドキュメント
Production routeLive
提供元
Google
モデル
3.7 Flash
コンテキスト
1,048,576 Token
プロトコル
Chat + Gemini

Gemini 3.7 Flash を選択

Google 最新の Flash 系高効率主力モデルで、コスト効率の高いコーディング、エージェントワークフロー、ナレッジワーク、マルチモーダル推論に対応し、Gemini 3.6 Flash より高いトークン効率と 100万 Token のコンテキストウィンドウを備えています。

Gemini 3.7 Flash

Google の Flash 系高効率主力モデル

選択中
$0.675 / 100万入力 Token から$1.500 公式料金gemini-3.7-flash
適した用途

本番コーディングとフルスタックのリファクタリング、多段階エージェントとオーケストレーション、文書やグラフの分析、そして高いトークン効率が完了タスクあたりのコストを下げる大量処理。

入力
$0.675 / 1M-55%
45.9 cr / 1M$1.500公式料金
キャッシュ読み取り
$0.068 / 1M-55%
4.6 cr / 1M$0.150公式料金
出力
$3.375 / 1M-55%
229.5 cr / 1M$7.500公式料金

Gemini 3.7 Flash pricing

Estimate a request with the interactive pricing calculator. All user groups use the official Gemini 3.7 Flash rate.

3.7 Flash

Token calculator

Enter the token mix for one request.

Estimated request cost

Gemini 3.7 Flash
Official rate
USD$0.0018
Credits0.1158
Input tokens0.0459 cr
Cache read tokens0.001 cr
Output tokens0.0689 cr

Minimum charge: 0.01 credits per request.

EvoLink vs Google direct

Same token mix, default group price.
-55%
EvoLink estimate$0.0018
Google official$0.0038
You save$0.0021

Budget guide

Approximate requests using the current token mix.
Add credits
$10
About 5872 requests

For quick testing

$50
About 29360 requests

For regular development

$100
About 58721 requests

For production evaluation

Model pricing

Gemini 3.7 Flash

All context sizes
Input tokens
$0.675 / 1M-55%
45.9 cr / 1M$1.500official price
Cache read tokens
$0.068 / 1M-55%
4.6 cr / 1M$0.150official price
Output tokens
$3.375 / 1M-55%
229.5 cr / 1M$7.500official price

USD and credits are shown per 1M tokens. Live backend pricing takes priority over these frozen fallback rates.

コスト効率の高いコーディングとエージェント向け Gemini 3.7 Flash API

Google 最新の Flash クラス主力モデルを EvoLink の統一 API で利用できます。Gemini 3.7 Flash は Gemini 3.6 Flash より高いトークン効率で、コーディング、ナレッジワーク、マルチモーダル推論を改善し、1,048,576 Token のコンテキスト、プロンプトキャッシュ、構造化出力、ツール利用に対応します。料金は Google の公式導入価格として入力 / 出力 100 万 Token あたり $0.75 / $3.75(2026 年 12 月 31 日まで)です。

Gemini 3.7 Flash
Gemini 3.7 Flash のユースケース

本番モデル構成で Gemini 3.7 Flash が価値を発揮する場所

Google は Gemini 3.7 Flash を主力モデルと位置づけています。Gemini 3.6 Flash より大幅に高いトークン効率で、コーディング、ナレッジワーク、マルチモーダル性能を高めます。十分に良い推論を低いトークンコストで得られることが、プレミアム層に支払うより有利になる本番作業に最も適しています。

コスト効率の高いコーディングとリファクタリング

Gemini 3.7 Flash は日常的なコーディング、プロトタイピング、フルスタックのリファクタリングを、Gemini 3.6 Flash より少ないトークンと少ない呼び出し回数で狙います。Google の Antigravity エージェント環境でも利用できます。評価は単独スニペットの品質ではなく、採用されたパッチとレビュー時間で行います。

エージェントワークフローとオーケストレーション

多段のオーケストレーション、ツール選択、構造化出力、コード実行に適し、1 回あたりの低コストが長いエージェント実行を通じて積み上がります。ターン間でアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を完全に保持してください。

ナレッジワークとマルチモーダル推論

100 万 Token のコンテキストで、文書分析、チャート解釈、複数要素の Web レイアウト生成に使えます。検索と文書構造は依然として重要で、100 万 Token の窓があっても無関係なコンテキストが有用になるわけではありません。

別のルートが適している場合

単純、低遅延が重要、または超大量の分類・抽出は、通常より安価な Gemini 3.5 Flash-Lite が適しています。最も難しい推論は Pro 層モデルに回します。3.7 Flash への引き上げは、その効率が採用タスク当たりのコストを実際に下げるときだけにします。

公開初日のシグナル

Gemini 3.7 Flash の初期反応が示すことと、まだ検証が必要なこと

Gemini 3.7 Flash は 2026-08-13 に公開されました。公開初日のコミュニティ反応は、確定したベンチマークではなく、自分のタスク、ツール、予算、受け入れ基準で検証すべき仮説として扱ってください。

3.6 Flash と同価格で、より強力なエージェント実行

Google は 3.7 Flash を Gemini 3 ファミリーのエージェント主力と位置づけ、コーディングとエージェント向けとしてこれまでで最も高性能な主力モデルと紹介しています。コード生成とターミナル実行が大きく向上しながら、価格は Gemini 3.6 Flash と完全に同じです。同じワークロードでの利点は、単価の安さではなく、リトライの減少とエージェントループの短縮から生まれます。

これは Flash クラスの主力モデルであり、最上位のエンジニアリングモデルではない

公開初日の一部の議論では、難しいソフトウェアエンジニアリングのベンチマークで、より大きなフロンティアモデルに後れを取るとされています。深いリポジトリのリファクタリングや長時間の自律コーディングが目的なら、既定にする前に Pro 層またはプレミアムモデルと比較してください。

自分のプロンプトでタスクあたりの Token 用量を検証する

公開初日の一部報告では、同じタスクでの Token 使用量が Gemini 3.6 Flash より多いと観察されています。代表的なプロンプトで応答長、指示遵守、ツール呼び出しの規律を確認し、追加の推論が出力コストを密かに押し上げないようにしてください。

これはクローズドで API 専用の Google モデル

Gemini 3.7 Flash にはオープンウェイトがなく、セルフホストもできません。アクセスは Gemini API と、Google AI Studio、Antigravity、EvoLink のような統一ゲートウェイを通じて行うため、ローカル配置ではなくコストと信頼性でルーティングしてください。

中核機能

Gemini 3.7 Flash が複雑なワークロードを処理できる理由

Gemini 3.7 Flash は、大きなコンテキストウィンドウ、向上したトークン効率、再利用可能なプロンプトのプレフィックスが組み合わさったときに最も役立ちます。コンテキスト容量だけでは回答は良くならず、関連する根拠、明確な構造、出力予算が依然として必要です。

100 万 Token は作業領域であり、埋める目標ではない

1,048,576 Token のウィンドウは、関連コード、仕様、過去のツール結果を過度な分割なしに保持できます。無関係な入力は注意を奪い処理コストを増やすため、検索とコンテキスト圧縮は引き続き重要です。

3.6 Flash より向上したトークン効率

Gemini 3.7 Flash は多段ワークフローをより少ないターンと少ないトークンで完了することを目指します。コスト優位の源泉は呼び出し回数の削減と総トークンの削減なので、単発リクエストの価格ではなく、採用タスク当たりの総トークンを追跡してください。

プロンプトキャッシュはプレフィックスが安定すると効く

リポジトリ指示、システムプロンプト、参照資料、ツールスキーマは、順序が一貫していれば最も強いキャッシュ機会を生みます。モデルやプロンプト構造を頻繁に変えると、長いプレフィックスの再処理を招くことがあります。

Gemini 3.7 Flash API 本番チェック

Gemini 3.7 Flash に本番トラフィックを送る前に確認すること

適切なワークロードでも、統合が誤った識別子を使う、非対応パラメータを送る、ターン間でエージェント状態を失うと失敗します。モデル品質を評価する前に、リクエスト面と会話契約を確認してください。

01

正確なモデル ID gemini-3.7-flash を使用

EvoLink API ルートでは model に "gemini-3.7-flash"(ドット付き)を送信します。ハイフン形式の gemini-3-7-flash はページ URL であり、API のモデルパラメータではありません。

モデル ID
02

OpenAI Chat Completions または Gemini ネイティブ API を使用

EvoLink は OpenAI 互換の /v1/chat/completions と Gemini ネイティブの generateContent エンドポイントで Gemini 3.7 Flash を提供します。どちらのプロトコルでも同じ EvoLink API キーを使います。

プロトコル
03

破壊的なパラメータ変更に注意

Google の公式移行チェックリストに従い、カスタムの temperature、top-P、top-K、candidate_count を削除し、数値の thinking_budget を thinking_level 文字列に置き換え、事前入力された model ターンを削除してください。既存の Gemini リクエスト構築処理もあわせて更新します。

移行
04

アシスタントとツールの状態を完全に再送

マルチターンのエージェントは、完全なアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を保持すべきです。最終テキストだけを残すと状態の連続性が崩れ、コンテキストウィンドウが十分でも後続ステップが失敗することがあります。

ツール状態
本番コスト評価

トークン単価ではなく、採用タスク当たりのコストを比較

Gemini 3.7 Flash が経済的に勝つのは、同じワークロードで効率がトークン、モデル呼び出し、再試行、人手のやり直しを減らすときです。孤立したプロンプト価格を比べるのではなく、同一のタスクセットで評価してください。

初回成功率採用できる成果物の割合再試行回数出力 Tokenキャッシュヒット率有効なツール呼び出し採用可能な結果までの時間人手修正とフォールバック率

Gemini 3.7 Flash が少ないトークンと少ないレビュー工数で使える結果を出すなら、その高いトークン効率は積み重なって実際のコスト優位になります。最も難しいタスクで品質が落ちるなら、それらは Pro 層モデルに引き上げ、3.7 Flash は効率の高い大多数に使ってください。

実ワークロードの検証後に長文コンテキストモデルを比較

EvoLink

まず Gemini 3.7 Flash が再試行とレビューを減らすか確認し、その後に料金、コンテキスト、キャッシュ、用途を比較して本番ルートを選びます。

Gemini 3.7 Flash
入力 / 出力$0.675 / $3.375
コンテキスト1M
キャッシュ自動キャッシュ読み取り
適した用途本番コーディングとフルスタックのリファクタリング、多段階エージェントとオーケストレーション、文書やグラフの分析、そして高いトークン効率が完了タスクあたりのコストを下げる大量処理。
Gemini 3.5 Flash Lite
入力 / 出力$0.3 / $2.5
コンテキスト1M
キャッシュコンテキストキャッシュ
適した用途Flash 系では対応しきれない最も深い推論タスク向けの Pro 系 Gemini。
Gemini 3.1 Pro
入力 / 出力$1.68 / $10.08
コンテキスト1M
キャッシュコンテキストキャッシュ
適した用途Flash 系では対応しきれない最も深い推論タスク向けの Pro 系 Gemini。

EvoLink の他の Gemini モデル

Gemini 3.5 Flash

Gemini 3.5 Flash

The previous-generation Flash workhorse that 3.7 Flash improves on for token efficiency and output cost.

モデルを見る
Gemini 3.5 Flash Lite

Gemini 3.5 Flash Lite

The cheapest, fastest 3.5-class route for classification, extraction, and high-throughput subagents.

モデルを見る
Gemini 3.1 Pro

Gemini 3.1 Pro

The Pro-tier step up when a task needs deeper reasoning than the Flash line can deliver.

モデルを見る
Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite

The lightweight 3.1 route for high-volume, cost-sensitive, and low-latency workloads.

モデルを見る

その他のテキストモデル

GPT-5.6

GPT-5.6

OpenAI’s tiered frontier family (Sol/Terra/Luna) for capability, latency, and cost-routing flexibility.

モデルを見る
Claude Opus 4.8

Claude Opus 4.8

Anthropic’s premium baseline for long-running coding agents and judgment-heavy review.

モデルを見る
DeepSeek V4

DeepSeek V4

Cost-sensitive open baseline for high-volume coding, reasoning, and agent workloads.

モデルを見る
Kimi K3

Kimi K3

Moonshot’s long-context reasoning route for repository-scale coding and multi-document work.

モデルを見る

本番導入に役立つ関連記事

Gemini 3.7 Flash のリリース日と展開

Gemini 3.7 Flash のリリース日と展開

2026 年 8 月 13 日に公開された内容、モデル ID gemini-3.7-flash、公式料金、利用可能な場所をまとめます。

ガイドを読む
Gemini 3.7 Flash vs Gemini 3.6 Flash

Gemini 3.7 Flash vs Gemini 3.6 Flash

同一料金で 3 週間差——移行チェックリスト、検証すべき挙動の変化、そして 3.6 に留まるべきケース。

ガイドを読む
Gemini API ファミリーを比較

Gemini API ファミリーを比較

ルーティング前に、3.7 Flash、3.5 Flash-Lite、3.6 Flash、3.1 Pro が価格、コンテキスト、ワークロード適合でどう異なるかを確認します。

ガイドを読む
Gemini 3.5 Flash-Lite API

Gemini 3.5 Flash-Lite API

分類、抽出、高スループットのサブエージェント向けに最も安く速い 3.5 系ルート。難しい作業は 3.7 Flash に引き上げます。

ガイドを読む
Gemini 3.6 Flash API

Gemini 3.6 Flash API

3.7 Flash と同一料金の前世代 Flash モデル。本番トラフィックを移す前に比較してください。

ガイドを読む
Gemini 3.1 Pro API

Gemini 3.1 Pro API

Flash ラインでは足りない、より深い推論がタスクに必要なときは Pro 層に引き上げます。

ガイドを読む

Gemini 3.7 Flash API よくある質問

Gemini 3.7 Flash API は EvoLink で利用できますか?

はい。本番モデルとして利用でき、ライブ料金と公式フォールバック料金に対応しています。

Gemini 3.7 Flash API ではどのモデル ID を使うべきですか?

モデルには "gemini-3.7-flash"(ドット区切り)を指定します。ハイフン区切りの gemini-3-7-flash はページの URL であり、API のモデルパラメータではありません。

Gemini 3.7 Flash ではどのプロトコルと SDK が使えますか?

OpenAI 互換の Chat Completions エンドポイント、または Gemini ネイティブの generateContent エンドポイントを、同じ EvoLink API Key で利用できます。このモデルには Anthropic の Messages API 経由のルートはありません。

Gemini 3.7 Flash API は本当に 1M コンテキスト全体に対応していますか?

はい。Google のドキュメントに基づき、ルートは 1,048,576 入力 Token を記録します。より小さい上限は通常、特定の Gemini 製品面やクライアント設定に由来し、API モデル自体のものではありません。

Gemini 3.7 Flash の 1M Token コンテキストウィンドウはどう使うべきですか?

関連するコード、文書、ツールの結果はまとめて保持しつつ、既定で窓を埋めるのではなく、検索、安定したキャッシュ済みプレフィックス、コンテキスト圧縮を活用してください。

Gemini 3.7 Flash は Gemini 3.6 Flash や 3.5 Flash-Lite とどう違いますか?

3.7 Flash は 3.6 Flash と同価格ですが、Google の公表では FrontierCode や Terminal-bench などのコーディング・エージェント系ベンチマークで公式スコアが高くなっています。3.5 Flash-Lite は引き続き、分類や高スループットタスク向けのより安価で高速なルートです。

Gemini 3.7 Flash は Token 使用量が増えても実際に安くなりますか?

Token 単価は Gemini 3.6 Flash と同じです。Google は 3.7 Flash がより少ないターンでタスクを完了すると位置づけていますが、公開初日の一部報告ではタスクあたりの Token 使用量が多いという観察もあります。リクエスト単価ではなく、自分のワークロードで受理タスクあたりの総 Token を比較してください。

Gemini 3.7 Flash へ移行する際に対応すべき破壊的変更は何ですか?

Google の公式移行チェックリストに従い、生成設定からカスタムの temperature、top-P、top-K、candidate_count を削除し、数値の thinking_budget を thinking_level 文字列に置き換え、事前入力された model ターンを削除してください。

Gemini 3.7 Flash の minimal 思考レベルはどうなりましたか?

Google が削除しました。利用できるのは low、medium(デフォルト)、high で、Gemini API に minimal を送るとエラーになります。EvoLink は reasoning_effort の none や minimal を low に自動降格するため、移行済みリクエストは失敗しません。高スループットの分類パイプラインには、より低コストな Gemini 3.5 Flash-Lite が下限として適しています。

Gemini 3.7 Flash の思考 Token はどう課金されますか?

Google の料金では思考 Token は出力単価で課金されるため、冗長な推論は見えている回答よりも請求額を大きくすることがあります。タスクに合った思考レベルを設定し、推論と最終回答の Token を監視してください。

Gemini 3.7 Flash は動画や音声を分析できますか?

はい。テキスト、画像、動画、音声、PDF の入力を受け付けてテキストを出力するため、動画・音声理解ワークロードでよく選ばれます。画像生成、音声生成、ライブストリーム生成には対応していません。

Gemini 3.7 Pro はありますか?

ありません。3.7 Flash のリリース時点で、Google の Pro 系最新モデルは gemini-3.1-pro-preview のままで、3.5 や 3.7 の Pro は公式チャネルで発表されていません。

Gemini 3.7 Flash の導入価格はいつまで続きますか?

Google は 100 万 Token あたり入力 $0.75、出力 $3.75 を 2026 年 12 月 31 日までの導入価格として掲載しており、2027 年 1 月 1 日からは標準価格の $1.50 と $7.50 になります。EvoLink の現在の料金は本ページの料金セクションをご覧ください。

Gemini 3.7 Flash は 3.6 Flash より指示遵守が信頼できますか?

Google は 3.6 Flash と同程度の安全性とトーンを報告していますが、ある独立系トラッカーは公開時により高いハルシネーション率を測定しました。本番投入の前に、自分の代表的なタスクで指示遵守と事実面の規律を検証してください。

本番評価では何を計測すべきですか?

初回成功率、採用成果物、再試行、出力 Token、キャッシュヒット率、有効なツール呼び出し、所要時間、人手修正、フォールバック率を計測します。