
Gemini 3.5 ProとFlashを比較:今どちらを選ぶ?

したがって、これは確定した性能比較ではありません。今すぐ提供すべき機能には文書化済みの現行モデルを使い、ProについてはモデルID、料金、コンテキスト、ツール、性能を推測せず、同一条件のテストを準備するという提供判断です。
一目でわかる
| 判断項目 | Gemini 3.5 Flash | Gemini 3.5 Pro |
|---|---|---|
| Googleのステータス | 安定版として文書化されたAPIモデル | 近日公開予定・パートナーテスト中 |
| 公開モデルID | gemini-3.5-flash | 未知 |
| 公開料金 | 公開済み | 不明 |
| 公開機能表 | 公開済み | 未公開 |
| コンテキストと出力 | Flashについて文書化済み | Proは不明 |
| 同一条件での実測 | 現時点で可能 | 公開ルートを待つ必要あり |
| 現時点の判断 | 現行ワークロードで評価 | トレースと採用基準を準備 |
この表が比較しているのは根拠の有無であり、噂上の性能ではありません。現段階で勝者を決める表を作れば、比較項目の半分を推測で埋めることになります。

実際に何が知られているのか?
Google の公開ドキュメントでは、Gemini 3.5 Flash のエンドポイント、サポートされている入力、トークン制限、機能、消費オプション、および価格が確認されています。 Google はまた、Gemini 3.5 Pro が存在し、パートナーとテスト中であり、後日リリースされることを確認しています。
情報源を区別すると、次のように整理できます。
| 主張 | 状態 | 安全な扱い |
|---|---|---|
| Flashは安定版のGemini APIモデル | 公式情報 | 現在の事実 |
| Proは近日公開予定でパートナーテスト中 | 公式情報 | 現在の製品状態 |
| Proに公開エンドポイントや料金がある | 根拠なし | 事実として掲載しない |
| Proは2MコンテキストやDeep Thinkに対応 | 第三者の主張 | 評価項目としてのみ扱う |
| ProはコーディングでFlashを上回る | 不明 | 検証仮説としてのみ扱う |
主な比較ポイント:モデル階層ではなく、検証可能性
現時点で最も重要な違いは、理論上の賢さではありません。Flashは実際のタスクで測定できますが、Proには確認済みの公開APIルートがなく、同じ条件ではまだ評価できません。
Proという名称は根拠の代わりにならず、Flashだから合格タスクあたりのコストが必ず低いとも限りません。Gemini 3.5 Flash がすでに提供しているもの
GoogleはGemini 3.5 Flashを、継続的なエージェント処理やコーディングに対応する安定版エンドポイントとして文書化しています。モデルページには、テキスト、画像、動画、音声、PDFの入力、テキスト出力、thinking、関数呼び出し、構造化出力、グラウンディング、コード実行、キャッシュ、複数の利用方式が掲載されています。
Flashが常に最適という意味ではありません。重要なのは、現時点で検証できることです。代表的なリポジトリ作業、複数ステップのエージェント、抽出、長文書、マルチモーダル入力を使い、品質・レイテンシ・コストの基準を満たす範囲を確認します。
待機または切り替えを正当化するために Gemini 3.5 Pro が改善すべき点
将来のProルートは、次の実務指標を改善できて初めて採用候補になります。
- より困難なコーディング、計画、調査、およびマルチモーダルなタスクを完了します。
- エージェントのループ、無効なツールの呼び出し、コンテキストの損失、人による修正を削減します。
- 再試行、フォールバック、レビューをカウントした後に受け入れられたタスクあたりのコストを改善します。
- 構造化された出力、グラウンディング、キャッシュ、およびツールの互換性を維持または改善します。
- 予測可能なクォータ、レイテンシー、安全動作、リージョン、非推奨期間を提供します。
Pro がレイテンシ、レビューの負担、または失敗したタスクのコストを増加させながら、ベンチマークのヘッドラインのみを改善する場合、多くのワークロードが Flash 上に残るはずです。
検証すべき挙動の変化
静的ベンチマーク テーブルから新しいルートをプロモートしないでください。同じワークロードを再生し、トレース全体の動作を検査します。
| 挙動 | 測定項目 | 採用時の懸念 |
|---|---|---|
| 思考 | 合格結果、思考トークン、レイテンシ | 推論量が増えても結果が改善しない |
| ツールの使用 | 有効な呼び出し、引数、リカバリ、ループ | 実行後の失敗または繰り返しのアクション |
| 構造化された出力 | スキーマの有効性と修復率 | サイレントシェイプドリフト |
| 長文コンテキスト | 有用な範囲での検索精度 | 最大ウィンドウを埋めるだけで価値がない |
| キャッシング | ヒットの動作、鮮度、キャッシュされていない入力、課金 | 使用量に現れない想定節約額 |
| 安全性 | ブロック、終了理由、一貫性 | 新たな誤検知または属性の欠落 |
| フォールバック | 要求したID、返されたID、請求 | 気付かないまま別ルートに置換される |
セッションの鮮度、有効なコンテキスト量、キャッシュ済み・未キャッシュ入力を明示的なテスト変数にします。公称最大コンテキストを埋めるためだけに、すべてのプロンプトを長くしないでください。
互換性の面と移行のリスク
同じファミリーのモデルでも、リクエスト項目や運用時の挙動が異なる場合があります。次を再検証してください。
- 正確なモデル ID、エイリアス、プレビューまたは安定したステータス、および返された ID。
- 入力部分の形式とファイル制限。
thinkingConfig、サンプリング コントロール、および出力上限。- 関数スキーマ、組み込みツール、グラウンディング、およびコード実行。
- ストリーミング チャンク、使用状況メタデータ、終了理由、および安全ブロック。
- キャッシュ、バッチ、フレックス、優先度、クォータ、リージョン、およびデータ条件。
- EvoLinkルートの料金、容量、使用量計上、ロールバック。
Flash によって受け入れられたリクエストが、Pro によって変更されずに受け入れられるとは想定しないでください。プロバイダー固有の違いは、アプリケーションのビジネス ロジックではなく、ルーティング アダプター内に保持します。
Gemini 3.5 Flashを使い続けるべき場合
レイテンシの影響を受けやすいツール、大量の抽出、日常的なコーディング ループ、分類、またはマルチモーダル処理の受け入れゲートをすでに通過している場合は、Flash を保持します。また、Pro が実際のトラフィック ミックスで安定した動作を示すまで、フォールバックとして保持してください。
Pro のリリース後も、正しい答えは、置き換えではなくルーティング ポリシーである可能性があります。
| ワークロード | デフォルトの候補 | 次の場合にのみエスカレーションします |
|---|---|---|
| 短く、レイテンシ重視のリクエスト | Flash | 品質不足が繰り返され、Proの効果が確認できた場合 |
| 大量抽出 | Flash | Proが合格出力を大幅に増やした場合 |
| 複雑なリポジトリ計画 | 一致したベンチマーク | Pro は再試行とやり直しを削減します |
| 長い文書の合成 | 一致したベンチマーク | プロが有用なコンテキストの向上を証明 |
| 重要な意思決定支援 | 制限付きルート+レビュー | Proが品質・安全基準を満たした場合 |
安全な評価と展開計画
- ベースラインを固定します。 代表的なタスクを保存し、Flashの成功率、レイテンシ、使用量、再試行、ツールエラー、レビュー工数を記録します。
- 候補ルートを検証します。 公式モデルID、認証リクエストの成功、返されたID、使用量、料金、請求を確認します。
- オフラインで再評価します。 同じプロンプト、ツール、コンテキスト量、サービス階層、合格基準で両モデルを実行します。
- チャレンジャー枠を設けます。 シャドウトラフィックから始め、障害と支出の上限を設定した小規模カナリアへ進みます。
- ワークロード単位で採用します。 Proが成功率、レイテンシ、コスト、互換性、安全性の基準を満たしたタスクだけを移行し、即時ロールバックを維持します。
1 つのゲートウェイを使用すると、モデルの選択は引き続き構成主導で行うことができます。この運用上の柔軟性は、ページに 2 つのモデル名が表示されるからではなく、各ルートが検証された後にのみ役立ちます。
EvoLink ユーザーに対する現在の決定
- Gemini 3.5 Flashを確認する。本番導入前にルートを検証してください。
- Gemini 3.1 Proを確認する。現行Pro系のベースラインとして評価します。
- Gemini 3.5 Proの公開APIに関する根拠を追跡する。
- Gemini 3.5 Proのリリース通知を受け取る。
- Geminiモデルファミリーを比較する。
情報源
- Google DeepMind: Gemini モデル ファミリー
- Google: Gemini 3.5 の発表
- Google:パートナーテストを確認する7月21日のアップデート
- Google AI for Developers: Gemini API モデル カタログ
- 開発者向け Google AI: Gemini 3.5 Flash
- Google AI for Developers: Gemini API の価格
よくある質問
Gemini 3.5 Pro と Gemini 3.5 Flash は両方とも利用できますか?
いいえ。Flashは安定版のGemini APIモデルとして文書化されています。Proは近日公開予定でパートナーテスト中ですが、2026年8月12日時点で公開APIエンドポイントは掲載されていません。
開発者は今どのモデルを使用すべきでしょうか?
現在の 3.5 世代のルートについて Gemini 3.5 Flashを評価します。ワークロードに 2 番目の比較ポイントが必要な場合は、Gemini 3.1 Pro を現在の Pro ファミリのベースラインとして使用します。
Gemini 3.5 Pro はコーディングに Flash よりも優れていますか?
現時点では不明です。Googleは公開Proエンドポイントも、条件をそろえたGemini 3.5 Pro APIの比較結果も公開していません。リリース後に同じリポジトリ、ツール、合格基準でテストしてください。
Gemini 3.5 Pro は Flash よりも高価ですか?
Google は Pro の価格を公開していません。実際のルートと請求が利用可能になった後でのみ、受け入れられたタスクごとの定価と合計コストを比較してください。
Gemini 3.5 Proのコンテキストウィンドウはより大きくなりますか?
Gemini 3.5 Pro API コンテキスト制限は確認されていません。 Flash、Gemini 3.1 Pro、またはサードパーティの噂の制限を Pro 仕様にコピーしないでください。
チームは Flash の評価をやめて Pro を待つべきでしょうか?
いいえ、公開開始日が決まっていない状態で待っていると配信リスクが生じます。現在のルートを評価し、将来の候補を構成可能な状態に保ちます。
Proのリリース時にFlashを置き換える必要がありますか?
自動的に置き換えるべきではありません。品質、レイテンシ、コストの条件を満たすワークロードではFlashを維持し、同一条件の検証で明確な改善が確認できた場合だけProへ移行します。
実稼働トラフィックが Pro に到達する前に何を検証する必要がありますか?
モデル ID、リクエストの成功、返された ID、入力、パラメータ、ツール、制限、クォータ、リージョン、使用状況、価格、請求、フォールバック、ロールバック動作を確認します。


