Seedance 2.5がEvoLinkで利用可能にSeedance 2.5を試す

Gemini 3.8 Flash API

Google-テキスト生成-$0.675 / 100万入力 Token から$1.500 Google 導入価格-利用可能
100万コンテキスト最大出力 6.5万プロンプトキャッシュChat + Gemini API
API ドキュメント
本番ルート稼働中
提供元
Google
モデル
3.8 Flash
コンテキスト
1,048,576 Token
プロトコル
Chat + Gemini

Gemini 3.8 Flash を選択

コーディング、エージェントワークフロー、ナレッジワーク、マルチモーダル推論向けの Google 最新 Flash 主力モデルです。Google は Gemini 3.7 Flash より高い精度を報告しており、100万 Token のコンテキストに対応します。

Gemini 3.8 Flash

Google の Flash 系主力モデル

選択中
$0.675 / 100万入力 Token から$1.500 Google 導入価格gemini-3.8-flash
適した用途

高いタスク精度が追加の Token 消費を正当化できる、本番コーディング、フルスタックのリファクタリング、多段階エージェント、文書やグラフの分析。

入力
$0.675 / 1M-55%
45.9 cr / 1M$1.500Google 導入価格
キャッシュ読み取り
$0.068 / 1M-55%
4.6 cr / 1M$0.150Google 導入価格
出力
$3.375 / 1M-55%
229.5 cr / 1M$7.500Google 導入価格

Gemini 3.8 Flash の料金

インタラクティブな料金計算でリクエスト費用を見積もり、EvoLink と Google の現在の導入価格を比較します。

3.8 Flash

Token 計算

1 リクエストの Token 構成を入力します。

推定リクエスト費用

Gemini 3.8 Flash
現在の料金
USD$0.0018
Credits0.1158
入力 Token0.0459 cr
キャッシュ読み取り Token0.001 cr
出力 Token0.0689 cr

最低料金:1 リクエストあたり 0.01 Credits。

EvoLink と Google 直接利用の比較

同じ Token 構成、デフォルトグループ料金。
-55%
EvoLink の見積もり$0.0018
Google 導入価格$0.0038
節約額$0.0021

予算ガイド

現在の Token 構成でのおおよそのリクエスト数。
Credits を追加
$10
約 5872 リクエスト

簡単なテスト向け

$50
約 29360 リクエスト

通常の開発向け

$100
約 58721 リクエスト

本番評価向け

モデル料金

Gemini 3.8 Flash

すべてのコンテキスト長
入力 Token
$0.675 / 1M-55%
45.9 cr / 1M$1.500Google 導入価格
キャッシュ読み取り Token
$0.068 / 1M-55%
4.6 cr / 1M$0.150Google 導入価格
出力 Token
$3.375 / 1M-55%
229.5 cr / 1M$7.500Google 導入価格

USD と Credits は 100 万 Token 単位です。バックエンドのリアルタイム料金が保存済みのフォールバック料金より優先されます。

コーディングとエージェント向け Gemini 3.8 Flash API

Google 最新の Flash 主力モデルを EvoLink の統一 API で利用できます。Google は Gemini 3.7 Flash より高い精度を報告する一方、Token 消費も増えると説明しています。1,048,576 Token のコンテキスト、プロンプトキャッシュ、構造化出力、ツール利用に対応し、Google 導入価格は入力 / 出力 100 万 Token あたり $0.75 / $3.75(2026 年 12 月 31 日まで)です。

Gemini 3.8 Flash
Gemini 3.8 Flash のユースケース

本番モデル構成で Gemini 3.8 Flash が価値を発揮する場所

Google は Gemini 3.8 Flash を、コーディング、ナレッジワーク、マルチモーダルタスク向けの高精度な主力モデルと位置づける一方、Gemini 3.7 Flash より Token 消費が増えると説明しています。成功率の向上が追加コストを補える本番作業に適しています。

コーディングとリファクタリングを評価

Gemini 3.8 Flash は Gemini 3.7 Flash より高い精度が報告されていますが、Token 消費が増える可能性があります。日常的なコーディングやフルスタックのリファクタリングでは、採用パッチ、総 Token、レビュー時間を測定してください。

エージェントワークフローとオーケストレーション

Google は多段のオーケストレーション、ツール選択、構造化出力、コード実行を強調しています。EvoLink はこれらのワークフローのタスク完了率や総コストを測定していません。テストの際は、ターン間でアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を完全に保持してください。

ナレッジワークとマルチモーダル推論

100 万 Token のコンテキストで、文書分析、チャート解釈、複数要素の Web レイアウト生成に使えます。検索と文書構造は依然として重要で、100 万 Token の窓があっても無関係なコンテキストが有用になるわけではありません。

別のルートが適している場合

Gemini 3.5 Flash-Lite は、大量の分類・抽出向けに公開 Token 単価がより低く設定されています。タスクコストで有利だと仮定して 3.8 Flash を割り当てるのではなく、同じ受け入れ基準で既存ルートと比較してください。

公式リリースの根拠

Google が確認していることと、EvoLink が測定していないこと

Google は 2026-09-02 に Gemini 3.8 Flash を公開し、モデルレベルのベンチマークと Token 消費に関する説明を公表しました。EvoLink は 3.8 と 3.7 の対照ワークロード調査を公開していないため、このページはリトライ削減、エージェントループ短縮、タスク単位の低コストを主張しません。

導入価格は同じで、公式ベンチマークスコアはより高い

Google は 3.8 Flash と 3.7 Flash に同じ導入価格(入力、出力、キャッシュ読み取り)を掲載し、強調するコーディング・エージェント系ベンチマークで 3.8 のスコアが高いと報告しています。同時に Token 消費の増加も明記しており、これらの事実は本番タスクの請求額が下がることを示しません。

公式ベンチマークはプロバイダー横断の本番ランキングではない

Google のリリース結果は選ばれたベンチマークを示すもので、あなたのワークロードで 3.8 Flash があらゆる Pro 層モデルやサードパーティモデルに勝つことを証明しません。したがってこのページはプロバイダー横断の優劣を主張しません。

Token 消費の増加は公式の注意事項

Google は、3.8 Flash が 3.7 Flash より精度を高める一方で多くの Token を使うと明言しています。公開された Token 単価だけでは、完了タスクあたりどちらのモデルが安いかは判断できません。

これはクローズドで API 専用の Google モデル

Gemini 3.8 Flash にはオープンウェイトがなく、セルフホストもできません。アクセスは Gemini API と、Google AI Studio、Antigravity、EvoLink のような統一ゲートウェイを通じて行うため、ローカル配置ではなくコストと信頼性でルーティングしてください。

中核機能

Gemini 3.8 Flash が複雑なワークロードを処理できる理由

Gemini 3.8 Flash は、大きなコンテキストウィンドウ、高いタスク精度、再利用可能なプロンプトのプレフィックスが組み合わさったときに最も役立ちます。コンテキスト容量だけでは回答は良くならず、関連する根拠、明確な構造、出力予算が必要です。

100 万 Token は作業領域であり、埋める目標ではない

1,048,576 Token のウィンドウは、関連コード、仕様、過去のツール結果を過度な分割なしに保持できます。無関係な入力は注意を奪い処理コストを増やすため、検索とコンテキスト圧縮は引き続き重要です。

高い精度と増える Token 消費

Google は Gemini 3.7 Flash より精度が高い一方、Token 消費も増えると明記しています。採用タスク当たりの総コストを追跡し、結果改善が追加 Token を補えるか確認してください。

プロンプトキャッシュはプレフィックスが安定すると効く

リポジトリ指示、システムプロンプト、参照資料、ツールスキーマは、順序が一貫していれば最も強いキャッシュ機会を生みます。モデルやプロンプト構造を頻繁に変えると、長いプレフィックスの再処理を招くことがあります。

Gemini 3.8 Flash API 本番チェック

Gemini 3.8 Flash に本番トラフィックを送る前に確認すること

適切なワークロードでも、統合が誤った識別子を使う、非対応パラメータを送る、ターン間でエージェント状態を失うと失敗します。モデル品質を評価する前に、リクエスト面と会話契約を確認してください。

01

正確なモデル ID gemini-3.8-flash を使用

EvoLink API ルートでは model に "gemini-3.8-flash"(ドット付き)を送信します。ハイフン形式の gemini-3-8-flash はページ URL であり、API のモデルパラメータではありません。

モデル ID
02

OpenAI Chat Completions または Gemini ネイティブ API を使用

EvoLink は OpenAI 互換の /v1/chat/completions と Gemini ネイティブの generateContent エンドポイントで Gemini 3.8 Flash を提供します。どちらのプロトコルでも同じ EvoLink API キーを使います。

プロトコル
03

破壊的なパラメータ変更に注意

EvoLink ネイティブリクエストでは、Gemini 3.x は generationConfig.thinkingConfig.thinkingLevel を使います。thinkingBudget は Gemini 2.5 向けで、両者は同時に指定できません。EvoLink のドキュメントによれば、カスタムの temperature と topP は Gemini 3.x の出力に影響せず、topK は無視され、範囲外の temperature や topP は 400 を返します。会話の最後のターンに role model は使えません。

移行
04

アシスタントとツールの状態を完全に再送

マルチターンのエージェントは、完全なアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を保持すべきです。最終テキストだけを残すと状態の連続性が崩れ、コンテキストウィンドウが十分でも後続ステップが失敗することがあります。

ツール状態
本番コスト評価

タスク単位のコスト優位はまだ確認されていない

確認できる事実は、3.8 Flash と 3.7 Flash が Google の同じ導入価格(Token 単価)を共有し、Google が 3.8 の Token 消費増加と精度向上を明記していることです。EvoLink は再試行、採用成果物、ツール呼び出し、所要時間、人手レビューに関する対照結果を公開していません。

初回成功率採用できる成果物の割合再試行回数出力 Tokenキャッシュヒット率有効なツール呼び出し採用可能な結果までの時間人手修正とフォールバック率

これらは評価の入力項目であり、Gemini 3.8 Flash で観測された結果ではありません。同じ本番サンプルを同じ設定でテストするまで、3.8 が採用タスク当たりのコストを下げると主張しないでください。3.7 や Flash-Lite の公開価格と計算プロファイルがすでにワークロードに合うなら、そちらを選びます。

実ワークロードの検証後に長文コンテキストモデルを比較

EvoLink

高い精度が Gemini 3.8 Flash の追加 Token 消費を補えるか確認し、その後に料金、コンテキスト、キャッシュ、用途を比較して本番ルートを選びます。

Gemini 3.8 Flash
入力 / 出力$0.675 / $3.375
コンテキスト1M
キャッシュ自動キャッシュ読み取り
適した用途高いタスク精度が追加の Token 消費を正当化できる、本番コーディング、フルスタックのリファクタリング、多段階エージェント、文書やグラフの分析。
Gemini 3.5 Flash Lite
入力 / 出力$0.3 / $2.5
コンテキスト1M
キャッシュコンテキストキャッシュ
適した用途公開 Token 単価がより低いルート。分類、抽出、高スループットタスクの比較に使えます。
Gemini 3.1 Pro
入力 / 出力$1.68 / $10.08
コンテキスト1M
キャッシュコンテキストキャッシュ
適した用途Flash 系では足りない深い推論タスクを評価する Pro 層の比較ルート。

EvoLink の他の Gemini モデル

Gemini 3.5 Flash

Gemini 3.5 Flash

品質、レイテンシ、Token 使用量を比較する 3.5 クラスの Flash ルート。

モデルを見る
Gemini 3.5 Flash Lite

Gemini 3.5 Flash Lite

公開 Token 単価がより低いルート。分類、抽出、高スループットのサブエージェントの比較に使えます。

モデルを見る
Gemini 3.1 Pro

Gemini 3.1 Pro

より深い推論タスク向けの Pro 層比較ルート。

モデルを見る
Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite

コスト重視の大量ワークロードを比較する軽量な 3.1 ルート。

モデルを見る

その他のテキストモデル

GPT-5.6

GPT-5.6

能力、レイテンシ、コストルーティングを比較する OpenAI の階層型モデルファミリー。

モデルを見る
Claude Opus 4.8

Claude Opus 4.8

長時間のコーディングエージェントや判断力を要するレビューを比較する Anthropic モデル。

モデルを見る
DeepSeek V4

DeepSeek V4

コーディング、推論、エージェントワークロード向けのオープンモデル比較ルート。

モデルを見る
Kimi K3

Kimi K3

長文コンテキスト推論と複数文書作業を比較する Moonshot ルート。

モデルを見る

本番導入に役立つ関連記事

Gemini 3.8 Flash vs Gemini 3.7 Flash

Gemini 3.8 Flash vs Gemini 3.7 Flash

デフォルトモデルを切り替える前に、精度、Token 消費、導入価格、承認タスクあたりのコストを比較します。

ガイドを読む
Gemini 3.8 Flash API の使い方

Gemini 3.8 Flash API の使い方

最初のリクエストを送信し、Gemini 3 の移行ルールに対応し、テレメトリ、カナリア、ロールバックの制御を追加します。

ガイドを読む
Gemini API ファミリーを比較

Gemini API ファミリーを比較

ルーティング前に、3.8 Flash、3.5 Flash-Lite、3.7 Flash、3.1 Pro が価格、コンテキスト、ワークロード適合でどう異なるかを確認します。

ガイドを読む
Gemini 3.5 Flash-Lite API

Gemini 3.5 Flash-Lite API

分類、抽出、高スループットのサブエージェント向けに最も安く速い 3.5 系ルート。難しい作業は 3.8 Flash に引き上げます。

ガイドを読む
Gemini 3.7 Flash API

Gemini 3.7 Flash API

3.8 Flash と同一料金の前世代 Flash モデル。本番トラフィックを移す前に比較してください。

ガイドを読む
Gemini 3.1 Pro API

Gemini 3.1 Pro API

Flash ラインでは足りない、より深い推論がタスクに必要なときは Pro 層に引き上げます。

ガイドを読む

Gemini 3.8 Flash API よくある質問

Gemini 3.8 Flash API は EvoLink で利用できますか?

はい。本番モデルとして掲載されています。ページは取得できたバックエンド料金を優先し、取得できない場合は現在の Google 導入価格を比較基準にします。

Gemini 3.8 Flash API ではどのモデル ID を使うべきですか?

モデルには "gemini-3.8-flash"(ドット区切り)を指定します。ハイフン区切りの gemini-3-8-flash はページの URL であり、API のモデルパラメータではありません。

Gemini 3.8 Flash ではどのプロトコルと SDK が使えますか?

EvoLink は direct.evolink.ai で、同じ API Key により OpenAI 互換の Chat Completions と Gemini ネイティブの generateContent を提供すると文書化しており、gemini-3.8-flash は両エンドポイントのモデル enum に掲載されています。実際のルートはアカウントで確認してください。

Gemini 3.8 Flash API は本当に 1M コンテキスト全体に対応していますか?

はい。Google のドキュメントに基づき、ルートは 1,048,576 入力 Token を記録します。より小さい上限は通常、特定の Gemini 製品面やクライアント設定に由来し、API モデル自体のものではありません。

Gemini 3.8 Flash の 1M Token コンテキストウィンドウはどう使うべきですか?

関連するコード、文書、ツールの結果はまとめて保持しつつ、既定で窓を埋めるのではなく、検索、安定したキャッシュ済みプレフィックス、コンテキスト圧縮を活用してください。

Gemini 3.8 Flash は Gemini 3.7 Flash や 3.5 Flash-Lite とどう違いますか?

Google は 3.8 と 3.7 に同じ導入価格(Token 単価)を掲載し、選ばれたコーディング・エージェント系ベンチマークで 3.8 のスコアが高いと報告し、3.8 の Token 消費が増えることも明記しています。3.5 Flash-Lite にはより低い Token 単価が掲載されています。ワークロードごとの結果は引き続きテストが必要です。

Gemini 3.8 Flash は Token 使用量が増えても実際に安くなりますか?

Token 単価は Gemini 3.7 Flash と同じですが、Google は精度向上とともに Token 消費も増えると明記しています。タスク単価が下がると決めつけず、自分のワークロードで採用タスクあたりの総コストを比較してください。

Gemini 3.8 Flash へ移行する際に対応すべきパラメータのルールは何ですか?

EvoLink ネイティブリクエストでは、Gemini 3.x は generationConfig.thinkingConfig.thinkingLevel を使います。thinkingBudget は Gemini 2.5 向けで、thinkingLevel と併用できません。EvoLink のドキュメントによれば、カスタムの temperature と topP は Gemini 3.x の出力に影響せず、topK は無視され、範囲外の temperature や topP は 400 を返します。最後のターンに role model は使えません。

Gemini 3.8 Flash の minimal 思考レベルはどうなりましたか?

Google は Gemini 3.8 Flash について low、medium(デフォルト)、high を文書化しており、minimal は未対応です。EvoLink のネイティブ API リファレンスでは、未対応の minimal は自動的に low へ降格されるため移行したリクエストは失敗しませんが、予測可能な制御のために low を明示的に指定してください。Gemini 3.5 Flash-Lite は公開 Token 単価がより低く、高スループットの分類向けの比較ルートとして引き続き使えます。

Gemini 3.8 Flash の思考 Token はどう課金されますか?

Google の料金では思考 Token は出力単価で課金されるため、冗長な推論は見えている回答よりも請求額を大きくすることがあります。タスクに合った思考レベルを設定し、推論と最終回答の Token を監視してください。

Gemini 3.8 Flash は動画や音声を分析できますか?

はい。テキスト、画像、動画、音声、PDF の入力を受け付けてテキストを出力するため、動画・音声理解ワークロードでよく選ばれます。画像生成、音声生成、ライブストリーム生成には対応していません。

Gemini 3.7 Pro はありますか?

ありません。3.8 Flash のリリース時点で、Google の Pro 系最新モデルは gemini-3.1-pro-preview のままで、3.5 や 3.7 の Pro は公式チャネルで発表されていません。

Gemini 3.8 Flash の導入価格はいつまで続きますか?

Google は 100 万 Token あたり入力 $0.75、出力 $3.75 を 2026 年 12 月 31 日までの導入価格として掲載しており、2027 年 1 月 1 日からは標準価格の $1.50 と $7.50 になります。EvoLink の現在の料金は本ページの料金セクションをご覧ください。

Gemini 3.8 Flash は 3.7 Flash より指示遵守が信頼できますか?

Google は全体的な精度の向上と Token 消費の増加を報告していますが、EvoLink は指示遵守の対照比較を公開していません。本番投入の前に代表的なタスクでテストしてください。

本番評価では何を計測すべきですか?

初回成功率、採用成果物、再試行、出力 Token、キャッシュヒット率、有効なツール呼び出し、所要時間、人手修正、フォールバック率を計測します。