Gemini 3.8 Flash API
Gemini 3.8 Flash を選択
コーディング、エージェントワークフロー、ナレッジワーク、マルチモーダル推論向けの Google 最新 Flash 主力モデルです。Google は Gemini 3.7 Flash より高い精度を報告しており、100万 Token のコンテキストに対応します。
Gemini 3.8 Flash
Google の Flash 系主力モデル
gemini-3.8-flash高いタスク精度が追加の Token 消費を正当化できる、本番コーディング、フルスタックのリファクタリング、多段階エージェント、文書やグラフの分析。
Gemini 3.8 Flash の料金
インタラクティブな料金計算でリクエスト費用を見積もり、EvoLink と Google の現在の導入価格を比較します。
Token 計算
1 リクエストの Token 構成を入力します。推定リクエスト費用
Gemini 3.8 Flash最低料金:1 リクエストあたり 0.01 Credits。
EvoLink と Google 直接利用の比較
同じ Token 構成、デフォルトグループ料金。予算ガイド
現在の Token 構成でのおおよそのリクエスト数。簡単なテスト向け
通常の開発向け
本番評価向け
モデル料金
| モデル | コンテキスト | 入力 Token | キャッシュ読み取り Token | 出力 Token |
|---|---|---|---|---|
Gemini 3.8 Flashgemini-3.8-flash | すべてのコンテキスト長 | $0.675 / 1M-55% 45.9 cr / 1M$1.500Google 導入価格 | $0.068 / 1M-55% 4.6 cr / 1M$0.150Google 導入価格 | $3.375 / 1M-55% 229.5 cr / 1M$7.500Google 導入価格 |
Gemini 3.8 Flash
すべてのコンテキスト長USD と Credits は 100 万 Token 単位です。バックエンドのリアルタイム料金が保存済みのフォールバック料金より優先されます。
コーディングとエージェント向け Gemini 3.8 Flash API
Google 最新の Flash 主力モデルを EvoLink の統一 API で利用できます。Google は Gemini 3.7 Flash より高い精度を報告する一方、Token 消費も増えると説明しています。1,048,576 Token のコンテキスト、プロンプトキャッシュ、構造化出力、ツール利用に対応し、Google 導入価格は入力 / 出力 100 万 Token あたり $0.75 / $3.75(2026 年 12 月 31 日まで)です。
本番モデル構成で Gemini 3.8 Flash が価値を発揮する場所
Google は Gemini 3.8 Flash を、コーディング、ナレッジワーク、マルチモーダルタスク向けの高精度な主力モデルと位置づける一方、Gemini 3.7 Flash より Token 消費が増えると説明しています。成功率の向上が追加コストを補える本番作業に適しています。
コーディングとリファクタリングを評価
Gemini 3.8 Flash は Gemini 3.7 Flash より高い精度が報告されていますが、Token 消費が増える可能性があります。日常的なコーディングやフルスタックのリファクタリングでは、採用パッチ、総 Token、レビュー時間を測定してください。
エージェントワークフローとオーケストレーション
Google は多段のオーケストレーション、ツール選択、構造化出力、コード実行を強調しています。EvoLink はこれらのワークフローのタスク完了率や総コストを測定していません。テストの際は、ターン間でアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を完全に保持してください。
ナレッジワークとマルチモーダル推論
100 万 Token のコンテキストで、文書分析、チャート解釈、複数要素の Web レイアウト生成に使えます。検索と文書構造は依然として重要で、100 万 Token の窓があっても無関係なコンテキストが有用になるわけではありません。
別のルートが適している場合
Gemini 3.5 Flash-Lite は、大量の分類・抽出向けに公開 Token 単価がより低く設定されています。タスクコストで有利だと仮定して 3.8 Flash を割り当てるのではなく、同じ受け入れ基準で既存ルートと比較してください。
Google が確認していることと、EvoLink が測定していないこと
Google は 2026-09-02 に Gemini 3.8 Flash を公開し、モデルレベルのベンチマークと Token 消費に関する説明を公表しました。EvoLink は 3.8 と 3.7 の対照ワークロード調査を公開していないため、このページはリトライ削減、エージェントループ短縮、タスク単位の低コストを主張しません。
導入価格は同じで、公式ベンチマークスコアはより高い
Google は 3.8 Flash と 3.7 Flash に同じ導入価格(入力、出力、キャッシュ読み取り)を掲載し、強調するコーディング・エージェント系ベンチマークで 3.8 のスコアが高いと報告しています。同時に Token 消費の増加も明記しており、これらの事実は本番タスクの請求額が下がることを示しません。
公式ベンチマークはプロバイダー横断の本番ランキングではない
Google のリリース結果は選ばれたベンチマークを示すもので、あなたのワークロードで 3.8 Flash があらゆる Pro 層モデルやサードパーティモデルに勝つことを証明しません。したがってこのページはプロバイダー横断の優劣を主張しません。
Token 消費の増加は公式の注意事項
Google は、3.8 Flash が 3.7 Flash より精度を高める一方で多くの Token を使うと明言しています。公開された Token 単価だけでは、完了タスクあたりどちらのモデルが安いかは判断できません。
これはクローズドで API 専用の Google モデル
Gemini 3.8 Flash にはオープンウェイトがなく、セルフホストもできません。アクセスは Gemini API と、Google AI Studio、Antigravity、EvoLink のような統一ゲートウェイを通じて行うため、ローカル配置ではなくコストと信頼性でルーティングしてください。
Gemini 3.8 Flash が複雑なワークロードを処理できる理由
Gemini 3.8 Flash は、大きなコンテキストウィンドウ、高いタスク精度、再利用可能なプロンプトのプレフィックスが組み合わさったときに最も役立ちます。コンテキスト容量だけでは回答は良くならず、関連する根拠、明確な構造、出力予算が必要です。
100 万 Token は作業領域であり、埋める目標ではない
1,048,576 Token のウィンドウは、関連コード、仕様、過去のツール結果を過度な分割なしに保持できます。無関係な入力は注意を奪い処理コストを増やすため、検索とコンテキスト圧縮は引き続き重要です。
高い精度と増える Token 消費
Google は Gemini 3.7 Flash より精度が高い一方、Token 消費も増えると明記しています。採用タスク当たりの総コストを追跡し、結果改善が追加 Token を補えるか確認してください。
プロンプトキャッシュはプレフィックスが安定すると効く
リポジトリ指示、システムプロンプト、参照資料、ツールスキーマは、順序が一貫していれば最も強いキャッシュ機会を生みます。モデルやプロンプト構造を頻繁に変えると、長いプレフィックスの再処理を招くことがあります。
Gemini 3.8 Flash に本番トラフィックを送る前に確認すること
適切なワークロードでも、統合が誤った識別子を使う、非対応パラメータを送る、ターン間でエージェント状態を失うと失敗します。モデル品質を評価する前に、リクエスト面と会話契約を確認してください。
正確なモデル ID gemini-3.8-flash を使用
EvoLink API ルートでは model に "gemini-3.8-flash"(ドット付き)を送信します。ハイフン形式の gemini-3-8-flash はページ URL であり、API のモデルパラメータではありません。
OpenAI Chat Completions または Gemini ネイティブ API を使用
EvoLink は OpenAI 互換の /v1/chat/completions と Gemini ネイティブの generateContent エンドポイントで Gemini 3.8 Flash を提供します。どちらのプロトコルでも同じ EvoLink API キーを使います。
破壊的なパラメータ変更に注意
EvoLink ネイティブリクエストでは、Gemini 3.x は generationConfig.thinkingConfig.thinkingLevel を使います。thinkingBudget は Gemini 2.5 向けで、両者は同時に指定できません。EvoLink のドキュメントによれば、カスタムの temperature と topP は Gemini 3.x の出力に影響せず、topK は無視され、範囲外の temperature や topP は 400 を返します。会話の最後のターンに role model は使えません。
アシスタントとツールの状態を完全に再送
マルチターンのエージェントは、完全なアシスタントメッセージ、ツール呼び出し ID、引数、ツール結果を保持すべきです。最終テキストだけを残すと状態の連続性が崩れ、コンテキストウィンドウが十分でも後続ステップが失敗することがあります。
タスク単位のコスト優位はまだ確認されていない
確認できる事実は、3.8 Flash と 3.7 Flash が Google の同じ導入価格(Token 単価)を共有し、Google が 3.8 の Token 消費増加と精度向上を明記していることです。EvoLink は再試行、採用成果物、ツール呼び出し、所要時間、人手レビューに関する対照結果を公開していません。
これらは評価の入力項目であり、Gemini 3.8 Flash で観測された結果ではありません。同じ本番サンプルを同じ設定でテストするまで、3.8 が採用タスク当たりのコストを下げると主張しないでください。3.7 や Flash-Lite の公開価格と計算プロファイルがすでにワークロードに合うなら、そちらを選びます。
実ワークロードの検証後に長文コンテキストモデルを比較
EvoLink高い精度が Gemini 3.8 Flash の追加 Token 消費を補えるか確認し、その後に料金、コンテキスト、キャッシュ、用途を比較して本番ルートを選びます。
| モデル | Gemini 3.8 Flash | Gemini 3.5 Flash Lite | Gemini 3.1 Pro |
|---|---|---|---|
| 入力 / 出力 | $0.675 / $3.375 | $0.3 / $2.5 | $1.68 / $10.08 |
| コンテキスト | 1M | 1M | 1M |
| キャッシュ | 自動キャッシュ読み取り | コンテキストキャッシュ | コンテキストキャッシュ |
| 適した用途 | 高いタスク精度が追加の Token 消費を正当化できる、本番コーディング、フルスタックのリファクタリング、多段階エージェント、文書やグラフの分析。 | 公開 Token 単価がより低いルート。分類、抽出、高スループットタスクの比較に使えます。 | Flash 系では足りない深い推論タスクを評価する Pro 層の比較ルート。 |
EvoLink の他の Gemini モデル




その他のテキストモデル




本番導入に役立つ関連記事



Gemini API ファミリーを比較
ルーティング前に、3.8 Flash、3.5 Flash-Lite、3.7 Flash、3.1 Pro が価格、コンテキスト、ワークロード適合でどう異なるかを確認します。
ガイドを読む
Gemini 3.8 Flash API よくある質問
Gemini 3.8 Flash API は EvoLink で利用できますか?
はい。本番モデルとして掲載されています。ページは取得できたバックエンド料金を優先し、取得できない場合は現在の Google 導入価格を比較基準にします。
Gemini 3.8 Flash API ではどのモデル ID を使うべきですか?
モデルには "gemini-3.8-flash"(ドット区切り)を指定します。ハイフン区切りの gemini-3-8-flash はページの URL であり、API のモデルパラメータではありません。
Gemini 3.8 Flash ではどのプロトコルと SDK が使えますか?
EvoLink は direct.evolink.ai で、同じ API Key により OpenAI 互換の Chat Completions と Gemini ネイティブの generateContent を提供すると文書化しており、gemini-3.8-flash は両エンドポイントのモデル enum に掲載されています。実際のルートはアカウントで確認してください。
Gemini 3.8 Flash API は本当に 1M コンテキスト全体に対応していますか?
はい。Google のドキュメントに基づき、ルートは 1,048,576 入力 Token を記録します。より小さい上限は通常、特定の Gemini 製品面やクライアント設定に由来し、API モデル自体のものではありません。
Gemini 3.8 Flash の 1M Token コンテキストウィンドウはどう使うべきですか?
関連するコード、文書、ツールの結果はまとめて保持しつつ、既定で窓を埋めるのではなく、検索、安定したキャッシュ済みプレフィックス、コンテキスト圧縮を活用してください。
Gemini 3.8 Flash は Gemini 3.7 Flash や 3.5 Flash-Lite とどう違いますか?
Google は 3.8 と 3.7 に同じ導入価格(Token 単価)を掲載し、選ばれたコーディング・エージェント系ベンチマークで 3.8 のスコアが高いと報告し、3.8 の Token 消費が増えることも明記しています。3.5 Flash-Lite にはより低い Token 単価が掲載されています。ワークロードごとの結果は引き続きテストが必要です。
Gemini 3.8 Flash は Token 使用量が増えても実際に安くなりますか?
Token 単価は Gemini 3.7 Flash と同じですが、Google は精度向上とともに Token 消費も増えると明記しています。タスク単価が下がると決めつけず、自分のワークロードで採用タスクあたりの総コストを比較してください。
Gemini 3.8 Flash へ移行する際に対応すべきパラメータのルールは何ですか?
EvoLink ネイティブリクエストでは、Gemini 3.x は generationConfig.thinkingConfig.thinkingLevel を使います。thinkingBudget は Gemini 2.5 向けで、thinkingLevel と併用できません。EvoLink のドキュメントによれば、カスタムの temperature と topP は Gemini 3.x の出力に影響せず、topK は無視され、範囲外の temperature や topP は 400 を返します。最後のターンに role model は使えません。
Gemini 3.8 Flash の minimal 思考レベルはどうなりましたか?
Google は Gemini 3.8 Flash について low、medium(デフォルト)、high を文書化しており、minimal は未対応です。EvoLink のネイティブ API リファレンスでは、未対応の minimal は自動的に low へ降格されるため移行したリクエストは失敗しませんが、予測可能な制御のために low を明示的に指定してください。Gemini 3.5 Flash-Lite は公開 Token 単価がより低く、高スループットの分類向けの比較ルートとして引き続き使えます。
Gemini 3.8 Flash の思考 Token はどう課金されますか?
Google の料金では思考 Token は出力単価で課金されるため、冗長な推論は見えている回答よりも請求額を大きくすることがあります。タスクに合った思考レベルを設定し、推論と最終回答の Token を監視してください。
Gemini 3.8 Flash は動画や音声を分析できますか?
はい。テキスト、画像、動画、音声、PDF の入力を受け付けてテキストを出力するため、動画・音声理解ワークロードでよく選ばれます。画像生成、音声生成、ライブストリーム生成には対応していません。
Gemini 3.7 Pro はありますか?
ありません。3.8 Flash のリリース時点で、Google の Pro 系最新モデルは gemini-3.1-pro-preview のままで、3.5 や 3.7 の Pro は公式チャネルで発表されていません。
Gemini 3.8 Flash の導入価格はいつまで続きますか?
Google は 100 万 Token あたり入力 $0.75、出力 $3.75 を 2026 年 12 月 31 日までの導入価格として掲載しており、2027 年 1 月 1 日からは標準価格の $1.50 と $7.50 になります。EvoLink の現在の料金は本ページの料金セクションをご覧ください。
Gemini 3.8 Flash は 3.7 Flash より指示遵守が信頼できますか?
Google は全体的な精度の向上と Token 消費の増加を報告していますが、EvoLink は指示遵守の対照比較を公開していません。本番投入の前に代表的なタスクでテストしてください。
本番評価では何を計測すべきですか?
初回成功率、採用成果物、再試行、出力 Token、キャッシュヒット率、有効なツール呼び出し、所要時間、人手修正、フォールバック率を計測します。