GPT Image 2.5 Flare & Sunburst が EvoLink で利用可能にGPT Image 2.5 を試す

GLM-5.3 FlashX API

GLM-5.3 FlashX は、対話型コーディングやエージェント処理に向けた、速度重視の Z.ai マルチモーダルモデルです。Flash とのトークンコストを比較し、EvoLink の統一 API から導入できます。

Z.aiテキスト生成利用可能
入力 100 万トークンあたり $0.371 から
API ドキュメント
マルチモーダル入力画像 · 動画 · ファイル入力思考は常時オンChat + Messages
本番ルート公開中
コンテキスト
コンテキスト 1M · 最大出力 131K
適した用途
対話型コーディングエージェント、スクリーンショット分析、文書処理
入力
テキスト + 画像 + 動画 + ファイル
出力
テキスト · JSON(構造化出力)· ツール呼び出し

GLM-5.3 FlashX を選ぶ

GLM-5.3 FlashX は、対話型コーディングやエージェント処理に向けた、速度重視の Z.ai マルチモーダルモデルです。Flash とのトークンコストを比較し、EvoLink の統一 API から導入できます。

GLM-5.3 FlashX

速度を重視した Z.ai のマルチモーダルモデル

選択中
モデル ID
glm-5.3-flashx
適した用途

対話型コーディングエージェント、スクリーンショット分析、文書処理

入力
$0.371 / 1M25.2 cr / 1M
キャッシュ読み取り
$0.075 / 1M5.1 cr / 1M
出力
$1.250 / 1M85 cr / 1M

すべての料金は 100 万トークンあたりで、USD とクレジットの両方で表示され、お使いのアカウントの現在の価格を反映します。

GLM-5.3 FlashX の料金

統合前に GLM-5.3 FlashX の 1 リクエストあたりの費用を見積もれます。計算機はお使いのアカウントの現在の料金を使い、公式価格は比較用の参考として表示します。

リクエスト計算機

1 リクエスト分のトークン構成と成功したツール呼び出し回数を入力してください。

1 リクエストの推定費用

GLM-5.3 FlashX
USD$0.0008
クレジット0.0518
入力トークン0.0252 cr
キャッシュ読み取りトークン0.0011 cr
出力トークン0.0255 cr

最低課金:1 リクエストあたり 0.01 クレジット。

予算の目安

現在のトークン構成でのおおよそのリクエスト数。
クレジットを追加
$10
約 13127 リクエスト

手早いテスト向け

$50
約 65637 リクエスト

日常的な開発向け

$100
約 131274 リクエスト

本番評価向け

サーバーサイドツールの料金

成功したサーバーサイド呼び出しのみ回数課金されます。失敗した試行にツール料金はかかりませんが、トークンは課金されます。
  • ウェブ検索$0.010/ 回0.68 cr / 回

対話型マルチモーダル処理のための GLM-5.3 FlashX

モデルの出力待ちがコーディングやエージェント処理を遅らせる場合に、FlashX を評価してください。Flash のトークン単価はより低いため、実際のタスクで短縮できる時間が価格差に見合うかを測定します。

GLM-5.3 FlashX は EvoLink ではモデル ID glm-5.3-flashx として Chat Completions · Responses · Anthropic Messages で提供され、他のモデルと同じ API キーと残高で使えます。1M のコンテキストウィンドウと最大 131K トークンの出力に加えて画像入力、長文ドキュメント分析、複数ステップのエージェントを備えています。

GLM-5.3 FlashX

GLM-5.3 FlashX の仕様と機能

数値は EvoLink のルート設定に基づき、機能は API が現在提供しているものです。

コンテキストウィンドウ
1M トークン
最大出力
131K トークン
入力
テキスト + 画像 + 動画 + ファイル
出力
テキスト · JSON(構造化出力)· ツール呼び出し
推論
常時オンの推論
ツール利用
複数ステップのツール連携を含む Function Calling
プロンプトキャッシュ
自動キャッシュ読み取り(低価格)
サーバーサイドツール
ウェブ検索、成功した呼び出しごとに課金
プロトコル
Chat Completions · Responses · Anthropic Messages
モデル ID
glm-5.3-flashx

FlashX の選択を左右するポイント

速度だけでなく、必要な入力、タスクの品質、利用可能な結果を得るためのコストを比較します。

Flash と並ぶ速度重視の選択肢

Z.ai は FlashX を高速推論向けと位置付けています。Flash より高品質である証拠や、EvoLink のレイテンシ保証ではありません。同じプロンプト、推論設定、出力上限で比較してください。

長いコンテキストで扱うマルチモーダル情報

Z.ai はテキスト・画像・動画・ファイル入力と 100 万トークンのコンテキストを文書化しています。使用可能なリクエスト形式は API ドキュメントで確認してください。モデルの出力はテキストで、ファイル作成や操作はエージェントのツールが担います。

一つのゲートウェイでモデルを選択

EvoLink でモデルのコストを比較し、統一 API ゲートウェイに接続先をまとめられます。低コストで品質要件を満たすタスクは Flash に任せ、応答時間が重要な場合に FlashX を評価してください。

GLM-5.3 FlashX を評価したいタスク

人や別のツールが、モデルの次の応答を待っているタスクから始めてください。

対話型コーディングエージェント

同じエージェントループで実装、デバッグ、ツール結果の解釈を評価します。トークン生成速度だけでなく、ツール実行や再試行を含め、動作する成果物が得られるまでの時間を測定してください。

スクリーンショットに基づく開発

画面のスクリーンショットを使い、コード変更の根拠や表示不具合を説明させます。結果が参照画像と一致するか、選択した API ルートが画像形式を受け付けるかを確認してください。

すぐに応答が必要な文書処理

文字と視覚情報を含む文書で、情報抽出や追加質問を評価します。待ち時間を許容できるオフライン分類や一括処理では、まず低価格の Flash と比較してください。

FlashX・Flash・GLM-5.3 の選び方

EvoLink

以下の現在の料金を比較してください。FlashX は速度重視、Flash はトークン単価が低い選択肢です。変更前にタスク成功率と完了までの時間を測定します。

GLM-5.3 FlashX
入力 / 出力$0.371 / $1.25
コンテキスト1M
キャッシュキャッシュ読み取り
最適な用途対話型コーディングエージェント、スクリーンショット分析、文書処理
GLM-5.3
入力 / 出力$1.4 / $4.4
コンテキスト1M
キャッシュキャッシュ読み取り
最適な用途難しい推論タスクでは、テキスト専用のフラッグシップを評価できます。マルチモーダルリクエストをテキスト専用モデルへそのまま転送することはできません。
GLM-5.3 Flash
入力 / 出力$0.15 / $0.5
コンテキスト1M
キャッシュキャッシュ読み取り
最適な用途オフライン処理やコスト重視のタスク向けの低価格なマルチモーダルモデルです。応答待ちが問題になる場合に FlashX と比較し、精度向上は前提にしないでください。

GLM-5.3 FlashX を使う 2 つの方法:EvoLink API または Agent

プロダクトのバックエンドやバッチ処理には EvoLink API を、コーディングや分析のワークフローには Codex・Claude・Gemini から GLM-5.3 FlashX を直接呼び出せます。どちらも同じ EvoLink API キー、残高、モデル ID、リクエスト履歴を共有します。

方法 1

EvoLink API で統合する

向いている用途:プロダクトのバックエンド、バッチ処理、自動化パイプライン

OpenAI 互換の Chat Completions(または Anthropic Messages)リクエストを EvoLink に送り、モデル ID、システムプロンプト、出力予算、ツール、構造化出力を自分で制御します。

  1. 1コンソールで EvoLink API キーを作成する
  2. 2OpenAI または Anthropic の SDK の base URL を EvoLink に向け、上に表示されたモデル ID を選ぶ
  3. 3代表的なリクエストを 1 件送り、usage フィールドで入力・キャッシュ・出力トークンを確認する
  4. 4タスクごとに max_tokens と再試行を設定し、複数ターンでは tool-call の ID と結果を保持する
方法 2

Agent から呼び出す

向いている用途:Codex・Claude・Gemini でのコーディング、レビュー、分析

タスク、含める入力、受け入れ基準を Agent に渡すと、Agent がリクエストを組み立て、EvoLink 経由で GLM-5.3 FlashX を呼び出し、回答をトークン使用量とともに返します。

  1. 1EVOLINK_API_KEY をローカル環境変数に設定する(コードやプロンプトには書かない)
  2. 2タスク、含める入力、期待する出力形式を説明する
  3. 3EvoLink 経由で GLM-5.3 FlashX を呼び出し、送信前にリクエストを表示するよう Agent に指示する
  4. 4回答、トークン使用量、エラー本文を Agent に報告させる

GLM-5.3 FlashX API のコード例とエラー処理

この例は最短で実行できるリクエストです:システムプロンプト、ユーザーメッセージ、出力予算を含む OpenAI 互換の Chat Completions 呼び出し。パラメータとレスポンスの完全なリファレンスは API タブを開いてください。

完全な API ドキュメントを見る
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flashx",
    "messages": [
      { "role": "system", "content": "You extract structured data. Answer in JSON only." },
      { "role": "user", "content": "Extract the product, quantity, and unit price: 2 notebooks at $4.50 each." }
    ],
    "thinking": { "type": "enabled", "clear_thinking": false },
    "reasoning_effort": "low",
    "max_tokens": 4096,
    "temperature": 0.1
  }'

# Reasoning is always on for the 5.3 generation: do not send
# thinking.type "disabled". The same model ID works on /v1/messages
# (Anthropic Messages). The response includes choices[0].message and
# a usage object; image and video input is counted in prompt_tokens.

無効なリクエストまたは未対応パラメータ

API リファレンスに照らしてモデル ID、messages 配列、パラメータ範囲を確認し、このルートが対応しないフィールドを削除してください。

認証または残高の問題

Authorization の Bearer トークンを確認し、コンソールで利用可能残高を確かめてください。

コンテキスト長の超過

プロンプトのトークンが GLM-5.3 FlashX のコンテキストウィンドウを超えています。必要な情報だけに絞るか検索で取り出し、キャッシュ済みプレフィックスを再利用してください。

レート制限(429)

バックオフとジッターを入れて再試行し、並列バーストではなくバッチやキューで送ってください。

コンテンツまたはツール呼び出しの拒否

再試行の前に、センシティブな内容、形式不正の tool-call 引数、JSON スキーマの不一致を確認してください。

入力・出力・キャッシュの料金を分けて見積もる

同じモデル ID に対応する本ページの料金と計算ツールを使ってください。代表的なリクエストで返される使用量と請求を確認します。プロンプトの繰り返しだけでは、キャッシュにヒットした証拠になりません。

リクエスト全体を測定する

最初のトークンまでの時間、出力速度、タスク全体の時間、再試行、採用できる結果あたりのコストを別々に記録してください。提供元の毎秒トークン数には、アプリケーションのすべての処理は含まれません。

GLM モデルファミリー

同じ API キーと残高のまま、統合を変えずにティアを切り替えられます。

GLM-5.3

GLM-5.3

Z.ai のフラッグシップ推論モデル

モデルを見る
GLM-5.2

GLM-5.2

前世代の GLM フラッグシップ。5.3 世代では思考の無効化ができなくなったため、その機能に依存するクライアントでは今も必要です。

モデルを見る
GLM-5.3 Flash

GLM-5.3 Flash

Z.ai のマルチモーダル大量処理モデル

モデルを見る

GLM-5.3 FlashX 以外の EvoLink のテキストモデル

DeepSeek V4 Flash

DeepSeek V4 Flash

DeepSeek の大量処理向けモデル。100 万コンテキストでキャッシュ読み取り価格が非常に安く、大量テキスト処理では最も直接的なコスト比較対象です。

モデルを見る
Gemini 3.7 Flash

Gemini 3.7 Flash

Google の低コストマルチモーダルモデル。画像や文書の理解が選定基準になる場合のベンダー横断の比較対象として有用です。

モデルを見る
Kimi K3

Kimi K3

Moonshot の長文脈推論ルート。リポジトリ規模のコーディングや複数文書の作業向け。

モデルを見る
GPT-5.6

GPT-5.6

OpenAI の段階制フロンティアファミリー(Sol / Terra / Luna)。性能・レイテンシ・コストで柔軟にルーティング。

モデルを見る

GLM-5.3 FlashX の関連記事

GLM-5.3 Flash と GLM-5.3 の比較

GLM-5.3 Flash と GLM-5.3 の比較

モダリティ、難度、受け入れ済み結果当たりコストでルートを選び、Flash-first の選択的昇格方針を構築します。

記事を読む
1 つのゲートウェイで 3 つのコーディング CLI

1 つのゲートウェイで 3 つのコーディング CLI

設定ファイルのパス、環境変数、そして複数の CLI を単一エンドポイント経由で動かすためのトラブルシューティング一覧。

記事を読む

GLM-5.3 FlashX API のよくある質問

GLM-5.3 FlashX とは何ですか?

FlashX は GLM-5.3 Flash ファミリーの中で速度を重視した Z.ai の選択肢です。対話型コーディングやマルチモーダルエージェント向けですが、トークン単価が高いことは回答品質が高い証拠ではありません。

この EvoLink ページのモデル ID は何ですか?

モデル ID は glm-5.3-flashx です。各エンドポイントのリクエスト形式と対応パラメーターは、本ページからリンクしている API ドキュメントで確認してください。

GLM-5.3 FlashX API の料金はいくらですか?

料金欄に、このモデルの入力・出力・キャッシュ読み取り単価を表示しています。トークンの構成を計算ツールで見積もり、実際の使用量と請求を確認してください。他社の料金やキャンペーンは適用しないでください。

Flash ではなく FlashX を選ぶのはどんな場合ですか?

応答時間が対話型処理の制約になる場合に FlashX を評価してください。Flash はトークン単価が低く、オフラインの一括処理に適する場合があります。同じ設定で成功率、総時間、再試行、費用を比較します。

EvoLink は毎秒 200 トークンを保証しますか?

本ページは速度を保証しません。Z.ai は FlashX の速度を 200 tokens/s としていますが、これは提供元の発表であり、EvoLink の実測や SLA ではありません。最初のトークンまでの待ち時間とリクエスト全体の時間は分けて測定してください。

FlashX はどの入力と出力に対応していますか?

Z.ai は入力としてテキスト・画像・動画・ファイル、出力としてテキストを挙げています。ルートごとの形式はリンク先の API ドキュメントで確認してください。動画やファイルを入力できても、API が動画や Office ファイルを直接生成するわけではありません。

推論を無効にできますか?

Z.ai の文書では FlashX の thinking.type は enabled のみです。reasoning_effort を下げても推論は無効になりません。Z.ai は thinking オブジェクト内で clear_thinking: false を設定することを推奨しています(完全なパスは thinking.clear_thinking)。ルートの対応は API ドキュメントで確認してください。

メディア入力やキャッシュの費用はどう見積もりますか?

代表的なリクエストの使用量と請求を確認し、料金欄の対応単価を適用してください。画像ごとのトークン数が固定であることや、繰り返すすべてのプロンプトがキャッシュにヒットすることは前提にしないでください。

FlashX のコンテキスト長はどれくらいですか?

Z.ai は 100 万トークンのコンテキストと最大 128K トークンの出力を文書化しています。出力上限を選ぶ前に仕様と API ドキュメントを確認してください。入力コンテキストと出力にはそれぞれ別の上限があります。

GLM-5.3 をフォールバックに使えますか?

品質基準を満たさない、互換性のあるテキスト専用タスクで評価できます。GLM-5.3 は同じマルチモーダル入力を受け付けないため、画像・動画・ファイルのリクエストをそのまま転送しないでください。入力処理、費用、再試行の方針を先に決めてください。