メインコンテンツへスキップ
POST
BaseURL について:デフォルトの BaseURL は https://direct.evolink.ai で、テキストモデルへのサポートがより優れ、長時間接続に対応しています;https://api.evolink.ai はマルチモーダル主力アドレスで、画像入力を含む場合はこのアドレスを使用してください。セッションキャッシュ:Responses インターフェースはリクエストヘッダー x-dashscope-session-cache: enable でサーバー側のセッションキャッシュを有効にし、複数ターンの遅延とコストを削減します。

承認

Authorization
string
header
必須

##すべての API で Bearer Token 認証が必要です##

API キーの取得:

API キー管理ページで API キーを取得してください

リクエストヘッダーに追加:

ヘッダー

x-dashscope-session-cache
enum<string>
デフォルト:disable

セッションキャッシュのスイッチ。enable に設定すると、サーバー側が対話コンテキストを自動的にキャッシュし、複数ターン推論の遅延とコストを削減します。

利用可能なオプション:
enable,
disable

ボディ

application/json
model
enum<string>
必須

対話モデル名

利用可能なオプション:
qwen3.8-max-preview
:

"qwen3.8-max-preview"

input
必須

モデル入力。文字列(プレーンテキスト)を渡すことも、Chat 形式のメッセージ配列を渡すこともできます(マルチモーダル input_text / input_image に対応)。

instructions
string

システム指示としてコンテキストの先頭位置に挿入されます。previous_response_id を使用する場合、前のターンの instructions は今回のターンには渡されません。

previous_response_id
string

前のターンの応答の一意の ID(応答 id、有効期間 7 日)。複数ターン対話の関連付けに使用され、サーバー側がそのターンの入力と出力を自動的に取得してコンテキストとして組み合わせます。

max_output_tokens
integer

今回生成する出力内容の最大 token 数(思考を含む)。

reasoning
object

思考の制御。

store
boolean
デフォルト:true

今回の応答を保存するかどうか。

  • true(デフォルト):previous_response_id で参照可能
  • false:保存せず、以降は参照できません
stream
boolean
デフォルト:false

Responses イベントでストリーミング返却するかどうか。

temperature
number

サンプリング温度、値の範囲は [0, 2]

必須範囲: 0 <= x <= 2
top_p
number

核サンプリングパラメータ、値の範囲は (0, 1]

必須範囲: 0 <= x <= 1
tools
object[]

ツールのリスト。組み込みツール(web_search Web 検索、web_extractor Web ページ抽出、code_interpreter コードインタプリタ)およびカスタム function に対応。

レスポンス

生成に成功しました

id
string

今回の応答の一意の ID(有効期間 7 日、previous_response_id として使用可能)

:

"resp_xxxxxxxx"

object
string
:

"response"

status
string

応答ステータス

:

"completed"

model
string
:

"qwen3.8-max-preview"

output
object[]

出力項目の配列(message / reasoning / 組み込みツール呼び出しなどを含む)

usage
object

Token 使用統計。