curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "qwen3.8-max",
"input": "何ができますか?"
}
'
{
"id": "resp_xxxxxxxx",
"object": "response",
"status": "completed",
"model": "qwen3.8-max",
"output": [
{}
],
"usage": {
"input_tokens": 45,
"output_tokens": 63,
"total_tokens": 108,
"input_tokens_details": {
"cached_tokens": 0
},
"output_tokens_details": {
"reasoning_tokens": 0
},
"prompt_tokens_details": {
"cached_tokens": 0,
"cache_creation_input_tokens": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient credits",
"type": "insufficient_quota"
}
}{
"error": {
"code": 123,
"message": "<string>",
"type": "<string>",
"param": "<string>"
}
}{
"error": {
"code": 123,
"message": "<string>",
"type": "<string>",
"param": "<string>"
}
}Responses API
Qwen3.8-Max - Responses インターフェース
- OpenAI Responses プロトコルで Qwen3.8-Max を呼び出します
- 柔軟な入力:
inputには文字列を渡すことも、Chat 形式のメッセージ配列を渡すこともできます(マルチモーダルinput_text/input_imageに対応) - 複数ターン対話:
previous_response_idを渡して前のターンの応答を関連付けると、サーバー側がコンテキストを自動的に組み合わせます(応答idの有効期間は 7 日) - セッションキャッシュ:リクエストヘッダーに
x-dashscope-session-cache: enable(デフォルトは disable)を追加して有効化、ヒットはusage.input_tokens_details.cached_tokensを参照 - 思考強度:
reasoning.effortで制御 - ストリーミング出力:
stream=trueの場合、Responses イベント(response.output_text.delta/response.completedなど)で返します
POST
/
v1
/
responses
curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "qwen3.8-max",
"input": "何ができますか?"
}
'
{
"id": "resp_xxxxxxxx",
"object": "response",
"status": "completed",
"model": "qwen3.8-max",
"output": [
{}
],
"usage": {
"input_tokens": 45,
"output_tokens": 63,
"total_tokens": 108,
"input_tokens_details": {
"cached_tokens": 0
},
"output_tokens_details": {
"reasoning_tokens": 0
},
"prompt_tokens_details": {
"cached_tokens": 0,
"cache_creation_input_tokens": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient credits",
"type": "insufficient_quota"
}
}{
"error": {
"code": 123,
"message": "<string>",
"type": "<string>",
"param": "<string>"
}
}{
"error": {
"code": 123,
"message": "<string>",
"type": "<string>",
"param": "<string>"
}
}BaseURL について:デフォルトの BaseURL は
https://direct.evolink.ai で、テキストモデルへのサポートがより優れ、長時間接続に対応しています;https://api.evolink.ai はマルチモーダル主力アドレスで、画像入力を含む場合はこのアドレスを使用してください。セッションキャッシュ:Responses インターフェースはリクエストヘッダー x-dashscope-session-cache: enable でサーバー側のセッションキャッシュを有効にし、複数ターンの遅延とコストを削減します。承認
##すべての API で Bearer Token 認証が必要です##
API キーの取得:
API キー管理ページで API キーを取得してください
リクエストヘッダーに追加:
Authorization: Bearer YOUR_API_KEY
ヘッダー
セッションキャッシュのスイッチ。enable に設定すると、サーバー側が対話コンテキストを自動的にキャッシュし、複数ターン推論の遅延とコストを削減します。
利用可能なオプション:
enable, disable ボディ
application/json
対話モデル名
利用可能なオプション:
qwen3.8-max 例:
"qwen3.8-max"
モデル入力。文字列(プレーンテキスト)を渡すことも、Chat 形式のメッセージ配列を渡すこともできます(マルチモーダル input_text / input_image に対応)。
システム指示としてコンテキストの先頭位置に挿入されます。previous_response_id を使用する場合、前のターンの instructions は今回のターンには渡されません。
前のターンの応答の一意の ID(応答 id、有効期間 7 日)。複数ターン対話の関連付けに使用され、サーバー側がそのターンの入力と出力を自動的に取得してコンテキストとして組み合わせます。
今回生成する出力内容の最大 token 数(思考を含む)。
思考の制御。
Show child attributes
Show child attributes
今回の応答を保存するかどうか。
true(デフォルト):previous_response_idで参照可能false:保存せず、以降は参照できません
Responses イベントでストリーミング返却するかどうか。
サンプリング温度、値の範囲は [0, 2]。
必須範囲:
0 <= x <= 2核サンプリングパラメータ、値の範囲は (0, 1]。
必須範囲:
0 <= x <= 1ツールのリスト。組み込みツール(web_search Web 検索、web_extractor Web ページ抽出、code_interpreter コードインタプリタ)およびカスタム function に対応。
Show child attributes
Show child attributes