Qwen3.8-Max-Preview - Responses インターフェース
🚧 このモデルはまだ利用できません。お楽しみに
- OpenAI Responses プロトコルで Qwen3.8-Max-Preview を呼び出します
- 柔軟な入力:
inputには文字列を渡すことも、Chat 形式のメッセージ配列を渡すこともできます(マルチモーダルinput_text/input_imageに対応) - 複数ターン対話:
previous_response_idを渡して前のターンの応答を関連付けると、サーバー側がコンテキストを自動的に組み合わせます(応答idの有効期間は 7 日) - セッションキャッシュ:リクエストヘッダーに
x-dashscope-session-cache: enable(デフォルトは disable)を追加して有効化、ヒットはusage.input_tokens_details.cached_tokensを参照 - 思考強度:
reasoning.effortで制御 - ストリーミング出力:
stream=trueの場合、Responses イベント(response.output_text.delta/response.completedなど)で返します
https://direct.evolink.ai で、テキストモデルへのサポートがより優れ、長時間接続に対応しています;https://api.evolink.ai はマルチモーダル主力アドレスで、画像入力を含む場合はこのアドレスを使用してください。セッションキャッシュ:Responses インターフェースはリクエストヘッダー x-dashscope-session-cache: enable でサーバー側のセッションキャッシュを有効にし、複数ターンの遅延とコストを削減します。承認
ヘッダー
セッションキャッシュのスイッチ。enable に設定すると、サーバー側が対話コンテキストを自動的にキャッシュし、複数ターン推論の遅延とコストを削減します。
enable, disable ボディ
対話モデル名
qwen3.8-max-preview "qwen3.8-max-preview"
モデル入力。文字列(プレーンテキスト)を渡すことも、Chat 形式のメッセージ配列を渡すこともできます(マルチモーダル input_text / input_image に対応)。
システム指示としてコンテキストの先頭位置に挿入されます。previous_response_id を使用する場合、前のターンの instructions は今回のターンには渡されません。
前のターンの応答の一意の ID(応答 id、有効期間 7 日)。複数ターン対話の関連付けに使用され、サーバー側がそのターンの入力と出力を自動的に取得してコンテキストとして組み合わせます。
今回生成する出力内容の最大 token 数(思考を含む)。
思考の制御。
今回の応答を保存するかどうか。
true(デフォルト):previous_response_idで参照可能false:保存せず、以降は参照できません
Responses イベントでストリーミング返却するかどうか。
サンプリング温度、値の範囲は [0, 2]。
0 <= x <= 2核サンプリングパラメータ、値の範囲は (0, 1]。
0 <= x <= 1ツールのリスト。組み込みツール(web_search Web 検索、web_extractor Web ページ抽出、code_interpreter コードインタプリタ)およびカスタム function に対応。