メインコンテンツへスキップ
POST
BaseURL について:デフォルトの BaseURL は https://direct.evolink.ai で、テキストモデルへのサポートがより優れ、長時間接続に対応しています;https://api.evolink.ai はマルチモーダル主力アドレスで、画像 / 音声 / 動画入力を含む場合はこのアドレスを使用してください。

承認

Authorization
string
header
必須

##すべての API で Bearer Token 認証が必要です##

API キーの取得:

API キー管理ページで API キーを取得してください

リクエストヘッダーに追加:

ボディ

application/json
model
enum<string>
必須

対話モデル名

利用可能なオプション:
qwen3.8-max-preview
:

"qwen3.8-max-preview"

messages
(System Message · object | User Message · object | Assistant Message · object | Tool Message · object)[]
必須

対話メッセージのリスト、複数ターン対話に対応。ロール(system / user / assistant / tool)ごとにメッセージのフィールド構造が異なるため、対応するロールを選択して確認してください。

enable_thinking
boolean
デフォルト:false

深い思考を有効にするかどうか

  • true:モデルが思考過程を出力し、reasoning_content で返します
  • false(デフォルト):思考過程を出力しません

注:一部のモデルでは、非ストリーミング呼び出し時に明示的に true を設定しないと思考内容を返しません。

temperature
number

サンプリング温度、出力のランダム性を制御します。低い値ほど確定的、高い値ほど多様になります。値の範囲は [0, 2]。temperature と top_p を同時に調整しないことを推奨します。

必須範囲: 0 <= x <= 2
top_p
number

核サンプリング(Nucleus Sampling)パラメータ、累積確率が上位の token からサンプリングします。値の範囲は (0, 1]。temperature と top_p を同時に調整しないことを推奨します。

必須範囲: 0 <= x <= 1
max_completion_tokens
integer

生成内容の長さの上限(Token 数)、思考の連鎖と回答を含みます。思考系モデルではこのパラメータの使用を推奨します。デフォルト値と最大値はいずれもモデルの最大出力長です;超過すると finish_reason=length で早期停止します。

max_tokens
integer

旧版の生成長制限パラメータ。

非推奨:新規導入では max_completion_tokens を使用してください。このパラメータは回答部分のみを制限します(思考の連鎖は含みません)。

stream
boolean
デフォルト:false

応答をストリーミング方式で返すかどうか。

  • true:SSE(Server-Sent Events)でチャンクごとに返します
  • false(デフォルト):完全な応答を一度に返します
stream_options
object

ストリーミング応答オプション、stream=true の場合のみ有効です。

tools
object[]

ツール定義のリスト、Function Calling に使用します。各ツールには名前、説明、パラメータ schema を定義する必要があります。

レスポンス

対話の生成に成功しました

id
string

今回の対話の一意の識別子

:

"chatcmpl-xxxxxxxx"

object
string
:

"chat.completion"

created
integer

作成時刻(Unix 秒)

:

1735120033

model
string
:

"qwen3.8-max-preview"

choices
object[]
usage
object

Token 使用統計情報。