Qwen3.8-Max-Preview - 전체 매개변수 문서
🚧 이 모델은 아직 제공되지 않습니다. 기대해 주세요
- OpenAI Chat Completions 프로토콜로 Qwen3.8-Max-Preview 호출
- 멀티턴 대화: 단일 턴 또는 멀티턴 컨텍스트 대화 지원
- 시스템 프롬프트:
role=system메시지로 AI 역할과 동작 설정 - 멀티모달 입력:
content에 content part 배열 전달,text/image_url/input_audio/video_url지원 - 컨텍스트 캐시: content part에
cache_control을 추가해 명시적 캐시 선언; 적중 여부는 응답usage.prompt_tokens_details참조 - 사고 모드:
enable_thinking=true로 활성화하며, 사고 내용은reasoning_content로 반환 - 스트리밍 출력:
stream=true일 때 SSE로 청크 단위 반환
https://direct.evolink.ai이며, 텍스트 모델을 더 잘 지원하고 장기 연결을 지원합니다; https://api.evolink.ai는 멀티모달 주력 주소로, 이미지 / 오디오 / 비디오 입력을 포함할 때 이 주소를 사용하세요.인증
본문
대화 모델 이름
qwen3.8-max-preview "qwen3.8-max-preview"
대화 메시지 목록, 멀티턴 대화 지원. 역할(system / user / assistant / tool)에 따라 메시지 필드 구조가 다르므로 해당 역할을 선택해 확인하세요.
- System Message
- User Message
- Assistant Message
- Tool Message
심층 사고 활성화 여부
true: 모델이 사고 과정을 출력하며reasoning_content로 반환false(기본값): 사고 과정을 출력하지 않음
참고: 일부 모델은 비스트리밍 호출에서 명시적으로
true로 설정해야 사고 내용을 반환합니다.
샘플링 온도, 출력 무작위성을 제어합니다. 값이 낮을수록 더 결정적이고 높을수록 더 다양합니다. 범위 [0, 2]. temperature와 top_p를 동시에 조정하지 않는 것을 권장합니다.
0 <= x <= 2뉴클리어스 샘플링(Nucleus Sampling) 매개변수, 누적 확률 상위 일부 token에서 샘플링합니다. 범위 (0, 1]. temperature와 top_p를 동시에 조정하지 않는 것을 권장합니다.
0 <= x <= 1생성 콘텐츠 길이 상한(token 수), 사고 체인과 답변을 포함합니다. 사고형 모델에서는 이 매개변수 사용을 권장합니다. 기본값과 최대값은 모두 모델의 최대 출력 길이이며, 초과 시 finish_reason=length로 조기 중단됩니다.
구버전 생성 길이 제한 매개변수.
지원 중단됨: 신규 연동에서는
max_completion_tokens를 사용하세요. 이 매개변수는 답변 부분만 제한합니다(사고 체인 미포함).
응답을 스트리밍 방식으로 반환할지 여부.
true: SSE(Server-Sent Events)로 청크 단위 반환false(기본값): 완전한 응답을 한 번에 반환
스트리밍 응답 옵션, stream=true일 때만 유효합니다.
도구 정의 목록, Function Calling에 사용됩니다. 각 도구는 이름, 설명, 매개변수 schema를 정의해야 합니다.