MiniMax-M2.5
MiniMax-M2.5 - 전체 API 레퍼런스
- OpenAI SDK 형식으로 MiniMax-M2.5 모델 호출
- 동기 처리 모드, 실시간 응답
- 텍스트 대화: 단일 또는 다중 턴 컨텍스트 대화
- 시스템 프롬프트: AI 역할 및 동작 사용자 정의
POST
BaseURL: 기본 BaseURL은
https://direct.evolink.ai이며, 텍스트 모델 지원이 더 우수하고 장시간 연결을 지원합니다. https://api.evolink.ai는 멀티모달 서비스의 주력 엔드포인트이며, 텍스트 모델에 대해서는 대체 주소로 사용됩니다.인증
본문
application/json
채팅 모델 이름
사용 가능한 옵션:
MiniMax-M2.5 예시:
"MiniMax-M2.5"
대화 메시지 목록, 다중 턴 대화 지원
Minimum array length:
1생성 콘텐츠의 최대 토큰 수, 상한은 2048
참고:
- 상한을 초과하는 콘텐츠는 잘립니다
length이유로 생성이 중단된 경우 이 값을 높여보세요
필수 범위:
1 <= x <= 2048예시:
2048
스트리밍 모드로 응답을 반환할지 여부
true: 스트리밍 응답, 실시간으로 청크 단위로 콘텐츠 반환false: 완전한 응답을 기다린 후 반환
예시:
false
샘플링 온도, 출력의 무작위성 제어
참고:
- 낮은 값(예: 0.1): 더 확정적이고 집중된 출력
- 높은 값(예: 0.9): 더 무작위적이고 창의적인 출력
- 범위: (0, 1], 0 제외
필수 범위:
x <= 1예시:
0.7
Nucleus Sampling 매개변수
참고:
- 누적 확률에서 토큰 샘플링 제어
- 예: 0.9는 누적 확률 90%에 도달하는 토큰에서 선택을 의미
- 범위: (0, 1], 0 제외
권장: temperature와 top_p를 동시에 조정하지 마세요
필수 범위:
x <= 1예시:
0.9
웹 검색 활성화 여부
true: 웹 검색 활성화, 모델이 필요에 따라 인터넷에서 최신 정보를 검색합니다false: 웹 검색 비활성화
예시:
true
웹 검색 옵션, enable_search: true 필요