
EvoLink에서 Kimi K3 사용하기: 통합 및 마이그레이션 가이드

빠른 결론: Kimi K3는 공식 출시된 모델입니다. Moonshot은 직접 API 모델 ID, 가격, 멀티모달 입력, 1,048,576 토큰 컨텍스트를 공개했습니다. 장시간 소프트웨어 엔지니어링, 복잡한 에이전트, 대규모 지식 작업에 초점을 둔 플래그십 모델입니다.
Moonshot 직접 API 가격은 캐시 미적중 입력이 100만 토큰당 ¥20, 출력이 ¥100입니다. 일반적인 워크로드에서는 Kimi K2.6보다 약 3~4배 비싸므로 모든 요청의 기본 모델보다 고난도 작업용 프리미엄 또는 에스컬레이션 경로로 평가하는 편이 합리적입니다.
kimi-k3**로 EvoLink에서 제공됩니다. 현재 가격과 워크로드 포지셔닝은 Kimi K3 모델 페이지, 최신 요청 규격은 EvoLink API 문서에서 확인하세요.Kimi K3 공식 사양
| 항목 | 공식 정보 | 개발 의미 |
|---|---|---|
| 직접 API ID | kimi-k3 | Moonshot ID이며 EvoLink ID를 보장하지 않음 |
| 규모 | 총 2.8조, 활성 1,040억 파라미터 | 희소 활성화로 계산 효율은 높아지지만 전체 전문가 웨이트는 여전히 매우 큼 |
| 구조 | Kimi Delta Attention + Attention Residuals | 효율과 장기 작업을 목표로 함 |
| 컨텍스트 | 1,048,576 토큰 | 대형 저장소와 문서 집합 처리 |
| 입력 | 텍스트, 이미지, 비디오 | 멀티모달 검토 가능 |
| 추론 | 항상 활성화 | 단순 작업에서는 비용과 지연이 과할 수 있음 |
| 추론 제어 | reasoning_effort는 low, high, max 지원, 기본값은 max | 품질, 지연 시간, 출력 비용을 비교할 수 있음 |
| 도구 | Tool Calling, tool_choice, 동적 로딩 | 대규모 도구 카탈로그에 적합 |
| 오픈 웨이트 | 약 1.56 TB 저장소를 Kimi K3 License로 공개 | 라이선스에 따라 자체 호스팅할 수 있지만 대규모 인프라가 필요함 |
모델 ID와 접근 채널
| 채널 | 모델 ID | 컨텍스트와 접근 조건 |
|---|---|---|
| Moonshot Open Platform | kimi-k3 | 직접 API, 최대 1,048,576 토큰 |
| Kimi Code | k3 | Moderato 256K, Allegretto 이상 최대 1M |
| Kimi Code 표준 | kimi-for-coding | K2.7 Code이며 K3가 아님 |
| Kimi Code 고속 | kimi-for-coding-highspeed | K2.7 Code 고속, Allegretto 이상 |
| EvoLink | kimi-k3 | 요청 동작이 문서화된 검증된 프로덕션 경로 |
kimi-k3, Kimi Code에서는 k3를 사용합니다. Kimi Code에서 256K만 보이거나 401이 발생하면 플랜 권한을 확인하세요. 모델을 전환하면 이전 컨텍스트 캐시가 유지되지 않으므로 새 세션을 시작하는 것이 안전합니다.
API 가격과 비용 예시
| 토큰 구분 | Moonshot 직접 가격 / 1M tokens |
|---|---|
| 캐시 입력 | ¥2 |
| 비캐시 입력 | ¥20 |
| 출력 | ¥100 |
| 요청 예시 | 비캐시 | 입력 캐시 적용 |
|---|---|---|
| 입력 20K + 출력 5K | ¥0.90 | ¥0.54 |
| 입력 100K + 출력 20K | ¥4.00 | ¥2.20 |
| 입력 500K + 출력 50K | ¥15.00 | ¥6.00 |
| 입력 1M + 출력 100K | ¥30.00 | ¥12.00 |
어떤 팀이 먼저 평가해야 할까?
| 워크로드 | 우선순위 | 이유 |
|---|---|---|
| 대형 저장소용 코딩 에이전트 | 높음 | 1M 컨텍스트와 장기 작업에 직접 부합 |
| 다수 문서를 활용한 리서치 | 높음 | 수동 분할 작업을 줄일 가능성 |
| 많은 도구를 가진 에이전트 | 높음 | 동적 로딩으로 선택 정확도와 비용 개선 |
| 멀티모달 리뷰 | 중간~높음 | 텍스트, 이미지, 비디오 지원 |
| 고객지원 채팅과 분류 | 낮음 | 항상 활성화된 추론이 과도할 수 있음 |
| 자체 호스팅 | 조건부 평가 | 웨이트와 라이선스가 공개됐으며, Moonshot은 효율적인 추론에 64개 이상의 가속기를 권장 |
마이그레이션 주의사항
thinking 대신 reasoning_effort를 사용합니다. 멀티턴 및 도구 워크플로에서는 reasoning_content와 Tool Calls를 포함한 전체 assistant 메시지를 다음 요청에 전달해야 합니다. 모델 이름만 바꾸는 방식은 안전하지 않습니다.도구가 많은 에이전트는 다음 흐름을 권장합니다.
- 도구 검색과 소수의 공통 도구만 처음에 제공합니다.
- 필요한 도구를 검색합니다.
- 선택한 도구 정의만 동적으로 추가합니다.
- 올바른
tool_call_id로 결과를 반환합니다. - 전체 assistant 메시지를 기록에 유지합니다.
프로덕션 평가 방법
저장소 이해, 여러 파일 변경, 문서 종합, 구조화 출력, 비전, 도구 호출을 포함한 실제 작업 20~50개를 준비하세요. 현재 경로와 성공률, 지연 시간, 토큰, 재시도, 사람의 수정 시간을 비교해야 합니다.
아직 확인되지 않은 내용
- 동일한 하네스를 사용한 독립 평가;
- Kimi K3 License가 제품에 미치는 영향;
- 선택한 전문가 토폴로지의 실제 성능;
- 전체 1M 컨텍스트에서의 실제 품질;
- 실패 요청의 과금 방식;
- EvoLink 경로의 워크로드별 프로덕션 비용.
Kimi K3 평가 계속하기
| 다음 결정 | 가이드 |
|---|---|
| 출처가 있는 재사용 가능한 작업으로 평가 시작 | Kimi K3 프롬프트 및 활용 사례 |
| K3와 OpenAI의 최상위 코딩 경로 비교 | Kimi K3 vs GPT-5.6 Sol |
| K3와 Anthropic의 장시간 작업용 프리미엄 경로 비교 | Kimi K3 vs Claude Opus 4.8 |
| 지연, 출력, 캐시와 성공한 작업당 비용 측정 | Kimi K3 토큰 효율 |
FAQ
Kimi K3는 공식 출시됐나요?
네. Moonshot은 2026년 7월 16일 공식 모델, 가격, API 문서에 K3를 추가했습니다.
컨텍스트 길이는 얼마인가요?
공식 문서 기준 1,048,576 토큰입니다.
추론을 끌 수 있나요?
reasoning_effort는 low, high, max를 지원하며 기본값은 max입니다.Kimi K3 가격은 얼마인가요?
Moonshot 직접 API 기준 캐시 입력 ¥2/MTok, 비캐시 입력 ¥20/MTok, 출력 ¥100/MTok입니다.
Kimi K3는 오픈소스인가요?
Moonshot은 전체 웨이트를 자체 Kimi K3 License로 공개했습니다. 일반적인 오픈소스 라이선스로 단정하기보다 “Kimi K3 License 기반 오픈 웨이트”라고 표현하는 것이 정확합니다.
EvoLink에서 Kimi K3를 사용할 수 있나요?
kimi-k3 경로를 출시했습니다. 현재 가격은 모델 페이지에서 확인하세요. xAI의 차세대 모델을 평가한다면 Grok 4.6과 Kimi K3 비교를 통해 호출 가능한 K3를 프로덕션 기준으로 유지하세요.kimi-for-coding은 Kimi K3인가요?
k3를 선택합니다.

