
안녕하세요, 미니지식공간입니다.
2026년 9월 11일 Moonshot AI가 Kimi Code의 kimi-for-coding을 Kimi K2.8 Preview로 교체했다. 모델 ID를 유지한 채 내용만 갈아 끼우는 in-place 업그레이드라, 설정 파일을 그대로 두면 어제와 같은 명령이 오늘은 다른 모델에 들어간다.
kimi-for-coding의 실체가 K2.7 Code에서 K2.8 Preview로 바뀌었다. 설정 변경은 필요 없지만, 컨텍스트 캐시는 무효화된다.low / high / max로 열렸고 기본값이 max다. K3의 기본값 high와 다르다.Kimi Code 공식 What's New는 9월 11일 항목에서 이렇게 적는다. "Model ID는 그대로 kimi-for-coding이므로 클라이언트와 서드파티 도구가 설정 변경 없이 동작한다." 편하지만, 바꿔 말하면 버전을 고정할 방법이 없다는 뜻이기도 하다. 재현 실험을 돌리고 있었다면 9월 11일을 기준으로 앞뒤 결과를 같은 선상에 놓으면 안 된다.
문서가 함께 안내하는 주의점이 캐시다. 모델이 바뀌면 이전 세션에서 쌓은 컨텍스트 캐시가 새 모델에서 적중하지 않아 다시 프리필된다. 새 모델 적용 직후 소모량이 튀어 보이는 이유가 이것이고, 문서의 권장 조치는 단순하다. 새 모델을 쓸 때는 새 세션에서 시작하라.
Kimi Code API는 OpenAI 프로토콜과 Anthropic 프로토콜을 모두 받는다. 공식 Model Configuration 문서에 실린 Base URL과 모델 ID는 다음과 같다.
# Base URL (Kimi Code Docs - Model Configuration)
# OpenAI 호환
https://api.kimi.com/coding/v1
# Anthropic 호환
https://api.kimi.com/coding/
# Model ID (버전 이름이 아니라 이 값들을 그대로 넣어야 한다)
k3
k3-256k
kimi-for-coding # <- K2.8 Preview
kimi-for-coding-highspeed
문서는 API Key를 Kimi Code Console에서 만들고 도구에 Base URL과 Model ID를 넣으라고 안내한다. 그리고 한 가지를 못 박는다. K3나 K2.8 Preview 같은 모델 버전 이름을 넣으면 호출이 실패한다. 또 HighSpeed ID를 오타로 적으면 오류가 나지 않고 조용히 일반 kimi-for-coding으로 폴백되므로, 속도가 안 빨라졌다면 ID 문자열부터 확인하는 게 빠르다.
출처: https://www.kimi.com/code/docs/en/kimi-code/models.html

K3와 K2.8 Preview 모두 low / high / max 사고 강도를 지원한다. 문제는 서드파티 도구마다 부르는 이름이 다르다는 점인데, 공식 문서가 매핑표를 그대로 공개해 뒀다.
# default
null / undefined -> model default (high for K3, max for K2.8 Preview)
any other unknown -> HTTP 400 error
# -> max
ultra / max / xhigh -> max
# -> high (recommended)
high / medium -> high
# -> low
low / minimum / light -> low
# -> thinking disabled
none -> thinking.type disabled
여기서 실무적으로 중요한 줄이 둘이다. 하나는 문서가 high를 권장(recommended)으로 표시했다는 점. K2.8 Preview의 기본값은 max이므로, 아무것도 지정하지 않으면 권장값보다 한 단계 높은 강도로 돌아간다. 다른 하나는 목록에 없는 값을 보내면 무시가 아니라 HTTP 400이라는 점이다. 도구의 effort 설정을 커스텀 문자열로 채워 두었다면 먼저 걷어내야 한다.
한 가지 더. 문서는 "thinking을 끄면 K3 계열과 K2.8 Preview 요청이 모두 K2.8 Preview(사고 없음)로 처리된다"고 적는다. 즉 thinking off 상태에서는 k3를 지정해도 실제로 응답하는 쪽은 K2.8 Preview다.
| Model ID | 모델 | 컨텍스트 | 사고 강도 | 속도·쿼터 | 이용 조건 |
|---|---|---|---|---|---|
k3 | K3 (2.8T 파라미터) | 1,048,576 | low/high/max (기본 high) | k3-256k의 약 2배 쿼터 | Moderato 이상, 1M은 Allegretto 이상 |
k3-256k | K3 | 262,144 고정 | low/high/max (기본 high) | 기준 | Moderato 이상 |
kimi-for-coding | K2.8 Preview | 1,048,576 | low/high/max (기본 max) | 일반 속도 | 전 멤버십 등급 |
kimi-for-coding-highspeed | K2.7 Code HighSpeed | 262,144 | Thinking ON | 출력 약 5~6배 속도, 쿼터 3배 | Allegretto 이상 |
쿼터를 태우는 지점이 세 군데다. 모델 전환 시 캐시 재프리필, 사고 강도 전환 시 캐시 재프리필, 그리고 HighSpeed의 3배 소모다. 문서는 사고 강도에 대해 "작업에 맞는 강도를 골라 세션 내내 유지하고, 정말 바꿔야 하면 긴 세션에서 왔다 갔다 하지 말고 새 세션을 열라"고 권한다. 구독형 코딩 도구에서 사용량이 어디로 새는지 점검하는 방식은 Claude Code 주간 한도를 /usage로 뜯어본 글에 정리해 뒀는데, 캐시 무효화가 소모를 키운다는 구조는 두 도구가 같다.
HighSpeed가 기대만큼 안 빠른 경우에 대한 문서의 설명도 참고할 만하다. HighSpeed는 모델 출력만 가속한다. 파일 읽기·쓰기, 명령 실행 같은 툴 호출과 스크립트 실행 시간은 그대로이므로, 한 턴에서 툴이 대부분을 차지하면 체감 가속폭이 작다.
모델 ID가 맞는데도 401이 돌아온다면, 문서는 요청한 기능이 플랜 권한을 넘었을 때 서버가 401을 반환한다고 설명하며 세 가지를 든다.
k3, k3-256k를 호출할 수 없다.k3는 최대 256K까지다. 1M은 Allegretto 이상이며, k3-256k는 256K 고정이다.kimi-for-coding-highspeed는 Allegretto 이상이 필요하다.반대로 말하면 kimi-for-coding(K2.8 Preview)은 전 등급 대상이라 이 세 갈래 어디에도 걸리지 않는다. 등급이 낮은 계정에서 1M 컨텍스트를 쓰려면 현재로서는 이쪽이 유일한 경로다.
Kimi Code는 멤버십 기반이고, Moonshot 오픈 플랫폼의 토큰 단가는 별개다. 가격 집계 사이트 BenchLM이 2026년 9월 14일 기준으로 정리한 Moonshot 공식 가격표는 다음과 같다.
| 모델 | 입력 $/1M | 캐시 히트 입력 $/1M | 출력 $/1M | 컨텍스트 |
|---|---|---|---|---|
| Kimi K3 | $3.00 | $0.30 | $15.00 | 1.05M |
| Kimi K2.6 | $0.95 | — | $4.00 | 256K |
| Kimi K2.7 Code | $0.95 | $0.19 | $4.00 | 256K |
| Kimi K2.5 | $0.60 | — | $3.00 | 256K |
이 표에 K2.8 Preview 행은 없다. 2026년 9월 15일 현재 K2.8 Preview는 Kimi Code 멤버십 안에서 쓰는 모델로만 확인된다. 일부 집계 사이트가 $0.80 / $3.35 같은 값을 싣고 있으나 Moonshot 공식 문서로 대조되지 않아 확인 필요로 남겨 둔다. 비용 추정은 토큰 단가가 아니라 멤버십 쿼터 기준으로 잡는 편이 안전하다.
Q. kimi-for-coding을 K2.7 Code로 되돌릴 수 있나?
공식 문서에는 K2.7 Code 일반 버전을 지정하는 모델 ID가 없다. 현재 선택 가능한 K2.7 계열은 kimi-for-coding-highspeed(HighSpeed, 256K, Allegretto 이상)뿐이다. 버전 고정이 필요한 작업이라면 이 제약을 먼저 확인해야 한다.
Q. Kimi K2.8 Preview는 API로 직접 호출할 수 있나?
Kimi Code Console에서 API Key를 만들고 Base URL(https://api.kimi.com/coding/v1 또는 https://api.kimi.com/coding/)에 모델 ID kimi-for-coding을 넣으면 서드파티 도구에서 쓸 수 있다. 다만 이는 Kimi Code 멤버십 경로이며, 오픈 플랫폼 토큰 과금 목록에는 아직 등재돼 있지 않다.
Q. 이미지나 영상도 넣을 수 있나?
공식 문서의 멀티모달 입력 항목은 kimi-for-coding에 대해 이미지와 영상을 지원한다고 표기한다. k3-256k만 이미지 전용이라 영상 입력이 포함된 대화를 k3-256k로 전환하면 실패한다고 문서가 따로 경고한다.
이번 교체는 새 모델 발표라기보다 런타임 스왑에 가깝다. 도입 비용이 없는 대신 버전 고정이 불가능하고, 캐시·기본 effort·쿼터처럼 눈에 안 띄는 축에서 값이 움직인다. 9월 11일 이후 소모량이나 응답 성격이 달라졌다면 코드가 아니라 모델이 바뀐 것일 수 있다. 성능이 "K3에 근접한다"는 서술은 Moonshot 자사 발표이며 공개된 벤치마크 수치는 아직 없다는 점도 함께 기억해 두는 게 좋겠다.
본 글은 공개 자료를 바탕으로 정리했으며, 세부 내용·수치는 원 출처·공식 문서와 대조 확인을 권장합니다.