Kimi K2.8 Preview vs Kimi K3: 어떤 것을 사용해야 할까요?
Kimi K2.8 Preview와 Kimi K3는 서로 다른 표면에 있습니다. K3는 공개 API 모델(kimi-k3)이고, K2.8 Preview는 Kimi Code 경로(kimi-for-coding)입니다. 사양, 접근 제한, 가격 및 각각을 사용해야 하는 시점을 비교합니다.
게시 2026-09-17
Kimi K2.8 Preview와 Kimi K3는 같은 선반 위의 두 가지 옵션이 아닙니다. K3는 공개 API 모델이고, K2.8 Preview는 Kimi Code 내부의 경로입니다. Kimi의 오픈 플랫폼에서 플래그십 모델은 **kimi-k3**로 응답하며, Kimi Code 내부에서는 동일한 플래그십 모델이 **k3**로 응답하고, K2.8 Preview는 이전 ID인 **kimi-for-coding**을 유지합니다.
K2.8 Preview는 더 가볍고 비용이 낮은 등급입니다. 모든 Kimi Code 멤버십 등급에서 1M 토큰 창을 포함하여 사용할 수 있으며, Moonshot은 전반적인 성능이 K3에 근접한다고 설명합니다. K3는 2.8조 파라미터를 가진 플래그십이지만 Moderato 이상이 필요하며, 1M 창은 Allegretto 이상이 필요합니다.
Moonshot은 K2.8 Preview에 대한 토큰당 가격을 공개하지 않았으므로, K3의 공식 입력 토큰 100만 개당 $3.00, 출력 토큰 100만 개당 $15.00와 나란히 비교할 수 있는 수치가 없습니다. APIMaster에서는 호환되는 OpenAI 키 하나로 오늘 kimi-k3를 사용할 수 있습니다. K2.8 Preview는 아직 공개 API 모델이 아니며, Moonshot이 오픈 마켓에 공개하는 즉시 목록에 추가할 예정입니다.
동일한 모델이 다른 표면에서 다른 ID를 가집니다
이 부분이 사람들을 혼란스럽게 만듭니다. Kimi는 두 개의 별도 제품을 운영하며, 각 제품은 모델을 자체 방식으로 명명합니다.
| 표면 | 무엇인가 | Kimi K3 ID | Kimi K2.8 Preview ID |
|---|---|---|---|
| Kimi 오픈 플랫폼 | 모든 개발자를 위한 종량제 API | kimi-k3 |
— 제공되지 않음 |
| Kimi Code | Kimi 멤버십에 포함된 코딩 서비스 | k3, k3-256k |
kimi-for-coding |
Kimi Code는 현재 세 가지 모델에서 네 개의 모델 ID를 노출합니다: k3 및 k3-256k(K3의 1M 및 262,144토큰 변형), kimi-for-coding(K2.8 Preview), kimi-for-coding-highspeed(K2.7 Code HighSpeed).
두 가지 실질적인 결과:
- API에
kimi-k2.8을 보내지 마십시오. 해당 식별자는 어디에도 존재하지 않습니다. Kimi의 오픈 플랫폼에서 현재 유일한 Kimi 모델은kimi-k3,kimi-k2.7-code,kimi-k2.7-code-highspeed및kimi-k2.6입니다. - 게이트웨이에 이전 Kimi 이름이 나열되어 있다고 해서 자동으로 K2.8이 된 것은 아닙니다. Kimi의 오픈 플랫폼은 2026년 5월에
kimi-k2시리즈를 중단했고, 2026년 8월에kimi-k2.5및moonshot-v1제품군을 중단했습니다. 해당 ID 중 어느 것도 현재 K2.8 Preview로 확인되지 않습니다.
각 모델의 공식 포지셔닝
Kimi K3는 Moonshot의 가장 강력한 모델입니다. Kimi의 모델 목록은 "소프트웨어 엔지니어링, 지식 작업 및 심층 추론과 같은 프론티어 인텔리전스 시나리오"를 위해 설계되었으며, 2.8조 파라미터, 기본 시각적 이해 및 1,048,576토큰 컨텍스트 창을 갖추고 있다고 설명합니다. API 표면, 도구 호출 및 운영 제한에 대해서는 Kimi K3 출시 가이드에서 다룹니다.
Kimi K2.8 Preview는 프론티어 작업보다는 일상적인 개발을 위해 포지셔닝되었습니다. Kimi의 릴리스 노트는 K2.7 Code보다 눈에 띄게 향상된 사고 효율성으로 코딩 및 에이전트 기능을 개선했으며 코드 완성 및 일상적인 개발 작업에 적합하다고 말합니다. 2026년 9월 11일 Kimi Code 내부에서 전체 롤아웃으로 출시되었으며 — 모델 ID는 변경되지 않아 기존 kimi-for-coding 구성이 클라이언트 변경 없이 이를 선택했습니다. Kimi K2.8 Preview 가이드에서 Kimi Code를 타사 키에 연결하는 방법을 안내합니다.
두 모델 간의 관계는 의도적입니다: K2.8 Preview는 기본 작업 모델이고, K3는 확장 경로입니다.
사양 비교
아래 모든 내용은 두 모델이 현재 나란히 제공되는 Kimi Code에 대한 Kimi 자체 공개 사양입니다.
| Kimi K2.8 Preview | Kimi K3 | |
|---|---|---|
| 모델 ID | kimi-for-coding |
k3 / k3-256k |
| 파라미터 수 | 공개되지 않음 | 2.8조 |
| 컨텍스트 창 | 1,048,576토큰 | 1,048,576토큰 (k3) / 262,144 (k3-256k) |
| 추론 노력 | low / high / max, 기본값 max |
low / high / max, 기본값 high |
| 멀티모달 입력 | 이미지 및 비디오 | 이미지 및 비디오 (k3) / 이미지만 (k3-256k) |
| 호출 가능 대상 | 모든 멤버십 등급 | Moderato 이상; 1M 창은 Allegretto 이상 필요 |
| 상대적 소비량 | 표준 | k3(1M)는 k3-256k보다 약 2배 비용 |
| 공개 API 가격 | 공개되지 않음 | 토큰 100만 개당 $0.30 캐시 입력 / $3.00 입력 / $15.00 출력 |
요청을 처리하는 모델을 조용히 변경하기 때문에 기억해야 할 라우팅 규칙이 하나 있습니다: Kimi Code 내부에서 사고를 끄면 K3 및 K2.8 Preview 요청 모두 사고 없는 K2.8 Preview로 라우팅됩니다. K3로 구성한 요청이 K2.8로 응답될 수 있습니다. 이것은 Kimi Code 동작입니다. 동일한 규칙이 오픈 플랫폼이나 타사 게이트웨이에 적용된다고 가정하지 마십시오.
Moonshot이 공개하지 않은 것
대부분의 비교 콘텐츠가 추측으로 채우기 때문에 세 가지 공백을 명확히 언급할 가치가 있습니다:
- 파라미터 수. Kimi는 K3에 대해 2.8T를 공개했습니다. K2.8 Preview에 대한 공개된 파라미터 수는 없습니다.
- 벤치마크. K2.8 Preview 발표는 점수나 재현 가능한 K2.8 대 K3 평가를 공개하지 않습니다. "K3에 근접"은 독립적인 측정(우리 측정 포함)이 아닌 Moonshot 자체 평가입니다.
- 가격. 다음 섹션을 참조하십시오.
가격: K3에는 숫자가 있고, K2.8 Preview에는 없습니다
Kimi의 가격표에는 네 가지 모델이 나열되어 있습니다. K2.8 Preview는 그 중 하나가 아닙니다.
| 모델 | 입력(캐시 적중) | 입력(캐시 미스) | 출력 | 컨텍스트 |
|---|---|---|---|---|
kimi-k3 |
$0.30/M | $3.00/M | $15.00/M | 1,048,576 |
kimi-k2.7-code |
$0.19/M | $0.95/M | $4.00/M | 262,144 |
kimi-k2.7-code-highspeed |
$0.38/M | $1.90/M | $8.00/M | 262,144 |
kimi-k2.6 |
$0.16/M | $0.95/M | $4.00/M | 262,144 |
| Kimi K2.8 Preview | — | — | — | — |
K2.8 Preview는 토큰 단위가 아닌 Kimi Code 멤버십의 일부로 판매됩니다. Kimi Code는 Kimi 멤버십과 동일한 할당량을 공유합니다: 할당량은 7일마다 갱신되고, 추가로 5시간의 롤링 창이 있으며, 할당량이 소진되면 추가 사용 잔액이 적용됩니다. Kimi는 추가 사용 요금을 "플랫폼에 표시된 Kimi 오픈 플랫폼의 공식 API 가격에 가깝다"고만 설명하며 K2.8 Preview 요금은 공개하지 않습니다.
따라서 정직한 비교는 "K2.8이 K3보다 X만큼 저렴하다"가 아니라 "K2.8은 구독으로, K3는 토큰으로 청구된다"입니다. 그럼에도 불구하고 세 가지 공개된 사실은 K2.8 Preview가 비용 측면에서 K3 아래에 있음을 시사합니다:
- 모든 Kimi Code 등급이 K2.8 Preview를 호출할 수 있는 반면, K3는 Moderato 이상이 필요합니다.
- K2.8 Preview는 프론티어 작업이 아닌 완성 및 일상적인 개발을 위해 포지셔닝되었습니다.
- 오픈 플랫폼에서 가장 가까운 공개 형제 모델인
kimi-k2.7-code는 토큰 100만 개당 $0.95 입력 / $4.00 출력으로 가격이 책정되어 있으며, 이는 K3 입력 가격의 약 1/3, 출력 가격의 1/4입니다.
APIMaster의 K2.8 Preview 경로 가격은 예약된 슬롯입니다. K2.8 가격이나 확정된 제공 가능 여부를 발표하지 않습니다. Moonshot이 모델을 공개 API에 공개하고 경로를 목록에 추가하면 이 자리에 숫자가 들어가며, 동일한 마켓플레이스에서 K3와 카드 대 카드로 비교할 수 있습니다.
| 경로 | 입력 | 출력 |
|---|---|---|
| APIMaster의 Kimi K3 (현재) | $2.25/M — Kimi 공식 $3.00/M보다 25% 저렴 | $11.25/M — Kimi 공식 $15.00/M보다 25% 저렴 |
| APIMaster의 Kimi K2.8 Preview | 예약됨 — 경로와 함께 공개 예정 | 예약됨 — 경로와 함께 공개 예정 |
경로 가격과 채널 공급은 변경될 수 있습니다. 프로덕션 트래픽을 이동하기 전에 마켓플레이스에서 실시간 카드를 확인하십시오.
두 모델은 같은 제품군에 속하므로, 여전히 Kimi와 다른 프론티어 경로 사이에서 결정 중이라면 Kimi API 페이지에서 단일 키가 Kimi, Claude, GPT 및 DeepSeek 전반에 걸쳐 무엇을 커버하는지 비교합니다.
실제로 의미하는 것
사양 시트 외에도 선택의 느낌을 결정하는 네 가지 운영 세부 사항이 있습니다.
캐시 무효화. 모델을 변경하거나 추론 노력을 변경하면 컨텍스트 캐시가 무효화되어 다음 요청이 대화를 다시 프리필하고 더 많은 비용이 발생합니다. Kimi는 긴 세션 내에서 앞뒤로 전환하는 대신 새 세션을 시작할 것을 권장합니다. 동일한 작업에서 K2.8과 K3를 비교할 계획이라면 각각의 첫 번째 비용이 많이 드는 요청에 대한 예산을 세우십시오.
권한 오류는 인증 오류처럼 보입니다. 플랜을 초과하는 요청은 할당량 메시지가 아닌 401을 반환합니다. Moderato 미만에서 k3를 호출하거나, Moderato에서 1M 창을 요청하거나, Allegretto 미만에서 kimi-for-coding-highspeed를 호출하면 모두 401로 표시됩니다. 키가 한 모델에서는 작동하고 다른 모델에서는 실패하면 키를 교체하기 전에 플랜을 확인하십시오.
ID는 표면마다 다릅니다. k3 구성은 Kimi Code 내부에서만 유효합니다. 오픈 플랫폼에서 동일한 모델은 kimi-k3입니다. 실제로 호출하는 표면에서 ID를 복사하고, 유지하는 모든 벤치마크와 함께 공급자, 엔드포인트 및 모델 ID를 기록하십시오.
확인하십시오, 가정하지 마십시오. 모델의 자체 ID 주장은 어떤 모델이 요청을 처리했는지에 대한 증거가 아닙니다. K3에서 사고를 비활성화하면 요청이 합법적으로 K2.8 Preview로 넘어가기 때문에 여기서 이 점이 평소보다 더 중요합니다 — 예상하지 못했다면 다운그레이드처럼 보이는 라우팅 결과입니다.
선택 방법
- 코드 완성, 소규모 리팩터링 및 일상적인 개발: K2.8 Preview. 모든 등급에서 사용 가능하고, 전체 1M 창을 지원하며, 더 저렴한 경로입니다.
- 리포지토리 규모 변경, 긴 에이전트 실행, 심층 추론 및 지식 작업: K3. 2.8T 파라미터 플래그십 등급과 1M 컨텍스트가 더 많은 비용을 지불할 이유입니다.
- 공개 API, SDK 호환성 또는 예측 가능한 토큰당 청구가 필요한 경우: 오늘은 K3. K2.8 Preview에는 공개 API ID가 없기 때문입니다.
- Kimi Code 내부에서 최고 처리량을 원하는 경우: 위 어느 것도 아님 —
kimi-for-coding-highspeed는 K2.7 Code와 동일한 코딩 기능으로 3배 소비에서 약 6배 출력 속도를 제공합니다.
커뮤니티에서 논의되는 내용
두 모델은 공개 논의 수준이 매우 다르며, 그 자체가 유용한 신호입니다.
K3는 2026년 7월 이후로 활발히 논의되었습니다. Hacker News에서 "Kimi K3: Open Frontier Intelligence"는 2,107포인트와 1,214개의 댓글에 도달했고, "Kimi-K3 on HuggingFace"는 1,382포인트, "Kimi K3 Is Competitive with Fable"은 877포인트, "Moonshot AI suspends new subscriptions due to Kimi K3 demand"는 284포인트에 도달했습니다 — 마지막 것은 품질뿐만 아니라 용량이 Moonshot이 모델을 판매하는 방식을 형성했음을 상기시킵니다. 아키텍처 노트, 기술 보고서 및 로컬 추론 실험(29GB RAM에서 K3 실행) 모두 상당한 스레드를 끌어모았습니다.
K2.8 Preview는 영어권 보도가 거의 없습니다: Hacker News에서 "Kimi K2.8" 및 "Moonshot K2.8" 검색은 스토리나 댓글이 전혀 반환되지 않으며, 주류 타사 게이트웨이도 모델을 나열하지 않습니다. 논의는 중국어 개발자 채널에 집중되어 있으며, 이는 현재 구독 제품 내부에서만 제공되는 모델과 일치합니다. K3에 대한 커뮤니티 열기를 관심의 증거로 취급하되, K2.8 대 K3 품질 판정으로 취급하지 마십시오.
FAQ
Kimi K2.8 Preview의 모델 ID는 무엇인가요?
Kimi Code 내부에서는 kimi-for-coding입니다. 기본 모델이 업그레이드되었을 때 ID는 변경되지 않았으므로 기존 구성이 계속 작동합니다. Kimi의 오픈 플랫폼은 K2.8 Preview를 제공하지 않으므로 아직 공개 API 모델 ID가 없습니다.
Kimi K2.8 Preview가 Kimi K3보다 더 나은가요?
Moonshot은 K2.8 Preview가 K2.7 Code보다 향상된 사고 효율성으로 K3에 근접한다고 설명하지만, 벤치마크 점수는 공개하지 않습니다. K3는 여전히 플래그십 2.8T 파라미터 모델입니다. 실제 답변을 얻으려면 실패하는 테스트, 다중 파일 변경, 긴 문서 질문과 같은 자신의 작업을 두 모델에서 실행하고 정확성, 완료 시간 및 비용을 비교하십시오.
API에서 Kimi K3를 호출할 수 있나요?
네. K3는 Kimi 오픈 플랫폼에서 kimi-k3로 제공되는 공개 모델이며, OpenAI 호환 엔드포인트로 APIMaster에서 사용할 수 있습니다. 공개 API 모델로 호출할 수 없는 것은 K2.8 Preview입니다.
Kimi Code ID가 k3인데 API ID가 kimi-k3인 이유는 무엇인가요?
두 제품에 두 가지 명명 체계가 있기 때문입니다. Kimi Code의 네 가지 ID는 k3, k3-256k, kimi-for-coding 및 kimi-for-coding-highspeed이고, 오픈 플랫폼의 현재 ID는 kimi-k3, kimi-k2.7-code, kimi-k2.7-code-highspeed 및 kimi-k2.6입니다. 항상 호출하는 표면에서 ID를 복사하십시오.
사고를 비활성화하면 Kimi K2.8 Preview를 얻을 수 있나요?
Kimi Code 내부에서는 그렇습니다: 사고가 꺼진 상태로 K3 또는 K2.8 Preview용으로 구성된 요청은 모두 사고 없는 K2.8 Preview가 처리합니다. 이 규칙을 오픈 플랫폼이나 타사 게이트웨이에 일반화하지 말고 해당 공급자의 문서를 확인하십시오.
Kimi K2.8 Preview가 APIMaster에서 제공되나요?
아직 아닙니다. K2.8 Preview는 공개 API 모델이 아니므로 나열할 경로나 가격이 없습니다. APIMaster는 현재 kimi-k3, kimi-k2.6 및 kimi-k2.7-code를 제공합니다. Moonshot이 오픈 마켓에 공개하는 즉시 K2.8 Preview를 목록에 추가할 예정이며, 동일한 API 키가 그때 이를 커버합니다.
출처 및 확인 날짜
- Kimi Code: 모델 구성, ID, 제한 및 라우팅, 2026년 9월 17일 확인.
- Kimi Code: 2026년 9월 11일 K2.8 Preview 롤아웃 릴리스 노트.
- Kimi Code: 멤버십, 공유 할당량, 5시간 창 및 추가 사용.
- Kimi 오픈 플랫폼: 모델 목록 및 중단된 모델.
- Kimi 오픈 플랫폼: 모델 추론 가격.
- 위에서 인용한 Hacker News 토론: 48935342, 49065752, 48999291, 48969291.
- APIMaster 실시간 가격 카탈로그 및 마켓플레이스 카드, 2026년 9월 17일 확인. 제공 가능 여부와 경로 가격은 게시 후 변경될 수 있습니다.
APIMaster.ai에서 Kimi K3로 시작하기
K2.8 Preview는 주목할 모델이고, K3는 지금 바로 호출할 수 있는 모델입니다. APIMaster.ai에서 단일 OpenAI 호환 키가 Kimi 공식 가격보다 25% 저렴한 Kimi K3를 Claude, GPT, DeepSeek, Gemini 및 GLM 경로와 함께 커버하므로, K2.8 Preview가 출시되기 전에 플래그십을 나머지 스택과 벤치마킹할 수 있습니다.
APIMaster 계정 만들기, 콘솔에서 키를 생성하고, 클라이언트를 https://apimaster.ai/v1로 지정하고 모델을 kimi-k3로 설정하십시오. 모든 Kimi 채널은 목록에 등록되기 전에 지문 검사를 거칩니다.