
중국발 세계 최대 규모의 오픈 모델 「Kimi K3」 철저 해설
요약
Moonshot AI가 2.8조 파라미터 규모의 차세대 오픈 웨이트 모델인 Kimi K3를 발표했습니다. 초희소 MoE 구조와 독자적인 KDA 어텐션 메커니즘을 통해 대규모 컨텍스트 처리 효율을 극대화한 것이 특징입니다.
핵심 포인트
- 2.8T 파라미터 규모의 세계 최대 오픈 웨이트 모델
- 896개 전문가 모듈을 활용한 초희소 MoE 아키텍처 적용
- KDA 기술로 100만 토큰 컨텍스트에서 디코딩 6.3배 가속화
- Claude Opus 4.8 Max를 상회하는 실무 수행 능력 입증
서론
2026년 7월 16일 심야(현지 시간), 중국의 AI 스타트업 「Moonshot AI(月之暗面)」가 차세대 플래그십 모델 Kimi K3를 발표했습니다[1][2]. 총 파라미터 수 2.8조(2.8T)라는, 현시점 세계 최대 규모의 오픈 웨이트(Open-weight) 모델이며, 업계에서는 「Kimi 모멘트」라고 불릴 정도의 충격을 주고 있습니다[3].
본 기사에서는 중국어 미디어 및 기술 블로그를 중심으로 정보를 수집하여, Kimi K3의 아키텍처(Architecture), 벤치마크(Benchmark) 결과, 요금, 이용 방법까지 정리합니다.
Kimi K3란
Kimi K3는 베이징에 본사를 둔 Moonshot AI가 개발한, Kimi K2 시리즈의 후속 모델인 오픈 웨이트(Open-weight) 에이전트 퍼스트(Agent-first) 프론티어 모델입니다[4]. 소프트웨어 엔지니어링, 지식 작업(Knowledge work), 심층 리서치, 멀티모달(Multimodal) 이해와 같은 복잡한 태스크(Task)에 최적화되어 있으며, 「질문에 답하기」에서 「태스크를 완수하기」로의 전환을 강력하게 의식한 설계가 되어 있습니다[5].
신화사 보도에 따르면, Kimi K3의 발표는 2026 세계 인공지능 대회(WAIC) 개막 직전이라는 타이밍에 이루어졌으며, 「중국의 AI 모델 개발이 새로운 발걸음을 내디뎠다」라고 위치 지어지고 있습니다[6].
기술 사양 · 아키텍처
| 항목 | 내용 |
|---|---|
| 총 파라미터 수 | 약 2.8조(2.8T), 활성화 파라미터(Activated parameters)만을 일부 이용하는 초희소 MoE(Mixture of Experts) 구성[1:1][5:1] |
| 컨텍스트 윈도우 (Context Window) | 최대 100만 토큰[1:2][2:1] |
| MoE 구성 | 896개의 전문가 모듈(Expert modules)을 가지며, 추론 시에는 그중 16개만을 활성화[5:2] |
| 어텐션 메커니즘 (Attention Mechanism) | 독자 개발한 「Kimi Delta Attention (KDA)」 혼합 선형 어텐션(Mixed Linear Attention) + 「Attention Residuals (AttnRes)」 구조[5:3] |
| 멀티모달 대응 | 시각 이해를 네이티브 지원(이미지 · 시각적 추론)[1:3][7] |
| 효율성 | KDA를 통해 100만 토큰급 컨텍스트에서 최대 6.3배의 디코딩(Decoding) 가속화, AttnRes는 2% 미만의 추가 비용으로 학습 효율을 약 25% 향상[5:4] |
| 제공 채널 | Kimi.com, 모바일/데스크톱 앱, Kimi Code (CLI 코딩 에이전트), API[5:5][7:1] |
특기할 점은 파라미터 규모를 단순히 확대하는 것이 아니라, 모델 아키텍처 · 학습 방법 · 데이터 레시피(Data recipe)를 협조적으로 최적화함으로써 전 세대(Kimi K2) 대비 약 2.5배의 스케일링 효율(Scaling efficiency)을 실현했다는 점입니다[8][7:2].
벤치마크 성능
복수의 제3자 평가 기관에 의한 측정 결과가 중국어 미디어에서 보도되었습니다.
- GDPval-AA v2 (업계 횡단 실무 수행 능력 평가): Kimi K3는 1687점을 획득하여, Anthropic의 「Claude Opus 4.8 Max」의 1600점을 상회했습니다. 단, 최상위인 「Claude Fable 5 Max」, 「GPT-5.6 Sol Max」에는 차순위입니다[5:6].
- AA-Briefcase (에이전트형 지식 작업 평가): Kimi K3는 1527점으로, GPT-5.6 Sol Max를 넘어 Claude Fable 5 Max에 이은 2위를 기록했습니다[5:7].
- Artificial Analysis 종합 지능 지수 (9개의 벤치마크를 통합한 스코어): Kimi K3는 57점으로, Claude Fable 5(60점), GPT-5.6 Sol(59점)에 이어 근소한 차이로 3위를 기록하며, 현시점 최고 평가를 받는 오픈 웨이트(Open-weight) 모델이 되었습니다[3:1].
비용 효율 측면에서도 주목받고 있으며, Artificial Analysis의 산출에 따르면 태스크당 비용(비용 가중 평균)은 0.94달러로, Claude Fable 5보다 약 65.82%, GPT-5.6 Sol보다 약 9.62% 낮다고 합니다[3:2]. 중국 국내외 헤지펀드 매니저들에 의한 독자 검증에서는 실운용 체감이 「Fable급」에 가깝다는 평가도 나오고 있습니다[5:8].
또한, Moonshot AI 스스로도 「종합 성능에서는 Claude Fable 5 · GPT-5.6 Sol에 미치지 못하지만, 자사 평가 전체에서는 최첨단 수준의 능력을 보여주며 다른 모든 모델을 안정적으로 상회했다」라고 겸손하게 위치 지은 점은 공정성 관점에서 참고할 만합니다[5:9][2:2].
요금 체계
API 요금(100만 토큰당)은 다음과 같습니다.
| 항목 | 중국 미디어 보도 (위안화) | 일부 해외 표기 (미달러) |
|---|---|---|
| 표준 입력 | 20위안 | 약 3.00달러 [7:3] |
| 캐시 히트 시 입력 | 2위안 | — |
| 출력 | 100위안 | 15.00달러 (GPT-5.6 Sol의 약 절반 가격) [3:3][7:4] |
일본어 정보 시스템 관점의 분석 기사에 따르면, 모델 웨이트 (Model Weights)의 완전 공개는 2026년 7월 27일까지 예정되어 있으며, 기업이 자사 인프라에서 호스팅 (Hosting)하는 선택지도 고려 대상이 될 것으로 보입니다 [7:5][9].
이용 가능한 채널과 현황의 주의점
Kimi K3는 발표와 동시에 Kimi 공식 사이트, 모바일/데스크톱 앱, CLI형 코딩 에이전트 (Coding Agent) 「Kimi Code」, 그리고 API를 통해 이용 가능해졌습니다. 기본 사고 강도는 「max (극치)」로 설정되어 있으며, 향후 「low」, 「high」 모드가 추가될 예정입니다 [5:10].
다만, 일본어 기술 블로그에서는 "오픈 소스 (Open Source)로 발표되었으나, 완전한 모델 웨이트 공개는 7월 27일까지의 '예정'이며, 발표 당일 시점에서는 누구나 다운로드하여 구동할 수 있는 상태가 아니다"라는 지적도 있어, 오픈화 일정에는 주의가 필요합니다 [9:1][10]. 중국 미디어의 일부 게시물에는 "7월 27일 전면 공개"라고 명시되어 있습니다 [10:1].
미중 AI 경쟁에서의 위치
복수의 중국어·일본어 미디어는 Kimi K3의 등장을 작년의 「DeepSeek 쇼크」에 비견되는 사건으로 보도하고 있습니다. DW中文 (독일 공영 방송)은 Kimi K3가 전 세계 오픈 모델 중 최대 파라미터 (Parameter)를 보유하고 있으며 성능 또한 국제 최상위권에 근접하고 있다고 평가하면서도, 벤치마크 (Benchmark) 결과는 제3자에 의한 독립 검증을 거치지 않았다는 점을 유보하고 있습니다 [11].
Yahoo! 뉴스 전문가 칼럼에서는 Kimi K3의 등장이 미국 AI 업계에 「DeepSeek 쇼크와 유사한 충격」을 주고 있으며, 코딩 에이전트 기능의 일부 평가에서는 Claude Fable 5를 상회하는 장면도 있어, 저렴한 요금을 배경으로 일부 미국 기업이 실제 이용을 검토하는 움직임도 나타나고 있다고 보도했습니다 [12].
요약
Kimi K3는 2.8조 파라미터, 100만 토큰 컨텍스트 (Context), 독자적인 KDA/AttnRes 아키텍처 (Architecture)를 결합한 현시점 세계 최대 규모의 오픈 웨이트 (Open Weight) 모델입니다 [1:4][5:11]. 종합 성능 면에서는 최첨단 폐쇄형 모델 (Claude Fable 5, GPT-5.6 Sol)에 약간 미치지 못하지만, 코딩 및 장기 태스크 처리의 일부 평가에서는 어깨를 나란히 하며, 비용 측면에서는 큰 우위를 점하고 있습니다 [3:4][5:12]. 백엔드 개발 및 API 연동을 다루는 개발자들에게 Kimi API와 Kimi Code의 실운용 검증은 향후 주목할 만한 테마가 될 것입니다.
月之暗面发布全球最大规模开源模型Kimi K3 — 联合早报, https://www.zaobao.com.sg/news/china/story20260717-9379062 ↩︎ ↩︎ ↩︎ ↩︎ ↩︎
月之暗面Kimi K3发布:2.8万亿参数,即将开源 — 新浪财经, https://finance.sina.com.cn/tob/2026-07-17/doc-iniiahrp8128941.shtml ↩︎ ↩︎ ↩︎ ↩︎ ↩︎
月之暗面推Kimi K3 評分逼近美兩大AI模型 — 香港經濟日報(明報), https://news.mingpao.com/pns/经济/article/20260718/s00004/1784309310601/ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎
Kimi K3:Moonshot AI의 2.8兆 파라미터·오픈 웨이트 모델 — Eigent AI, https://www.eigent.ai/ja/blog/kimi-k3-open-weight-frontier-model ↩︎
2.8萬億參數全球最大開源模型性能逼近海外頂級閉源模型 — 香港經濟日報, https://inews.hket.com/article/4162481/ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎
新突破中国企业发布全球最大规模的开源模型Kimi K3 — 新華社, https://www.news.cn/tech/20260717/01c04372f89a46e480206e1da2fb8e8c/c.html ↩︎
-
Kimi K3란 무엇인가? 성능·요금 및 기업 도입 리스크를 정보시스템(情シス) 관점에서 철저 해설 — Money Forward Admina, https://admina.moneyforward.com/jp/blog/kimi-k3-enterprise-guide ↩︎ ↩︎ ↩︎ ↩︎ ↩︎ ↩︎
전 세계 최대 규모 오픈 모델! Moonshot AI(月之暗面) Kimi K3 발표 — 鉅亨網, https://news.cnyes.com/news/id/6537490 ↩︎
Kimi K3란 무엇인가? 성능·요금·사용법과 Kimi Code — note (kazu_t), https://note.com/kazu_t/n/n8d655d925c81 ↩︎ ↩︎
Kimi, 2.8조 파라미터 대규모 모델(Large Model) K3 정식 발표, 이것은 우리의 영광입니다 — AIQ, https://www.6aiq.com/article/kimi-zheng-shi-fa-bu-2-8-wan-yi-da-mo-xing-k3-zhe-shi-shu-yu-wo-men-de-rong-guang-1784264744895 ↩︎ ↩︎
중국 AI 기업 Moonshot AI(月之暗面), 전 세계 최대 규모 오픈 모델 발표 — DW 중문, https://www.dw.com/zh/ ↩︎
중국 AI 「Kimi K3」의 충격 —— 「닫고 비싸게 파는」 미국 AI 모델 — Yahoo! 뉴스 전문가 칼럼, https://news.yahoo.co.jp/expert/articles/31d36648d21afd3b2faf0fa6895e53b4d6fe9f9d ↩︎
Discussion

AI 자동 생성 콘텐츠
본 콘텐츠는 Zenn AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기