inhainho 아빠님의 블로그 메인 배너

AI 자동화

구글 발표 전날, 문샷 AI가 던진 2.8조 파라미터 폭탄 | IT 위클리

inhainho 2026. 7. 18. 15:09
반응형
구글 발표 전날, 문샷 AI가 던진 2.8조 파라미터 폭탄 | IT 위클리
IT WEEKLY · 2026.07.18

구글 발표 전날,
문샷 AI가 던진 2.8조 파라미터

중국 문샷 AI가 역대 최대 오픈소스 모델 Kimi K3를 공개했습니다. 하필 구글이 Gemini 3.5 Pro를 발표하기 하루 전날, 시진핑 주석이 세계인공지능대회에 처음 등장한 그 주간에 말이죠. 우연이라기엔 너무 절묘한 타이밍입니다.

2.8T
총 파라미터
16/896
토큰당 활성 전문가
1M
컨텍스트 윈도우
7.27
가중치 완전 공개일
출시일 2026.07.16 개발사 Moonshot AI (문샷 AI)
01

타이밍이 곧 메시지다

2026.07.16
문샷 AI, Kimi K3 전격 출시 — "역대 최대 오픈소스 모델"
2026.07.17
구글 Gemini 3.5 Pro 정식 출시 예정일이자, 시진핑 주석이 2026 세계인공지능대회(WAIC) 개막 연설에 사상 첫 참석한 바로 그날
2026.07.27
Kimi K3 가중치 완전 공개 — 출시 11일 만에 누구나 무료로 다운로드 가능

업계 반응은 명확했습니다. "폐쇄형 랩들이 1년 내내 피해온 질문 — 도대체 이 프리미엄 가격이 무엇을 정당화하는가 — 이 2.8조 파라미터라는 숫자와 함께 정면으로 던져졌다"는 평가가 나옵니다. 구글의 모든 벤치마크 발표가 이제 "11일 뒤 무료로 풀리는 중국 모델"과 비교당하게 된 셈입니다.

02

무엇이 새로운가 — 그냥 큰 게 아니다

Kimi K3는 전작 K2.6을 단순히 키운 모델이 아니라 아예 새로운 아키텍처로 재설계됐습니다.

  • Kimi Delta Attention(KDA) — 선형 어텐션과 전체 어텐션을 3:1 비율로 섞은 하이브리드 방식. KV 캐시 메모리를 최대 75% 절감하고, 100만 토큰 컨텍스트에서 디코딩 속도를 6.3배 끌어올림
  • Attention Residuals(AttnRes) — 연산 비용은 2%만 늘리면서 학습 효율은 25% 개선
  • Stable LatentMoE — 896개 전문가 중 16개만 활성화하는 초희소 라우팅을 안정적으로 학습 가능하게 만든 구조

이 세 가지가 결합되며 전작 K2 대비 약 2.5배의 스케일링 효율을 달성했다고 문샷 측은 밝혔습니다.

03

벤치마크 성적표 — 프론티어에 근접, 하지만 1위는 아니다

벤치마크결과
LMArena 프론트엔드 코드1위 (1,679점)
GDPval-AA v2 (실무 44개 직군)3위 (1,687점)
LMArena 일반 텍스트9위

프론트엔드 코드 아레나에서는 Claude Fable 5(1,631점)·GPT-5.6 Sol(1,618점)·GLM-5.2(1,587점)를 모두 제치고 1위에 올랐습니다 — 전작 K2.6이 18위였던 것과 비교하면 17계단 도약입니다. 다만 GDPval-AA v2 종합 순위에서는 Claude Fable 5 Max(1,815점)·GPT-5.6 Sol Max(1,747.8점)에 이어 3위에 머물렀고, FrontierSWE·HLE-Full 같은 고난도 추론 벤치마크에서도 Fable 5에는 못 미칩니다.

문샷 팀 스스로도 "전반적인 성능은 여전히 최상위 폐쇄형 모델에는 못 미친다"고 인정하고 있습니다. 다만 최근 9개월 중 9개월간 오픈소스 모델 최대 규모 기록을 계속 Kimi가 갈아치우고 있다는 사실은 변함없습니다.
04

"저렴한 중국 AI" 시대의 끝?

Kimi K2.6 (전작)
~1/3
K3 대비 가격 수준
Kimi K3 (신작)
$0.30 / $3 / $15
캐시히트 입력 / 캐시미스 입력 / 출력 (100만 토큰당)

K3의 가격은 전작 대비 약 3배 뛰었습니다. 여전히 작업당 기준으로는 Claude Opus 4.8보다 저렴하지만, 더 이상 "그냥 저렴한 중국 AI"라 부르기는 어려워졌습니다. 성능 향상과 함께 환각(hallucination) 발생률도 함께 올라갔다는 지적도 나옵니다 — 정확도를 끌어올린 대가가 없지는 않다는 뜻입니다.

05

가중치는 아직이다 — 11일짜리 티저 전략

흥미로운 점은 출시 당일(7월 16일) 기준으로 모델 가중치가 즉시 풀리지 않았다는 사실입니다. API로는 바로 쓸 수 있지만, 완전한 오픈 가중치 공개는 7월 27일로 예고돼 있습니다. 대규모 병렬 처리에 특화된 "K3 Swarm Max" 버전도 함께 발표됐는데, 이는 문샷이 단일 거대 모델을 넘어 다중 에이전트 스웜(swarm) 방향을 다음 프론티어로 보고 있다는 신호로 읽힙니다.

K3 Max (범용) K3 Swarm Max (병렬 에이전트) 항상 켜진 추론 모드
TAKEAWAY

"싸구려 중국 모델"이라는 꼬리표가
이제는 통하지 않습니다.

K2.6이 출시된 지 채 3개월도 안 돼 그 규모를 거의 3배로 키운 모델이 나왔다는 사실 자체가, 중국 오픈소스 AI 진영의 개발 속도가 얼마나 빨라졌는지를 보여줍니다. 가격은 올랐지만 여전히 서구 폐쇄형 모델보다 저렴하고, 특정 영역(프론트엔드 코딩)에서는 이미 최상위권 폐쇄형 모델을 제쳤습니다. 구글이 하필 이 타이밍에 Gemini 3.5 Pro를 늦추고, 시진핑이 하필 이 주간에 AI 컨퍼런스에 처음 등장했다는 사실까지 겹치면서, 이번 출시는 단순한 모델 업데이트를 넘어 "누가 AI 서사를 주도하는가"를 둘러싼 상징적 사건으로 읽히고 있습니다.

#KimiK3 #문샷AI #오픈소스AI #중국AI #MoE #제미나이35Pro #AI벤치마크 #LLM #AI가격전쟁 #테크뉴스
2026.07.16~17 VentureBeat·MarkTechPost·TechStartups 등 보도를 종합해 정리했습니다.
반응형