언더스탠딩MORNING DIGEST · 2026-07-24 · 언더스탠딩🎬 영상

키미 K3와 오픈 웨이트 모델: 엔진만 공짜로 푸는 중국의 AI 전략

인포그래픽 요약

01핵심 개요

항목내용
채널언더스탠딩
제목키미 K3 뒤에 숨은 중국의 큰 그림 (김덕진 소장 2부)
길이약 60분(3582초)
핵심결론 1AI 경쟁의 축이 "누가 제일 똑똑한가"에서 "1달러로 얼마나 많은 일을 하는가"라는 효율·가격 싸움으로 옮겨가고 있다
핵심결론 2중국 키미 K3는 최고급 유료 모델(60점대)과 거의 차이 없는 57점을 내면서, 다음 주 월요일 이 두뇌를 무료로 내려받아 쓸 수 있는 "오픈 웨이트" 모델로 공개한다
핵심결론 3중국은 이를 국가 전략으로 삼아, AI 인프라가 없는 개발도상국에 "엔진은 공짜, 부품(칩·인프라)은 우리 것"이라는 패키지로 표준을 선점하려 한다

02핵심 내용 구조

1) GPT 5.6 — 1등이 아니라 "가성비"를 자랑한 이례적 사건

  • 보통 새 AI 모델은 "우리가 1등"이라고 자랑한다. 그런데 오픈AI는 GPT 5.6을 내놓으며 자기네가 2등이라는 그래프를 스스로 공개했다.
  • 벤치마크 사이트(아티피셜 애널리시스) 기준: 클로드 페이블 5가 60점 1위, GPT 5.6이 59점 2위.
  • 대신 오픈AI가 강조한 건 "가격". 같은 일을 한 번 할 때 페이블은 약 2.75달러, GPT는 약 1.04달러로 거의 절반이다.
  • 메시지: "최고로 똑똑한 건 클로드일 수 있다. 하지만 격차는 아주 작고, 우리는 절반 가격이다."

2) 왜 지금 "가격"이 중요해졌나 — 정액제 개인 vs 종량제 기업

  • 개인은 월정액(구독)으로 쓰니 많이 써도 요금이 같다.
  • 기업은 종량제(쓴 만큼 과금)로 쓴다. 에이전트가 질문 하나에 끝없이 작업을 반복하면 토큰 비용이 눈덩이처럼 불어난다.
  • 예: 200달러짜리 클로드를 1만 명이 API로 쓰면 비용이 엄청나게 커진다. 여기를 GPT가 "효율"로 파고들었다.

3) 실측 데모 — 같은 명령으로 게임 만들기

  • 소장이 GPT·클로드·키미 세 모델에 "지식의 바다를 항해하는 3D 게임을 효과음까지 넣어 만들어 줘"라는 한 문장을 똑같이 입력.
  • GPT는 6분 32초 만에 완성. 클로드는 조금 더 느리지만 그래픽이 더 좋았고, 중국 키미도 비슷한 수준을 만들어냈다.
  • 제3자(일론 머스크의 그록)에게 비용 평가를 시킨 결과(추정치): 클로드 약 1.96달러, GPT 5.6 약 0.36~0.64달러, 키미 K3 약 0.42달러.
  • 결론: 이제 중국 모델을 포함해 한 문장이면 그럴듯한 결과가 나오는 시대이고, 차이는 성능보다 "비용"에서 벌어진다.

4) 오픈 웨이트 모델이란 무엇인가 — "두뇌만 통째로 준다"

  • 챗GPT·클로드·제미나이는 아무리 좋은 슈퍼컴퓨터가 있어도 내 컴퓨터에 설치할 수 없다. 회사 서버에 접속해 건당 사용료를 내야 한다(전화 요금 같은 구조).
  • 오픈 웨이트 모델은 완성된 "두뇌"를 내 컴퓨터에 다운로드해 설치하게 해준다. 가져올 때 돈을 내지 않는다.
  • 키미 K3는 지금은 유료 구독 모델이지만, 이 오픈 웨이트 버전을 다음 주 월요일에 공개한다고 예고했다.
  • 놀라운 점: 과거 오픈 모델은 연구·학습용이라 성능이 최고급과 크게 벌어졌는데, 키미 K3는 그 격차를 크게 좁혔다(K2 시절 44점 → K3 57점, 몇 달 새 13점 상승).

5) 기업이 오픈 웨이트에 끌리는 이유 — 보안과 종속(Lock-in)

  • 설치 후에는 인터넷 연결 없이 쓸 수 있어 보안 걱정이 큰 금융권 등이 선호한다.
  • 성능이 조금 떨어져도(양자화한 소형 모델은 점수가 낮다) 추가 사용료가 없어 대량 사용 기업에 유리하다.
  • 한번 특정 모델(예: 51점짜리 GLM)에 맞춰 데이터·MCP·서비스를 최적화(튜닝)해 놓으면, 나중에 다른 모델로 갈아타기 어려워진다 → 자연스럽게 그 생태계에 종속된다.

03기술적 맥락

  • 엔진 비유: 오픈 웨이트는 자동차 "엔진만" 덜렁 주는 것. 차체·튜닝·기름은 쓰는 쪽이 알아서 해야 한다. 이 "엔진을 잘 돌려주는 일"을 서빙(serving)이라 부른다.
  • 서빙의 중요성: 엔진(모델)만 좋다고 되는 게 아니라, 안정적으로 빠르게 돌려주는 서빙 능력이 핵심. 아마존 AWS, MS 애저, 구글 클라우드 같은 회사가 이 튜닝·서빙·오케스트레이션을 대행한다.
  • 키미의 현재 한계: 머리는 좋게 만들었지만 이를 운영할 리소스(메모리 등)가 부족해 신규 가입을 막았고, 응답 속도가 첫날 대비 세 배 이상 느려졌다.
  • 화웨이 칩: 중국은 엔비디아급은 아니지만 여러 칩을 묶어 GPU 성능을 내는 방식을 발표. 딥시크·중국 모델에 최적화돼 있어, 오픈 웨이트 모델과 중국산 디바이스를 묶어 팔 수 있다.
  • 양자화(quantization): 모델을 작게 줄여 개인 PC나 맥에서도 돌릴 수 있게 만드는 기술. 원본을 그대로 돌리려면 데이터센터·클라우드급 인프라가 필요하다.

04전략적 의미

  • 딥시크 열풍과 다른 점: 딥시크는 "싸게도 만들 수 있다"는 비용 이야기였다면, 이번은 "우리도 그만큼 똑똑하게 만들 수 있다"는 성능 접근이다.
  • 중국의 국가 전략: 시진핑 주석이 상하이 세계인공지능대회(WAIC)에서 "중국 제조가 아니라 중국 지조(창조)", "AI는 한 나라의 독주가 아니라 세계적 교향곡"이라 선언. 오픈 웨이트 모델을 개발도상국에 뿌리는 그림.

- "AI판 UN"을 상하이에 만들겠다며 개도국을 모았고 12개국이 서명. 일대일로식 외교 패키지로 해석 가능.

  • 남반구(난방구) 시장: AI 의사가 의사 많은 선진국보다 의사가 부족한 아프리카·남미에서 훨씬 큰 효용을 낸다. 인프라가 없던 지역이 인터넷 대신 AI부터 정보화를 시작할 수 있고, 그 표준·인프라 시장을 중국이 선점하려 한다("칩은 화웨이, 시스템은 우리가 깔아줄게").
  • 미국 진영의 대응: 오픈AI도 GPT-OSS라는 오픈 웨이트 모델을 냈고, 구글은 소형 모델 젬마(Gemma)를 스마트폰·노트북 온디바이스에 심는 전략을 병행한다. 클라우드(AWS·애저·구글)가 서빙·튜닝을 대행하며 점유율을 키운다.

05활용 시나리오

  • 금융·국방·공공: 보안·규제 때문에 인터넷 연결이나 중국 모델 사용이 꺼려지는 곳은, 자체 서버에 오픈 웨이트 모델(예: GPT-OSS)을 설치해 폐쇄망에서 운영한다.
  • 대량 사용 기업: 하루 수만~수십만 번 에이전트를 호출해야 하는 기업은, 보유 GPU에 오픈 웨이트 모델을 올려 건당 사용료를 없애고 클라우드·전기 비용만 부담한다.
  • 개인 파워 유저: 성능 좋은 맥/맥미니에 양자화한 소형 모델을 설치해, 단순 반복 작업은 로컬 모델로, 복잡한 추론만 유료 API로 나눠 쓰는 다중 AI 조율 구조를 구축한다.
  • 개발도상국 정부: 비싼 챗GPT 구독 대신 무료 중국 오픈 웨이트 모델 + 화웨이 칩 + 데이터센터 인프라를 패키지로 도입한다.

06현황 및 전망

  • 최대 관전 포인트: 다음 주 월요일 공개될 키미 K3 오픈 웨이트 버전이 실제로 유료 모델만큼의 성능·속도를 내는지. 잘 나오면 파급이 커지고, 실망스러우면 "튜닝 실패 + 중국 모델 불안감"으로 남는다.
  • 반도체 영향(HBM·GPU):

- 단기(1~2년)엔 HBM 수요는 괜찮거나 오히려 늘 수 있다. 지구인 머릿수가 늘지 않는 한 총수요는 비슷하되, 오픈 웨이트로 새 시장(개도국)이 열릴 여지가 있기 때문. - 1순위 병목은 AI 회사들이 원하는 몸값으로 상장에 성공할지 여부. 오픈AI·앤트로픽은 상장을 앞두고 요금을 올리려다, 경쟁 모델이 싸게 나오자 오히려 무료 티어를 늘리며 가격을 못 올리는 상황. 순환 투자(버블) 궤도가 끊기면 HBM에도 영향. - 2순위는 화웨이 칩 + 중국 오픈 웨이트 모델의 확산 → 엔비디아 같은 칩메이커가 먼저 고민에 빠지고, 그다음 HBM으로 파급될 가능성. - 다만 HBM은 아직 하이닉스·삼성이 우위라, 중국이 완벽한 HBM 없이 속도를 끌어올리는 그림이면 HBM 관점에선 나쁘지 않다는 시각도.

  • 기업의 새 과제(AX): AI 도입은 대부분 결정했으나, "어떤 팀에 어느 등급 모델을 얼마나 배분할지" 가이드라인이 없으면 1년 예산이 두 달 만에 소진된다. GPT 5.6이 솔·테라·루나로, 클로드가 등급별로 나뉜 이유. 젠슨 황(2025 CES)의 예언처럼 AI 부서장(CAIO)이 HR처럼 "AI 두뇌를 어디에 배치할지" 결정하는 역할을 하게 된다.

07용어 사전

용어한줄 설명비유/예시
오픈 웨이트 모델완성된 AI 두뇌를 무료로 내려받아 내 컴퓨터/서버에 설치해 쓰는 모델자동차 엔진만 통째로 공짜로 받는 것
키미 K3중국 문샷(Moonshot)이 만든 AI. 유료 모델 대비 격차를 크게 좁힌 57점K2(44점)에서 몇 달 만에 13점 상승
서빙(serving)만들어진 모델을 안정적·빠르게 돌려 서비스로 제공하는 운영 능력엔진에 차체·기름을 채워 실제 굴러가게 하는 정비
튜닝회사 데이터·서비스에 맞게 모델을 최적화하는 작업엔진을 차종에 맞게 세팅하는 것
양자화(quantization)모델을 작게 압축해 개인 PC에서도 돌아가게 만드는 기술짐을 줄여 작은 차에 싣기
종량제쓴 만큼 요금을 내는 과금 방식(기업용)전화 통화 건당 요금
정액제월 고정 요금으로 무제한급 사용(개인용)무제한 요금제
HBMAI 연산에 쓰이는 고대역폭 메모리. 하이닉스·삼성이 주도AI의 초고속 작업 책상
아티피셜 애널리시스전 세계 AI 모델 성능·비용을 벤치마크하는 사이트모델들의 성적표·가격표
WAIC상하이 세계인공지능대회. 시진핑이 키노트 발표중국판 AI 정상회의
AXAI 기반으로 비즈니스 자체를 전환하는 것단순 도입(도구)을 넘어 체질 개선
언더스탠딩 · 2026-07-24
← 목록으로