01핵심 개요
| 항목 | 내용 |
|---|---|
| 채널 | 언더스탠딩 |
| 제목 | 키미 K3 뒤에 숨은 중국의 큰 그림 (김덕진 소장 2부) |
| 길이 | 약 60분(3582초) |
| 핵심결론 1 | AI 경쟁의 축이 "누가 제일 똑똑한가"에서 "1달러로 얼마나 많은 일을 하는가"라는 효율·가격 싸움으로 옮겨가고 있다 |
| 핵심결론 2 | 중국 키미 K3는 최고급 유료 모델(60점대)과 거의 차이 없는 57점을 내면서, 다음 주 월요일 이 두뇌를 무료로 내려받아 쓸 수 있는 "오픈 웨이트" 모델로 공개한다 |
| 핵심결론 3 | 중국은 이를 국가 전략으로 삼아, AI 인프라가 없는 개발도상국에 "엔진은 공짜, 부품(칩·인프라)은 우리 것"이라는 패키지로 표준을 선점하려 한다 |
02핵심 내용 구조
1) GPT 5.6 — 1등이 아니라 "가성비"를 자랑한 이례적 사건
- 보통 새 AI 모델은 "우리가 1등"이라고 자랑한다. 그런데 오픈AI는 GPT 5.6을 내놓으며 자기네가 2등이라는 그래프를 스스로 공개했다.
- 벤치마크 사이트(아티피셜 애널리시스) 기준: 클로드 페이블 5가 60점 1위, GPT 5.6이 59점 2위.
- 대신 오픈AI가 강조한 건 "가격". 같은 일을 한 번 할 때 페이블은 약 2.75달러, GPT는 약 1.04달러로 거의 절반이다.
- 메시지: "최고로 똑똑한 건 클로드일 수 있다. 하지만 격차는 아주 작고, 우리는 절반 가격이다."
2) 왜 지금 "가격"이 중요해졌나 — 정액제 개인 vs 종량제 기업
- 개인은 월정액(구독)으로 쓰니 많이 써도 요금이 같다.
- 기업은 종량제(쓴 만큼 과금)로 쓴다. 에이전트가 질문 하나에 끝없이 작업을 반복하면 토큰 비용이 눈덩이처럼 불어난다.
- 예: 200달러짜리 클로드를 1만 명이 API로 쓰면 비용이 엄청나게 커진다. 여기를 GPT가 "효율"로 파고들었다.
3) 실측 데모 — 같은 명령으로 게임 만들기
- 소장이 GPT·클로드·키미 세 모델에 "지식의 바다를 항해하는 3D 게임을 효과음까지 넣어 만들어 줘"라는 한 문장을 똑같이 입력.
- GPT는 6분 32초 만에 완성. 클로드는 조금 더 느리지만 그래픽이 더 좋았고, 중국 키미도 비슷한 수준을 만들어냈다.
- 제3자(일론 머스크의 그록)에게 비용 평가를 시킨 결과(추정치): 클로드 약 1.96달러, GPT 5.6 약 0.36~0.64달러, 키미 K3 약 0.42달러.
- 결론: 이제 중국 모델을 포함해 한 문장이면 그럴듯한 결과가 나오는 시대이고, 차이는 성능보다 "비용"에서 벌어진다.
4) 오픈 웨이트 모델이란 무엇인가 — "두뇌만 통째로 준다"
- 챗GPT·클로드·제미나이는 아무리 좋은 슈퍼컴퓨터가 있어도 내 컴퓨터에 설치할 수 없다. 회사 서버에 접속해 건당 사용료를 내야 한다(전화 요금 같은 구조).
- 오픈 웨이트 모델은 완성된 "두뇌"를 내 컴퓨터에 다운로드해 설치하게 해준다. 가져올 때 돈을 내지 않는다.
- 키미 K3는 지금은 유료 구독 모델이지만, 이 오픈 웨이트 버전을 다음 주 월요일에 공개한다고 예고했다.
- 놀라운 점: 과거 오픈 모델은 연구·학습용이라 성능이 최고급과 크게 벌어졌는데, 키미 K3는 그 격차를 크게 좁혔다(K2 시절 44점 → K3 57점, 몇 달 새 13점 상승).
5) 기업이 오픈 웨이트에 끌리는 이유 — 보안과 종속(Lock-in)
- 설치 후에는 인터넷 연결 없이 쓸 수 있어 보안 걱정이 큰 금융권 등이 선호한다.
- 성능이 조금 떨어져도(양자화한 소형 모델은 점수가 낮다) 추가 사용료가 없어 대량 사용 기업에 유리하다.
- 한번 특정 모델(예: 51점짜리 GLM)에 맞춰 데이터·MCP·서비스를 최적화(튜닝)해 놓으면, 나중에 다른 모델로 갈아타기 어려워진다 → 자연스럽게 그 생태계에 종속된다.
03기술적 맥락
- 엔진 비유: 오픈 웨이트는 자동차 "엔진만" 덜렁 주는 것. 차체·튜닝·기름은 쓰는 쪽이 알아서 해야 한다. 이 "엔진을 잘 돌려주는 일"을 서빙(serving)이라 부른다.
- 서빙의 중요성: 엔진(모델)만 좋다고 되는 게 아니라, 안정적으로 빠르게 돌려주는 서빙 능력이 핵심. 아마존 AWS, MS 애저, 구글 클라우드 같은 회사가 이 튜닝·서빙·오케스트레이션을 대행한다.
- 키미의 현재 한계: 머리는 좋게 만들었지만 이를 운영할 리소스(메모리 등)가 부족해 신규 가입을 막았고, 응답 속도가 첫날 대비 세 배 이상 느려졌다.
- 화웨이 칩: 중국은 엔비디아급은 아니지만 여러 칩을 묶어 GPU 성능을 내는 방식을 발표. 딥시크·중국 모델에 최적화돼 있어, 오픈 웨이트 모델과 중국산 디바이스를 묶어 팔 수 있다.
- 양자화(quantization): 모델을 작게 줄여 개인 PC나 맥에서도 돌릴 수 있게 만드는 기술. 원본을 그대로 돌리려면 데이터센터·클라우드급 인프라가 필요하다.
04전략적 의미
- 딥시크 열풍과 다른 점: 딥시크는 "싸게도 만들 수 있다"는 비용 이야기였다면, 이번은 "우리도 그만큼 똑똑하게 만들 수 있다"는 성능 접근이다.
- 중국의 국가 전략: 시진핑 주석이 상하이 세계인공지능대회(WAIC)에서 "중국 제조가 아니라 중국 지조(창조)", "AI는 한 나라의 독주가 아니라 세계적 교향곡"이라 선언. 오픈 웨이트 모델을 개발도상국에 뿌리는 그림.
- "AI판 UN"을 상하이에 만들겠다며 개도국을 모았고 12개국이 서명. 일대일로식 외교 패키지로 해석 가능.
- 남반구(난방구) 시장: AI 의사가 의사 많은 선진국보다 의사가 부족한 아프리카·남미에서 훨씬 큰 효용을 낸다. 인프라가 없던 지역이 인터넷 대신 AI부터 정보화를 시작할 수 있고, 그 표준·인프라 시장을 중국이 선점하려 한다("칩은 화웨이, 시스템은 우리가 깔아줄게").
- 미국 진영의 대응: 오픈AI도 GPT-OSS라는 오픈 웨이트 모델을 냈고, 구글은 소형 모델 젬마(Gemma)를 스마트폰·노트북 온디바이스에 심는 전략을 병행한다. 클라우드(AWS·애저·구글)가 서빙·튜닝을 대행하며 점유율을 키운다.
05활용 시나리오
- 금융·국방·공공: 보안·규제 때문에 인터넷 연결이나 중국 모델 사용이 꺼려지는 곳은, 자체 서버에 오픈 웨이트 모델(예: GPT-OSS)을 설치해 폐쇄망에서 운영한다.
- 대량 사용 기업: 하루 수만~수십만 번 에이전트를 호출해야 하는 기업은, 보유 GPU에 오픈 웨이트 모델을 올려 건당 사용료를 없애고 클라우드·전기 비용만 부담한다.
- 개인 파워 유저: 성능 좋은 맥/맥미니에 양자화한 소형 모델을 설치해, 단순 반복 작업은 로컬 모델로, 복잡한 추론만 유료 API로 나눠 쓰는 다중 AI 조율 구조를 구축한다.
- 개발도상국 정부: 비싼 챗GPT 구독 대신 무료 중국 오픈 웨이트 모델 + 화웨이 칩 + 데이터센터 인프라를 패키지로 도입한다.
06현황 및 전망
- 최대 관전 포인트: 다음 주 월요일 공개될 키미 K3 오픈 웨이트 버전이 실제로 유료 모델만큼의 성능·속도를 내는지. 잘 나오면 파급이 커지고, 실망스러우면 "튜닝 실패 + 중국 모델 불안감"으로 남는다.
- 반도체 영향(HBM·GPU):
- 단기(1~2년)엔 HBM 수요는 괜찮거나 오히려 늘 수 있다. 지구인 머릿수가 늘지 않는 한 총수요는 비슷하되, 오픈 웨이트로 새 시장(개도국)이 열릴 여지가 있기 때문. - 1순위 병목은 AI 회사들이 원하는 몸값으로 상장에 성공할지 여부. 오픈AI·앤트로픽은 상장을 앞두고 요금을 올리려다, 경쟁 모델이 싸게 나오자 오히려 무료 티어를 늘리며 가격을 못 올리는 상황. 순환 투자(버블) 궤도가 끊기면 HBM에도 영향. - 2순위는 화웨이 칩 + 중국 오픈 웨이트 모델의 확산 → 엔비디아 같은 칩메이커가 먼저 고민에 빠지고, 그다음 HBM으로 파급될 가능성. - 다만 HBM은 아직 하이닉스·삼성이 우위라, 중국이 완벽한 HBM 없이 속도를 끌어올리는 그림이면 HBM 관점에선 나쁘지 않다는 시각도.
- 기업의 새 과제(AX): AI 도입은 대부분 결정했으나, "어떤 팀에 어느 등급 모델을 얼마나 배분할지" 가이드라인이 없으면 1년 예산이 두 달 만에 소진된다. GPT 5.6이 솔·테라·루나로, 클로드가 등급별로 나뉜 이유. 젠슨 황(2025 CES)의 예언처럼 AI 부서장(CAIO)이 HR처럼 "AI 두뇌를 어디에 배치할지" 결정하는 역할을 하게 된다.
07용어 사전
| 용어 | 한줄 설명 | 비유/예시 |
|---|---|---|
| 오픈 웨이트 모델 | 완성된 AI 두뇌를 무료로 내려받아 내 컴퓨터/서버에 설치해 쓰는 모델 | 자동차 엔진만 통째로 공짜로 받는 것 |
| 키미 K3 | 중국 문샷(Moonshot)이 만든 AI. 유료 모델 대비 격차를 크게 좁힌 57점 | K2(44점)에서 몇 달 만에 13점 상승 |
| 서빙(serving) | 만들어진 모델을 안정적·빠르게 돌려 서비스로 제공하는 운영 능력 | 엔진에 차체·기름을 채워 실제 굴러가게 하는 정비 |
| 튜닝 | 회사 데이터·서비스에 맞게 모델을 최적화하는 작업 | 엔진을 차종에 맞게 세팅하는 것 |
| 양자화(quantization) | 모델을 작게 압축해 개인 PC에서도 돌아가게 만드는 기술 | 짐을 줄여 작은 차에 싣기 |
| 종량제 | 쓴 만큼 요금을 내는 과금 방식(기업용) | 전화 통화 건당 요금 |
| 정액제 | 월 고정 요금으로 무제한급 사용(개인용) | 무제한 요금제 |
| HBM | AI 연산에 쓰이는 고대역폭 메모리. 하이닉스·삼성이 주도 | AI의 초고속 작업 책상 |
| 아티피셜 애널리시스 | 전 세계 AI 모델 성능·비용을 벤치마크하는 사이트 | 모델들의 성적표·가격표 |
| WAIC | 상하이 세계인공지능대회. 시진핑이 키노트 발표 | 중국판 AI 정상회의 |
| AX | AI 기반으로 비즈니스 자체를 전환하는 것 | 단순 도입(도구)을 넘어 체질 개선 |
