조코딩 JoCodingMORNING DIGEST · 2026-08-17 · 조코딩 JoCoding🎬 영상

그록 4.6·그록봇 출시부터 앤트로픽 리만 가설 진전까지, 이번 주 AI 뉴스 총정리

인포그래픽 요약

01핵심 개요

항목내용
형식조코딩 JoCoding 채널의 주간 AI 뉴스 라이브. 진행자가 실시간 채팅을 응대하며 한 주간의 AI 업계 소식을 순서대로 훑는다.
최상위 화제XAI 그록 4.6이 아티피셜 아날리시스 종합 점수 기준 페이블(claude 계열로 추정되는 최상위 모델) 다음으로 GPT-5.6 소울 맥스와 동점을 기록했고, GDP발 벤치마크에서는 전체 1위를 차지했다.
최대 반전27B(270억 파라미터)짜리 오픈웨이트 모델 큐엔(Qwen) 3.8이 에이전트 코딩·소프트웨어 벤치 프로 등에서 한때 최강으로 불리던 오퍼스 4.6 맥스를 앞섰고, 소비자용 GPU 한 대로 무료 구동이 가능하다.
논쟁적 사건오픈AI가 챗GPT 사용자의 전 여자친구 위협 대화를 감지해 FBI에 신고했고 해당 사용자가 실제 체포됐다. 범죄 실행 전 개입이라는 점에서 '마이너리티 리포트' 현실화 논쟁이 붙었다.
학술 진전앤트로픽 내부 미출시 연구용 클로드가 리만 가설(소수의 분포를 설명하는 미해결 수학 난제)에 도전해, 영점 비율 하한을 인간이 찾은 41.6%에서 67.2%까지 끌어올렸다(가설 자체는 미해결).
반발 이슈앤트로픽이 클로드 출력 텍스트에 AI 생성 여부를 식별할 수 있는 워터마크(단어 선택 확률을 미세 조정하는 방식)를 도입하면서 사용자 반발과 구독 취소, 오픈소스 제거 도구 등장이 이어졌다.
한국 성과아티피셜 아날리시스의 국가별 오픈웨이트 순위에서 한국의 모티프(Motif) 모델이 47점대로 올라 글로벌 오픈웨이트 2위(중국 키미 K3에 이어)를 기록했다.

02핵심 기능/내용 구조

영상은 아래 순서로 이번 주 AI 뉴스를 다룬다.

  1. XAI 그록 4.6 공개: 아티피셜 아날리시스 종합 점수 기준 최상위권(약 61점)에 진입해 GPT-5.6 소울 맥스와 동점, GDP발 벤치마크 1위, 딥 소프트웨어 엔지니어링 3위를 기록했다. 일론 머스크는 "그록 4.6을 시도해 볼 만하다, 다음 버전인 4.7이 나오면 모든 모델의 지능을 능가할 기회가 있다"고 트윗했다. 가격은 최상위권치고는 준수한 편이나 저렴한 축은 아니다.
  2. 그록봇(Grok Bot) 출시: XAI가 컴퓨터 한 대를 통째로 할당해 에이전트가 브라우저·메일 등을 직접 조작하게 하는 신제품을 냈다. 맥미니에 오픈클로드·코덱스 등을 물려 쓰는 방식과 유사하되 서버까지 통째로 제공한다는 점이 특징이다. 가격은 커서 울트라 월 200달러, 슈퍼그록 헤비 월 300달러, 커서 프리미엄 팀 플랜이 월 120달러로 상대적으로 저렴하다. 앤트로픽 에이전트류보다 작업 거부(가드레일)가 낮다는 비교 트윗도 소개됐다.
  3. X 추천 알고리즘 오픈소스 공개: 일론 머스크가 X의 개인화 추천(포유) 알고리즘을 공개해, 정부의 검열·규제 압박에 대한 방어 수단으로 활용했다는 해석이 나왔다. 특정 의원의 요청으로 특정 게시물을 억제했다는 사실까지 코드에 노출되어 오히려 투명성을 증명하는 효과를 냈다.
  4. 에르메스(Hermes) 에이전트: 그록 본모드와 유사한 다중 채팅창 협업 기능을 빠르게 출시했다.
  5. 오픈AI 컴퓨터 히스토리: 챗GPT가 컴퓨터·앱·웹사이트에서의 사용자 활동을 기록해 맥락으로 활용하는 기능. 업무 자동 일지, 스킬 자동 생성 등 장점이 있으나 직원 감시 도구로 악용될 수 있다는 우려가 함께 제기됐다. 기본 비활성화, 프로 이상/비즈니스/엔터프라이즈 대상 제공.
  6. 오픈AI 울트라패스트 모드: 셀레브라스(Cerebras) 추론 특화 칩과 협업해 GPT-5.6 소울을 최대 14배, 초당 최대 750토큰까지 빠르게 출력. 일부 고객 대상 제한적 프리뷰로 시작했다.
  7. 코덱스 성능 개선 루머: 오픈AI 코덱스 팀원이 공유한 벤치마크에서 평균 로딩 시간이 27.6초에서 1.7초로, 성능이 최대 94% 개선됐다는 스크린샷이 화제가 됐다. 다음 주 주요 업데이트가 예고된 것으로 해석된다.
  8. 챗GPT 대화 신고·체포 사건: 전 여자친구에 대한 폭력을 반복 논의한 사용자가 오픈AI의 FBI 신고로 5월에 체포, 10만 달러 보석금으로 석방됐다. 범죄 실행 전 차단이라는 순기능과 '저지르지 않은 일'로 체포되는 것의 타당성 논쟁이 함께 소개됐다.
  9. 챗GPT 프로 한도 리셋 유료화 루머: 월 200달러 요금제에서 사용량 리셋을 80달러에 판매한다는 스크린샷이 화제가 됐다(진위 미확인으로 소개).
  10. 앤트로픽 리만 가설 진전: 미출시 연구용 클로드가 리만 가설의 영점 비율 하한을 인간의 41.6%에서 67.2%로 끌어올렸다(100만 달러 현상금이 걸린 난제로 가설 자체는 미해결).
  11. 앤트로픽 워터마크 도입: AI 법 준수를 위해 텍스트 출력에 단어 선택 확률을 미세 조정하는 방식의 워터마크를 넣는다고 공개했다. 품질에는 영향이 없다고 설명했으나 사용자 반발과 구독 취소, 오픈소스 워터마크 제거 도구 등장으로 이어졌다.
  12. 다리오 아모데이 아내 관련 논란: 앤트로픽 비공식 조언자인 애나 카미유 클라크가 제프리 엡스타인의 유죄 판결 이후에도 사업 투자를 요청했다는 사실이 월스트리트저널 보도로 알려져, 안전·윤리를 강조해온 앤트로픽의 이미지에 타격을 줬다(IPO를 앞둔 시점이라 더 주목받음).
  13. 프론티어 모델 추론 과정 유출 취약점: "Stealing Reasoning Traces via LLM API"라는 논문에서, 서버에만 있어야 할 암호화된 추론 데이터 일부가 사용자 기기까지 전달되는 구조의 취약점을 이용해, 상위 모델의 암호화된 추론을 하위(보안이 약한) 모델에 전달해 해독하는 방식으로 오픈AI·앤트로픽·구글 제미나이의 숨겨진 사고 과정을 추출했다고 밝혔다.
  14. 제미나이 3.7 플래시 공개: 3.6 플래시 이후 3주 만에 출시. GPT-5.6 테라급 점수를 기록했고, 가성비(저렴한 가격+속도)가 강점으로 소개됐다. 연말까지 반값 프로모션 중.
  15. 구글 제미나이 점유율: 채팅 기반 일상 사용에서 국내 네이버 검색 이용자 수를 넘어섰다고 소개됐다.
  16. 구글 딥마인드 수화 인식 AI: 수화 동작을 실시간으로 텍스트로 변환하는 모델을 공개했다.
  17. 오픈웨이트 모델 대량 공개: 큐엔(Qwen) 3.8(27B)이 오퍼스 4.6 맥스를 앞서는 성능으로 오픈웨이트 공개(2비트 양자화 시 11~13GB VRAM으로 구동 가능), 딥시크 V4 프로 및 전용 하네스 오픈소스 공개, 메타 뮤즈 글리머(30B, 기대만큼 주목받지 못함), Zai GLM 5.3(터미널 벤치 등에서 대폭 개선), 엔비디아 네모트론 3.5 라이트닝 및 라우터 모델 네모 스위치 아르드가 잇따라 발표됐다.
  18. 한국 독자 파운데이션 모델(독파모): 모티프(Motif)가 국가별 오픈웨이트 순위에서 글로벌 2위(47점대)에 올랐다는 소식과, 업스테이지 솔라 프로 4 공개 소식이 소개됐다.
  19. 영상·음악·음성 생성 모델: LTX 2.5(오픈웨이트 영상 생성, 멀티샷·네이티브 4K HDR 지원), 미니맥스 뮤직 3(2B 파라미터의 오픈웨이트 음악 생성, 상업적 사용 허용), 수노 스튜디오 2.0(DAW형 음악 제작 도구), 샤오미 미대싱 LM(복합 음향 장면 생성), 인덱스 TTS 2.5(감정 표현·목소리 복제 특화)가 소개됐다.
  20. 로봇/하드웨어: 테슬라가 이달 중 공중부양 로드스터 시연을 예고했고(스페이스X 냉각가스 추진기 적용, 트랙 전용 초고가 모델), 다이나로보틱스가 100만 시간 인간 행동 비디오로 학습한 세계 행동 모델 '다이나 2'를 공개해 로봇 행동에서도 스케일링 법칙이 확인됐다고 밝혔다.
  21. 조코 헌트 이번 주 1등: 바이브 코딩 서비스의 다운타임을 모니터링해 주는 '바이브 펄스'가 선정됐다.

03기술적 맥락

이번 주 소식의 배경에는 몇 가지 축이 있다. 첫째, XAI(그록)가 최근 커서(Cursor) 인수를 완료하면서 코딩 벤치마크가 개선된 것으로 추정되며, 아티피셜 아날리시스라는 제3자 벤치마크 사이트가 모델 간 성능·가격 비교의 표준 참조점으로 반복 인용된다. 둘째, '오픈웨이트'(가중치를 공개해 누구나 다운로드해 로컬 구동할 수 있는 모델) 진영이 큐엔(알리바바), 딥시크, GLM(Zai), 네모트론(엔비디아), 모티프(한국) 등 다수 주체로 확장되며 폐쇄형 프론티어 모델과의 성능 격차를 빠르게 좁히고 있다. 셋째, 추론 모델의 '숨겨진 사고 과정(Chain of Thought)'은 지금까지 서버 내부에만 보관되는 것이 원칙이었으나, 클라이언트 전달 과정의 암호화 취약점이 이번에 학술적으로 드러났다. 넷째, 텍스트 워터마킹은 이미지·영상에 쓰이던 기법을 텍스트 토큰 확률 조정 방식으로 옮긴 것으로, AI 생성물 표시를 요구하는 각국 AI 법 대응 차원에서 도입되고 있다.

04전략적 의미

그록의 약진과 오픈웨이트 모델의 폭발적 성능 향상은 폐쇄형 프론티어 3사(오픈AI·앤트로픽·구글)의 독점적 우위가 흔들리고 있음을 보여준다. 특히 27B급 오픈웨이트 모델이 소비자 GPU에서 구동되면서도 한때 최강이던 유료 모델을 넘어서는 사례는, 로컬 AI 생태계와 기업의 자체 인프라 투자 유인을 동시에 키운다. 앤트로픽의 워터마크 도입과 그에 따른 반발은 AI 생성물 규제(각국 AI 법)와 사용자 신뢰 사이의 긴장을 보여주는 사례이며, 동시에 오픈소스 제거 도구가 즉시 등장한 것은 워터마킹 자체의 실효성 한계를 시사한다. 챗GPT의 FBI 신고 사건은 AI 사업자가 콘텐츠 모더레이션을 넘어 실질적 치안 개입자로 기능할 수 있음을 보여주는 선례로, 프라이버시·적법절차 논쟁과 함께 로컬(오프라인) 모델 수요를 자극할 요인으로 언급됐다. 프론티어 모델의 추론 과정 유출 취약점은 경쟁사(특히 중국 모델 진영)가 지식 증류(distillation) 방식으로 격차를 좁혀온 배경을 설명하는 단서로 제시됐다. 한국의 모티프가 글로벌 오픈웨이트 2위에 오른 것은 독자 파운데이션 모델(독파모) 프로젝트의 성과가 가시화되고 있음을 보여준다.

05현황 및 핵심 소식 정리

이번 주는 특히 신모델 발표 밀도가 높았던 한 주로 소개됐다. 폐쇄형 진영에서는 그록 4.6, 제미나이 3.7 플래시, 오픈AI의 컴퓨터 히스토리·울트라패스트 기능이 나왔고, 오픈웨이트 진영에서는 큐엔 3.8, 딥시크 V4 프로, GLM 5.3, 메타 뮤즈 글리머, 엔비디아 네모트론 3.5가 동시다발적으로 쏟아졌다. 미디어 생성 쪽에서도 LTX 2.5(영상), 미니맥스 뮤직 3(음악), 수노 스튜디오 2.0, 샤오미 미대싱 LM, 인덱스 TTS 2.5 등 신제품이 이어졌다. 한국 독파모 2차 평가 결과가 이번 주 중 발표될 예정이라고 언급됐으며, 모티프의 글로벌 순위 상승이 그 성과의 일부로 소개됐다.

06활용 시나리오

  1. 로컬 AI 인프라 구축: 소비자용 GPU(예: RTX 5090, VRAM 17GB 이상)로 큐엔 3.8(27B)을 돌리면 검열 해제(언센서드) 버전까지 포함해 오퍼스 4.6급 코딩·에이전트 성능을 무료로 활용할 수 있다. 개발자나 소규모 팀이 API 비용 없이 고성능 코딩 어시스턴트를 구축하려 할 때 검토할 만하다.
  2. 에이전트 기반 업무 자동화 도입: 맥미니 등 별도 서버 구매 없이 그록봇 구독만으로 브라우저·메일 조작형 에이전트를 운용할 수 있어, 서버 관리가 부담스러운 1인 사업자나 소규모 팀에 적합하다.
  3. 음악·오디오 콘텐츠 제작 비용 절감: 미니맥스 뮤직 3(2B, 상업적 사용 허용)를 로컬에 다운받으면 수노 같은 유료 구독 없이 무제한 음악 생성이 가능해, 콘텐츠 크리에이터나 유튜버의 배경음악 제작에 활용할 수 있다.
  4. AI 생성 텍스트 판별 대응 전략 수립: 앤트로픽 워터마크 도입과 즉각적인 제거 도구 등장 사례는, 기업이 AI 생성 콘텐츠 정책을 세울 때 워터마킹만으로는 완전한 판별이 어렵다는 점을 감안해 설계해야 함을 시사한다.
  5. AI 대화 로그의 법적 리스크 인지: 챗GPT 신고 사건은 AI와의 대화가 향후 법적 증거로 활용될 수 있음을 보여주므로, 민감한 대화나 감정적 표현을 다룰 때 이 점을 고려할 필요가 있다.
  6. 더빙·보이스 콘텐츠 제작: 인덱스 TTS 2.5의 목소리 복제·감정 표현 기능을 활용하면 다국어 더빙이나 감정이 실린 내레이션 제작에 활용할 수 있다(단, 한국어는 아직 미지원).

07용어 사전

용어한줄설명비유/예시
오픈웨이트모델 가중치를 공개해 누구나 다운받아 로컬 구동 가능한 모델큐엔, 딥시크, GLM처럼 무료로 내려받는 소프트웨어
아티피셜 아날리시스AI 모델 성능·가격을 비교하는 제3자 벤치마크 사이트자동차 연비·성능을 비교하는 소비자 리포트
GDP발(GDPval)실무형 작업 수행 능력을 측정하는 벤치마크실제 업무 시험 성적표
체인 오브 소트(CoT)AI가 답을 내기 전 거치는 단계별 추론 과정수학 문제 풀 때 쓰는 풀이 과정
워터마크(텍스트)단어 선택 확률을 미세 조정해 AI 생성물임을 식별 가능하게 하는 기법지폐의 숨은 무늬처럼 티 안 나게 심는 표식
증류(디스틸레이션)큰 모델의 출력·추론을 작은 모델 학습에 활용하는 기법스승의 노하우를 제자가 베껴 배우는 것
리만 가설소수의 분포를 설명하는 수학계 최대 미해결 난제 중 하나100만 달러 현상금이 걸린 수학 퍼즐
스케일링 법칙데이터·컴퓨팅을 늘릴수록 성능이 예측 가능하게 좋아지는 경향공부량을 늘릴수록 성적이 오르는 패턴
세계 행동 모델(월드 액션 모델)인간 행동 영상을 학습해 로봇의 물리적 작업 수행을 익히는 모델요리 영상을 보고 요리를 따라 배우는 로봇
양자화모델 파라미터의 정밀도를 낮춰 용량과 메모리 요구량을 줄이는 기법고화질 영상을 압축해 저장 공간을 줄이는 것
하네스모델을 실제로 쓰기 좋게 감싸는 실행 도구·환경자동차 엔진(모델)을 감싸는 차체(도구)
독파모한국의 독자 파운데이션 모델(자체 개발 대형언어모델) 프로젝트국산 AI 모델 육성 프로젝트

08딥링크

  • 00:08 오프닝, 이번 주 AI 뉴스 다수 예고와 리만 가설 진전 예고
  • 10:26 그록봇 소개, 컴퓨터 한 대를 통째로 제공하는 에이전트 제품
  • 15:29 X 추천 알고리즘 오픈소스 공개와 정부 검열 방어 논리
  • 26:24 챗GPT 전 여자친구 위협 대화 신고, 사용자 체포 소식
  • 31:47 챗GPT 프로 한도 리셋 80달러 유료화 루머
  • 37:24 앤트로픽 워터마크 원리 설명(단어 확률 미세 조정)
  • 48:30 프론티어 모델 숨겨진 추론 과정 유출 취약점 논문 소개
  • 81:11 국가별 오픈웨이트 순위, 한국 모티프 글로벌 2위
  • 93:31 미니맥스 뮤직 3 데모, 오픈웨이트 음악 생성 시연
  • 105:24 테슬라 공중부양 로드스터 이달 중 시연 예고
조코딩 JoCoding · 2026-08-17
← 목록으로