01핵심 개요
조코딩 채널의 주간 AI 뉴스 브리핑. 정체불명 모델 ox-alpha의 벤치마크 논란부터 오픈AI의 안전성 이유 RL 훈련 일시 중지, 앤트로픽 Mythos 5(밑소스5) 보안 스캔 공개, 모더나의 AI 설계 맞춤 암 백신 임상 3상 성공, 한국 독자 파운데이션 모델(독파몬) 선정 논란, 살아있는 인간 뉴런으로 작동하는 생물학적 데이터센터, 로봇 올림픽에서 인간 세계기록을 넘어선 휴머노이드 달리기까지 폭넓은 주제를 다룬다.
| 항목 | 내용 |
|---|---|
| 채널 | 조코딩 JoCoding |
| 발행 성격 | 주간 AI 뉴스 요약(토픽 나열형) |
| 주요 토픽 수 | 약 30개(모델/인프라/바이오/로보틱스/커뮤니티 프로젝트) |
| 핵심 화두 | 모델 성능 경쟁 과열, 안전성 우려, 로컬/오픈웨이트 확산, AI-바이오 융합, 휴머노이드 로봇 급성장 |
| 영상 링크 | https://youtu.be/i1FoKc5X4_8 |
02핵심 기능/내용 구조
이번 영상은 8개 뉴스 클러스터로 나눌 수 있다.
- ① 모델 출시/성능 경쟁: 정체불명 ox-alpha 등장과 벤치마크 논란, GLM/제미나이 추정설
- ② 빅테크 정책·가격 변화: 오픈AI RL 훈련 중지, GPT-5.6 가격 인하, 코덱스 컨텍스트 설정법, 스트라이프의 오픈라우터 인수
- ③ 앤트로픽 생태계: Mythos 5(코드명 밑소스5) 보안 스캔 공개, 클로드 아카데미, 내부 스킬 "5(파이브)"
- ④ 오픈웨이트/로컬 AI: 딥시크 V4 플래시 비전, 알리바바 Qwen 3.8(언센서드), 미니맥스 H3, 센스노바 이미지 모델
- ⑤ 하드웨어/인프라: 셀레브라스 CS4 칩, 탈라스 온칩 모델, 프리토큰(적응형 CPU/GPU 실행)
- ⑥ 바이오·헬스: 모더나 맞춤 암 백신 임상 3상, 자동 채혈 기계, 생물학적 데이터센터(인간 뉴런)
- ⑦ 로보틱스: 젠 1.5 원샷 학습 로봇, 유비테크 휴머노이드, 2026 월드 휴머노이드 로봇 게임스
- ⑧ 한국/커뮤니티: 독파몬(독자 파운데이션 모델) 선정 논란, 조코딩 바이브코딩 주간 1등 프로젝트
03기술적 맥락
- ox-alpha: 오픈라우터에 무료로 공개된 정체불명 스텔스 모델. 1백만 토큰 컨텍스트, 텍스트·이미지·비디오 입력 지원. 소프트웨어 엔지니어링 벤치마크(SWE 계열 추정)에서 초기 80% 보고 후 재실행 시 63%로 정정. 참고로 GPT-5.6 Sol 52%, "페이블(Fable, Claude 계열 최신 모델 추정)" 65% 대비 준수한 성능. 시스템 프롬프트·토크나이저 유사성으로 ZAI(GLM 계열)의 차기 모델 또는 구글 제미나이 신모델이라는 두 가지 추정이 나옴 (https://youtu.be/i1FoKc5X4_8&t=0s).
- 오픈AI RL 훈련 일시 중지: 샘 알트먼이 "새로운 수준의 역량에 맞는 정렬·보안·모니터링 기준"을 이유로 일부 프론티어 모델의 강화학습(RL) 훈련을 중단했다고 발표. 최근 모델이 수학적 발견을 해내는 등 성능이 급격히 올라간 데 따른 안전 조치로 해석됨. 대신 GPT-5.6 Sol 가격은 입력 20%, 출력 33% 인하(프로모션은 2026년 11월 21일까지) (https://youtu.be/i1FoKc5X4_8&t=234s).
- 코덱스 100만 토큰 컨텍스트 활성화: 기본값은 컨텍스트가 다 차기 전에 자동 압축되도록 설정되어 있음. config.toml에 GPT-5.6 Sol 모델의 컨텍스트 윈도우 값을 명시적으로 늘려야 100만 토큰을 온전히 사용 가능. 단, 상시 최대치 사용이 항상 유리한 것은 아니며 중간 압축이 성능에 더 나을 수 있음 (https://youtu.be/i1FoKc5X4_8&t=308s).
- Mythos 5(밑소스5) 공개: 기존 보안 문제로 제한됐던 모델이 클로드 시큐리티 스캔(보안 취약점 스캐닝 기능)을 통해 엔터프라이즈 고객 대상 공개 베타로 풀림. 기존엔 대형 IT 기업 위주로만 접근 가능했음.
- 엔비디아 ARC-AGI-3 100점: 인간에게는 쉽지만 AI에게는 어려운 퍼즐 벤치마크 ARC-AGI를, 엔비디아가 설계한 에이전트 검증 루프("하네스") A4 아키텍처 위에 Claude Opus 5를 얹어 100% 달성. 모델 자체 지능이 아니라 하네스(작업 설계) 최적화만으로 만점이 가능함을 보여준 사례 (https://youtu.be/i1FoKc5X4_8&t=612s).
- 프리토큰(FreeToken) 실험(UC버클리·MIT): 딥시크 V4 플래시(248B) 모델을 RTX 5090에서 초당 25토큰으로 구동, 8GB급 RTX 4060 노트북에서도 Qwen 3.6 35B를 초당 39토큰으로 구동 성공. 원리는 "대역폭 적응형 CPU-GPU 실행"으로, 자주 쓰는 부분만 GPU VRAM 캐시에 두고 나머지는 CPU D램에 배치해 처리. 기존 올라마(Ollama) 대비 2~4배 빠름 (https://youtu.be/i1FoKc5X4_8&t=1005s).
- 셀레브라스 CS4 / 탈라스: CS4는 웨이퍼 전체를 깎지 않고 하나의 단일 칩으로 사용하는 추론 특화 칩으로, GPU 대비 최대 30배, 전작 CS3 대비 와트당 최대 10배 효율. 탈라스는 모델 가중치를 아예 실리콘에 새겨 넣어 모델 로딩 과정 자체를 없앤 AI 칩(AMD가 인수). 실직한 엔지니어 한 명이 6개월간 특허를 분해해 허깅페이스 체크포인트를 양자화·온칩화하는 과정을 독자 구현한 사례가 소개됨 (https://youtu.be/i1FoKc5X4_8&t=1087s).
- 생물학적 데이터센터: 코티칼 랩스(Cortical Labs)가 1,600만 개의 살아있는 인간 뉴런을 실리콘 하드웨어에 통합한 프로토타입 공개. 이 뉴런 기반 연산으로 게임(둠)을 플레이하는 시연 영상 존재. 소비 전력 약 25~30W로, 수십 KW를 소비하는 기존 AI 인프라 대비 압도적으로 낮음 (https://youtu.be/i1FoKc5X4_8&t=1314s).
04전략적 의미
- 인수합병으로 본 인프라 가치: 결제 스타트업 스트라이프가 "단순 라우팅 래퍼"인 오픈라우터를 약 10조원(70억 달러 이상)에 인수. 오픈라우터의 추론 처리량은 설립 이후 매년 최소 10배씩 성장 중으로, 모델 자체보다 "여러 모델을 손쉽게 연결해주는 어그리게이터 계층"의 가치가 폭발적으로 커지고 있음을 시사.
- 안전성과 속도의 긴장: 오픈AI가 최신 모델의 RL 훈련을 스스로 중단한 것은, 모델 능력이 예상보다 빠르게 올라가는 상황에서 정렬·모니터링 체계가 따라가지 못한다는 업계 전반의 우려를 보여주는 신호.
- 오픈웨이트·로컬화의 가속: 딥시크 V4 플래시 비전(API 성능이 Claude Opus 4.8급을 상회), 알리바바 Qwen 3.8 언센서드(검열 없는 오픈웨이트), 센스노바 이미지 모델 등 오픈웨이트 모델이 클로즈드 프론티어 모델을 빠르게 추격. 동시에 언센서드 모델은 생물무기·마약 등 위험 정보까지 응답하는 문제를 노출해 오픈웨이트 확산의 양면성을 드러냄 (https://youtu.be/i1FoKc5X4_8&t=690s).
- 하네스/도구 설계가 지능만큼 중요: 엔비디아 ARC-AGI-3 100점 사례는 "모델 지능이 정체되어도 작업별 하네스 설계만 잘하면 성능을 끌어올릴 수 있다"는 관점을 뒷받침. 향후 경쟁 축이 순수 모델 스케일링에서 에이전트 워크플로우 설계로 이동할 가능성.
- AI-바이오 융합의 실질적 성과: 모더나 맞춤 암 백신의 임상 3상 성공은 AI가 신약개발을 가속하는 첫 대형 실증 사례 중 하나로, 2027년경 상용화 가능성이 언급됨.
- 한국 AI 정책의 신뢰성 이슈: 독파몬(독자 파운데이션 모델) 선정에서 벤치마크 최고점 모델(모티프3, 47점)이 탈락하고 업스테이지·SKT·LG 3사가 선정되며 "대기업 밀어주기" 논란 발생. 평가에서 객관적 벤치마크 비중이 40%에 불과해 평가 기준의 투명성 문제가 제기됨 (https://youtu.be/i1FoKc5X4_8&t=1163s).
05핵심 워크플로우·방법론 (영상에서 소개된 실전 팁)
- 코덱스 100만 컨텍스트 활성화: config.toml 파일을 열어 GPT-5.6 Sol 모델의 컨텍스트 윈도우 값을 늘려 등록 → 기본 자동 압축 없이 최대 컨텍스트 사용 가능.
- 미니맥스 H3로 게임 스프라이트 제작: ① 캐릭터 생성 → ② 걷기/점프/펀치/킥/블록 등 동작을 5초 클립 영상으로 생성 → ③ 각 클립을 프레임별로 잘라 포즈 추출 → ④ 스프라이트로 연결해 게임 애니메이션 완성. GPU만 있으면 무료로 로컬 실행 가능.
- 컴피 MCP(ComfyMCP) 로컬 설치: 기존엔 컴피 클라우드 또는 CLI로만 로컬 GPU 연동이 가능했으나, 이제 공식 MCP로 클로드 코드·코덱스에 명령어 한 줄만 붙여넣으면 워크플로우까지 자동 설치·연동됨.
- 탈라스 온칩 모델 구현 재현: 허깅페이스에서 모델 체크포인트를 가져와 양자화 후 칩에 새길 수 있는 형태로 변환하는 과정을 개인이 독자 구현(원 특허를 6개월간 분해).
06활용 시나리오
- 개발자 - 무료 프론티어급 코딩 모델 체험: 오픈라우터에서 ox-alpha를 무료로 사용해 복잡한 소프트웨어 엔지니어링 작업(에이전틱 코딩)을 테스트해볼 수 있음. 코덱스 사용자는 config.toml 설정으로 100만 토큰 컨텍스트를 활용해 대규모 코드베이스 작업 가능.
- 인디 게임 개발자 - 저비용 애니메이션 제작: 미니맥스 H3(무료 오픈웨이트)로 캐릭터 동작 영상을 생성하고 프레임을 잘라 스프라이트 시트를 만들면, 별도 애니메이터 없이 2D 게임 캐릭터 애니메이션 제작 가능.
- 마케터 - X 광고 자동 운영: X 광고 관리 MCP를 연결하면 "미국 대상으로 얼마 예산으로 광고 돌려줘" 같은 자연어 지시만으로 AI 에이전트가 타겟팅부터 캠페인 집행까지 대행. 마케팅 전문 지식이 없어도 운영 가능 (https://youtu.be/i1FoKc5X4_8&t=533s).
- 보안 연구자 - 로컬 취약점 진단: Qwen 3.8 언센서드 같은 오픈웨이트 모델을 로컬(맥북 등)에서 구동해, 클로드 코드·코덱스가 정책상 다루지 못하는 네트워크 보안 취약점 분석 등에 활용 가능(단, 오남용 소지도 동시에 존재).
- 1인 창업가 - 바이브 코딩으로 서비스 제작: 조코딩 커뮤니티 사례처럼 전화번호 없이 초대·수락만으로 대화하는 익명 톡 서비스, 그리스 신화 기반 심리테스트, 사진 1장으로 카톡 이모티콘 15종을 만드는 서비스 등을 바이브 코딩으로 직접 제작해볼 수 있음.
07현황 및 전망
- ox-alpha는 재실행 후 63%로 성능이 정정됐지만 여전히 준프론티어급으로, 정체가 ZAI(GLM) 신모델인지 구글 제미나이 신모델인지는 미확정 상태. 구글은 최근 제미나이 관련 하입성 발언을 반복하고 있어 제미나이4 출시 임박 정황으로 해석되는 분위기.
- 오픈AI는 RL 훈련 일시 중지 이후 "천천히 출시"할 것이라는 전망이 나오는 한편, GPT-5.6 Sol 가격 인하(프로모션 2026년 11월 21일까지)로 당분간 저렴하게 사용 가능.
- 오픈AI 개발자 행사 데브데이(DevDay)는 2026년 9월 29일 샌프란시스코에서 개최되며, 한국판 "데브데이 익스체인지"는 10월 22일 서울에서 열림(신청 마감 9월 4일) (https://youtu.be/i1FoKc5X4_8&t=380s).
- 로보틱스 분야는 1년 사이 극적으로 발전: 2026 월드 휴머노이드 로봇 게임스(66개 팀 참가)에서 휴머노이드 로봇 달리기 기록이 9.3초대로 우사인 볼트의 인간 세계기록을 앞질렀고, 유닛트리 로봇은 2m 높이 점프와 축구까지 수행. 작년(2025년) 영상 속 아장아장 걷던 로봇과 비교하면 1년 만의 격차가 크다고 평가됨 (https://youtu.be/i1FoKc5X4_8&t=1401s).
- 생물학적 데이터센터, 4D 영상 생성(4D니), 날아다니는 변신 휴머노이드 로봇 등은 아직 프로토타입·연구 단계이나 오픈소스로 모델이 공개된 사례(4D니)도 있어 직접 실험이 가능.
- 모더나 맞춤 암 백신은 1인당 비용이 1억원 이상으로 고가이나, AI가 유전자 판독·암세포 표지 선별 과정을 단축시켜 비용을 낮추는 역할을 하고 있으며 2027년경 상용화 약이 나올 수 있다는 전망이 제시됨.
08용어 사전
| 용어 | 한줄설명 | 비유·예시 |
|---|---|---|
| ox-alpha | 오픈라우터에 무료 공개된 정체불명 프론티어 모델 | 택배 상자에 발신자 이름이 없는 것과 비슷 |
| 오픈라우터(OpenRouter) | 여러 AI 모델을 API 하나로 호출·분배해주는 중개 서비스 | 여러 통신사를 하나로 묶어주는 알뜰폰 허브 |
| RL(강화학습) 훈련 | 모델이 시행착오로 보상을 받으며 능력을 키우는 훈련 단계 | 게임에서 클리어할 때마다 실력이 느는 과정 |
| Mythos 5(밑소스5) | 보안 문제로 제한됐던 앤트로픽의 모델/기능, 이번에 베타 개방 | 출입 제한이 풀린 특별 연구실 |
| 클로드 시큐리티 스캔 | 코드 보안 취약점을 자동 검사하는 클로드 기능 | 건물 화재 점검을 자동으로 돌리는 것 |
| ARC-AGI-3 | 인간은 쉽고 AI는 어려운 퍼즐로 범용지능을 재는 벤치마크 | 사람에겐 쉬운 숨은그림찾기, AI에겐 고난도 시험 |
| 하네스(harness) | 모델을 감싸 작업을 반복·검증시키는 에이전트 운용 틀 | 말을 부리는 마구(고삐)처럼 모델의 힘을 방향 짓는 장치 |
| 언센서드(uncensored) 모델 | 안전 필터를 제거해 제한 없이 답하는 오픈웨이트 모델 | 검열 없는 백과사전, 위험 정보도 그대로 알려줌 |
| 프리토큰(FreeToken) | CPU와 GPU 메모리를 함께 써서 큰 모델을 저사양에서 돌리는 기법 | 냉장고와 창고를 같이 써서 좁은 부엌에서도 큰 요리를 하는 것 |
| 웨이퍼 스케일 칩(CS4) | 반도체 원판 전체를 하나의 칩으로 쓰는 초대형 추론 칩 | 피자를 조각내지 않고 통째로 굽는 초대형 오븐 |
| 온칩(on-chip) 모델(탈라스) | 모델 가중치를 칩에 물리적으로 새겨 로딩 없이 즉시 구동 | 책 내용을 통째로 외운 사람처럼 펼쳐볼 필요가 없는 것 |
| 독파몬 | 한국 정부의 "독자 파운데이션 모델" 지원사업 줄임말 | 국산 AI 모델 육성을 위한 국가대표 선발전 |
| 생물학적 데이터센터 | 살아있는 인간 뉴런으로 연산을 수행하는 하드웨어 | 실리콘 대신 진짜 뇌세포로 만든 컴퓨터 |
| 원샷 학습(젠 1.5) | 로봇이 사람의 시연 단 한 번만 보고 그대로 따라 하는 능력 | 요리를 한 번 본 것만으로 똑같이 만드는 것 |
