조코딩이 실시간 라이브에서 이번 주 AI 업계 소식을 훑는다. 오픈AI 차세대 모델 '아스트라'의 비공개 테스트 소식부터, 앤트로픽의 사용량 한도 논란, 중국 오픈웨이트 모델 러시, 엔비디아의 허깅페이스 인수, 실시간 영상 생성까지 다룬다.
01오픈AI — 아스트라와 'AGI 연내 달성' 발언
오픈AI 차세대 모델 아스트라(내부 코드명 '울티마 알파')가 비공개 테스터들에게 풀리며 성능이 화제 — 원샷 프롬프트로 만든 GTA 1 클론, 고퀄리티 3D 우주선·게임 에셋 생성 데모가 공유됐다. GPT 이미지 2와 함께 다음 주 공개 가능성이 거론된다.
비공개 프리뷰를 접한 사용자는 "의미 있는 방식으로 새로운 것을 스스로 발명해내는 최초의 모델"이라며, 수학 증명을 위해 여러 에이전트를 조율하고 며칠~몇 주간 연속 작업이 가능하도록 설계됐다고 전했다.
샘 알트먼이 타임지 인터뷰에서 "올해 안에 내부적으로 AGI라 부를 수 있는 시스템을 구축하게 될 것"이라며 연내 AGI 도달을 공개 언급 — IPO를 앞둔 시점의 발언이라 다소 과장 논란도 있다.
오픈AI가 브로드컴과 공동 설계한 추론 전용 칩 '할라피뇨'가 초기 A0 실리콘만으로 엔비디아 블랙웰 대비 전력당 처리량이 앞섰고, 차세대 루빈 칩의 공개 스펙도 넘어섰다는 세미어낼리시스 분석이 나왔다.
ChatGPT 예약 작업이 이벤트 기반으로 확장 — 슬랙·Gmail·깃허브에서 특정 이벤트가 발생하면 자동 실행되도록 설정 가능해졌고, 무료 사용자도 최대 3개까지 예약 작업을 쓸 수 있게 됐다.
02앤트로픽 — '25% 인상'이라 발표했지만 실질은 17% 감소
클로드 코드의 프로/맥스/팀 및 엔터프라이즈 플랜 사용량 한도가 9월 14일부터 "25% 인상"된다고 공지했지만, 실제로는 이벤트 기간 중 50% 증가했던 한도가 9월 14일부터 줄어드는 것이어서 결과적으로 현재 대비 약 17% 감소 — 개발자들의 반발을 샀다.
같은 시점 오픈AI는 코덱스·워크 유료 사용량을 리셋하고 버그 수정으로 동일 할당량이 10~50% 더 오래 지속되도록 개선한다고 발표하며 대조적인 행보를 보였다.
클로드 페이블 5 사용자 일부가 간헐적으로 '페이블 5.1'로 라우팅되는 현상이 포착돼, 정식 출시 전 A/B 테스트가 진행 중인 것으로 추정된다.
03오픈웨이트 모델 러시 — 중국이 프론티어를 바짝 추격
지난주 화제였던 미지의 'OX 알파' 모델의 정체가 GLM 5.3 플래시(액티브 파라미터 18B)로 밝혀졌다 — 작은 크기에도 오퍼스 4.8·GPT 5.6 테라급과 견줄 종합 점수(57점)를 기록, 제미나이 3.7 플래시를 넘어섰다. GLM 5.3 풀버전(753B)도 오픈웨이트로 공개돼 키미 K3·그록 5.6급 성능을 보인다.
GLM 5.3 플래시는 1비트 양자화 시 100GB 미만 VRAM으로 맥북(128GB)이나 DGX 스파크에서도 구동 가능하며, 오픈웨이트 특성상 무검열(언센서드) 버전이 함께 풀린다.
텐센트의 후위(Hunyuan) HY4 프리뷰(770B, 액티브 49B)가 공개돼 오퍼스 5급 성능을 보였고, 알리바바는 쿠엔4 아키텍처의 프리뷰인 쿠엔 3.8 플래시 넥스트(180B)를 미리 공개했다.
GLM 5.3 플래시는 오픈라우터 무료 트래픽 1위를 기록했는데, 이 모든 트래픽이 중국산 AI 칩에서 처리됐다는 점이 화제 — 하루 100조 토큰을 처리할 추론 인프라를 갖췄다는 의미다.
딥시크는 올 1~7월 API 매출 약 970억 원(매출총이익률 82.9%)을 기록해 오픈웨이트 공개가 손해 보는 장사가 아니라는 인식을 보여줬다(7개월 만에 10배 증가).
04엔비디아, 허깅페이스를 18조 원에 인수
오픈웨이트 모델 배포의 핵심 허브인 허깅페이스를 엔비디아가 인수 — 허깅페이스의 '다이렉트 디플로이' 기능으로 신규 공개 모델을 곧바로 GPU에 얹어 유료로 서비스할 수 있는 구조를 엔비디아가 흡수하게 됐다. 기존 엔비디아 API 서비스(build.nvidia.com)의 낮은 인지도를 허깅페이스의 트래픽으로 보완하려는 전략으로 풀이된다.
05구글 — 제미나이 옴니 1.1 & 광고 자동화
제미나이 옴니 1.1 플래시가 출시 — 이전 영상 최대 10초를 분석해 캐릭터·조명·서사 맥락을 유지한 채 자연스럽게 이어 찍는 기능, 360p 프리뷰 후 4K 업스케일 지원이 특징.
구글 애즈에 옴니 기반 '셋 스튜디오'가 통합돼 브랜드 소재 기획부터 광고 영상 제작, 유튜브/구글 캠페인 송출까지 한 번에 처리할 수 있게 됐다.
제미나이 3.8 플래시 프리뷰를 일부 구글 직원이 사용 중이라는 보도가 나와, 오픈AI·앤트로픽을 따라잡기 위한 잦은 모델 업데이트 기조가 이어질 전망이다.
06xAI/그록 — 컴패니언 분리, 오픈AI와 결별, 쇼핑 에이전트
그록의 AI 컴패니언 캐릭터(애니 등)가 9월 1일부로 별도 서비스 '애니메이츠'로 이전 — 성인 콘텐츠·중독 등 리스크를 그록 본체에서 분리하려는 조치로 해석된다.
스페이스X에 인수된 코딩 툴 커서가 11월 12일부로 오픈AI 모델 공식 지원을 종료 — 일론 머스크가 과거 xAI의 오픈AI 데이터 증류(약관 위반) 사실을 인정한 바 있어, 오픈AI 측의 데이터 유출 우려가 배경으로 지목된다.
그록봇이 스트라이프 링크 연동으로 인터넷 쇼핑 결제를 대신 수행할 수 있게 됐고(미국 사용자 대상), 음성 통화 기능도 곧 추가될 예정. 한편 그록봇 소스코드가 소스맵 설정 실수로 깃허브에 노출되는 사고도 있었다(수노 AI도 별도로 유튜브 뮤직 크롤링 등 학습 데이터 파이프라인이 유출).
07영상 생성 — '시청 속도보다 생성 속도가 빨라졌다'
오픈웨이트 영상모델 미니맥스 H3를 기반으로 각 업체가 속도를 끌어올리면서 실시간을 넘어선 영상 생성이 가능해졌다 — 팔(Fal) AI의 H3맥스는 5초 영상을 평균 3.49초(경우에 따라 2.5~3초)에 생성, B200 GPU 4장이면 15초 영상을 13초 만에 뽑아 시청 속도보다 빠른 무한 스트리밍이 가능하다.
실시간 채팅 입력을 받아 영상을 계속 생성해 트위치로 스트리밍하는 '인피니티 슬롭' 같은 실험 서비스가 등장했고, 발표자가 직접 데모에서 프롬프트만으로 2~3초 만에 인물 영상을 생성하는 모습을 시연했다(검열 수준이 낮다는 점도 확인됨).
이는 24시간 AI 버튜버·AI 방송국처럼 무제한 실시간 콘텐츠 생성 인프라가 현실화되는 신호로 언급됐다.
08시사점
오픈AI·앤트로픽·구글의 프론티어 모델 경쟁과 별개로, 중국 오픈웨이트 모델들이 몇 주 단위로 격차를 좁히며 GPU 인프라까지 자립하는 모습을 보이고 있어 오픈소스 생태계의 무게중심이 빠르게 이동하고 있다.
영상 생성이 시청 속도를 추월한 지금, 실시간 개인화 콘텐츠·AI 방송이 조만간 상용화 단계에 진입할 가능성이 커 보인다.