조코딩MORNING DIGEST · 2026-08-31 · 조코딩 JoCoding🎬 영상

아스트라 임박, 할라피뇨 칩, GLM 5.3 오픈웨이트까지 — 이번 주 AI 뉴스 총정리

조코딩이 실시간 라이브에서 이번 주 AI 업계 소식을 훑는다. 오픈AI 차세대 모델 '아스트라'의 비공개 테스트 소식부터, 앤트로픽의 사용량 한도 논란, 중국 오픈웨이트 모델 러시, 엔비디아의 허깅페이스 인수, 실시간 영상 생성까지 다룬다.

인포그래픽 요약

01오픈AI — 아스트라와 'AGI 연내 달성' 발언

  • 오픈AI 차세대 모델 아스트라(내부 코드명 '울티마 알파')가 비공개 테스터들에게 풀리며 성능이 화제 — 원샷 프롬프트로 만든 GTA 1 클론, 고퀄리티 3D 우주선·게임 에셋 생성 데모가 공유됐다. GPT 이미지 2와 함께 다음 주 공개 가능성이 거론된다.
  • 비공개 프리뷰를 접한 사용자는 "의미 있는 방식으로 새로운 것을 스스로 발명해내는 최초의 모델"이라며, 수학 증명을 위해 여러 에이전트를 조율하고 며칠~몇 주간 연속 작업이 가능하도록 설계됐다고 전했다.
  • 샘 알트먼이 타임지 인터뷰에서 "올해 안에 내부적으로 AGI라 부를 수 있는 시스템을 구축하게 될 것"이라며 연내 AGI 도달을 공개 언급 — IPO를 앞둔 시점의 발언이라 다소 과장 논란도 있다.
  • 오픈AI가 브로드컴과 공동 설계한 추론 전용 칩 '할라피뇨'가 초기 A0 실리콘만으로 엔비디아 블랙웰 대비 전력당 처리량이 앞섰고, 차세대 루빈 칩의 공개 스펙도 넘어섰다는 세미어낼리시스 분석이 나왔다.
  • ChatGPT 예약 작업이 이벤트 기반으로 확장 — 슬랙·Gmail·깃허브에서 특정 이벤트가 발생하면 자동 실행되도록 설정 가능해졌고, 무료 사용자도 최대 3개까지 예약 작업을 쓸 수 있게 됐다.

02앤트로픽 — '25% 인상'이라 발표했지만 실질은 17% 감소

  • 클로드 코드의 프로/맥스/팀 및 엔터프라이즈 플랜 사용량 한도가 9월 14일부터 "25% 인상"된다고 공지했지만, 실제로는 이벤트 기간 중 50% 증가했던 한도가 9월 14일부터 줄어드는 것이어서 결과적으로 현재 대비 약 17% 감소 — 개발자들의 반발을 샀다.
  • 같은 시점 오픈AI는 코덱스·워크 유료 사용량을 리셋하고 버그 수정으로 동일 할당량이 10~50% 더 오래 지속되도록 개선한다고 발표하며 대조적인 행보를 보였다.
  • 클로드 페이블 5 사용자 일부가 간헐적으로 '페이블 5.1'로 라우팅되는 현상이 포착돼, 정식 출시 전 A/B 테스트가 진행 중인 것으로 추정된다.

03오픈웨이트 모델 러시 — 중국이 프론티어를 바짝 추격

  • 지난주 화제였던 미지의 'OX 알파' 모델의 정체가 GLM 5.3 플래시(액티브 파라미터 18B)로 밝혀졌다 — 작은 크기에도 오퍼스 4.8·GPT 5.6 테라급과 견줄 종합 점수(57점)를 기록, 제미나이 3.7 플래시를 넘어섰다. GLM 5.3 풀버전(753B)도 오픈웨이트로 공개돼 키미 K3·그록 5.6급 성능을 보인다.
  • GLM 5.3 플래시는 1비트 양자화 시 100GB 미만 VRAM으로 맥북(128GB)이나 DGX 스파크에서도 구동 가능하며, 오픈웨이트 특성상 무검열(언센서드) 버전이 함께 풀린다.
  • 텐센트의 후위(Hunyuan) HY4 프리뷰(770B, 액티브 49B)가 공개돼 오퍼스 5급 성능을 보였고, 알리바바는 쿠엔4 아키텍처의 프리뷰인 쿠엔 3.8 플래시 넥스트(180B)를 미리 공개했다.
  • GLM 5.3 플래시는 오픈라우터 무료 트래픽 1위를 기록했는데, 이 모든 트래픽이 중국산 AI 칩에서 처리됐다는 점이 화제 — 하루 100조 토큰을 처리할 추론 인프라를 갖췄다는 의미다.
  • 딥시크는 올 1~7월 API 매출 약 970억 원(매출총이익률 82.9%)을 기록해 오픈웨이트 공개가 손해 보는 장사가 아니라는 인식을 보여줬다(7개월 만에 10배 증가).

04엔비디아, 허깅페이스를 18조 원에 인수

  • 오픈웨이트 모델 배포의 핵심 허브인 허깅페이스를 엔비디아가 인수 — 허깅페이스의 '다이렉트 디플로이' 기능으로 신규 공개 모델을 곧바로 GPU에 얹어 유료로 서비스할 수 있는 구조를 엔비디아가 흡수하게 됐다. 기존 엔비디아 API 서비스(build.nvidia.com)의 낮은 인지도를 허깅페이스의 트래픽으로 보완하려는 전략으로 풀이된다.

05구글 — 제미나이 옴니 1.1 & 광고 자동화

  • 제미나이 옴니 1.1 플래시가 출시 — 이전 영상 최대 10초를 분석해 캐릭터·조명·서사 맥락을 유지한 채 자연스럽게 이어 찍는 기능, 360p 프리뷰 후 4K 업스케일 지원이 특징.
  • 구글 애즈에 옴니 기반 '셋 스튜디오'가 통합돼 브랜드 소재 기획부터 광고 영상 제작, 유튜브/구글 캠페인 송출까지 한 번에 처리할 수 있게 됐다.
  • 제미나이 3.8 플래시 프리뷰를 일부 구글 직원이 사용 중이라는 보도가 나와, 오픈AI·앤트로픽을 따라잡기 위한 잦은 모델 업데이트 기조가 이어질 전망이다.

06xAI/그록 — 컴패니언 분리, 오픈AI와 결별, 쇼핑 에이전트

  • 그록의 AI 컴패니언 캐릭터(애니 등)가 9월 1일부로 별도 서비스 '애니메이츠'로 이전 — 성인 콘텐츠·중독 등 리스크를 그록 본체에서 분리하려는 조치로 해석된다.
  • 스페이스X에 인수된 코딩 툴 커서가 11월 12일부로 오픈AI 모델 공식 지원을 종료 — 일론 머스크가 과거 xAI의 오픈AI 데이터 증류(약관 위반) 사실을 인정한 바 있어, 오픈AI 측의 데이터 유출 우려가 배경으로 지목된다.
  • 그록봇이 스트라이프 링크 연동으로 인터넷 쇼핑 결제를 대신 수행할 수 있게 됐고(미국 사용자 대상), 음성 통화 기능도 곧 추가될 예정. 한편 그록봇 소스코드가 소스맵 설정 실수로 깃허브에 노출되는 사고도 있었다(수노 AI도 별도로 유튜브 뮤직 크롤링 등 학습 데이터 파이프라인이 유출).

07영상 생성 — '시청 속도보다 생성 속도가 빨라졌다'

  • 오픈웨이트 영상모델 미니맥스 H3를 기반으로 각 업체가 속도를 끌어올리면서 실시간을 넘어선 영상 생성이 가능해졌다 — 팔(Fal) AI의 H3맥스는 5초 영상을 평균 3.49초(경우에 따라 2.5~3초)에 생성, B200 GPU 4장이면 15초 영상을 13초 만에 뽑아 시청 속도보다 빠른 무한 스트리밍이 가능하다.
  • 실시간 채팅 입력을 받아 영상을 계속 생성해 트위치로 스트리밍하는 '인피니티 슬롭' 같은 실험 서비스가 등장했고, 발표자가 직접 데모에서 프롬프트만으로 2~3초 만에 인물 영상을 생성하는 모습을 시연했다(검열 수준이 낮다는 점도 확인됨).
  • 이는 24시간 AI 버튜버·AI 방송국처럼 무제한 실시간 콘텐츠 생성 인프라가 현실화되는 신호로 언급됐다.

08시사점

  • 오픈AI·앤트로픽·구글의 프론티어 모델 경쟁과 별개로, 중국 오픈웨이트 모델들이 몇 주 단위로 격차를 좁히며 GPU 인프라까지 자립하는 모습을 보이고 있어 오픈소스 생태계의 무게중심이 빠르게 이동하고 있다.
  • 영상 생성이 시청 속도를 추월한 지금, 실시간 개인화 콘텐츠·AI 방송이 조만간 상용화 단계에 진입할 가능성이 커 보인다.
조코딩 · 2026-08-31
← 목록으로