01OpenAI의 탈엔비디아 행보 — 할라피뇨 칩
- OpenAI가 엔비디아 의존도를 줄이기 위해 개발 중인 자체 추론칩 '할라피뇨'의 첫 성과를 공개 — 오픈웨이트 모델 기준 성능이 최대 104배 향상됐다고 주장(검증 가능성이 높은 공개 모델로 테스트).
- 다만 GPT-5.6은 OpenAI 클라우드에서만 구동돼 타 칩에서 검증 불가 — 세레브라스와의 협력에 이어 자체 칩까지, 학습이 아닌 '추론' 영역에서 엔비디아를 대체하려는 움직임으로 해석.
02엔비디아의 허깅페이스 인수설(미확인)
- 엔비디아가 허깅페이스(오픈웨이트 모델의 '깃허브'이자 GPU 대여 플랫폼) 인수에 합의했다는 정보 — 영상 녹화 시점 기준 양사 공식 발표는 없는 루머 단계.
- 해석: OpenAI·메타(자체칩)·구글(TPU) 등 대형 AI사들이 스택을 자체 소유하며 엔비디아 학습칩 매출이 잠식될 수 있는 상황에서, 오픈웨이트 모델 확산에 베팅해 허깅페이스를 통한 추론 컴퓨팅 지배력을 확보하려는 포석.
- Vercel CEO 공개 데이터: AI 게이트웨이 토큰 사용량 기준 오픈웨이트 모델 비중이 2개월 전 28.4%에서 최근 62%로 급증(단, 요청 건수 기준으로는 여전히 폐쇄형 모델이 62%로 우세 — 토큰량과 요청량 지표가 다른 그림을 보여줌).
03애플 M5 Ultra 공개
4.5배M5 Ultra의 AI 처리 성능(M3 Ultra 대비)
512GB최대 통합메모리(대부분 AI 모델 VRAM으로 활용 가능)
약 1.1만달러1TB 저장 256GB 메모리 구성 기준가(512GB가는 미공개)
- 로컬에서 GLM·딥시크·퀸 대형 모델 구동이 가능한 수준의 개인용 AI 컴퓨터가 현실화되고 있다는 점을 강조.
04신규 오픈웨이트 모델 — GLM 5.3 Flash·Qwen 3.8 Flash
- GLM 5.3 Flash(구 '옥스 알파'): 딥서치 벤치마크 63.4점으로 Opus 4.8보다 높고 제미니 3.7 플래시와 유사 — 인공분석 지능-비용 그래프상 클로드 오푸스5·페이블5·GPT-5.6 소울 등 다수 폐쇄형 모델보다 저렴하면서 성능이 앞서 "많은 모델을 사실상 무용지물로 만든" 출시로 평가.
- Qwen 3.8 Flash(1,250억 파라미터): 인공분석 지능점수 약 56점(GLM 5.3 Flash는 57점)으로 근접한 성능, 고성능 소비자 GPU에서 로컬 구동 가능.
05기타 — 구글 Gemini Omni 1.1 Flash·3.5 Transcribe
- 신규 비디오 모델 Gemini Omni 1.1 Flash가 텍스트→비디오 아레나 블라인드테스트에서 1위(이미지→비디오는 2위), 10초 컨텍스트 분석, 시작/종료 프레임 지정 애니메이션, 4K 업스케일 지원.
- 신규 음성인식 모델 Gemini 3.5 Transcribe도 함께 출시 — 자체 벤치마크 기준 타 앱 대비 높은 정확도를 주장, macOS Gemini 앱·Android 등에 순차 적용.
