
01핵심 개요
| 항목 | 내용 |
|---|
| 주제 | 2026년 8월 첫째 주 AI 업계 소식 총정리 (조코딩 주간 뉴스) |
| 뉴스 1 | 오픈AI 차세대 모델 '아스트라'가 인류가 10년 이상 못 푼 수학 난제 10개를 해결 |
| 뉴스 2 | DeepSeek-V4-Flash 정식 출시 - 오픈 웨이트 무료 공개, API 가격이 최상위 모델의 1/105 수준 |
| 뉴스 3 | 오픈AI가 경량 모델 가격 인하 (루나 80%, 테라 20%) |
| 뉴스 4 | Seedance 2.5 글로벌 출시 - 30초 영상 단일 생성, 최대 3분 롱비디오 |
| 뉴스 5 | 미니맥스 H3(오픈 영상 모델), 그록 보이스, 크리스퍼 위스퍼 2.0, 제미나이 로보틱스 2 등 다수 |
02핵심 내용 구조
2-1. 오픈AI '아스트라' - 미해결 수학 난제 10개 해결 (8/1 블로그)
- 오픈AI가 8월 1일 블로그에서 "수학 및 이론 컴퓨터과학 분야의 10대 발전"을 발표.
- 대상은 최소 10년, 대부분 그보다 훨씬 오래 인류가 진전을 못 낸 '미해결 난제'다. 예: 고차원 구형 패킹(sphere packing) 밀도의 새로운 상한값, 이진 코드·구형 코드 관련 문제.
- 기존 IMO 금메달·수능 풀이는 '이미 인간이 풀 수 있는 문제'를 푼 것이지만, 이번은 인간이 못 푼 문제를 새로 풀었다는 점에서 다르다.
- 단순히 그럴듯하게 쓴 환각(할루시네이션)이 아니라, 각 논증을 'Lean 인증서(검증 가능한 형식 증명)'로 공식화해 제출.
- 이 성과를 낸 모델은 오픈AI 차세대 주력 모델의 내부 버전인 코드명 '아스트라(Astra)'. 정식 모델명은 미정(GPT-6 급으로 추정).
- 아직 수학계의 완전한 검증·인정 단계는 아니며 '유의미한 진전' 수준.
2-2. DeepSeek-V4-Flash 정식 출시 (7/31)
- 이전 공개는 프리뷰였고, 이번이 정식 버전. Hugging Face에 오픈 웨이트로 공개, 라이선스는 MIT(무료·자유 사용).
- 경량(Flash) 모델임에도 이전 세대 Pro 모델을 능가. 성능은 한때 최강이던 오퍼스(Opus) 4.8에 근접.
- 아티피셜 애널리시스(Artificial Analysis) 기준, 구글 최신 경량 모델 제미나이 3.6 플래시와 동일 점수.
- API 가격이 파격적. 구글의 초가성비 모델 제미나이 3.5 플래시 라이트보다 성능은 좋으면서 더 저렴(약 $0.03 수준). 최상위 모델 페이블(Fable) 5 대비 약 105배 저렴.
- 오픈 웨이트라 양자화 버전도 등장. 거의 무손실 4비트는 약 162GB 필요, 3비트는 DGX 스파크·맥 128GB 통합메모리급에서 실행. DGX 스파크 2대로 초당 약 30토큰(느리지만 배치 작업엔 무료라 유용).
2-3. 오픈AI 경량 모델 가격 인하 (7/30)
- 가장 가벼운 모델 '루나' 가격 80% 인하, 중간 모델 '테라' 20% 인하.
- 인하 후 테라는 입력 $2 / 출력 $12 수준.
- '솔(Sol)' 모델은 가격 변동 없이, 지능 유지하며 표준 대비 최대 2.5배 빠른 패스트 모드를 2배 가격에 제공.
- 이번 인하는 DeepSeek의 초저가 공세에 대한 대응으로 추정.
2-4. ARC-AGI-3 점수 3배 상승 - '하네스'의 중요성
- 오픈AI가 GPT-5.6 솔의 ARC-AGI-3(추론 벤치마크) 점수를 3배 이상 끌어올렸다고 발표.
- 모델을 바꾼 게 아니라 '하네스(harness, 모델을 감싸는 실행·설정 틀)'만 조정. 추론 유지(retained reasoning) + 압축(compaction) 방법론 적용.
- 결과: 13.3% -> 38.3%로 약 40%p 근접 상승.
- 시사점: 벤치마크 점수는 모델 자체뿐 아니라 API 설정·하네스 설계·프롬프트 방식까지 함께 측정된다.
2-5. 앤트로픽의 새 프롬프트 지침 - "80%를 삭감하라"
- Y Combinator 강연에 클로드 코드 헤드 보리스 체르니 출연. 최신 모델(오퍼스 5 등)에서 시스템 프롬프트 구문의 80% 이상을 삭제했다고 밝힘.
- 모델이 똑똑해질수록 복잡한 프롬프트·하네스가 오히려 방해. 다 지우고 생 모델부터 관찰하며 필요한 부분만 다시 채우는 방식 권장.
- 앤트로픽 클로드 코드 팀의 '컨텍스트 엔지니어링 새 규칙'도 동일 맥락. 세세한 지침 대신 모델의 자율 판단에 위임, 도구도 예시 없이 파라미터·구조만 명확히 하면 됨.
- 안드레이 카파시 트윗: 팰리컨 SVG 벤치마크가 포화되어, '반지의 제왕 첫 단락을 자바스크립트 3D 애니메이션으로 만들기'를 새 테스트로 제안.
2-6. Seedance 2.5 글로벌 출시 - 영상 생성 최강자
- 영상 생성 AI 시덴스(Seedance) 2.5 정식 공개. 단일 생성으로 네이티브 30초 영상(이전 15초). 인터랙티브 편집 롱비디오 모드로 최대 3분 일관성 유지.
- 마야(Maya)·블렌더(Blender) 3D 툴용 공식 플러그인 제공 - 3D 씬을 영상으로 변환 가능.
- 바이럴 사례: 30초 로지텍 키보드 광고, 프로즌 타임(정지) 효과, K팝 뮤비, AI 인플루언서 브이로그 등.
- 서비스는 바이트댄스(틱톡 모회사)의 드리미나(Dreamina)·캡컷에서 먼저 제공. 단, 720p 기준 영상 1편(30초)에 약 1만 원 이상으로 매우 비쌈.
2-7. 그 외 영상·음성·로봇 소식
- 미니맥스 H3: 오픈 영상 모델. 텍스트-투-비디오 리더보드에서 시덴스 2.0을 상회, 비디오 에디팅 리더보드 1위. RTX 3060 한 장(8비트, 32GB 메모리)으로 832x480/124프레임 영상을 10분 내 생성. 웨이트는 카운트다운 중(약 6시간 후 공개).
- 그록 이매진 비디오 1.5: 일론 머스크 그록의 영상 모델 개선, 최대 15초·1080p.
- 그록 보이스 씽크 패스트 2.0: 추론형 음성 모델. 음성 품질 82.9점, 음성 추론 97.2점, 응답 속도 0.7초로 매우 빠름.
- 크리스퍼 위스퍼(Crisper Whisper) 2.0: 오픈 웨이트 음성인식(ASR). 일레븐랩스 스크라이브 V2(79.2)보다 높은 87.8점, Pro는 93.5점. 한국어 전사·타임스탬프도 양호.
- 제미나이 로보틱스 2: 로봇용 비전-언어-행동(VLA) 모델. 포도를 지퍼백에 넣기, 전구 빼기, 쓰레기봉투 묶기 등 정교한 자율 동작. 리즈닝 모델(ER2), 온디바이스 모델도 함께 공개.
- 피규어 03: 계단 오르기 데모 공개. 구글은 8/4까지 제미나이 영상 10개 무료 제공.
03기술적 맥락
- '오픈 웨이트(open weight)'는 모델 가중치 파일을 누구나 내려받아 자기 PC·서버에서 돌릴 수 있게 공개한 것. API처럼 사용료 없이 전기세만 내면 무한히 쓸 수 있어 이번 주 핵심 흐름(DeepSeek-V4-Flash, 미니맥스 H3, 크리스퍼 위스퍼).
- '양자화(quantization)'는 모델의 숫자 정밀도를 낮춰 용량·메모리를 줄이는 기술. 비트가 낮을수록 가볍지만 성능 손실 위험. 4비트가 거의 무손실 기준.
- 'Lean 인증서'는 수학 증명을 컴퓨터가 기계적으로 검증할 수 있게 형식언어로 옮긴 것. 환각과 진짜 증명을 구분하는 근거.
- '하네스'는 모델 자체가 아니라 그 주위의 실행 파이프라인(설정·프롬프트·도구 연결). 같은 모델도 하네스만 바꾸면 점수가 크게 달라진다.
04전략적 의미
- AI가 '인간이 이미 푼 문제'를 넘어 '인간이 못 푼 미해결 난제'로 진입 - 특이점 논의를 자극하고, 순수 수학자·과학자 진로의 장기적 위상에 물음표.
- 오픈 웨이트 모델이 상용 최상위 모델과 성능 격차를 좁히며 가격을 무너뜨림. 오픈AI의 가격 인하도 DeepSeek 압박에 대한 대응으로 해석.
- 앤트로픽의 "프롬프트 80% 삭감" 지침은, 모델 지능이 오르면서 프롬프트 엔지니어링·하네스 설계의 비중이 줄어드는 패러다임 전환을 시사.
- 영상 생성은 '최고 품질 유료(Seedance)'와 '가성비 오픈 웨이트(미니맥스 H3)'로 양분되는 구도.
05핵심 워크플로우/방법론
- 벤치마크 개선: 모델 교체 대신 하네스 조정(추론 유지 + 압축)만으로 점수 3배 상승 가능 - 평가·운영 시 하네스를 함께 고려.
- 프롬프트 최적화(앤트로픽식): 기존 시스템 프롬프트·코드를 대폭 삭제 -> 생 모델의 반응 관찰 -> 꼭 필요한 부분만 재추가. 도구는 예시 대신 파라미터·구조만 명확히.
- 로컬 실행: 오픈 웨이트 모델을 양자화해 DGX 스파크·RTX 3060 등 소비자 하드웨어에서 배치·비실시간 작업으로 활용.
06활용 시나리오
- 개인·스타트업이 DeepSeek-V4-Flash API(초저가) 또는 로컬 오픈 웨이트로 가성비 대량 처리 작업을 수행.
- 광고·마케팅 팀이 Seedance 2.5로 30초 광고·뮤비를 딸깍 제작(외주 대비 저렴하나 편당 1만 원대 비용 유의).
- 자막·전사 작업자가 크리스퍼 위스퍼 2.0(오픈 웨이트)으로 다국어 전사·타임스탬프 생성, 한국어도 처리.
- 개발자가 그록 보이스 씽크 패스트 2.0(응답 0.7초)으로 실시간 상담원·통화형 서비스 구축.
- 막장 웹드라마 쇼츠처럼 무한 반복 생성이 필요한 콘텐츠를 미니맥스 H3 오픈 웨이트로 저비용 양산.
07현황 및 전망
- 아스트라 성과는 수학계 완전 인정 전 단계이나, 정식 출시 시 연구 보조 도구로의 폭발적 활용이 예상.
- 오픈 웨이트 영상 모델(미니맥스 H3, 곧 나올 플럭스 3 등)이 로컬 영상 생성 생태계를 재편할 가능성.
- 프롬프트·하네스 최소화 흐름은 실험적 검증이 더 필요하지만 앤트로픽 공식 권고라 무게가 실림.
08용어 사전
| 용어 | 한줄 설명 | 비유/예시 |
|---|
| 아스트라(Astra) | 오픈AI 차세대 주력 모델의 내부 코드명 | 아직 이름 안 붙은 GPT-6 시제품 |
| 오픈 웨이트 | 모델 파일을 누구나 받아 직접 돌리게 공개 | 레시피까지 통째로 공개한 요리 |
| 양자화 | 정밀도를 낮춰 모델 용량·메모리를 줄임 | 고화질 사진을 압축 저장 |
| Lean 인증서 | 컴퓨터가 검증 가능한 형식 수학 증명 | 자동 채점 가능한 답안지 |
| 하네스(harness) | 모델을 감싸는 실행·설정·도구 틀 | 같은 엔진에 다른 차체 |
| 할루시네이션 | AI가 그럴듯하게 지어내는 거짓 답변 | 아는 척하는 헛소리 |
| ASR | 음성을 텍스트로 바꾸는 음성인식 기술 | 받아쓰기 하는 AI |
| VLA 모델 | 비전·언어를 보고 로봇 행동까지 내는 모델 | 보고 듣고 손을 움직이는 뇌 |
| 롱비디오 모드 | 장면을 이어붙여 긴 영상을 만드는 기능 | 여러 컷을 이은 한 편의 영상 |
| MIT 라이선스 | 상업 이용까지 자유로운 개방형 라이선스 | 조건 없이 가져다 써도 되는 허가 |