조코딩 JoCodingMORNING DIGEST · 2026-08-03 · 조코딩 JoCoding🎬 영상

조코딩 AI 뉴스 - 오픈AI 아스트라 10대 난제 해결, DeepSeek-V4-Flash 정식 출시, Seedance 2.5 등

인포그래픽 요약

01핵심 개요

항목내용
주제2026년 8월 첫째 주 AI 업계 소식 총정리 (조코딩 주간 뉴스)
뉴스 1오픈AI 차세대 모델 '아스트라'가 인류가 10년 이상 못 푼 수학 난제 10개를 해결
뉴스 2DeepSeek-V4-Flash 정식 출시 - 오픈 웨이트 무료 공개, API 가격이 최상위 모델의 1/105 수준
뉴스 3오픈AI가 경량 모델 가격 인하 (루나 80%, 테라 20%)
뉴스 4Seedance 2.5 글로벌 출시 - 30초 영상 단일 생성, 최대 3분 롱비디오
뉴스 5미니맥스 H3(오픈 영상 모델), 그록 보이스, 크리스퍼 위스퍼 2.0, 제미나이 로보틱스 2 등 다수

02핵심 내용 구조

2-1. 오픈AI '아스트라' - 미해결 수학 난제 10개 해결 (8/1 블로그)

  • 오픈AI가 8월 1일 블로그에서 "수학 및 이론 컴퓨터과학 분야의 10대 발전"을 발표.
  • 대상은 최소 10년, 대부분 그보다 훨씬 오래 인류가 진전을 못 낸 '미해결 난제'다. 예: 고차원 구형 패킹(sphere packing) 밀도의 새로운 상한값, 이진 코드·구형 코드 관련 문제.
  • 기존 IMO 금메달·수능 풀이는 '이미 인간이 풀 수 있는 문제'를 푼 것이지만, 이번은 인간이 못 푼 문제를 새로 풀었다는 점에서 다르다.
  • 단순히 그럴듯하게 쓴 환각(할루시네이션)이 아니라, 각 논증을 'Lean 인증서(검증 가능한 형식 증명)'로 공식화해 제출.
  • 이 성과를 낸 모델은 오픈AI 차세대 주력 모델의 내부 버전인 코드명 '아스트라(Astra)'. 정식 모델명은 미정(GPT-6 급으로 추정).
  • 아직 수학계의 완전한 검증·인정 단계는 아니며 '유의미한 진전' 수준.

2-2. DeepSeek-V4-Flash 정식 출시 (7/31)

  • 이전 공개는 프리뷰였고, 이번이 정식 버전. Hugging Face에 오픈 웨이트로 공개, 라이선스는 MIT(무료·자유 사용).
  • 경량(Flash) 모델임에도 이전 세대 Pro 모델을 능가. 성능은 한때 최강이던 오퍼스(Opus) 4.8에 근접.
  • 아티피셜 애널리시스(Artificial Analysis) 기준, 구글 최신 경량 모델 제미나이 3.6 플래시와 동일 점수.
  • API 가격이 파격적. 구글의 초가성비 모델 제미나이 3.5 플래시 라이트보다 성능은 좋으면서 더 저렴(약 $0.03 수준). 최상위 모델 페이블(Fable) 5 대비 약 105배 저렴.
  • 오픈 웨이트라 양자화 버전도 등장. 거의 무손실 4비트는 약 162GB 필요, 3비트는 DGX 스파크·맥 128GB 통합메모리급에서 실행. DGX 스파크 2대로 초당 약 30토큰(느리지만 배치 작업엔 무료라 유용).

2-3. 오픈AI 경량 모델 가격 인하 (7/30)

  • 가장 가벼운 모델 '루나' 가격 80% 인하, 중간 모델 '테라' 20% 인하.
  • 인하 후 테라는 입력 $2 / 출력 $12 수준.
  • '솔(Sol)' 모델은 가격 변동 없이, 지능 유지하며 표준 대비 최대 2.5배 빠른 패스트 모드를 2배 가격에 제공.
  • 이번 인하는 DeepSeek의 초저가 공세에 대한 대응으로 추정.

2-4. ARC-AGI-3 점수 3배 상승 - '하네스'의 중요성

  • 오픈AI가 GPT-5.6 솔의 ARC-AGI-3(추론 벤치마크) 점수를 3배 이상 끌어올렸다고 발표.
  • 모델을 바꾼 게 아니라 '하네스(harness, 모델을 감싸는 실행·설정 틀)'만 조정. 추론 유지(retained reasoning) + 압축(compaction) 방법론 적용.
  • 결과: 13.3% -> 38.3%로 약 40%p 근접 상승.
  • 시사점: 벤치마크 점수는 모델 자체뿐 아니라 API 설정·하네스 설계·프롬프트 방식까지 함께 측정된다.

2-5. 앤트로픽의 새 프롬프트 지침 - "80%를 삭감하라"

  • Y Combinator 강연에 클로드 코드 헤드 보리스 체르니 출연. 최신 모델(오퍼스 5 등)에서 시스템 프롬프트 구문의 80% 이상을 삭제했다고 밝힘.
  • 모델이 똑똑해질수록 복잡한 프롬프트·하네스가 오히려 방해. 다 지우고 생 모델부터 관찰하며 필요한 부분만 다시 채우는 방식 권장.
  • 앤트로픽 클로드 코드 팀의 '컨텍스트 엔지니어링 새 규칙'도 동일 맥락. 세세한 지침 대신 모델의 자율 판단에 위임, 도구도 예시 없이 파라미터·구조만 명확히 하면 됨.
  • 안드레이 카파시 트윗: 팰리컨 SVG 벤치마크가 포화되어, '반지의 제왕 첫 단락을 자바스크립트 3D 애니메이션으로 만들기'를 새 테스트로 제안.

2-6. Seedance 2.5 글로벌 출시 - 영상 생성 최강자

  • 영상 생성 AI 시덴스(Seedance) 2.5 정식 공개. 단일 생성으로 네이티브 30초 영상(이전 15초). 인터랙티브 편집 롱비디오 모드로 최대 3분 일관성 유지.
  • 마야(Maya)·블렌더(Blender) 3D 툴용 공식 플러그인 제공 - 3D 씬을 영상으로 변환 가능.
  • 바이럴 사례: 30초 로지텍 키보드 광고, 프로즌 타임(정지) 효과, K팝 뮤비, AI 인플루언서 브이로그 등.
  • 서비스는 바이트댄스(틱톡 모회사)의 드리미나(Dreamina)·캡컷에서 먼저 제공. 단, 720p 기준 영상 1편(30초)에 약 1만 원 이상으로 매우 비쌈.

2-7. 그 외 영상·음성·로봇 소식

  • 미니맥스 H3: 오픈 영상 모델. 텍스트-투-비디오 리더보드에서 시덴스 2.0을 상회, 비디오 에디팅 리더보드 1위. RTX 3060 한 장(8비트, 32GB 메모리)으로 832x480/124프레임 영상을 10분 내 생성. 웨이트는 카운트다운 중(약 6시간 후 공개).
  • 그록 이매진 비디오 1.5: 일론 머스크 그록의 영상 모델 개선, 최대 15초·1080p.
  • 그록 보이스 씽크 패스트 2.0: 추론형 음성 모델. 음성 품질 82.9점, 음성 추론 97.2점, 응답 속도 0.7초로 매우 빠름.
  • 크리스퍼 위스퍼(Crisper Whisper) 2.0: 오픈 웨이트 음성인식(ASR). 일레븐랩스 스크라이브 V2(79.2)보다 높은 87.8점, Pro는 93.5점. 한국어 전사·타임스탬프도 양호.
  • 제미나이 로보틱스 2: 로봇용 비전-언어-행동(VLA) 모델. 포도를 지퍼백에 넣기, 전구 빼기, 쓰레기봉투 묶기 등 정교한 자율 동작. 리즈닝 모델(ER2), 온디바이스 모델도 함께 공개.
  • 피규어 03: 계단 오르기 데모 공개. 구글은 8/4까지 제미나이 영상 10개 무료 제공.

03기술적 맥락

  • '오픈 웨이트(open weight)'는 모델 가중치 파일을 누구나 내려받아 자기 PC·서버에서 돌릴 수 있게 공개한 것. API처럼 사용료 없이 전기세만 내면 무한히 쓸 수 있어 이번 주 핵심 흐름(DeepSeek-V4-Flash, 미니맥스 H3, 크리스퍼 위스퍼).
  • '양자화(quantization)'는 모델의 숫자 정밀도를 낮춰 용량·메모리를 줄이는 기술. 비트가 낮을수록 가볍지만 성능 손실 위험. 4비트가 거의 무손실 기준.
  • 'Lean 인증서'는 수학 증명을 컴퓨터가 기계적으로 검증할 수 있게 형식언어로 옮긴 것. 환각과 진짜 증명을 구분하는 근거.
  • '하네스'는 모델 자체가 아니라 그 주위의 실행 파이프라인(설정·프롬프트·도구 연결). 같은 모델도 하네스만 바꾸면 점수가 크게 달라진다.

04전략적 의미

  • AI가 '인간이 이미 푼 문제'를 넘어 '인간이 못 푼 미해결 난제'로 진입 - 특이점 논의를 자극하고, 순수 수학자·과학자 진로의 장기적 위상에 물음표.
  • 오픈 웨이트 모델이 상용 최상위 모델과 성능 격차를 좁히며 가격을 무너뜨림. 오픈AI의 가격 인하도 DeepSeek 압박에 대한 대응으로 해석.
  • 앤트로픽의 "프롬프트 80% 삭감" 지침은, 모델 지능이 오르면서 프롬프트 엔지니어링·하네스 설계의 비중이 줄어드는 패러다임 전환을 시사.
  • 영상 생성은 '최고 품질 유료(Seedance)'와 '가성비 오픈 웨이트(미니맥스 H3)'로 양분되는 구도.

05핵심 워크플로우/방법론

  • 벤치마크 개선: 모델 교체 대신 하네스 조정(추론 유지 + 압축)만으로 점수 3배 상승 가능 - 평가·운영 시 하네스를 함께 고려.
  • 프롬프트 최적화(앤트로픽식): 기존 시스템 프롬프트·코드를 대폭 삭제 -> 생 모델의 반응 관찰 -> 꼭 필요한 부분만 재추가. 도구는 예시 대신 파라미터·구조만 명확히.
  • 로컬 실행: 오픈 웨이트 모델을 양자화해 DGX 스파크·RTX 3060 등 소비자 하드웨어에서 배치·비실시간 작업으로 활용.

06활용 시나리오

  • 개인·스타트업이 DeepSeek-V4-Flash API(초저가) 또는 로컬 오픈 웨이트로 가성비 대량 처리 작업을 수행.
  • 광고·마케팅 팀이 Seedance 2.5로 30초 광고·뮤비를 딸깍 제작(외주 대비 저렴하나 편당 1만 원대 비용 유의).
  • 자막·전사 작업자가 크리스퍼 위스퍼 2.0(오픈 웨이트)으로 다국어 전사·타임스탬프 생성, 한국어도 처리.
  • 개발자가 그록 보이스 씽크 패스트 2.0(응답 0.7초)으로 실시간 상담원·통화형 서비스 구축.
  • 막장 웹드라마 쇼츠처럼 무한 반복 생성이 필요한 콘텐츠를 미니맥스 H3 오픈 웨이트로 저비용 양산.

07현황 및 전망

  • 아스트라 성과는 수학계 완전 인정 전 단계이나, 정식 출시 시 연구 보조 도구로의 폭발적 활용이 예상.
  • 오픈 웨이트 영상 모델(미니맥스 H3, 곧 나올 플럭스 3 등)이 로컬 영상 생성 생태계를 재편할 가능성.
  • 프롬프트·하네스 최소화 흐름은 실험적 검증이 더 필요하지만 앤트로픽 공식 권고라 무게가 실림.

08용어 사전

용어한줄 설명비유/예시
아스트라(Astra)오픈AI 차세대 주력 모델의 내부 코드명아직 이름 안 붙은 GPT-6 시제품
오픈 웨이트모델 파일을 누구나 받아 직접 돌리게 공개레시피까지 통째로 공개한 요리
양자화정밀도를 낮춰 모델 용량·메모리를 줄임고화질 사진을 압축 저장
Lean 인증서컴퓨터가 검증 가능한 형식 수학 증명자동 채점 가능한 답안지
하네스(harness)모델을 감싸는 실행·설정·도구 틀같은 엔진에 다른 차체
할루시네이션AI가 그럴듯하게 지어내는 거짓 답변아는 척하는 헛소리
ASR음성을 텍스트로 바꾸는 음성인식 기술받아쓰기 하는 AI
VLA 모델비전·언어를 보고 로봇 행동까지 내는 모델보고 듣고 손을 움직이는 뇌
롱비디오 모드장면을 이어붙여 긴 영상을 만드는 기능여러 컷을 이은 한 편의 영상
MIT 라이선스상업 이용까지 자유로운 개방형 라이선스조건 없이 가져다 써도 되는 허가

09타임스탬프

조코딩 JoCoding · 2026-08-03
← 목록으로