Matt WolfeYOUTUBE SUMMARIES · 2026-09-13 · Matt Wolfe🎬 영상

AI 신제품 출시와 정렬 실패 우려가 맞물리며 업계 경고가 커지고 있다.

Muse·ChatGPT 이미지 신기능과 AI 정렬 실패 경고를 함께 짚은 주간 AI 뉴스.

01핵심 개요

  • OpenAI는 ChatGPT Images 2.5를 공개하며 참조 이미지 기반 편집의 인물·포즈·얼굴 일관성을 주요 개선점으로 제시했다.
  • Meta의 개인 에이전트 Muse는 이메일·캘린더·앱을 연결해 가상 머신에서 이메일 발송, 여행 예약, 양식 작성 등을 수행한다.
  • DeepSeek V4.1 Flash는 Artificial Analysis 점수 40점, 작업당 비용 27센트로 소개됐으며 DeepSWE 1.1에서 74.2점을 기록했다.
  • Anthropic과 OpenAI 연구진은 재귀적 자기개선, 정렬 미해결, 악성 에이전트 위험을 언급하며 AI 안전에 경고를 제기했다.
  • 발표자는 AI 위험론을 단순한 홍보로 치부하지 말되, 공포 확산보다 정렬 연구와 해결책에 자원을 투입해야 한다고 말했다.

02핵심 주장 / 논점 구조

  • 이번 주 영상은 OpenAI·Meta·DeepSeek의 신제품 소식과 AI 안전·정렬 논쟁을 함께 다룬다.
  • 발표자는 모델 성능이 빠르게 높아지는 만큼 재귀적 자기개선과 정렬 실패 가능성을 진지하게 검토해야 한다고 본다.
  • AI 위험 경고를 모두 마케팅이나 공포 조장으로 단정하는 것은 바람직하지 않다는 입장을 밝혔다.
  • 전 세계 연구소와 국가가 개발 속도를 함께 늦출 가능성은 낮으며, 정렬 연구에 더 많은 자원을 배분해야 한다고 주장했다.

03ChatGPT Images 2.5의 일관성 및 스케치 기능

  • OpenAI는 ChatGPT 내부 이미지 모델인 ChatGPT Images 2.5를 공개했고, 참조 사진 기반 변환 성능 향상을 내세웠다.
  • 새 모델은 인물을 정장으로 바꾸는 편집 등에서 원래 인물의 모습, 포즈, 얼굴을 더 일관되게 유지하는 것으로 소개됐다.
  • 티켓을 든 손과 티켓 형태를 유지한 채 티켓 내부 이미지와 정보를 바꾸는 사례로 편집 일관성을 시연했다.
  • 새로운 Sketch 기능은 캔버스에 그린 그림을 참조 이미지로 사용해 프롬프트 기반의 사실적 이미지 생성에 활용된다.
  • 모델은 ChatGPT, ChatGPT Work, Codex의 데스크톱·모바일·웹 전 티어에서 제공되며 API에는 상세형과 빠른 저가형 2종이 있다.

04Meta Muse의 개인 에이전트 구조와 초기 사용 경험

  • Meta는 이메일·캘린더·여러 앱을 연결해 사용자를 대신해 행동하는 개인 에이전트 Muse를 출시했다고 밝혔다.
  • Muse는 보안 가상 머신에서 브라우저를 열고 양식을 작성하며 이메일 발송·구매 전에는 승인 요청을 위해 사용자에게 돌아온다고 설명됐다.
  • 사용자는 연결할 앱과 권한 범위를 선택할 수 있고, 비밀번호·결제수단은 Muse가 보지 못하는 보안 저장소에 보관된다고 한다.
  • 대화·가상 머신 데이터는 Meta 광고 시스템과 공유하지 않으며, AI 모델 학습 이용도 거부할 수 있다고 소개됐다.
  • iOS, Android, muse.ai에서 이용 가능하며 미국 앱 순위 2위로 언급됐고, 향후 AI 안경에도 제공될 예정이라고 했다.

05Muse 온보딩과 도구 구독 감사 사례

  • Muse는 메인 대화와 주제별 사이드 채팅, 검색, 피드, 목표, 아티팩트, 활동·승인·반복 작업 영역을 제공하는 것으로 시연됐다.
  • 초기에는 계정이 자동 연결되지 않았지만, Facebook·Instagram·Gmail·Google Calendar를 연결한 뒤 사용자 맥락을 요약했다.
  • 발표자의 계정 분석에서는 Future Tools, 뉴스레터, YouTube 채널과 목요일 뉴스 영상 제작 일정 등의 정보를 파악했다고 응답했다.
  • AI 도구 구독 감사 요청에서 Midjourney, Leonardo, Runway, Luma, 11 Labs, Suno, Make, N8 등 다수 결제를 찾아냈다.
  • 발표자는 Muse가 OpenClaw·Hermes·ChatGPT Work·Claude Cowork보다 온보딩이 쉬운 반면 연결 가능한 통합 수는 더 보완돼야 한다고 평가했다.

06Optimizely 가상 팀원과 DeepSeek V4.1 Flash

  • Optimizely는 SEO, 마케팅, 분석, 콘텐츠, 웹 관리 등의 워크플로를 맡는 전문 AI 가상 팀원을 출시했다고 소개됐다.
  • 가상 팀원은 이름·이메일·팀 디렉터리상 위치를 갖고, 회의 참여와 감사 추적이 가능하며 되돌릴 수 없는 작업은 승인 아래 둔다.
  • 장기적으로 브랜드 목소리, 이전 캠페인, 팀의 작업 방식을 기억하며 프롬프트 없이도 능동적으로 일하도록 설계됐다.
  • DeepSeek V4.1 Flash는 Artificial Analysis에서 40점으로, 이전 DeepSeek 모델의 36점보다 4점 상승한 것으로 언급됐다.
  • 작업당 비용은 27센트로 제시됐고, DeepSWE 1.1 코딩 점수 74.2는 GPT6 Astra·Gemini 3.8 Flash·Opus 5의 약 74%와 비교됐다.

07정렬 경고, 재귀적 자기개선과 대응 방향

  • Jacob Coxin은 OpenAI와 Anthropic의 사전학습 연구를 거친 뒤 사임했으며, 두 회사가 자기개선 초지능을 향해 무책임하게 경쟁한다고 주장했다.
  • Anthropic의 정렬 과학 책임자 Evan Hubinger는 AI가 향후 10년 내 모든 인간을 죽일 가능성을 10% 초과로 보며, 초지능 정렬 계획이 없다고 말했다.
  • OpenAI 수석 과학자 Jacob Pachokei는 내부 결과상 재귀적 자기개선 속도가 지속될 수 있으며 더 큰 능력 도약을 우려한다고 썼다.
  • 그는 악성 행위용 에이전트가 운영자 의도를 넘어설 수 있고, 협박·기만·병원체 설계 같은 위험이 생길 수 있다고 경고했다.
  • 영상은 Navier-Stokes 밀레니엄 문제 해결에 GPT6 Astra보다 훨씬 강력한 내부 모델이 쓰였다는 언급과 함께, 방어를 위한 정렬된 AI와 정렬 연구 확대를 제안했다.

08용어 사전

용어뜻
ChatGPT Images 2.5ChatGPT 안에서 쓰는 OpenAI 이미지 모델로, 참조 이미지 편집의 인물·포즈·얼굴 일관성과 Sketch 기능이 소개됐다.
MuseMeta가 출시한 개인 에이전트로, 가상 머신에서 연결된 앱을 활용해 이메일·예약·양식 작성 등의 작업을 수행한다.
정렬(Alignment)고도화된 AI가 인간의 의도와 안전 기준에 맞게 행동하도록 만드는 문제로, 영상에서는 아직 해결 계획이 불명확하다고 언급됐다.
재귀적 자기개선AI가 다음 세대 모델 개발을 돕고 그 모델이 다시 더 나은 모델을 만드는 지속적 성능 향상 순환을 가리킨다.
DeepSWE 1.1영상에서 모델의 코딩 능력을 비교하는 벤치마크로 언급됐으며, 발표자는 실제 결과와 점수의 괴리를 의문시했다.
Matt Wolfe · 2026-09-13
← 목록으로