Matt WolfeYOUTUBE SUMMARIES · 2026-09-13 · Matt Wolfe🎬 영상
AI 신제품 출시와 정렬 실패 우려가 맞물리며 업계 경고가 커지고 있다.
Muse·ChatGPT 이미지 신기능과 AI 정렬 실패 경고를 함께 짚은 주간 AI 뉴스.
01핵심 개요
- OpenAI는 ChatGPT Images 2.5를 공개하며 참조 이미지 기반 편집의 인물·포즈·얼굴 일관성을 주요 개선점으로 제시했다.
- Meta의 개인 에이전트 Muse는 이메일·캘린더·앱을 연결해 가상 머신에서 이메일 발송, 여행 예약, 양식 작성 등을 수행한다.
- DeepSeek V4.1 Flash는 Artificial Analysis 점수 40점, 작업당 비용 27센트로 소개됐으며 DeepSWE 1.1에서 74.2점을 기록했다.
- Anthropic과 OpenAI 연구진은 재귀적 자기개선, 정렬 미해결, 악성 에이전트 위험을 언급하며 AI 안전에 경고를 제기했다.
- 발표자는 AI 위험론을 단순한 홍보로 치부하지 말되, 공포 확산보다 정렬 연구와 해결책에 자원을 투입해야 한다고 말했다.
02핵심 주장 / 논점 구조
- 이번 주 영상은 OpenAI·Meta·DeepSeek의 신제품 소식과 AI 안전·정렬 논쟁을 함께 다룬다.
- 발표자는 모델 성능이 빠르게 높아지는 만큼 재귀적 자기개선과 정렬 실패 가능성을 진지하게 검토해야 한다고 본다.
- AI 위험 경고를 모두 마케팅이나 공포 조장으로 단정하는 것은 바람직하지 않다는 입장을 밝혔다.
- 전 세계 연구소와 국가가 개발 속도를 함께 늦출 가능성은 낮으며, 정렬 연구에 더 많은 자원을 배분해야 한다고 주장했다.
03ChatGPT Images 2.5의 일관성 및 스케치 기능
- OpenAI는 ChatGPT 내부 이미지 모델인 ChatGPT Images 2.5를 공개했고, 참조 사진 기반 변환 성능 향상을 내세웠다.
- 새 모델은 인물을 정장으로 바꾸는 편집 등에서 원래 인물의 모습, 포즈, 얼굴을 더 일관되게 유지하는 것으로 소개됐다.
- 티켓을 든 손과 티켓 형태를 유지한 채 티켓 내부 이미지와 정보를 바꾸는 사례로 편집 일관성을 시연했다.
- 새로운 Sketch 기능은 캔버스에 그린 그림을 참조 이미지로 사용해 프롬프트 기반의 사실적 이미지 생성에 활용된다.
- 모델은 ChatGPT, ChatGPT Work, Codex의 데스크톱·모바일·웹 전 티어에서 제공되며 API에는 상세형과 빠른 저가형 2종이 있다.
04Meta Muse의 개인 에이전트 구조와 초기 사용 경험
- Meta는 이메일·캘린더·여러 앱을 연결해 사용자를 대신해 행동하는 개인 에이전트 Muse를 출시했다고 밝혔다.
- Muse는 보안 가상 머신에서 브라우저를 열고 양식을 작성하며 이메일 발송·구매 전에는 승인 요청을 위해 사용자에게 돌아온다고 설명됐다.
- 사용자는 연결할 앱과 권한 범위를 선택할 수 있고, 비밀번호·결제수단은 Muse가 보지 못하는 보안 저장소에 보관된다고 한다.
- 대화·가상 머신 데이터는 Meta 광고 시스템과 공유하지 않으며, AI 모델 학습 이용도 거부할 수 있다고 소개됐다.
- iOS, Android, muse.ai에서 이용 가능하며 미국 앱 순위 2위로 언급됐고, 향후 AI 안경에도 제공될 예정이라고 했다.
05Muse 온보딩과 도구 구독 감사 사례
- Muse는 메인 대화와 주제별 사이드 채팅, 검색, 피드, 목표, 아티팩트, 활동·승인·반복 작업 영역을 제공하는 것으로 시연됐다.
- 초기에는 계정이 자동 연결되지 않았지만, Facebook·Instagram·Gmail·Google Calendar를 연결한 뒤 사용자 맥락을 요약했다.
- 발표자의 계정 분석에서는 Future Tools, 뉴스레터, YouTube 채널과 목요일 뉴스 영상 제작 일정 등의 정보를 파악했다고 응답했다.
- AI 도구 구독 감사 요청에서 Midjourney, Leonardo, Runway, Luma, 11 Labs, Suno, Make, N8 등 다수 결제를 찾아냈다.
- 발표자는 Muse가 OpenClaw·Hermes·ChatGPT Work·Claude Cowork보다 온보딩이 쉬운 반면 연결 가능한 통합 수는 더 보완돼야 한다고 평가했다.
06Optimizely 가상 팀원과 DeepSeek V4.1 Flash
- Optimizely는 SEO, 마케팅, 분석, 콘텐츠, 웹 관리 등의 워크플로를 맡는 전문 AI 가상 팀원을 출시했다고 소개됐다.
- 가상 팀원은 이름·이메일·팀 디렉터리상 위치를 갖고, 회의 참여와 감사 추적이 가능하며 되돌릴 수 없는 작업은 승인 아래 둔다.
- 장기적으로 브랜드 목소리, 이전 캠페인, 팀의 작업 방식을 기억하며 프롬프트 없이도 능동적으로 일하도록 설계됐다.
- DeepSeek V4.1 Flash는 Artificial Analysis에서 40점으로, 이전 DeepSeek 모델의 36점보다 4점 상승한 것으로 언급됐다.
- 작업당 비용은 27센트로 제시됐고, DeepSWE 1.1 코딩 점수 74.2는 GPT6 Astra·Gemini 3.8 Flash·Opus 5의 약 74%와 비교됐다.
07정렬 경고, 재귀적 자기개선과 대응 방향
- Jacob Coxin은 OpenAI와 Anthropic의 사전학습 연구를 거친 뒤 사임했으며, 두 회사가 자기개선 초지능을 향해 무책임하게 경쟁한다고 주장했다.
- Anthropic의 정렬 과학 책임자 Evan Hubinger는 AI가 향후 10년 내 모든 인간을 죽일 가능성을 10% 초과로 보며, 초지능 정렬 계획이 없다고 말했다.
- OpenAI 수석 과학자 Jacob Pachokei는 내부 결과상 재귀적 자기개선 속도가 지속될 수 있으며 더 큰 능력 도약을 우려한다고 썼다.
- 그는 악성 행위용 에이전트가 운영자 의도를 넘어설 수 있고, 협박·기만·병원체 설계 같은 위험이 생길 수 있다고 경고했다.
- 영상은 Navier-Stokes 밀레니엄 문제 해결에 GPT6 Astra보다 훨씬 강력한 내부 모델이 쓰였다는 언급과 함께, 방어를 위한 정렬된 AI와 정렬 연구 확대를 제안했다.
08용어 사전
| 용어 | 뜻 |
|---|
| ChatGPT Images 2.5 | ChatGPT 안에서 쓰는 OpenAI 이미지 모델로, 참조 이미지 편집의 인물·포즈·얼굴 일관성과 Sketch 기능이 소개됐다. |
| Muse | Meta가 출시한 개인 에이전트로, 가상 머신에서 연결된 앱을 활용해 이메일·예약·양식 작성 등의 작업을 수행한다. |
| 정렬(Alignment) | 고도화된 AI가 인간의 의도와 안전 기준에 맞게 행동하도록 만드는 문제로, 영상에서는 아직 해결 계획이 불명확하다고 언급됐다. |
| 재귀적 자기개선 | AI가 다음 세대 모델 개발을 돕고 그 모델이 다시 더 나은 모델을 만드는 지속적 성능 향상 순환을 가리킨다. |
| DeepSWE 1.1 | 영상에서 모델의 코딩 능력을 비교하는 벤치마크로 언급됐으며, 발표자는 실제 결과와 점수의 괴리를 의문시했다. |