Theoretically MediaMORNING DIGEST · 2026-08-07 · Theoretically Media🎬 영상

Seedance 2.5 Masterclass & Early Review

Theoretically Media(Tim)가 단편 "Death Walks into a Bar" 제작 비하인드를 통해 ByteDance Seedance 2.5의 프롬프팅·30초 생성·비용·한계를 실전 리뷰한 마스터클래스 영상.

인포그래픽 요약

01핵심 개요

항목내용
대상 모델ByteDance Seedance 2.5 (Dreamina 플랫폼 경유)
사례 작품단편 "Death Walks into a Bar" (네온누아르, 약 2분22초)
핵심 신기능30초 단일 생성 모드, 최대 50개 이미지 레퍼런스, 옴니 레퍼런스
해상도720p 고정 생성 → Topaz로 업스케일 필요
총 생성량약 15회 생성 · 450초 분량 → 최종 142초 편집 (비율 약 3.2:1)
비용 추정API 기준 약 $80~95, 플랫폼 환산 시 약 $240~355
전통 촬영 대비 비용약 $55,000~85,000 (저예산 인디 버전 $20,000~35,000)

02핵심 기능/내용 구조

  • 30초 생성 모드: 기존 2.0 대비 대폭 늘어난 단일 생성 길이. 대사 위주 신에서 특히 유용하며, 생성 비용은 높지만 재시도(retake) 횟수가 줄어 총량으로는 이득
  • 옴니 레퍼런스(Omni Reference): 캐릭터·장소를 이미지 3장만으로 지정 가능. 상세 캐릭터 시트나 정교한 로케이션 지도 없이도 일관된 톤 유지
  • 최대 50개 이미지 레퍼런스: 캐릭터의 다양한 의상/소품 등 다중 이미지 레퍼런스를 한 번에 투입해도 안정적으로 반영
  • 퍼스트 프레임 + 옴니 레퍼런스 결합: 각 샷의 첫 프레임 이미지와 상세 옴니 레퍼런스를 동시에 제공하는 방식도 테스트, 준수한 결과이나 샷 순서가 프롬프트 의도와 다르게 나오는 경우 있음
  • 음성 캐스팅: 별도 지정이 없으면 이미지 레퍼런스의 인상에 맞춰 모델이 자체적으로 목소리(억양 포함)를 부여. 예) 미국인 캐릭터에 영국식 억양이 붙는 오류 발생, "speaking American"으로 명시해도 완전히 해결되지 않음

03기술적 맥락

  • 2.5는 2.0과 프롬프트 문법이 상당히 달라, 기존 2.0용 프롬프트를 그대로 쓰면 결과가 무너지는 경우가 많음 — 공식 문서 기반 재학습 필요
  • 텍스트를 화면 내 소품(책 페이지의 이름 등)에 정확히 렌더링해야 하는 경우, 외부 이미지 편집 도구(GPT image, Nano Banana)로 레퍼런스를 만드는 방식은 공간·비율 문제로 실패 — Seedance 자체에 프롬프트로 직접 생성시키는 방식이 더 안정적
  • 30초 장문 생성에서 디코히런스(decoherence)·모핑 아티팩트가 간헐적으로 발생(특히 액션 시퀀스), 생성 전체에 지속되지는 않으며 업스케일로도 제거되지 않음 — 추후 패치 예상(2.0 출시 초기에도 유사 패턴 있었음)
  • 과도하게 빠른 컷 편집(1초 단위 하이퍼컷) 스타일의 프롬프트는 선호하지 않으며, 호흡을 더 주는 프롬프트에서 결과가 개선됨
  • smartedit·롱비디오 기능은 제작 당시 접근 권한이 없어 테스트하지 못함

04전략적 의미

  • 30초 생성은 비용이 높으므로 모든 신에 적용할 필요는 없음 — 대사 중심의 "talky" 신처럼 실제로 긴 호흡이 필요한 곳에만 선택적으로 사용하는 것이 합리적
  • 720p 고정 생성 + 외부 업스케일(Topaz) 조합이 현재로선 비용 대비 합리적인 워크플로우로 자리잡음
  • 프롬프트 난도가 높아져 진입장벽이 있지만, 프롬프트 어드히어런스(지시 반영도) 자체는 이전 버전 대비 크게 개선되어 "좋은 모델에서 훌륭한 모델로 가는 길목"이라는 평가
  • 1인 창작자가 AI 영상 생성만으로 네온누아르 단편을 프로덕션 비용의 1/200 수준으로 완성할 수 있음을 실증 — 전통 프로덕션 대비 비용 격차가 워크플로우 성숙과 함께 계속 좁혀지는 흐름

05핵심 워크플로우·방법론

  1. 레퍼런스 최소화: 캐릭터 2명 + 로케이션 1컷, 총 3장의 이미지만으로 전체 단편의 비주얼 일관성 확보 (Midjourney v8로 사전 생성)
  2. 30초 생성 우선 시도: 대사·연기가 중요한 신은 30초 모드로 크게 생성 후, 쓸 만한 구간을 편집에서 골라 쓰는 방식(전체가 실패해도 부분 활용 가능)
  3. 부분 재촬영(스크린샷 재활용): 특정 대사 구간의 앵글이 어색하면, 다른 세그먼트에서 캐릭터 스크린샷을 추출해 이미지-투-비디오로 개별 재생성
  4. 텍스트 소품은 모델 자체 생성: 책에 적힌 이름처럼 정밀한 텍스트가 필요한 장면은 외부 이미지 편집 대신 Seedance에 프롬프트로 직접 요청
  5. 저해상도 생성 후 업스케일: 720p로 다수 생성 → Topaz Desktop(표준 업스케일, 크리에이티브 모드 아님)으로 후반 업스케일
  6. AI를 활용한 비용 산정: Claude에게 실제 생성 비용(플랫폼/크레딧 환산)과 전통 촬영 대비 비용을 각각 산출시켜 비교 자료로 활용

06활용 시나리오

  • 저예산 단편 영화·시네마틱 트레일러: 대사 중심 신을 30초 생성으로 확보하고 나머지는 짧은 인서트로 채우는 하이브리드 편집
  • 캐릭터 의상/소품 베리에이션 테스트: 최대 50개 레퍼런스 기능으로 동일 캐릭터의 다양한 착장 변형을 빠르게 프로토타입
  • 브랜드/광고용 목업 프로덕션: 전통 촬영 대비 1/200 수준 비용으로 컨셉 영상 제작 후 실제 촬영 여부 의사결정
  • 프롬프트 엔지니어링 학습 자료 제작: 실패 사례(거대한 책, 영국식 억양 등)를 공유해 팀 내 프롬프트 가이드/스킬 파일로 축적

07현황 및 전망

  • 현재 720p 고정 생성이 한계이나, 비용 절감 관점에서는 오히려 "저해상도 생성 후 업스케일" 전략이 권장됨
  • 디코히런스·모핑 이슈는 2.0 출시 초기에도 있었던 패턴으로, 저자는 조만간 패치될 것으로 예상
  • smartedit·롱비디오 등 미공개/미접근 기능이 남아 있어 모델의 전체 역량은 아직 다 드러나지 않은 상태
  • "아직 매우 초기 단계이며 앞으로 발견할 것이 많다"는 것이 저자의 결론 — 지속적인 실험과 프롬프트 공유를 예고

08용어 사전

용어뜻
Seedance 2.5ByteDance 계열 AI 영상 생성 모델의 최신 버전
옴니 레퍼런스(Omni Reference)이미지 등 다중 레퍼런스를 함께 입력해 캐릭터·장면 일관성을 유지하는 기능
디코히런스(Decoherence)장시간 생성 중 형태·질감이 흐트러지거나 붕괴하는 현상
이미지-투-비디오정지 이미지를 시작 프레임으로 삼아 영상을 생성하는 방식
Topaz영상 업스케일링에 특화된 후반 처리 소프트웨어
DreaminaByteDance의 생성형 크리에이티브 플랫폼(Seedance 제공 경로)

09딥링크

  • 0:00 인트로 — 단편 공개 배경과 마스터클래스 예고
  • 3:09 레퍼런스 3장으로 전체 단편 제작한 방식
  • 6:25 텍스트 소품(책 이름) 렌더링 문제와 해결법
  • 7:52 720p 고정 생성과 Topaz 업스케일 워크플로우
  • 9:21 총 생성 비용과 전통 촬영 대비 비용 비교
  • 13:08 프롬프트 전략과 음성 억양 이슈
Theoretically Media · 2026-08-07
← 목록으로