# TheRoad Scene Lab — 제품 발전 방향 논의 자료

> **대상**: 영화 제작 현장(감독/PD/콘티 작가), 비(非)IT 전문가
> **목적**: 시나리오 → 웹북 변환 AI 파이프라인(v0.6.0)의 다음 방향을 **실제 사용자와 논의**하기 위한 문제 정리
> **작성일**: 2026-04-20 (v0.6.0 릴리스 직후)

---

## 0. 한 줄 요약

> **이 시스템은 시나리오 PDF를 입력하면 AI가 분석 · 연출 · 이미지 생성까지 자동화한 "스틸컷 웹북" 제작 도구**입니다. 지금까지는 **자동화 품질 개선**에 집중했고, 이제 **사람(감독·작가)이 개입해 수정·보완하는 협업 방식**으로 발전 방향을 잡으려 합니다.
>
> (기술 참고: 현재 전체 49 step — 분석 42 + 이미지 5 + 보조 2. 기본 active 40 step. 실측 baseline은 `docs/architecture/_step_manifest.generated.md`.)

### 현재 파이프라인 개요

```mermaid
flowchart LR
    A[시나리오 PDF] --> B[텍스트 정리]
    B --> C[씬 나누기]
    C --> D[등장 요소 발견<br/>인물/장소/소품]
    D --> E[연출/샷 설계<br/>카메라·의상·앵글]
    E --> F[교차 일관성<br/>같은 씬 내 샷들]
    F --> G[AI 이미지 생성<br/>Gemini + fal.ai]
    G --> H[웹북 PDF]

    style A fill:#2a2d35,stroke:#6386FF
    style H fill:#2a2d35,stroke:#22c55e
```

---

## 1. 🖋️ HiTL — 비전문가도 쉽게 고칠 수 있는 UI

> **HiTL (Human-in-the-Loop)**: AI 결과를 사람이 **검토·수정·보완**하는 방식

### 1.1 왜 중요한가

- AI는 **빠르지만 완벽하지 않음**. 수십 개의 파이프라인 step 중 어느 한 곳만 틀어져도 최종 이미지가 어색해짐.
- **현재 상태**: 개발자 관점 UI (JSON 편집창·기술 용어·버튼 나열)
- **원하는 상태**: 감독이 콘티판에 수정 표시하듯 **자연스러운 편집 인터페이스**

### 1.2 현재 편집 기능 (v0.6.0 기준)

| 기능 | 현재 UI | 한계 |
|------|---------|------|
| 인물 정보 편집 | 텍스트 필드 | "어떤 필드를 고쳐야 하나?" 불명확 |
| T2I 프롬프트 수정 | 긴 영문 텍스트 편집 | 비전문가가 영문 편집 부담 |
| 샷 선택/해제 | 체크박스 | "왜 이 샷이 선택됐나?" 근거 부재 |
| 앵글 편집 | 슬라이더(수평/수직/줌) | 숫자 기반, 시각 미리보기 없음 |
| 의상(outlook) 지정 | 드롭다운 | "이 인물이 왜 이 의상?" 설명 부재 |

### 1.3 논의 포인트

#### A. **시각 중심 편집**
- **예**: "민숙이 왼쪽으로 누운 자세가 이상해요" → 현재는 T2I 프롬프트 영문을 찾아 수정. 원하는 건 **이미지 위에 펜으로 표시**.
- 논의: 드로잉 오버레이 / 영역 선택 / "여기 인물 추가" 버튼 등

#### B. **자연어 수정 지시**
- **예**: 감독이 "이 샷은 너무 멀어, 더 가까이" → AI가 자동으로 `close-up` 적용
- 현재: 감독이 영문 프롬프트에 `close-up` 단어를 직접 넣어야 함

#### C. **"왜 이렇게 나왔나" 설명 (Provenance)**
- **예**: 민숙의 한복이 **파란색**으로 나옴. 감독이 "왜?"라고 물으면 → "기획서 12페이지 '파란 치마' 언급 + 인물 카드 color 필드"라고 근거 제시
- 현재: 설명 없음 → 신뢰도 낮음

#### D. **일괄 수정 vs 개별 수정**
- **예**: "민숙의 한복을 빨간색으로 바꿔줘" → 에피소드의 모든 샷에 자동 반영?
- 현재: 각 샷마다 개별 편집 필요

#### E. **되돌리기/히스토리**
- **예**: 편집 후 "이전 버전이 더 좋았어" → **원복 필요**
- 현재: 스냅샷 API 있으나 UI에 노출 부족

### 1.4 제안 워크플로 (논의용)

```mermaid
flowchart TD
    A[AI 자동 생성 결과] --> B[감독 검토]
    B -->|마음에 듦| C[확정]
    B -->|부분 수정| D[드로잉 / 자연어 지시]
    B -->|완전 다시| E[재생성 버튼]
    D --> F[AI 부분 재계산]
    E --> F
    F --> G[근거 표시<br/>Why this output?]
    G --> B
    C --> H[웹북 출력]

    style D fill:#4f46e5,color:#fff
    style G fill:#22d3ee,color:#000
```

---

## 2. 🎨 시각 품질 — 현재 부족하거나 문제 있는 부분

> 개발 히스토리에서 실제로 발생한 문제와 현재 해결 상태를 정리. **회색**: 해결됨, **빨강**: 미해결/부분 해결.

### 2.1 구도·카메라 문제

| 문제 | 예시 | 현재 상태 |
|------|------|----------|
| **극단 구도** (탑다운·버즈아이 남발) | 위에서 내려다보는 샷만 계속 나옴 | ✅ 해결 (v0.5.13) — 카메라 각도 분산 규칙 |
| **시점 혼합 버그** | "민숙이 자기 얼굴을 보면서 그녀를 봤다" 같이 관점 뒤섞임 | ✅ 해결 (v0.5.4~v0.5.7) — shot_validator 도입 |
| **연속 행동이 한 샷에 몰림** | 씬에 10개 행동 있는데 1개 샷에 다 넣음 | ✅ 해결 (v0.5.16) — shot-more 재설계 |
| **얼굴만 보임** (상반신/전신 균형) | 근접만 계속 | 🟡 부분 해결 — 규칙 추가했으나 편향 남음 |
| **공간감 부족** (인물 위치 모호) | "창가" 묘사인데 어느 위치인지 불명 | 🟡 부분 해결 — location_consistency 실험 롤백 |

**논의**: 감독이 "이 컷은 롱샷, 다음은 클로즈업"처럼 **샷 리스트 형태로 지정**할 수 있어야 하는가?

### 2.2 배경·소품 일관성

| 문제 | 예시 | 현재 상태 |
|------|------|----------|
| **같은 장소가 샷마다 다르게** | 옥탑방이 Shot1에선 파란 벽, Shot2에선 녹색 | 🟡 부분 해결 — set_design(Gemini가 장소 사진 생성) 도입 |
| **죽은 인물 자세 불일치** | S12_Shot1은 왼쪽으로 누움, S12_Shot2는 오른쪽으로 누움 | ✅ 해결 (v0.5.14) — scene_consistency 단계 신설 |
| **깨진 창문·피웅덩이 위치 이동** | 같은 씬 샷 사이에 환경 요소가 바뀜 | ✅ 해결 — scene_consistency가 고정 |
| **소품 강제 주입 실패** | 기획서에 "칼을 쥐고 있다" 있는데 안 나옴 | 🔴 미해결 — visible_entities 강제 주입 필요 |
| **인물 의상이 매 씬 바뀜** | 같은 하루인데 Shot1=한복, Shot3=양복 | 🟡 부분 해결 — outlook 3단계 분석 도입 |

**논의**: 감독이 **스토리보드처럼 시간순 레이아웃**으로 전체 샷을 보면서 불일치를 한눈에 잡을 수 있나?

### 2.3 물리 법칙·판타지 요소 해석

| 문제 | 예시 | 현재 상태 |
|------|------|----------|
| **비현실 능력 (빙의·변신) 오해석** | "소울라이드(영혼 탑승)" → AI가 평범한 사람 2명으로 그림 | ✅ 해결 (v0.5.x) — visual_world_rules로 물리 규칙 명시 + scene_director에 Gemini Pro 필수 |
| **동일 인물의 변형** | 변신 전/후 같은 캐릭터를 다른 인물로 인식 | ✅ 해결 — EntityCanon + variant 분리 |
| **죽은 인물의 "움직임"** | 죽은 인물이 다음 씬에서 멀쩡히 등장 | 🟡 부분 해결 — 죽은 인물 플래그 + variant 스킵 |
| **중력·공간 이상** (공중 부양 오인) | "둥실 떠 있다" 묘사 → AI가 점프 동작으로 해석 | 🔴 미해결 — 장면별 판타지 규칙 주입 부족 |

**논의**: 각 작품마다 고유 세계관이 있는데, 이걸 **기획서에서 자동 추출**할지 **감독이 수동 정의**할지?

### 2.4 AI 모더레이션(검열) 문제

| 문제 | 예시 | 현재 상태 |
|------|------|----------|
| **잔혹 장면 거부** (Gemini) | 살해 장면이 기획서에 있어도 이미지 생성 거부 | 🔴 미해결 — fallback 체계만 있음 |
| **맨살 노출 규칙 혼선** | "옷이 찢긴 묘사"가 너무 엄격하게 차단됨 | 🔴 미해결 — 우회 프롬프트 부분 효과 |
| **어린이 등장** | 미성년자 등장 씬이 자주 거부 | 🟡 부분 해결 — outlook으로 연령대 조정 |
| **정치·종교 민감 요소** | 특정 종교 복장 거부 | 🔴 미해결 |

**논의**: 상업적 영화 콘티에는 **성인·폭력·공포**가 불가피한데, 현 AI로 어디까지 가능한가? **대안 모델(상업용)** 도입 필요?

### 2.5 기타 시각 품질

| 문제 | 예시 | 현재 상태 |
|------|------|----------|
| **시나리오 텍스트가 이미지에 한글로 박힘** | T2I 영문 프롬프트인데 "한복", "옥탑방" 한글 유지 | ✅ 의도된 동작 (문화 뉘앙스 보존) |
| **표정 과장** | 슬픈 장면인데 과장된 울음 | 🟡 부분 해결 |
| **배경 장식 과잉** (일본 분위기 예쁨 편향) | 한국 배경인데 일본 느낌 소품 | 🟡 부분 해결 — visual_world_rules로 지역 명시 |

---

## 3. 📺 다중 에피소드 — 스토리 연속성

> 현재는 **에피소드 1 집중**. 실제 시리즈는 10~30화 연속.

### 3.1 문제 영역

#### A. **인물 일관성 (크로스 에피소드)**
- **예**: 에피소드 1에서 만든 민숙의 얼굴·의상을 에피소드 2에서 **자동 재사용**
- 현재: 에피소드마다 독립 분석 → 같은 인물 얼굴이 조금씩 달라짐
- 필요: **전역 EntityCanon** (프로젝트 단위, 에피소드 공유)

#### B. **스토리 변화 추적**
- **예**: 에피소드 3에서 민숙이 사망 → 에피소드 4~에서 "회상·유령" 등장
- 필요: 인물의 **시간축 상태** (생존/사망/부상/변신)

#### C. **관계 변화**
- **예**: 에피소드 1에서 "친구" → 에피소드 5에서 "연인"
- 필요: RelationFact의 시간적 스코프 추적

#### D. **세트 연속성**
- **예**: 옥탑방이 에피소드 1~5까지 동일 장소
- 필요: **location_catalog** (프로젝트 단위) + 에피소드 간 재참조

#### E. **복선·떡밥**
- **예**: 에피소드 1에 등장한 소품이 에피소드 8에서 결정적 단서
- 필요: 아이템/단서 태깅 + 재참조

### 3.2 제안 구조 (논의용)

```mermaid
flowchart TD
    subgraph 프로젝트["프로젝트 (작품 전체)"]
        Canon[공유 Entity Canon<br/>인물·장소·소품]
        Style[스타일 가이드<br/>visual_world_rules]
        Timeline[스토리 타임라인<br/>인물 상태 변화]
    end

    EP1[에피소드 1] -->|신규 등록| Canon
    EP2[에피소드 2] -->|재사용| Canon
    EP3[에피소드 3] -->|재사용 + 변화| Canon

    Canon --> EP1
    Canon --> EP2
    Canon --> EP3

    Style --> EP1
    Style --> EP2
    Style --> EP3

    Timeline --> EP2
    Timeline --> EP3

    style Canon fill:#a78bfa,color:#000
    style Timeline fill:#22d3ee,color:#000
```

### 3.3 논의 포인트
- 에피소드 1을 기준으로 **"표준"** 을 확정하고 이후 에피소드가 상속? 또는 민주적 병합?
- 에피소드 간 편집 시 **"이 변경은 전 에피소드에 반영?"** 분기 UI?
- **반영상용 작품** 은 어떻게 처리? (같은 세계관 다른 작품)

---

## 4. 🤔 그 외 내가 생각하는 논의 주제

### 4.1 ✂️ 제작 흐름 관련

#### A. **실시간 협업** (여러 편집자)
- **예**: 감독·콘티 작가·PD가 각자 다른 씬을 동시 편집
- 현재: 단일 사용자 전제
- 논의: 충돌 해결 / 권한 레벨 / 알림

#### B. **리뷰·승인 워크플로**
- **예**: 콘티 작가가 1차 수정 → 감독이 승인 → 이미지 생성 발주
- 현재: 없음
- 논의: 단계별 승인 필요한가?

#### C. **"이번 분기 내 완료" 같은 시간 계획**
- **예**: "4월 20일까지 에피소드 1~3 완료"
- 현재: 없음
- 논의: 프로젝트 일정 추적 기능 필요?

### 4.2 💡 창작 지원 관련

#### A. **샷 리스트 자동 생성 vs 수동 입력**
- 현재: AI가 완전 자동 설계
- 대안: 감독이 샷 리스트 먼저 작성 → AI는 **T2I 변환만** 담당

#### B. **스타일 학습 (프로젝트별)**
- **예**: 감독이 "이전 작품 같은 느낌"을 원함
- 현재: visual_world_rules 수동 조정
- 논의: 감독 스타일 메모리 / 레퍼런스 이미지 학습?

#### C. **다양성 vs 일관성 밸런스**
- **예**: 동일 앵글만 나오면 지루 → 변화 필요
- 논의: "변형 추천" 기능 확장?

### 4.3 🎬 출력 형식

#### A. **웹북 외 다른 포맷**
- **예**: 스토리보드(A4 가로) / 슬라이드쇼 / 동영상 콘티
- 현재: PDF 웹북만
- 논의: 어떤 포맷이 실무에 필요?

#### B. **배우·로케이션 섭외 자료**
- **예**: 각 인물 참조 이미지 세트를 캐스팅에 활용
- 현재: entity reference image는 있으나 export 없음

### 4.4 💰 운영·비용

#### A. **API 비용 관리**
- 1편 분석 = Gemini Pro 수백 회 + GPT 수백 회 + 이미지 수십 장
- 논의: 비용 예측 / 상한 / 저비용 모드?

#### B. **분석 시간**
- 현재: 1편 당 분석 20~40분, 이미지 생성 10~30분
- 논의: 어느 정도 속도면 실무 OK?

### 4.5 🌏 확장성

#### A. **장르별 특화**
- **예**: 공포/SF/로맨스/사극 각각 다른 분석 규칙?
- 현재: 범용
- 논의: 장르별 프롬프트 세트?

#### B. **다국어 시나리오**
- 현재: 한국어 중심
- 논의: 영어 시나리오 직접 처리?

#### C. **중간 형식 (중계본) 교환**
- **예**: 다른 팀이 작업한 콘티를 import
- 현재: 자체 JSON export만

---

## 5. 📋 우선순위 논의표

> 아래 항목 중 **먼저 다뤄야 할 것**을 감독·PD와 함께 순위 매기기.

| # | 영역 | 세부 | 긴급도 | 난이도 |
|---|------|------|--------|--------|
| 1 | HiTL UI | 시각 중심 편집 (드로잉 오버레이) | ⭐⭐⭐ | 높음 |
| 2 | HiTL UI | Provenance (왜 이렇게 나왔나) | ⭐⭐⭐ | 중간 |
| 3 | 시각 품질 | 소품 강제 주입 | ⭐⭐ | 낮음 |
| 4 | 시각 품질 | 모더레이션 우회 (상업 작품용) | ⭐⭐⭐ | 높음 |
| 5 | 다중 에피소드 | 프로젝트 단위 EntityCanon | ⭐⭐⭐ | 높음 |
| 6 | 다중 에피소드 | 스토리 타임라인 | ⭐⭐ | 중간 |
| 7 | 창작 지원 | 샷 리스트 수동 모드 | ⭐⭐ | 중간 |
| 8 | 출력 | 스토리보드 포맷 | ⭐ | 낮음 |
| 9 | 협업 | 리뷰·승인 워크플로 | ⭐ | 중간 |
| 10 | 운영 | 비용 상한 / 예측 | ⭐⭐ | 낮음 |

---

## 6. 🎯 논의 질문 (워크샵용)

### 감독·PD에게 물을 것

1. **최근 작품에서 AI 도구 사용 경험**은? 좋았던 점/답답했던 점?
2. **콘티 작업 시 가장 시간 오래 걸리는 단계**는? (캐릭터 디자인? 앵글 설계? 컬러?)
3. **AI가 자동 생성한 결과를 "수정"할 때, 가장 원하는 방식**은?
   - (a) 숫자/필드 직접 편집
   - (b) 이미지 위에 펜으로 표시
   - (c) 자연어로 "이것 좀 바꿔줘"
4. **시리즈 작품에서 에피소드 간 일관성** 유지는 어떻게 하시나요? 표준 문서? 감독 기억? 툴?
5. **잔혹·선정 장면**을 AI에게 얼마나 맡기시겠어요? 어느 선에서 사람이 직접 개입?
6. **"작품 전용 커스텀"** (장르별/감독별)이 가능하다면 가장 먼저 원하는 특화는?

### 기술팀에 확인할 것

1. 현재 미해결 **모더레이션 문제**는 AI 모델 선택으로 해결 가능한가?
2. **EntityCanon 프로젝트 단위 승격** 시 데이터 마이그레이션 비용은?
3. **드로잉 편집 UI** 도입 시 백엔드 변경 범위?

---

## 7. 부록: 주요 개발 히스토리 (참고)

**해결된 주요 버그/개선 (v0.5.x 시리즈)**:
- v0.5.4: shot_validator — 시점 혼합 버그 잡기
- v0.5.7: shot_staging v7 — 카메라 규칙 정비
- v0.5.8: scene_detail v4 + shot_selection 2중 캡 — 샷 과다 방지
- v0.5.10~14: visual_world_rules — 판타지 요소 판별 + 시나리오 의존 제거
- v0.5.16: shot-more — 씬 내 다중 순간 처리
- v0.5.19: scene_consistency — 씬 내 교차 샷 일관성
- v0.5.20~: 이미지 품질 4대 강화 (죽은 인물 variant, LLM 배경 선택, 극단 구도 방지, 인물 수 제한)
- v0.5.24~31: Phase 5 Frontend 리팩토링 (React Query, 컴포넌트 분할)
- v0.6.0: Backend silent failure 제거 (38건 로깅·주석 명시)

**아직 미해결**:
- 🔴 AI 모더레이션 우회 (잔혹·어린이·종교)
- 🔴 소품 강제 주입
- 🔴 물리법칙 해석 (공중 부양·중력 이상)
- 🔴 에피소드 간 인물 일관성 (프로젝트 단위 Canon)

---

## 8. 📎 참고 자료

- **전체 파이프라인 시각화**: `frontend/public/pipeline_explained.html` (일반인용)
- **기술 아키텍처**: `docs/architecture/00-overview.md` ~ `07-*.md` (개발자용)
- **변경 이력**: `CHANGELOG.md`
- **개발 메모**: `CLAUDE.md`

---

**다음 액션**: 이 문서를 초안 삼아 **영화 현장 인터뷰 1시간** 잡고, 위 6번 질문 중심으로 논의 → 우선순위 합의 → v0.7.0 로드맵 확정.
