# 🗺️ 00 — 전체 그림: 시나리오 PDF가 웹북이 되는 여정

---

## 여러분이 시작하는 곳

**여러분이 가진 것**: 시나리오 PDF 파일 1개 (예: "금월도 1부.pdf", 18페이지)

**AI가 만들어 주는 것**:
- 🎨 **스틸컷 수십 장** (씬마다 핵심 순간을 그린 이미지)
- 📖 **웹북 PDF** (스틸컷 + 설명 텍스트를 엮은 완성본)
- 📚 **인물/장소/소품 카드** (작품 사전처럼 관리 가능)

**걸리는 시간**: 시나리오 1편(18~30페이지)에 대략 **분석 20~40분 + 이미지 생성 20~40분 = 40~80분**

---

## 전체 여정을 한눈에

```mermaid
flowchart TD
    Start([📄 시나리오 PDF 업로드]) --> A

    subgraph A [📄 1단계: 시나리오 읽기]
        A1[PDF를 깨끗한 텍스트로]
        A2[씬 단위로 나누기]
        A3[에피소드 요약]
    end

    A --> B

    subgraph B [👥 2단계: 등장 요소 발견]
        B1[인물 찾기<br/>예 - 수리영 민숙]
        B2[장소 찾기<br/>예 - 옥탑방 바닷가]
        B3[소품 찾기<br/>예 - 손목시계]
    end

    B --> C

    subgraph C [📷 3단계: 샷 설계]
        C1[씬 안의 중요한 순간들 찾기]
        C2[어떤 샷을 웹북에 넣을지 선택]
    end

    C --> D

    subgraph D [🎭 4단계: 연출 결정]
        D1[카메라 앵글 - 위? 눈높이?]
        D2[누가 몇 명 나올지]
        D3[옷 입음 상태 - 한복? 양복?]
        D4[같은 씬 안에서 일관성]
    end

    D --> E

    subgraph E [🖼️ 5단계: 이미지 만들기]
        E1[인물 얼굴 참조 이미지]
        E2[씬 이미지 생성]
        E3[품질 검증 & 재생성]
    end

    E --> F

    subgraph F [✨ 6단계: 사용자 편집]
        F1[마음에 안 드는 부분 수정]
        F2[앵글 조정 / 색감 변경]
        F3[이미지 재생성]
    end

    F --> End([📕 웹북 PDF 완성])

    style Start fill:#6386FF,color:#fff
    style End fill:#22c55e,color:#fff
    style F fill:#4f46e5,color:#fff
```

---

## 각 단계가 하는 일

### 📄 1단계: 시나리오 읽기

PDF 파일에는 **글자 외에 이미지·표·특수 문자**도 섞여 있습니다. AI가 읽기 전에 **깨끗한 순수 텍스트**로 만들어야 합니다.

그 다음, 시나리오를 **씬 단위**로 잘라냅니다. "S1. 옥탑방, 밤" 같은 씬 헤딩을 기준으로요.

**입력**: PDF 1개
**출력**: 씬 30~70개 (각각 독립된 텍스트 덩어리)

---

### 👥 2단계: 등장 요소 발견

시나리오를 읽으며 AI가 **세 가지를 찾아냅니다**:

1. **인물** — 주인공·조연·엑스트라. 이름·나이·외모·성격 정리
2. **장소** — 씬이 펼쳐지는 공간. 옥탑방·해변·차 안 등
3. **소품** — 중요한 물건. 손목시계·편지·칼 등

각 요소는 **카드 형태**로 정리됩니다. 카드에는:
- 이름 (예: 민숙)
- 시각적 특징 (예: 40대 중반 여성, 검정 긴머리, 해녀복)
- 짧은 ID (예: C01, L01, P01 — AI가 내부적으로 사용)

---

### 📷 3단계: 샷 설계

**"한 씬 = 여러 순간"** 입니다. 예를 들어 "민숙이 바다에 들어가서 잠수한다"는 씬은:
- 순간 1: 민숙이 해변에서 장비 착용
- 순간 2: 바다에 들어가는 뒷모습
- 순간 3: 수면 아래 잠수하는 모습

AI는 이런 **중요한 순간(샷)들**을 찾고, 웹북에 몇 개를 넣을지 결정합니다.

---

### 🎭 4단계: 연출 결정

각 샷마다 **구체적인 연출**을 정합니다:
- 카메라 각도 (위에서? 인물 눈높이?)
- 몇 명이 보일지 (1명? 2명? 군중?)
- 인물 의상 (평상복? 한복? 물에 젖음?)
- 조명 (낮? 밤? 노을?)

**중요**: 같은 씬 안의 여러 샷이 **일관되어야 합니다**. 1번 샷에서 왼쪽 어깨 다친 인물이 2번 샷에서 오른쪽 어깨 다쳤으면 이상하잖아요?

---

### 🖼️ 5단계: 이미지 만들기

드디어 AI가 **그림을 그립니다**.

**먼저 참조 이미지**를 만듭니다 — 각 인물의 얼굴을 미리 한 번 생성해 놓고, 이후 씬마다 "이 얼굴로 그려줘"라고 AI에게 지시.

**다음 씬 이미지**를 생성. 한 샷당 보통 2~3개 변형(다른 각도/스타일)을 만들어 선택 폭을 넓힘.

**마지막 품질 검증**: AI가 다시 한번 이미지를 보고 "인물이 바뀌었는지", "장소가 맞는지" 등을 체크합니다.

---

### ✨ 6단계: 사용자 편집

AI가 만든 결과를 사람(감독·작가)이 **검토하고 수정**합니다.

수정할 수 있는 것:
- **앵글 편집** — "좀 더 가까이" / "살짝 옆에서"
- **색감 편집** — "더 어둡게" / "노을 빛으로"
- **재생성** — "이건 마음에 안 들어, 다시 그려줘"
- **엔티티 추가/제거** — "이 샷에 민숙 넣어줘" / "이 인물 빼줘"

---

## 전체를 관통하는 두 가지 원칙

### 1. **단계별 저장 (체크포인트)**

각 단계 결과를 **파일로 저장**합니다. 나중에 특정 단계만 다시 실행해도 앞 단계 결과는 재사용.

예: 이미지만 다시 만들고 싶을 때, 인물/장소 분석은 건드릴 필요 없음.

### 2. **일관성 유지**

여러 단계에 걸쳐 **같은 사실이 유지**되도록 관리합니다.
- 민숙의 얼굴은 참조 이미지와 씬 이미지가 같아야 함
- 옥탑방은 샷 1과 샷 5에서 같은 벽지·가구로 보여야 함
- 죽은 인물은 다음 씬에서 움직이지 않아야 함

---

## 이게 왜 어려운가요?

AI는 **놀랍도록 똑똑하지만 놀랍도록 멍청**합니다:
- 시나리오를 잘 이해하고 있다가도
- 갑자기 "민숙이 민숙을 봤다" 같은 시점 혼동 문장을 생성
- 같은 사람 얼굴인데 씬마다 조금씩 달라짐
- 죽은 사람이 다음 씬에서 걸어다님

이런 문제들을 **각 단계에서 하나씩 방지**하려고 단계를 30개 이상으로 쪼갠 겁니다.

---

## 다음 읽을 파일

**이제 각 단계를 자세히 살펴봅시다**:

→ [01-text-reading.md](./01-text-reading.md) — 시나리오 읽기

---

## 🤔 FAQ (자주 묻는 질문)

**Q: 내가 수정한 부분이 다음에 다시 분석되면 사라지지 않나요?**
A: 사용자 편집은 **표시되어 보존**됩니다. 재분석할 때 덮어쓰지 않습니다.

**Q: 에피소드 여러 개면 인물 얼굴이 유지되나요?**
A: **현재는 에피소드마다 독립** 분석입니다. 에피소드 간 동일 인물 얼굴 일관성은 **다음 개발 우선순위**입니다 (`docs/product-roadmap-discussion.md` 참조).

**Q: 영어 시나리오도 되나요?**
A: 현재는 한국어 중심. 영어 직접 처리는 **향후 과제**.

**Q: 잔혹 장면이나 선정 장면도 이미지 나오나요?**
A: AI 모더레이션 때문에 **일부 제한**됩니다. 상업 작품용 우회 방법은 논의 중입니다.
