TheRoad 전체 파이프라인 — 시나리오 입력 → 이미지 · 웹북 · HTML 출력

무엇을 하는 시스템인가: 시나리오 PDF 한 편을 넣으면 → 씬을 나누고 → 인물·장소·소품 카드를 만들고 → 씬마다 스틸컷(그림)을 뽑아 → 웹북(PDF)이나 HTML로 내보냅니다.
근거: 코드 원장 step_manifest.py(active 65스텝) + 내보내기 API 코드. 모델 표기는 2026-07-11 현행. 샘플 이미지는 5회차 E2E 기존 산출물을 복사(직행 캐논만 4회차) — 새로 만든 그림 없음.
색상 범례 — 노드·표 행 모두 같은 색 규칙:
글 LLM — 글을 읽고 쓰는 인공지능 이미지 생성 — 그림을 그리는 모델 VLM 판독 — 그림을 '보고' 판단하는 모델 코드 — 인공지능 없이 프로그램이 처리 ◆ 조건 분기 현재 꺼진 기능 입력/산출물

1. 전체 플로우차트

시나리오 PDF 업로드
◆ 기획안 PDF도 있나?
planning_doc_analysis — 기획안 분석
아니오
건너뜀
P1 텍스트 전처리 — 원고 정리·씬 나누기·요약·시각 규칙
P2 비트·샷 추출 — 씬을 사진 찍을 순간들로 분해
P3 엔티티 카드 — 인물·장소·소품·옷 카드 만들기
P4 연출 — 샷 선택·인물 배정·카메라·그림 주문서(T2I)
◆ 장소가 실내인가, 야외인가?
실내
도면(FP) 체인
야외
◆ 직행(W22) 기능 켜짐?
켜짐이면 (지금은 아님)
직행 3단계: 명세→대표사진→위치판정
꺼짐 (현재 상태)
항공뷰 3종 스택
P6-1 참조 사진 생성 — 얼굴→옷→합성→상태변형
P6-2 배경 그림 생성 — 실내 bg + 야외 plate
P6-3 씬 스틸 생성 — 참조 조립→번역→생성→검증
◆ 어떤 형태로 내보낼까?
갤러리
갤러리·캔버스 UI
웹북
웹북 패키지 (LLM 분절)
웹북 PDF
HTML
HTML ZIP (씬글+스틸 삽입)

2. 단계별 플로우차트

P1 — 입력·텍스트 전처리: 원고를 깨끗이 하고 씬으로 나눔

PDF 업로드
◆ 기획안 PDF 있나?
planning_doc_analysis
아니오
건너뜀
text_cleanup — 원고 청소
scene_segmentation — 씬 자르기
scene_save — 원문 저장 (LLM 없음)
episode_summary
visual_world_rules
scene_summary ×30

P2 — 비트·샷 추출: 씬을 '사진 찍을 순간'으로 분해

entity_character_list — 인물 명단 미리 뽑기
beat_extract — 씬→비트 ×30
shot_extract — 비트→샷 후보 ×30
shot_validator — 샷 규칙 검사 ×30

P3 — 엔티티 카드: 인물·장소·소품 카드 만들기

인물 명단·카드
장소 명단·카드
소품 명단·카드
entity_merge — 중복 합치기
entity_relation — 관계 연결 (변형·소유)
◆ 3씬 이하 등장?
entity_filter — 제거 판단
아니오
유지
entity_detail — 상세 보강
entity_t2i — 참조사진 주문서

P4 — 연출: 샷 고르고, 인물 배정하고, 그림 주문서 쓰기

shot_selection — 씬당 최대 3샷 선택
scene_director — 씬별 등장 인물 확정 → VE는 코드가 자동 구축
shot_director 기법2종
scene_camera_flow
shot_dependency 연결
outlook 1·2·3 — 옷 카드
shot_staging — 배치
scene_consistency — 교차 점검
scene_detail — 스틸 주문서 저작
◆ VE에 없는 인물을 썼나?
재시도 + 강제 제거 ↻
아니오
통과
shot_dependency_t2i
t2i_review — 일괄 검수

P5 — 배경 계획: 실내는 도면 방식, 야외는 항공뷰 방식 (조건 분기)

background_classify — 실내/야외 나누기
background_master_plan — 배경 계획표 (L03B01…)
◆ 실내? 야외?
실내 — 도면 체인
floor_plan_prompt — 도면 주문서
floor_plan_render — 도면 그리기
geometry_readback — VLM이 도면 되읽기
◆ 마커 겹침?
도면 다시 그리기 ↻
아니오
통과
shot_aware_bg_render_plan — 렌더 계획
background_prompt — '2026 대한민국' 앵커
야외 — 항공뷰 스택
outdoor_site_layout
항공 베이스
샷 블로킹
카메라 스케치
야외 직행 W22 — 현재 꺼짐
outdoor_place_spec — 마커 명세
outdoor_place_canon — 대표 실사+지도 (VLM 점수 판정)
outdoor_shot_grounding — 위치·카메라 판정
episode_reference_policy — 참조 규칙
연속성 앵커 (visual/zoom)
world_guide

P6 — 이미지 생성: 참조 사진 → 배경 → 최종 스틸 (재시도 루프 포함)

ref_image_gen — 참조 사진: 얼굴 → 옷 → 장소·소품
composite_image_gen — 얼굴+옷 합성 전신
character_state_variant — 상태 변형 (시신 등)
background_render — 배경 그리기 (실내=도면 참조 / 야외=항공뷰 참조)
◆ 검열(moderation)에 걸림?
문구 순화 후 1회 재시도 ↻
아니오
통과
scene_image_pipeline — 참조 꾸러미 조립 (배경+직전샷+구도가이드+인물합성)
prompt_translation — 주문서 영어 번역
스틸 생성 ×N (Gemini Image)
◆ 참조가 규칙대로 다 붙었나? (RCV)
위반
재시도 ↻
통과
scene_still 확정

P7 — 출력: 갤러리 / 웹북 PDF / HTML ZIP

분석·이미지 전부 완료
◆ 내보내기 선택
갤러리
갤러리·캔버스 UI에서 열람
웹북
generate-webbook — LLM이 연재 N화×섹션 M개로 나눔
webbook_package 저장
render-pdf — 세로 웹북 PDF 조판
HTML
export-html-zip
씬 원문을 문단으로 나누고 스틸 삽입 위치 계산
이미지 JPEG 변환(또는 원본) + ZIP

3. 스텝 상세 표 — 쉬운 설명 (active 65스텝, 실행 순서대로)

행 색: 초록=이미지 생성 개입, 보라=VLM(그림을 보고 판단) 개입, 흐림=현재 꺼진 기능. 배지: 유형 + 조건부 여부.

순서스텝유형모델무엇을 하나 (쉬운 설명)입력 → 출력조건
0planning_doc_analysis글 LLM조건부Gemini Flash-Lite기획안 PDF를 미리 읽고 작품의 배경 설정·인물 정보를 파악해 둡니다. 뒤 단계들이 이 지식을 참고합니다.기획안 PDF → 기획 분석 메모planning_doc
1text_cleanup글 LLMGemini Flash-LitePDF에서 뽑아낸 시나리오 글에서 페이지 번호·머리글 같은 잡티를 지워 깨끗한 원고로 만듭니다.업로드 원문 → 깨끗한 전문
2scene_segmentation글 LLMGemini 3.1 Flash긴 시나리오를 '씬(장면)' 단위로 자를 위치를 찾습니다.전문 → 씬 경계 목록
3episode_summary글 LLMGemini Flash에피소드 전체 줄거리를 한 문단으로 요약합니다. 뒤 단계들의 전체 맥락 역할.전문 → 줄거리 요약
4visual_world_rules글 LLMGPT-5.6 Sol이 작품의 시각 규칙을 뽑아 둡니다 — 귀신이 눈에 보이는 존재인지, 시대·장소는 어디인지 등. 감독 계열 단계들이 이 규칙(director_notes)을 계속 참고합니다.전문 → 시각 규칙
6scene_save코드코드잘린 씬들을 원문 그대로 DB에 저장합니다. LLM을 쓰지 않는 순수 저장 단계.씬 경계 → 씬 30개 저장
6.5entity_character_list글 LLMGPT-5.6 Sol시나리오에 나오는 등장인물 이름 목록을 미리 뽑아 둡니다. 뒤의 비트/샷 추출이 이 명단을 보고 인물을 정확히 지칭합니다.씬 전문 → 인물 명단
7scene_summary글 LLMGemini Flash씬 하나하나를 짧게 요약합니다 (30씬 병렬).씬 원문 → 씬 요약
7.1beat_extract글 LLMGemini 3.1 Pro각 씬을 '비트'(이야기가 한 번 움직이는 최소 단위)로 잘게 나눕니다.씬 원문 → 비트 목록
7.2shot_extract글 LLMGemini 3.1 Pro비트마다 사진 한 장으로 찍을 만한 순간(샷)을 골라냅니다. 한 샷 = 한 순간·한 장소가 원칙.비트 → 샷 후보
7.25shot_validator글 LLMGemini 3.1 Pro뽑힌 샷들이 규칙을 지켰는지 검사합니다 — 회상·몽타주가 섞이지 않았는지, 변신 전/후 인물이 섞이지 않았는지 등.샷 → 검증된 샷
8entity_all_character글 LLMGPT-5.6 Sol전체 샷을 훑어 실제 그림에 등장할 인물의 최종 명단을 확정합니다.전체 샷 → 인물 최종 명단
9entity_extract_character글 LLMGPT-5.6 Sol인물마다 생김새·변하지 않는 특징을 정리해 '인물 카드'(캐논)를 만듭니다. 변신하는 캐릭터는 형태별로 카드를 따로 만듭니다.명단 → 인물 카드
10entity_all_location글 LLMGPT-5.6 Sol이야기에 나오는 장소 목록을 확정합니다.전체 샷 → 장소 명단
11entity_extract_location글 LLMGemini 3.1 Pro장소마다 생김새 설명을 정리해 '장소 카드'를 만듭니다.명단 → 장소 카드
12entity_all_prop글 LLMGPT-5.6 Sol중요한 소품(사진, 주사기 같은 물건) 목록을 확정합니다.전체 샷 → 소품 명단
13entity_extract_prop글 LLMGemini 3.1 Pro소품마다 설명을 정리해 '소품 카드'를 만듭니다.명단 → 소품 카드
13.5entity_merge글 LLMGPT-5.6 Sol같은 대상이 이름만 다르게 두 번 등록된 경우를 찾아 하나로 합칩니다.카드 전체 → 중복 정리
13.6entity_relation글 LLMGPT-5.6 Sol카드끼리의 관계를 연결합니다 — 예: '이 검은 형상은 민숙의 변형이다'.카드 → 관계 연결
13.7entity_filter글 LLMGemini Flash3씬 이하로만 나오는 사소한 요소를 지울지 LLM에게 판단시킵니다.카드+등장 횟수 → 정리
14entity_detail글 LLMGPT-5.6 Sol카드의 외형 설명을 더 자세하게 다듬습니다.카드 → 상세 카드
15entity_t2i글 LLMGemini 3.1 Pro각 카드로 참조 사진을 만들 수 있게 그림 생성용 영어 문장(T2I 프롬프트)을 씁니다.카드 → 그림 주문서
15.5shot_selection글 LLMGemini Flash씬마다 실제로 그림으로 만들 샷을 최대 3개 고릅니다. 비슷한 그림이 중복되지 않게.샷 후보 → 선택 표시
16scene_director글 LLMGemini 3.1 Pro'씬 감독' — 각 씬에 어떤 인물이 등장하는지 최종 확정합니다. 이 확정 데이터로 코드가 샷별 등장 목록(VE)을 자동으로 만듭니다.씬+카드 → 인물 배정
16.5shot_director글 LLMGPT-5.6 Sol샷마다 카메라 촬영 기법을 2가지씩 정합니다 (→ 그림도 2가지 버전).선택 샷 → 촬영 기법 2종
17.05scene_camera_flow글 LLMGPT-5.6 Sol씬 안에서 카메라가 어떻게 이어질지(멀리→가까이 등) 흐름을 설계합니다.선택 샷 → 카메라 흐름
18.1shot_dependency글 LLMGPT-5.6 Sol이 샷이 앞의 어떤 샷과 같은 장소·인물인지 연결 관계를 찾습니다. 나중에 참조 사진으로 이어 붙일 근거.선택 샷 → 연결 그래프
19outlook_phase1글 LLMGemini 3.1 Pro인물들이 입는 옷(아웃룩) 목록을 뽑습니다.전문+카드 → 옷 목록
19.1outlook_phase2글 LLMGemini 3.1 Pro씬마다 누가 어떤 옷을 입고 있는지 짝을 맞춥니다.옷 목록 → 씬별 매핑
19.2outlook_phase3글 LLMGemini 3.1 Pro비슷한 옷을 합치고 정리해 최종 '옷 카드'(O01…)를 확정합니다.매핑 → 옷 카드
19.5shot_staging글 LLMGPT-5.6 Sol샷마다 인물이 어디에 서고 어떤 자세인지(블로킹)를 정합니다.선택 샷 → 배치 계획
19.51background_classify글 LLM조건부GPT-5.6 Sol장소마다 실내인지 야외인지 나눕니다. 이 결과로 배경 제작 방식이 갈립니다(실내=도면 방식 / 야외=항공뷰 방식).장소 카드 → 실내/야외 표background_mode
19.52background_master_plan글 LLM조건부GPT-5.6 Sol장소별로 배경 그림을 몇 장, 어떤 각도로 만들지 계획표(L03B01 같은 번호)를 짭니다.장소+샷 → 배경 계획표background_mode
19.61floor_plan_prompt글 LLM조건부GPT-5.6 Sol실내 장소의 평면도(도면)를 그리기 위한 주문서를 씁니다.실내 장소 → 도면 주문서background_mode
19.7shot_essence_extraction글 LLM조건부꺼짐GPT-5.6 Sol(꺼진 기능) 샷의 핵심만 요약.샷 → 요약shot_essence_enabled
19.9scene_consistency글 LLMGemini 3.1 Pro씬들 사이에 모순이 없는지 최종 교차 점검합니다.전체 확정 데이터 → 점검 결과
21.55floor_plan_render이미지 생성조건부GPT-5.6 Sol실내 평면도 이미지를 실제로 그립니다. 방·가구 위치에 알파벳 마커가 찍힌 도면.도면 주문서 → 도면 이미지background_mode
21.56floor_plan_light_sidecar글 LLM조건부GPT-5.6 Sol도면에 조명 정보(창·광원 위치)를 덧붙입니다.도면 → 조명 메모background_mode
21.57floor_plan_overlay_payload글 LLM조건부GPT-5.6 Sol도면 위 마커 라벨 표시용 데이터를 만듭니다.도면 → 마커 데이터background_mode
21.58base_location_dossier글 LLM조건부GPT-5.6 Sol장소에 대해 확정된 사실들을 한 문서로 모읍니다.장소+도면 → 장소 대장background_mode
21.59floor_plan_geometry_readbackVLM 판독조건부GPT-5.6 Sol그려진 도면을 VLM이 '눈으로 보고' 마커가 제대로 찍혔는지 되읽어 검사합니다. 마커가 겹치면 그 도면은 다시 그립니다(회차당 1~2장 발생하는 만성 이슈).도면 이미지 → 판독 결과background_mode
21.591floor_plan_semantic_readbackVLM 판독조건부GPT-5.6 Sol도면의 의미(어느 방이 어디인지)를 VLM이 되읽어 확인합니다.도면 이미지 → 의미 판독background_mode
21.593shot_projection_card글 LLM조건부GPT-5.6 Sol(조건부) 샷 카메라를 도면 위에 투영한 카드를 만듭니다.도면+샷 → 투영 카드background_mode
21.594bg_space_partition글 LLM조건부GPT-5.6 Sol(조건부) 큰 공간을 구역으로 나눕니다.도면 → 구역 나눔background_mode
21.5945dwelling_zone_map글 LLM조건부GPT-5.6 Sol(조건부) 주거 공간의 구역 지도를 만듭니다.도면 → 구역 지도background_mode
21.595shot_aware_bg_render_plan글 LLM조건부GPT-5.6 Sol샷의 카메라 각도를 반영해 배경 그림을 어떻게 변형해 만들지 계획합니다.샷+도면 판독 → 렌더 계획background_mode
21.6background_prompt글 LLM조건부GPT-5.6 Sol배경 그림 주문서를 씁니다. '2026년 대한민국'을 명시해 배경이 외국풍이 되는 것을 막는 지점.배경 계획표 → 배경 주문서background_mode
21.65episode_reference_policy글 LLMGPT-5.6 Sol그림 만들 때 어떤 참조 사진(배경/인물/직전 샷)을 붙일지 규칙을 정합니다.샷+카드 → 참조 규칙
21.66visual_continuity_anchor글 LLM조건부GPT-5.6 Sol(조건부) 샷 사이 시각 연속성을 잡아주는 기준점을 만듭니다.샷 → 기준점visual_continuity_anchor_enabled
21.7scene_detail글 LLMGemini 3.1 Pro샷마다 최종 그림 주문서(스틸 T2I)를 씁니다. 등장 목록(VE)에 없는 인물을 쓰면 자동으로 걸러내고 다시 씁니다.샷+VE+옷 카드 → 스틸 주문서
21.71shot_dependency_t2i글 LLMGemini Flash앞 샷과의 연결 정보를 주문서 문구에 반영합니다.연결 그래프 → 보강 주문서
21.72t2i_review글 LLMGPT-5.6 Sol주문서 전체를 한 번에 검토하고 규칙 위반을 고칩니다.전체 주문서 → 검수 결과
21.73zoom_continuity_anchor코드VLM 판독조건부GPT-5.6 Sol(조건부) 같은 장소를 당겨 찍은 샷을 위해 기존 그림에서 잘라낸 확대 참조를 만듭니다.샷 쌍 → 확대 참조zoom_continuity_anchor_enabled
21.76outdoor_site_layout글 LLM이미지 생성조건부GPT-5.6 Sol야외 장소를 위에서 내려다본 항공뷰 3종을 만듭니다 — ①마커 찍힌 기본 항공뷰 ②인물 위치 표시 ③카메라 위치 스케치. (오래 걸리는 단계, 90분+ 사례)야외 장소+샷 → 항공뷰 3종outdoor_site_layout_enabled
21.77outdoor_place_spec글 LLM조건부꺼짐GPT-5.6 Sol[꺼짐] 야외 장소의 구역·마커 명세서를 씁니다. 시나리오에 근거 있는 것만(evidence-bound).씬 근거 → 마커 명세outdoor_direct_compose
21.78outdoor_place_canon이미지 생성VLM 판독조건부꺼짐GPT-5.6 Sol[꺼짐] 야외 장소의 대표 실사 사진과 지도를 만듭니다 — 후보 3장을 생성하고 GPT/Gemini VLM이 점수를 매겨 뽑은 뒤, 결함을 고치고 지도로 재투영.명세 → 대표 실사+지도outdoor_direct_compose
21.79outdoor_shot_grounding글 LLM조건부꺼짐GPT-5.6 Sol[꺼짐] 각 샷이 지도의 어느 지점에서, 어느 방향을 보고 찍는지 판정합니다.지도+샷 → 위치·카메라 판정outdoor_direct_compose
22world_guide글 LLMGPT-5.6 Sol지금까지의 확정 내용을 모아 월드 가이드 문서를 만듭니다.전체 산출물 → 가이드 문서
22.5space_set_bg글 LLM조건부꺼짐GPT-5.6 Sol(조건부) 공간 세트 배경.background_mode
23ref_image_gen이미지 생성Gemini 3.1 Flash Image카드들의 참조 사진을 실제로 그립니다 — 1차: 인물 얼굴(증명사진풍) → 2차: 옷(마네킹 착장) → 장소·소품 순.그림 주문서 → 참조 사진들
24composite_image_gen이미지 생성조건부Gemini 3.1 Flash Image인물 얼굴 + 옷을 합쳐 '이 옷을 입은 이 사람' 전신 사진을 만듭니다. 스틸을 그릴 때 실제로 첨부되는 인물 참조.얼굴+옷 → 합성 전신has_outlooks
24.5character_state_variant이미지 생성Gemini 3.1 Flash Image특수 상태의 인물 사진을 만듭니다 — 예: 시신 상태. 기존 합성 사진을 변형(i2i).합성 사진+상태 → 상태 변형
24.72background_render이미지 생성조건부GPT-5.6 Sol배경 그림을 실제로 그립니다. 실내는 도면을 참조로, 야외는 항공뷰를 참조로. 검열에 걸리면 문구를 순화해 1회 재시도.배경 주문서+도면/항공뷰 → 배경 그림background_mode
25scene_image_pipeline이미지 생성VLM 판독혼합최종 스틸을 그립니다. ①참조 꾸러미 조립(배경+직전 샷+구도 가이드+인물 합성) → ②주문서 영어 번역 → ③그림 생성(샷당 N장) → ④참조가 규칙대로 다 붙었는지 코드 검증(RCV) — 위반이면 재시도.주문서+참조 → 씬 스틸
100outlook_dedup글 LLM요청 시GPT-5.6 Sol(요청 시) 옷 카드 중복 정리.옷 카드 → 병합

4. 내보내기 (웹북 · PDF · HTML) — 쉬운 설명

기능이름무엇을 하나입력 → 출력
generate-webbook웹북 패키지 만들기시나리오 전문 + 인물 카드 + 스틸들을 모아 LLM에게 주고, 웹 연재용으로 몇 화(기본 4화) × 화당 몇 섹션(기본 10개)으로 나눠 달라고 합니다. 섹션 제목도 같이 짓습니다. 결과는 DB에 저장.전문+카드+스틸 → 연재 분절 패키지
render-pdf웹북 PDF 만들기위 패키지와 스틸 이미지를 합쳐 세로로 긴 웹툰형 PDF를 조판합니다.패키지+이미지 → 웹북 PDF
export-html-zipHTML 묶음 내보내기에피소드마다 HTML 한 장을 만듭니다 — 씬 원문을 문단으로 나누고, 각 씬의 선택 스틸을 본문 사이 적절한 위치에 끼워 넣습니다. 참조 사진 섹션도 포함. 이미지는 용량 절감용 JPEG 변환본과 원본 두 가지로 ZIP.전문+스틸 → 글·그림 섞인 HTML ZIP

5. 단계별 실제 샘플 (기존 산출물 복사 — 새 생성 0)

단계설명샘플
씬 원문 (scene_save)모든 단계의 원천 — S11 발췌. LLM에는 항상 전문을 전달(자르기 금지)
episode_summary에피소드 줄거리 요약
도심과 숲속에서 기괴한 변사체가 발견되던 중, 수리영은 엄마 민숙의 실종을 겪는다. 집안에서 난도질당한 엄마의 시신과 옛 사진을 목격하지만, 경찰 혜수와 함께 돌아왔을 땐 시신과 혈흔이 감쪽같이 사라져 있었다. 헛것을 본 것이라 의심받는 상황에서 집안은 다시 난장판이 되고, 벽에는 붉은 원 문양이 나타난다. 수리영은 엄마의 휴대전화 마지막 GPS 좌표가 바다 한가운데를 가리키고 있음을 알아채고, 엄마의 과거 사진 속 '금월'이라는 단서를 쫓아 포구로 향한다. 우연히 선원 인우의 배를 타고 금월도로 향하던 중, 인우는 사진과 민숙의 이름을 듣고 사색이 되어 뱃머리를 돌리려 한다. 그 순간 수리영은 배 안에서 기이한 붉은 원들을 목격한 뒤 의식을 잃고, 배는 안개 속으로 사라진다.
shot + 등장 목록(VE)S11sh4 — 샷 설명·비트·등장 인물
[샷 설명] 철제 파이프 난간을 손으로 잡은 수리영이 코끝을 찡그린 채 계단 중간에 서 있는 얼굴 클로즈업
[비트] 역겨운 냄새에 멈칫하는 수리영
[등장 목록 VE] [{"short_id": "C01", "id": "fe558d44-4a72-49f2-9a4d-431176a4568a", "entity_name": "수리영"}, {"short_id": "L11", "id": "750c3e77-8e4c-4810-b68b-a401cdbc580b", "entity_name": "다세대 빌라 외부 철제 증축 계단"}]
entity_t2i (그림 주문서)C13 한국인 남성 보안직원 — 참조 사진용
Set in 2026 contemporary era, South Korea. Passport-style ID photo, head and upper chest visible. A Korean adult male with neat, short black hair. He has an average face shape and clean-cut, ordinary facial features. Photorealistic cinematic style, tense Korean folk-occult thriller aesthetic, muted natural colors, low-key contrast, subdued brightness, plain white background.
scene_detail (스틸 주문서)선택 샷의 최종 T2I — 인물 코드(C##O##)는 코드가 조립
Photorealistic cinematic still. C01O01 in a khaki sweatshirt, a Korean young woman in her 20s with long black hair, an oval young face, soft facial features, and a natural skin tone, seen at three-quarter angle from the right. Her gaze is fixed off-screen, nose pinched and brow furrowed in a distressed reaction, her climb stalled. One hand enters the lower frame edge, braced tightly on the pipe railing of [L11: an added exterior steel stair with thin steel-plate stringers, support posts, and open treads falling away into the deep shadow behind her]. Low-key, subdued nighttime ambient lighting envelops the outdoor space, casting deep shadows that conceal the surrounding background details and maintaining a dark atmosphere without any unmotivated artificial light sources. The close framing f
ref_image_gen — 얼굴인물 얼굴 참조 (증명사진풍)
ref_image_gen — 옷옷(아웃룩) 참조 (마네킹 착장)
composite_image_gen얼굴+옷 합성 전신 — 스틸 생성에 실제 첨부
character_state_variant상태 변형 (기존 사진을 i2i 변형)
floor_plan_render실내 도면 — 마커 라벨 포함
도면 주문서 발췌도면 그리기에 실제 쓰인 프롬프트
Create a square 1024 by 1024 flat top-down schematic architectural floor plan of an older low-rise multifamily-building rooftop and the exterior footprint of its compact rooftop room. Use a clean CAD-plan appearance with uniform single-weight black outlines on a white or off-white background, geometric plan symbols only, and minimal text. Strictly exclude 3D, isometric, perspective, axonometric, depth, shadows, shading, gradients, ambient occlusion, photorealism, rendered lighting, textures, and material rendering. Fill each zone with one consistent flat pastel solid color: the open rooftop utility/exterior deck in pale gray, the enclosed rooftop-room private zone in pale blue, the entry and
background_render — 실내도면을 참조로 그린 실내 배경 (옥탑방 내부)
background_render — 야외항공뷰를 참조로 그린 야외 배경 (철제 증축 계단)
배경 주문서 발췌'2026 대한민국' 앵커가 들어간 배경 프롬프트
STYLE CONTRACT — ordinary, modest, lived-in residential interior. Treat the result as an actual reference photograph of a real home: everyday materials, believable wear, modest furniture in plain shapes, natural daylight or simple ceiling lighting. Strictly avoid luxury, showroom, hotel-suite, boutique-design, high-end-retail, or magazine-staging styling. No marble surfaces, no chandeliers, no designer furniture, no polished decor displays, no curated styling props, no glossy magazine finish.

Use the supplied base floor plan as the only visual reference. Render a fresh photoreal interior under the modest style contract; treat the base markers as spatial guidance, not as overlay material.

R
outdoor_site_layout — 항공 베이스야외 장소 마커 항공뷰
outdoor_site_layout — 샷 블로킹인물 위치 표시 항공뷰
outdoor_site_layout — 카메라 스케치카메라 위치 스케치
location_aerial장소 항공 캐논
outdoor_place_canon — 실사 [꺼짐]직행 체인의 장소 대표 실사 (4회차 산출)
outdoor_place_canon — 지도 [꺼짐]직행 체인의 탑다운 지도 (4회차 산출)
캐논 주문서 발췌 [꺼짐]대표 실사 생성 프롬프트 (4회차)
A photorealistic 45-degree high aerial photograph of a real filming
location, shot in neutral daylight. No reference image is attached —
build the scene from this text alone.

LAYOUT:
The outdoor site is organized around a dog confinement enclosure and an adjoining shelter work area. The enclosure forms one side of the usable exterior space, while the work area runs directly alongside it so a handler or camera can move parallel to the enclosure and approach its occupied side. Camera positions for both close confrontation coverage and low grooming coverage belong in the work area, oriented toward subjects positioned beside the enclosure.

ELEMENTS (describe by appearance only — the photograph
zoom_continuity_anchor확대 연속성 크롭
registered_pose_guide [꺼짐]실내 공유 포즈 가이드 (현재 꺼짐)
scene_image_pipeline — 최종 스틸 1완성 씬 스틸
scene_image_pipeline — 최종 스틸 2완성 씬 스틸 (S13)
스틸 최종 프롬프트 발췌번역까지 끝나고 실제 생성에 쓰인 프롬프트
Photorealistic cinematic still.

Reference image 1: character appearance reference: Korean 40대 중반 여성. 단정한 검은 머리와 성숙한 타원형 얼굴, 또렷하고 차분한 이목구비.

the character from Image 1 in a dark leather detective jacket, a Korean middle-aged woman, facing the camera. Positioned directly before her at eye level, her deeply furrowed face occupies most of the frame in sharp shallow focus. She is looking down, shoulders curled, her eyes leading toward a smartphone held along the lower edge. The screen side of the phone faces her and angles away from the view, leaving its displayed content unreadable. [: soft, out-of-focus dim wall surface immediately behind her]. Subdued low-key dusk ambient light wraps her rigid expression in muted natural colors, isolating the tension between her brow and the unseen screen.
웹북/HTML 출력웹북 생성 이력이 아직 0건이라 이미지 샘플 없음 — 흐름은 §4 표와 P7 플로우차트 참조
샘플 없음 (기존 이미지만 사용 원칙)

6. 지금은 쓰지 않는(deprecated) 스텝 — 삭제 금지 규칙으로 보존

스텝라벨상태
scene_split큰 씬 분할 (레거시)deprecated
scene_cinematography촬영 감독 (레거시)deprecated
shot_cinematographyShot별 촬영 기법 (deprecated)deprecated
scene_dependency씬 연관 분석 (레거시 — disabled)deprecated
outlook_extraction아웃룩 추출 (레거시)deprecated
background_planner배경 생성 Planner (deprecated, Phase 7로 대체)deprecated
background_chain_planning배경 chain 플래닝 (deprecated, Phase 7로 대체)deprecated
scene_verify교차 검증 (레거시)deprecated
location_floor_plan위치 도면 생성 (deprecated, Phase 7로 대체)deprecated
background_chain_render배경 chain 렌더 (deprecated, Phase 7로 대체)deprecated
project_summary프로젝트 요약 (미구현)removed

알아두면 좋은 규칙 (쉬운 판)

생성 2026-07-11 · 빌더 scratchpad/forest_exp/pipeline_doc/build_doc.py · 코드 근거: step_manifest.py / export_service.py / exports.py / webbook_generator.py / pdf_renderer.py