# LLM 모델 사용 현황 (v5)

## 파이프라인별 모델 매핑

| 단계 | 모델 | 용도 | 처리 |
|------|------|------|------|
| Turn 0 스타일 분석 | `gemini-3-flash-preview` | 시나리오 읽고 세계관/스타일 추출 | 순차 |
| Turn 1 요소 리스팅 | `gemini-3-flash-preview` | 인물/배경/물체 이름 + 출현횟수 | 순차 |
| Turn 1.5 요소 리뷰 | `gpt-5.5` | 요소 목록 적절성 검증/필터링 | 순차 |
| Turn 1.7 요소 상세 일괄 | `gpt-5.5` | 전체 시나리오 기반 요소별 외형 상세 | 순차 |
| Turn 2+ 요소 T2I 생성 | `gemini-3-flash-preview` | 각 요소 T2I 프롬프트 생성 | **병렬** |
| 씬 분할 | `gemini-3.1-flash-lite-preview` | 긴 씬 2분할 | 순차 |
| 시각적 연관 씬 추출 | `gemini-3-flash-preview` | 앞/뒤 시각 연관 씬 매핑 | 순차 (1회) |
| 아웃룩 추출 | `gemini-3.1-pro-preview` | 의상 담당자: 전체 아웃룩 + 씬별 매핑 | 순차 (1회) |
| 씬 상세 분석 | `gemini-3-flash-preview` | 구도 중심 T2I + N개 카메라 변형 | **병렬** (큐) |
| T2I 프롬프트 변환 | `gemini-3-flash-preview` | 마커→영어 변환 + 참조 지시 | 씬별 |
| 참조 이미지 생성 | `gemini-3.1-flash-image-preview` | 얼굴/배경/물체 T2I | **병렬** |
| 인물+아웃룩 합성 | `gemini-3.1-flash-image-preview` | 합성 풀바디 T2I | **병렬** |
| 씬 이미지 생성 | `gemini-3.1-flash-image-preview` | 씬당 N개 이미지 | **병렬** (배치) |
| 대표 이미지 선택 | `gpt-5.5` | N개 중 1개 선택 | 씬별 |
| 프로젝트 요약 재생성 | `gemini-3-flash-preview` | 에피소드 요약 합산 | 순차 |
| ~~변형 추천~~ | ~~gpt-5.5~~ | ~~앵글+색감 추천~~ | **비활성화** |
| ~~변형 I2I 생성~~ | ~~gemini-3.1-flash-image-preview~~ | ~~앵글+색감 I2I~~ | **비활성화** |

## 설정 (config.py / .env)

```
gemini_text_model = "gemini-3-flash-preview"
gemini_lite_model = "gemini-3.1-flash-lite-preview"
gemini_image_model = "gemini-3.1-flash-image-preview"
openai_model = "gpt-5.5"

max_concurrent_image_gen = 15
max_concurrent_variation = 10
max_concurrent_entity_detail = 10
scene_variation_count = 3       # 씬당 N개 이미지 (1 base + N-1 카메라변형)
scene_segment_context_chars = 100
llm_max_output_tokens = 65536
```

## v5 파이프라인 흐름

```
요소 추출 (Turn 0~2+)
  ↓
씬 분할 (정규식 + Gemini lite)
  ↓
시각적 연관 씬 추출 (Gemini 3 Flash, 1회)
  ↓
아웃룩 추출 (Gemini 3.1 Pro, 1회 — 의상 담당자)
  ↓
씬 상세 분석 (Gemini 3 Flash, 병렬 큐)
  - 구도 중심 설명
  - N개 T2I: 1 base + N-1 카메라/색감 변형
  - 연관 씬 참조 포함
  ↓
참조 이미지 생성 (얼굴 + 배경 + 물체 + 인물+아웃룩 합성)
  ↓
씬 이미지 생성 (씬당 N개, 병렬)
  - T2I 변환 (Gemini Flash: 마커→영어)
  - 참조 이미지 매칭 (합성 우선)
  ↓
대표 이미지 선택 (GPT 5.4: N개 중 1개)
```

## 역할 구분

- **Gemini 3 Flash**: 텍스트 분석 (스타일, 요소, 씬, 변환, 연관)
- **Gemini 3.1 Flash Lite**: 보조 작업 (씬 분할)
- **Gemini 3.1 Pro**: 대형 작업 (아웃룩 전체 추출)
- **Gemini 3.1 Flash Image**: 이미지 생성 (T2I)
- **GPT 5.4**: 판단/검증 (리뷰, 상세, 병합, 대표 선택)
