Product UI Snapshot · 비전문가용 개발 현황

TheROAD
현재 개발된 화면과 기술을 한눈에 보는 대시보드

TheROADReality-Oriented AI Direction의 약자입니다. 글로 된 작품을 읽고, 인물·소품·장소·구도를 구조화한 뒤, 이미지와 향후 동영상 제작까지 이어지도록 감독 보조 데이터를 만드는 플랫폼입니다.

시나리오/소설 입력 인물·소품·장소 분해 도면·마네킹 스케치 샷별 이미지 생성 영상 생성 확장 예정

개발 현황 요약

아래 숫자는 투자자와 비전문가가 이해하기 쉬운 방식으로 정리한 현재 기능 상태입니다. 실제 화면 스크린샷이 아니라 제품 흐름을 설명하는 UI 스냅샷입니다.

구현 글 분석, 엔티티 추출, 이미지 파이프라인, 캔버스 연결
검증 중 공간 일관성, 배경 체이닝, 마네킹 구도 보조
확장 샷 이미지에서 짧은 영상 클립으로 이어지는 구조
목표 AI가 만든 결과를 사람이 감독하듯 추적·수정 가능하게
Pipeline Canvas

한 장면이 어떻게 만들어졌는지 연결해서 보는 화면

현재 개발의 핵심 UI는 “이미지 하나”가 아니라, 그 이미지가 어떤 글, 어떤 인물 참조, 어떤 배경 도면, 어떤 마네킹 스케치를 거쳐 만들어졌는지 연결관계로 보여주는 캔버스입니다.

Mock UI · 현재 기능 설명용
Episode 1 · 생성 트리
전체 가이드 배경
입력 참조 자산 공간·구도 결과
시나리오장면·대사·행동
기획안세계관·톤·설정
인물 조합얼굴 + 의상 + 상태
소품 참조크기·착용·사용법
장소 기준도면·블록·배치
배경 Plate장소별 실제 배경
마네킹 스케치포즈·카메라 구도
구도 분석이미지 모델용 방향
최종 샷검토 가능한 컷
수정 후보문제 원인 추적
영상 확장향후 클립 생성
What is already visible

현재 화면에서 보여줄 수 있는 개발 성과

TheROAD의 강점은 결과 이미지만 저장하는 것이 아니라, 그 결과를 만든 중간 재료와 판단 과정을 함께 남기는 데 있습니다. 비전문가도 “어떤 기준으로 만들어졌는지”를 화면에서 따라갈 수 있습니다.

C

캐릭터 조합 화면

인물은 단일 이미지가 아니라 얼굴, 의상, 나이 든 모습, 다친 모습, 사망 상태 같은 변형을 조합해 장면에 맞게 사용합니다.

Character Setface · outfit · state
P

소품 사용 방식

소품은 그냥 물건 사진이 아니라, 사람이 어떻게 쥐고, 착용하고, 어느 정도 크기로 보여야 하는지까지 추정하는 구조입니다.

Prop + Body Fitscale · hold · wear
소품
마네킹
장면
B

가장 어려운 배경 처리

같은 장소가 매 컷마다 달라지는 문제를 줄이기 위해, 도면·조감도·블록 구조· 이전 배경 이미지를 연결해 장소의 기준을 잡습니다.

Location Chainplan · plate · shot
도면
배경
G

마네킹 구도 스케치

복잡한 액션이나 카메라 방향이 필요한 장면은 실제 인물 이미지를 바로 만들기 전에 단순 마네킹 스케치로 포즈와 위치를 먼저 검토합니다.

Pose Guidecomposition first
배경
마네킹
최종
T

샷 생성 트리

최종 이미지 하나를 클릭하면 어떤 캐릭터, 어떤 배경, 어떤 구도 가이드가 입력으로 들어갔는지 트리로 확인할 수 있습니다.

Shot Treedirect inputs
캐릭터
+
배경
+
가이드
V

영상 생성 확장 준비

현재는 샷 이미지와 제작 기준을 고도화하는 단계입니다. 다음 단계는 확정된 샷과 구도 정보를 영상 모델에 전달해 짧은 클립과 프리비즈로 확장하는 것입니다.

Video Roadmapimage → clip
움직임
클립
Why this matters

같은 AI 모델을 쓰더라도, 참조 선택이 결과를 바꿉니다

영상 제작자는 같은 장소라도 어떤 사진을 먼저 보여주느냐, 어떤 도면을 기준으로 삼느냐, 어떤 구도 스케치를 넣느냐에 따라 전혀 다른 결과가 나온다는 것을 압니다. TheROAD는 이 과정을 “감”이 아니라 “추적 가능한 구조”로 바꿉니다.

쉬운 비유:
파운데이션 모델은 아주 뛰어난 미술팀에 가깝습니다. 하지만 미술팀에게 “무엇을 참고해야 하는지”를 잘못 주면 결과도 엉뚱해집니다. TheROAD는 감독과 조감독처럼, 장면마다 필요한 참조 자료를 골라주고 순서를 정하고, 결과가 앞뒤 장면과 맞는지 확인합니다.
기술적 차별점:
단순한 텍스트 프롬프트가 아니라, 인물·소품·장소·구도·연속성 정보를 분해하고 다시 연결합니다. 이 구조가 있어야 4C, 즉 Character, Context, Composition, Continuity를 더 안정적으로 지킬 수 있습니다.
현재 개발 방향: 여러 LLM, 이미지 모델, 향후 비디오 모델을 상황에 맞게 선택하고, 각 모델이 잘하는 일과 약한 일을 나눠 맡기는 구조입니다. 하나의 거대한 모델에 모든 판단을 맡기는 것이 아니라, 감독 보조 시스템이 필요한 자료를 준비하고 순서를 설계합니다.
Roadmap View

개발 현황을 단계로 보면

아래는 현재 개발된 영역과 앞으로 확장할 영역을 비전문가가 이해하기 쉬운 단계형태로 정리한 것입니다.

1

읽고 분해하기

시나리오, 소설, 웹소설, 기획안을 받아 씬·샷·인물·장소·소품으로 나눕니다. 현재 파이프라인의 기본 골격입니다.

2

제작 기준 만들기

인물 조합, 소품 사용 방식, 장소 도면, 배경 기준 이미지를 생성합니다. 현재 가장 많이 고도화 중인 영역입니다.

3

구도와 최종 컷

마네킹 스케치와 구도 분석을 거쳐 최종 샷을 만듭니다. 결과와 중간 자료의 연결관계가 캔버스에 표시됩니다.

4

영상 생성 확장

확정된 샷 이미지와 구조 데이터를 영상 모델에 전달해 짧은 클립, 프리비즈, 피칭 영상으로 확장할 예정입니다.

사업적으로 보여줄 수 있는 그림: TheROAD는 “AI 이미지 생성기”보다 넓은 제품입니다. 글을 제작 데이터로 바꾸고, 그 데이터가 이미지와 영상으로 이어지도록 관리하는 제작 운영 레이어입니다.