AI 단편 영화를 만들 때 가장 어려운 일은 멋진 샷 하나를 생성하는 것이 아닙니다. 1분이 지난 뒤에도 이야기, 인물, 공간, 소리, 리듬이 같은 작품 안에서 이어지게 만드는 일입니다. 모델에 "서스펜스 단편을 만들어 줘"라고 한 번만 요청하면 얼굴이 바뀌고, 방 구조가 달라지고, 소품이 사라지거나, 각 샷은 보기 좋지만 서로 연결되지 않는 결과가 나오기 쉽습니다.
이 가이드는 약 75초 분량의 서스펜스 이야기 문을 열지 마를 예시로 AI 단편 영화 만드는 법을 설명합니다. 한 문장의 아이디어에서 시작해 대본, 인물과 공간 설정, 8개 샷 스토리보드, 키프레임, 샷별 프롬프트, 음성, 환경음, 최종 편집까지 순서대로 진행합니다. 보이는 인물 한 명, 아파트 한 곳, 문 하나, 스마트폰 한 대만 사용해 너무 많은 변수를 다루지 않고 이야기와 연속성에 집중합니다.
완성된 AI 단편 영화를 만들려면 이야기를 통제 가능한 하나의 사건으로 줄이고, 대본을 개별 생성과 수정이 가능한 샷으로 나눕니다. 인물, 의상, 공간, 주요 소품을 먼저 고정한 다음 스토리보드와 키프레임을 만드세요. 이후 동작, 대사, 소리를 샷별로 생성하고, 편집과 연속성 검수로 관객이 이해할 수 있는 한 편의 영상으로 조립합니다.
AI 단편 영화는 한 번에 생성하지 않는다
현재 영상 모델은 한 번의 생성으로 60~90초 동안 인물, 공간, 이야기의 연속성을 유지하는 것보다 조건이 분명한 샷 하나를 완성하는 데 더 능숙합니다. 통제 가능한 AI 영상 제작 흐름은 소규모 촬영팀과 비슷합니다. 대본을 먼저 쓰고, 인물과 공간 레퍼런스를 정하고, 각 샷을 설계한 뒤 영상과 소리를 생성합니다.
| 단계 | 해결할 질문 | 이 사례의 결과물 |
|---|---|---|
| 이야기 범위 | 이 단편은 무엇에 관한 이야기인가? | 한 여성이 내일의 자신에게 경고를 받음 |
| 대본 | 언제 무엇이 일어나는가? | 약 75초, 8개 이야기 비트 |
| 비주얼 설정 | 무엇이 바뀌면 안 되는가? | 인물, 아파트, 소품 레퍼런스 |
| 스토리보드 | 각 샷이 정보를 어떻게 보여 주는가? | 8개 샷 시간표와 구도 |
| 영상 생성 | 인물과 카메라가 어떻게 움직이는가? | 샷별 독립 동작 프롬프트 |
| 사운드와 편집 | 긴장감을 어떻게 만드는가? | 미래 음성, 노크, 암전 결말 |
단계는 조금 늘어나지만 마지막 5초가 잘못됐다는 이유로 전체를 다시 만들지 않고, 실패한 샷만 재생성할 수 있습니다.
사례 설정: 문을 열지 마
밤 11시 47분. 30대 초반의 여성이 아파트에 혼자 있을 때 자기 번호에서 음성 메시지가 도착합니다. 하지만 메시지 날짜는 내일로 표시되어 있습니다.
녹음된 자신의 목소리가 경고합니다.
몇 초 뒤에 누군가 문을 두드릴 거야. 누구 목소리가 들려도 문을 열지 말고, 대답도 하지 마.
메시지가 끝나자 실제로 세 번의 노크가 들립니다. 이어 복도에서 자신의 목소리가 말합니다. "나야. 문 열어." 여성이 현관 구멍으로 밖을 보지만 아무도 없습니다. 그런데 문손잡이가 천천히 움직이기 시작합니다. 메시지를 다시 재생하자 아직 일어나지 않은 자신의 숨소리와 발걸음이 먼저 녹음되어 있습니다. 여성은 같은 경고를 녹음해 어제의 자신에게 보내야 한다는 사실을 깨닫습니다.
스마트폰에 "어제 23:47로 전송됨"이 표시되자 복도의 노크가 멈춥니다. 여성이 잠깐 긴장을 푸는 순간, 이번에는 아파트 안쪽에서 무거운 노크가 한 번 들리고 화면이 암전됩니다.
이 이야기는 보이는 인물이 한 명이고, 주요 공간이 하나이며, 고정할 소품이 적기 때문에 AI 제작에 적합합니다. 긴장감은 많은 군중, 싸움, 복잡한 장소 이동이 아니라 소리, 반응, 정보가 공개되는 순서에서 생깁니다.
1단계: 이야기를 통제 가능한 범위로 줄이기
단편 영화는 장편 영화를 빠르게 재생한 것이 아닙니다. 60~90초 이야기라면 하나의 갈등, 하나의 전환, 하나의 결말만 남기는 편이 좋습니다.
문을 열지 마의 이야기 골격은 세 문장으로 정리할 수 있습니다.
- 갈등: 여성은 내일의 자신에게 문을 열지 말라는 경고를 받는다.
- 전환: 문밖에서 자신의 목소리가 들리고, 녹음은 현재 행동을 미리 예측한다.
- 결말: 경고를 어제로 보내지만 진짜 위험은 이미 집 안에 있을 수 있다.
한 아이디어에 인물 세 명, 장소 다섯 곳, 추격전 두 번, 방대한 세계관이 함께 들어 있다면 핵심 반전을 바꾸지 않는 요소를 삭제하세요. AI 영상이 짧을수록 생성 예산은 관객이 기억할 장면에 집중해야 합니다.
2단계: 75초 단편 대본 쓰기
대본에는 인물의 생각만 적지 말고 관객이 보거나 들을 수 있는 정보를 적어야 합니다. 아래 버전은 이야기를 8개 비트로 나누며, 각 비트는 뒤의 스토리보드와 바로 연결됩니다.
| 시간 | 화면과 소리 | 이야기 역할 |
|---|---|---|
| 0~6초 | 밤의 아파트, 스마트폰은 23:47, 여성은 혼자 앉아 있음 | 시간, 인물, 고립감 설정 |
| 6~14초 | 자기 번호에서 내일 날짜의 음성이 도착 | 불가능한 사건 제시 |
| 14~23초 | 미래의 목소리가 문을 열지 말라고 경고 | 규칙과 위험 설명 |
| 23~33초 | 세 번의 노크, 문밖에서 자신의 목소리 | 경고를 현실로 만들기 |
| 33~44초 | 현관 구멍 밖은 비어 있고 손잡이가 움직임 | 존재를 보여 주지 않고 위협 강화 |
| 44~55초 | 다시 튼 음성에 현재의 숨과 발걸음이 먼저 들어 있음 | 시간 이상 현상 증명 |
| 55~67초 | 같은 경고를 녹음해 어제로 전송 | 인물이 선택하고 행동하게 만들기 |
| 67~75초 | 전송 성공, 실내에서 마지막 노크, 암전 | 시간 루프와 반전 완성 |
대사는 짧게 유지해 관객이 화면을 이해할 시간을 남기세요. 이 이야기에 꼭 필요한 대사는 미래의 경고, 문밖의 한마디, 주인공이 다시 녹음하는 경고뿐입니다.
3단계: 인물·공간·소품 레퍼런스 만들기
인물 일관성은 "같은 여자"라고 반복해서 쓰는 것만으로 만들어지지 않습니다. 매번 재사용할 수 있는 눈에 보이는 특징을 정해야 합니다. 공간도 마찬가지입니다. 문의 위치, 벽 색, 조명 방향, 가구의 관계를 고정하세요.
주인공 설정
- 30대 초반의 성인 동아시아 여성
- 어깨 아래까지 내려오는 짙은 갈색 생머리, 자연스러운 오른쪽 가르마
- 짙은 갈색 눈, 약간 긴 얼굴형, 매우 옅은 메이크업
- 차콜 니트 카디건, 아이보리 티셔츠, 짙은색 바지
- 영상 중 의상, 헤어스타일, 액세서리, 메이크업을 바꾸지 않음
- 연기는 편안함에서 혼란, 경계, 억눌린 공포로 진행
아파트 설정
- 밤의 작은 현대식 아파트, 차가운 도시 환경광
- 따뜻한 테이블 램프를 주요 실내 조명으로 사용
- 거실 오른쪽에 짙은 회색 현관문, 은색 수평 레버 손잡이
- 왼쪽에 나무 식탁, 위에는 검은 스마트폰과 투명한 물컵만 있음
- 문 뒤에는 창문이 없고, 밖에는 좁은 흰색 복도
소품 설정
스마트폰은 같은 검은색 바형 기기로 유지해야 합니다. 화면의 시간, 메시지 날짜, 전송 상태는 이야기 단서이므로 스마트폰 클로즈업을 독립된 샷으로 제작하세요. 복잡한 인물 연기와 정확한 인터페이스 문자를 모델이 한 번에 생성하게 만들지 않는 편이 안정적입니다.
더 체계적인 인물 레퍼런스가 필요하다면 AI 영상 캐릭터 일관성 가이드를 참고해 중립 정면, 3/4 각도, 주요 표정을 먼저 만든 뒤 스토리보드로 넘어가세요.
4단계: 대본을 생성 가능한 8개 샷으로 나누기
스토리보드는 화면에 무엇을 담을지만 정하지 않습니다. 샷 크기, 카메라 위치, 인물 동작, 다음 클립으로 연결되는 종료 상태까지 정의합니다.
| 샷 | 프레이밍과 카메라 | 주요 동작 | 종료 상태 |
|---|---|---|---|
| 1 | 35mm 미디엄 와이드, 천천히 푸시인 | 식탁의 여성이 진동하는 스마트폰을 봄 | 손을 스마트폰으로 뻗음 |
| 2 | 50mm 스마트폰 클로즈업, 고정 | 화면에 자기 번호와 내일 날짜 표시 | 손가락으로 재생을 누름 |
| 3 | 85mm 얼굴 클로즈업, 매우 느린 푸시인 | 경고를 들으며 혼란스러운 표정이 굳음 | 첫 노크가 울림 |
| 4 | 35mm 측면 미디엄, 약한 핸드헬드 느낌 | 문으로 돌아보고 세 번의 노크 뒤 일어남 | 밖의 목소리가 말함 |
| 5 | 50mm 어깨 너머로 현관 구멍까지 트래킹 | 문에 다가가지만 복도는 비어 있음 | 은색 손잡이가 움직임 |
| 6 | 85mm 스마트폰과 얼굴 클로즈업 교차 | 다시 튼 음성에서 미리 녹음된 숨을 들음 | 녹음 버튼을 봄 |
| 7 | 50mm 상반신, 고정 | 같은 경고를 낮은 목소리로 녹음 | 어제로 전송됨 표시 |
| 8 | 35mm 천천히 풀백 | 복도는 조용해지고 여성은 문을 향함 | 실내 노크 한 번, 즉시 암전 |
샷 설계가 익숙하지 않다면 AI 스토리보드 가이드를 참고해 각 샷이 하나의 주요 정보만 전달하도록 정리하세요.
이야기를 수정 가능한 스토리보드로 바꾸기
SoulVid에 이야기, 인물, 결말 방향을 입력하고, 생성할 클립을 결정하기 전에 대본, 인물 관계, 샷 순서를 검토하세요.
AI 단편 스토리보드 만들기5단계: 움직임을 추가하기 전에 키프레임 생성하기
키프레임은 한 샷에서 가장 중요한 정지 이미지입니다. 인물, 구도, 의상, 공간, 소품을 먼저 승인한 뒤 이미지 투 비디오 모델로 보내는 방식이 텍스트만으로 모든 요소를 한 번에 만들게 하는 것보다 안정적입니다.
첫 번째 샷의 키프레임 프롬프트는 다음처럼 쓸 수 있습니다.
1번 샷 키프레임 프롬프트
사실적이고 영화적인 스틸 이미지. 시간은 밤 11시 47분. 작은 현대식 아파트의 나무 식탁에 30대 초반의 성인 동아시아 여성 한 명이 혼자 앉아 있다. 어깨 아래까지 내려오는 짙은 갈색 생머리와 자연스러운 오른쪽 가르마. 차콜 니트 카디건, 아이보리 티셔츠, 짙은색 바지를 입고 있다. 투명한 물컵 옆에서 검은 스마트폰이 진동한다. 화면 왼쪽에는 따뜻한 테이블 램프, 창밖에서는 차가운 푸른 도시광이 들어온다. 방 오른쪽에는 은색 수평 레버 손잡이가 달린 짙은 회색 현관문이 있다. 절제된 심리 스릴러 분위기, 사실적인 피부, 35mm 렌즈, 미디엄 와이드 구도, 섬세한 그림자. 다른 인물, 문자, 변형된 손을 만들지 않는다.
현관 구멍 장면은 먼저 여성의 어깨 너머로 짙은 회색 문을 바라보는 구도를 생성한 다음, 빈 복도 화면을 별도 제작하세요. 하나의 짧은 클립에 현관 구멍 통과, 카메라 회전, 복도 공개, 인물 얼굴로 복귀를 모두 요구하지 마세요.
6단계: 샷별 동작과 카메라 프롬프트 쓰기
영상 프롬프트는 누가 움직이는지, 어떻게 움직이는지, 카메라는 어떻게 움직이는지, 화면에서 무엇이 바뀌면 안 되는지 설명해야 합니다. 가능하면 한 샷에는 하나의 주요 동작만 남기세요.
5번 샷 영상 프롬프트
승인된 아파트와 인물 레퍼런스를 이어서 사용한다. 같은 여성의 뒤에서 어깨 너머 트래킹 샷으로 촬영하며, 여성이 짙은 회색 현관문을 향해 천천히 다가간다. 한 손은 가슴 가까이에 두고, 손잡이에 닿지 않은 채 현관 구멍 쪽으로 몸을 기울인다. 카메라는 절제된 걷기 속도로 따라가며 자연스러운 움직임은 매우 작게 유지한다. 따뜻한 테이블 램프는 여성의 왼쪽 뒤에 그대로 두고, 차가운 빛으로 문의 윤곽을 만든다. 샷 마지막에는 형태가 유지된 은색 수평 레버 손잡이를 보여 주며, 손잡이가 저절로 몇 센티미터 아래로 움직인다. 침입자를 보이지 않는다. 인물, 가구, 의상을 추가하지 않는다. 얼굴을 변형하지 않는다. 카메라를 갑자기 회전하지 않는다.
마지막 샷 영상 프롬프트
같은 여성, 의상, 아파트 구조, 현관문, 조명, 검은 스마트폰을 사용한다. 경고를 전송한 뒤 여성이 스마트폰 화면을 내려다보는 미디엄 샷으로 시작한다. 복도의 노크가 멈추고 어깨의 긴장이 조금 풀리지만 미소는 짓지 않는다. 여성은 계속 현관문을 바라보고, 카메라는 천천히 뒤로 이동해 여성 뒤쪽 아파트 내부의 어둠을 더 많이 드러낸다. 아파트 안쪽 어딘가에서 무거운 노크가 한 번 들리자 여성은 뒤돌아보지 않고 굳는다. 1초 동안 유지한 뒤 빠르게 암전한다. 괴물, 보이는 공격자, 유혈, 추가 인물, 달라진 방 구조를 만들지 않는다.
카메라 표현이 더 필요하다면 시네마틱 프롬프트 가이드를 참고할 수 있습니다. 하지만 화려해 보이기 위해 모든 샷에 회전, 줌, 빠른 공간 이동을 넣지 마세요. 이 이야기에 필요한 것은 기술 과시가 아니라 절제입니다.
7단계: '내일의 나' 목소리 설계하기
소리는 이 단편의 두 번째 인물입니다. 미래 메시지, 문밖의 목소리, 주인공이 현장에서 녹음하는 경고에 같은 기본 음색을 사용하고, 거리, 압축, 감정으로 차이를 만드세요.
미래 메시지
잘 들어. 몇 초 뒤에 누군가 문을 두드릴 거야. 누구 목소리가 들려도 문을 열지 말고, 대답도 하지 마. 밖에 있는 사람을 믿지 마.
말하는 속도는 빠르고 호흡은 불안정하지만 목소리는 낮게 유지합니다. 전화 음성 대역 압축과 약한 노이즈를 더해 실제로 도착한 음성 메시지처럼 만드세요.
문밖의 목소리
나야. 문 열어.
같은 목소리를 쓰되 더 차분하고 문 가까이에서 들리게 만듭니다. 부자연스러운 침착함이 비명보다 더 위협적으로 느껴집니다.
현장 녹음
7번 샷에서 주인공은 미래의 경고를 다시 말합니다. 이미 시간 루프를 이해했기 때문에 앞부분은 다급하고, 뒷부분은 처음 들었던 메시지의 말투로 점차 변합니다. 관객은 두 음성이 처음부터 같은 녹음이었다는 사실을 알아차려야 합니다.
환경음은 냉장고 저음, 먼 교통 소리, 스마트폰 진동, 세 번의 노크, 금속 손잡이 마찰, 실내에서 나는 마지막 노크로 단순하게 유지하세요. 공포 음악으로 감정을 너무 일찍 설명하지 말고, 첫 노크 이후 낮은 음색을 추가합니다.
8단계: 편집으로 서스펜스 리듬 만들기
서스펜스는 관객이 인물보다 조금 더 알고 있지만 전체 정보는 볼 수 없는 상태에서 생깁니다. 편집할 때 다음 방법을 사용할 수 있습니다.
- 소리를 먼저 들려주기: 인물 클로즈업이 끝나기 전에 첫 노크를 시작한 뒤 문으로 전환합니다.
- 멈춤 남기기: 경고 뒤에 0.5초의 정적을 두어 예언이 실현될지 기다리게 합니다.
- 노크 횟수 고정하기: 세 번의 노크를 매번 분명히 남겨 녹음과 현실을 연결합니다.
- 과하게 전환하지 않기: 음성을 듣는 동안 스마트폰만 반복해서 보여 주지 말고 인물 반응을 유지합니다.
- 정체 공개 늦추기: 마지막 노크 뒤에 발생원을 보여 주지 않고 바로 암전합니다.
"내일", "23:47", "어제로 전송됨" 같은 스마트폰 인터페이스 문자는 편집 단계에서 정확하게 추가하세요. 핵심 줄거리 정보를 영상 모델이 임의로 생성하는 문자에 맡기지 마세요.
AI 단편 영화 연속성 체크리스트
첫 편집이 끝나면 각 샷을 아래 항목으로 확인합니다.
- 인물: 얼굴형, 머리 길이, 가르마, 의상, 나이가 일관적인가?
- 공간: 식탁, 문, 램프, 복도의 위치 관계가 바뀌지 않았는가?
- 소품: 스마트폰 색, 손잡이 방향, 물컵 디자인이 갑자기 변하지 않았는가?
- 시간: 스마트폰 날짜와 23:47의 시간 관계가 이야기에 맞는가?
- 소리: 미래 메시지, 문밖의 목소리, 현장 녹음이 같은 사람처럼 들리는가?
- 동작: 이전 샷 마지막의 손 위치가 다음 샷으로 자연스럽게 이어지는가?
- 이야기: 제작 과정을 설명하지 않아도 관객이 시간 루프를 이해할 수 있는가?
한 샷만 실패했다면 그 샷의 레퍼런스 프레임, 동작 프롬프트, 종료 자세로 돌아가 수정하세요. 손잡이 방향이 잘못됐다는 이유로 안정적인 얼굴 클로즈업과 음성까지 다시 만들 필요는 없습니다.
바로 복사하는 AI 단편 영화 프로젝트 프롬프트
아래 프롬프트는 프로젝트 생성 단계에서 대본, 인물 설정, 첫 스토리보드를 만들 때 사용할 수 있습니다. 개별 영상을 생성할 때는 앞의 샷별 프롬프트를 사용하세요.
문을 열지 마 프로젝트 프롬프트
문을 열지 마라는 제목의 약 75초, 9:16 세로형, 사실적인 심리 서스펜스 단편 영화를 제작한다.
주인공은 30대 초반의 성인 동아시아 여성 한 명이다. 어깨 아래까지 내려오는 짙은 갈색 생머리, 자연스러운 오른쪽 가르마, 짙은 갈색 눈을 가지고 있다. 차콜 니트 카디건, 아이보리 티셔츠, 짙은색 바지를 입는다. 화면에 보이는 인물은 이 여성 한 명뿐이며 얼굴, 머리, 의상, 체형을 영상 전체에서 일관되게 유지한다.
이야기는 밤 11시 47분의 작은 현대식 아파트에서 일어난다. 실내에는 따뜻한 테이블 램프와 차가운 도시 환경광을 사용한다. 거실 오른쪽에는 은색 수평 레버 손잡이가 달린 짙은 회색 현관문이 있다. 왼쪽에는 나무 식탁이 있고, 위에는 검은 스마트폰과 투명한 물컵만 있다. 아파트 구조, 문, 램프, 식탁, 스마트폰을 모든 샷에서 바꾸지 않는다.
이야기: 여성의 스마트폰에 자기 번호에서 음성 메시지가 도착하지만 날짜는 내일로 표시되어 있다. 미래의 자신이 "몇 초 뒤에 누군가 문을 두드릴 거야. 누구 목소리가 들려도 문을 열지 말고, 대답도 하지 마"라고 경고한다. 세 번의 노크가 울리고 문밖에서 자신의 목소리로 "나야. 문 열어"라고 말한다. 현관 구멍 밖에는 아무도 없지만 손잡이가 천천히 움직인다. 메시지를 다시 재생하자 현재의 숨과 발걸음이 일어나기 전에 녹음되어 있다. 여성은 같은 경고를 녹음해 어제의 자신에게 보내야 한다는 사실을 이해한다. 스마트폰에 "어제 23:47로 전송됨"이 표시되자 복도의 노크는 멈추지만 아파트 안쪽에서 마지막 무거운 노크가 한 번 울린다. 즉시 암전한다.
먼저 이야기 요약, 75초 대본, 인물 설정표, 아파트와 소품 설정, 서로 이어지는 8개 스토리보드 샷을 만든다. 각 샷에 길이, 샷 크기, 인물 동작, 카메라 움직임, 조명, 소리, 종료 상태를 정의한다. 이어 각 샷을 독립적으로 생성할 수 있는 이미지 프롬프트와 영상 프롬프트를 작성한다.
전체는 절제되고 사실적인 심리 스릴러 촬영으로 표현한다. 35mm, 50mm, 85mm 렌즈 언어, 느린 푸시인, 어깨 너머 트래킹, 고정 클로즈업을 사용한다. 유혈, 보이는 침입자, 괴물, 추가 인물, 의상 변경, 달라진 방 구조, 달라진 문이나 손잡이, 달라진 스마트폰, 극단적인 광각 왜곡, 갑작스러운 카메라 회전, 의미 없는 효과를 금지한다. 시간 루프는 분명하게 전달하되 위험이 이미 아파트 안으로 들어왔을 가능성을 결말에 남긴다.
이야기 아이디어에서 수정 가능한 AI 단편 영화로
좋은 AI 단편 영화는 가장 긴 프롬프트에서 나오지 않습니다. 이야기를 얼마나 작게 만들지, 인물의 어떤 특징을 바꾸지 않을지, 각 샷이 무엇을 해야 하는지, 소리가 언제 정보를 전달할지, 어떤 실패만 다시 생성할지에 대한 명확한 결정이 쌓여야 합니다.
SoulVid에서는 이야기 아이디어, 대본, 인물, 에셋, 스토리보드를 하나의 숏드라마 제작 흐름 안에서 관리할 수 있습니다. 영상 생성 전에 이야기와 샷 계획을 검토하면 성공한 결과는 남기고 실패한 장면만 수정할 수 있습니다.
다음 이야기를 볼 수 있는 단편으로 만들기
한 문장의 이야기 아이디어에서 시작해 인물, 대본, 스토리보드, 샷별 영상을 만들고 완성된 숏드라마로 정리하세요.
AI 단편 영화 만들기


