AI로 포토리얼리스틱 바이킹 영화를 만든 방법 (전체 워크플로우)

· Flick 사내 영화 제작자 · LinkedIn

Aug 2026

AI 단편 영화 Ulysses에서 석조 모노리스와 푸른 하늘을 배경으로 한 풍화된 노르웨이 남성의 로우 앵글 시네마틱 초상
AI 단편 영화 Ulysses에서 석조 모노리스와 푸른 하늘을 배경으로 한 풍화된 노르웨이 남성의 로우 앵글 시네마틱 초상

저는 Ulysses라는 포토리얼리스틱 바이킹 단편 영화를 전적으로 AI로 만들었습니다. 카메라도, 제작진도, 배우도, 세트장도 없었습니다. 약 8일 동안 제작한 400개가 넘는 샷들이 실제 영상처럼 보입니다. 이것은 캔버스에서 실제로 일어난 그대로의 전체 워크플로우입니다. 원한다면 먼저 Flick TV에서 완성된 영화를 시청하세요. 아래의 모든 내용은 어떻게 만들어졌는지에 대한 과정입니다.

빈 대기 공간에서 기다리고 있는 두 명의 평범해 보이는 게임 NPC에 관한 단편 영화입니다. 그들을 조종하는 플레이어보다 그들이 더 살아있을 수 있다는 것을 점차 깨닫게 됩니다. NPC를 비활성 배경 코드로 보는 대신, 우리는 그들이 보이지 않을 때도 계속 존재하며 자신만의 인식, 불확실성, 그리고 존재감을 지니고 있다고 상상합니다. 이야기는 부조리한 기다림 게임으로 시작하지만, 천천히 가시성, 수행성, 그리고 내면의 삶이 무엇을 의미하는지에 대한 성찰로 변해갑니다.

1. 스토리가 먼저, 그다음 샷

Ulysses는 바이킹 시대 이야기입니다: 미드홀 관리인, 젊은 경비병, 갑옷을 입은 전사, 그리고 용. 무언가를 생성하기 전에 저는 이야기를 샷으로 나눴습니다. 영화를 스토리보드로 만드는 것처럼요. 모든 샷에 대해 누가 등장하는지, 카메라가 어디에 위치하는지, 무슨 일이 일어나는지에 대한 대략적인 계획을 세웠습니다.

나만의 AI 영화 만들기

하나의 이미지로 시작해서 샷 단위로 전체 영화를 제작하세요.

2. 캐릭터를 레퍼런스 시트로 캐스팅하기

이것이 가장 중요한 단계입니다. 각 캐릭터마다 정면, 측면, 3/4 각도의 깔끔한 3면 레퍼런스 시트를 생성했습니다. 캐스팅 사진처럼 평범한 회색 배경에서요.

회색 배경에 양모 튜닉을 입은 수염 난 노르웨이 남성의 3면 전신 레퍼런스 시트
회색 배경에 양모 튜닉을 입은 수염 난 노르웨이 남성의 3면 전신 레퍼런스 시트

시트는 캐릭터의 "배우"가 됩니다. 그 사람의 모든 이후 샷은 이것을 기반으로 만들어지므로 얼굴이 흐트러지지 않습니다. 제 주인공의 시트는 79개의 개별 샷에서 베이스로 재사용되었습니다. 의상과 갑옷도 같은 방식으로 처리합니다: 저는 갑옷을 손으로 스케치한 다음, 스케치를 완전한 포토리얼 턴어라운드로 변환했습니다.

뿔 달린 헬멧을 쓰고 도끼를 든 갑옷 입은 바이킹 전사의 3면 레퍼런스 시트
뿔 달린 헬멧을 쓰고 도끼를 든 갑옷 입은 바이킹 전사의 3면 레퍼런스 시트

3. 모든 샷을 손으로 스케치하기

이것이 사람들을 가장 놀라게 하는 단계입니다. 프레임을 생성하기 전에 저는 구성에 대한 대략적인 스케치를 그렸습니다. 단순한 형태만으로요: 캐릭터가 서 있는 위치, 수평선이 놓인 위치, 카메라가 바라보는 곳. 이 영화에서 저는 수백 개의 샷에 대해 그렇게 했습니다.

스케치는 블로킹과 카메라를 하나로 합친 것입니다. 빠르고, 일회용이며, 단어로 구성을 추측하는 대신 모델이 따라갈 정확한 무언가를 제공합니다.

4. 스케치를 포토리얼 프레임으로 바꾸기

그런 다음 Nano Banana에서 세 가지를 결합했습니다. 구성 스케치, 캐릭터의 레퍼런스 시트, 그리고 짧은 지시사항. 그리고 포토리얼 실사 프레임을 요청했습니다. 프롬프트는 모델이 벗어나는 것을 금지합니다:

Use the provided sketch as the only composition reference, use the provided guard
reference as the guard character reference. Convert the scene into a photorealistic
live-action cinematic image. Composition 100% exactly matches the provided sketch.
Camera position 100% unchanged.

대략적인 스케치와 고정된 캐릭터는 반대편에서 촬영된 것처럼 보이는 샷으로 나옵니다.

레퍼런스 시트에 나온 같은 노르웨이 남성이 흰 모래 위 파란색으로 칠해진 벽을 따라 달리는 완성된 시네마틱 프레임
레퍼런스 시트에 나온 같은 노르웨이 남성이 흰 모래 위 파란색으로 칠해진 벽을 따라 달리는 완성된 시네마틱 프레임

5. 다시 생성하지 말고 편집으로 다듬기

이 영화에서 빈 텍스트 프롬프트만으로 만든 것은 거의 없습니다. 제가 생성한 이미지 중 371개는 기존 프레임을 편집한 것이었고, 텍스트-이미지 생성은 단 21개뿐이었습니다. 프레임이 약간 어긋났을 때, 턱이 너무 각졌거나, 이상한 그림자가 있거나, 잘못된 디테일이 있을 때, 처음부터 다시 시작하지 않고 해당 프레임을 편집했습니다. 일관성은 완벽한 문구가 아니라 고정된 베이스 위에 편집을 쌓는 것에서 나옵니다.

6. 애니메이션 적용하고 말하게 하기

스틸 이미지가 확정되면, 선택한 프레임들을 Kling으로 비디오로 애니메이션했습니다. 일부 샷은 단순한 움직임이고, 다른 샷들은 캐릭터가 카메라를 똑바로 보며 말하는 대화 장면입니다. 이러한 프롬프트는 연기에 대해 구체적입니다:

Handheld camera, extreme close-up of his face. His eyes stay locked on the camera,
no drift. He says, "Still, here." Then a brief pause, still staring, with visible
strain, as if forcing the words out.

스틸 이미지는 정체성을 유지하고, 비디오는 숨결과 목소리를 더합니다.

7. 모든 것이 일어난 캔버스

위의 모든 단계는 하나의 워크스페이스에 존재합니다. 실제 프로젝트를 축소한 모습입니다: 왼쪽의 스케치 행들이 오른쪽의 포토리얼 행들로 이어지고, 하단에는 캐릭터 시트들이, 그 사이에는 반복 작업 단계들이 있습니다. 424개의 이미지와 38개의 비디오 샷, 모두 레퍼런스로 추적 가능합니다.

Flick에서 축소된 전체 Ulysses 프로젝트 캔버스: 왼쪽의 손으로 그린 구도 스케치가 오른쪽의 포토리얼 프레임과 연결되어 있고, 하단에는 캐릭터 레퍼런스 시트가 있음
Flick에서 축소된 전체 Ulysses 프로젝트 캔버스: 왼쪽의 손으로 그린 구도 스케치가 오른쪽의 포토리얼 프레임과 연결되어 있고, 하단에는 캐릭터 레퍼런스 시트가 있음

어디든 확대하면 같은 패턴이 반복되는 것을 볼 수 있습니다: 하나의 구도, 여러 테이크, 하나의 최종본. 두 주연 캐릭터가 반복 작업 중간 단계에서 어떻게 보이는지 확인할 수 있습니다. 사슬 갑옷을 입은 경비병과 튜닉을 입은 수호자, 모든 테이크에서 같은 얼굴을 하고 있는데 모든 테이크가 동일한 시트를 가리키고 있기 때문입니다.

Ulysses 캔버스의 근접 뷰: 하얀 모래 위에 서 있는 두 주연, 갑옷을 입은 경비병과 양모 튜닉을 입은 남자의 반복된 테이크를 보여줌
Ulysses 캔버스의 근접 뷰: 하얀 모래 위에 서 있는 두 주연, 갑옷을 입은 경비병과 양모 튜닉을 입은 남자의 반복된 테이크를 보여줌

8. 숫자로 보는 제작 과정

규모를 가늠하기 위해, 완성된 프로젝트에 포함된 내용은 다음과 같습니다:

Ulysses 캔버스 기준
생성된 이미지 / 실패424 / 20
레퍼런스 이미지 연결653 (전체 연결의 92%)
이미지 편집 vs 텍스트-이미지371 vs 21 (95% img2img)
재사용된 레퍼런스 시트 1개79샷
제작 시간약 8일, 1인

9. 시작하기 전에 알려드리고 싶은 것

  • 레퍼런스 시트를 먼저 만드세요. 이것이 전부입니다. 시트 없는 캐릭터는 흔들립니다.
  • 샷을 스케치하세요. 올바른 구도의 서툰 그림이 아름다운 문장보다 낫습니다.
  • 다시 생성하지 말고 편집하세요. 베이스 이미지를 고정하고 최소한만 변경하세요.
  • 실패를 예상하세요. 20개의 샷이 완전히 실패했고 더 많은 샷들이 수정이 필요했습니다. 이것은 정상이며, 파이프라인은 이를 흡수하도록 구축되어 있습니다.

직접 만들어보세요

하나의 이미지로 시작해서 한 컷씩 영화를 만들어가세요. 가장 중요한 단계는 레퍼런스 시트이며, 일관된 AI 캐릭터 가이드에서 바로 그 부분을 자세히 다루고 있습니다.

자주 묻는 질문

이런 AI 영화를 만드는 데 얼마나 걸리나요?

Ulysses는 약 8일 동안 432개의 생성 작업을 실행했으며, 1명이 크루 없이 작업했습니다. 대부분의 시간은 렌더링을 기다리는 것이 아니라 테이크 사이에서 선택하는 데 소요됩니다.

영화에서 실제로 어떤 AI 모델을 사용했나요?

스틸과 편집에는 Nano Banana를 사용했고(392개 이미지 생성 중 371개가 기존 프레임의 편집이었습니다), 모션에는 Kling을 사용했습니다. 완성된 캔버스는 대사가 있는 테이크를 포함해 37개의 Kling 비디오 샷을 담고 있습니다.

400개의 샷에서 캐릭터가 어떻게 일관성을 유지하나요?

모든 것에 연결된 레퍼런스 시트 덕분입니다. 프로젝트는 653개의 레퍼런스 이미지 링크를 보유하고 있으며, 이는 전체 연결의 92%를 차지합니다. 주연의 시트만으로도 79개의 샷 아래에 있습니다. 어떤 샷도 단어만으로 생성되지 않습니다.

캐릭터가 실제로 말할 수 있나요?

네. 대사 샷은 대사, 멈춤, 눈동자의 움직임을 지정하는 연기 프롬프트로 고정된 스틸에서 애니메이션화됩니다. 스틸은 정체성을 담고 있고, 비디오 패스가 호흡과 목소리를 추가합니다.