참조 이미지로 영상

최대 9개의 참조 이미지를 넣어 영상 전반에서 캐릭터, 스타일, 제품을 일관되게 유지하세요.

레퍼런스 투 비디오 AI

필요한 얼굴, 의상, 제품, 장소를 업로드하고 프롬프트에서 하나씩 태그하면 AI Hug가 이를 흐트러지지 않는 하나의 장면으로 만들어 줍니다. 레퍼런스 투 비디오는 모델을 다시 학습시키거나 수십 번 다시 생성하지 않고도 캐릭터가 일관된 AI 동영상을 얻는 가장 빠른 방법입니다.

  • 참고 이미지 최대 9장
  • 참고 영상 및 오디오
  • Seedance 2.0 · Wan 3.0

참고 자료가 장면에 주는 변화

아래 클립은 모두 한두 장의 정지 이미지에서 시작했습니다. 프롬프트는 동작과 카메라를 설명하고, 참고 이미지는 피사체의 실제 모습을 고정합니다.

01

참고 이미지 한 장으로 장면 전체를

크리처 디자인 하나가 역광 속 사막 포위전이 되었습니다. 실루엣, 다리 개수, 체형이 모두 참고 이미지에서 그대로 왔기 때문에 컷이 바뀌어도 크리처의 모습이 변하지 않습니다.

02

얼굴과 의상을 함께 유지

얼굴 클로즈업은 이미지 1, 의상 전신 사진은 이미지 2로 태그했습니다. 인물과 의상을 두 장의 참고 이미지로 나누는 것이 빠른 카메라 움직임에서도 캐릭터를 일관되게 유지하는 가장 확실한 방법입니다.

03

스타일화된 캐릭터도 그 스타일 그대로

참고 이미지는 실제 인물에만 쓰이는 것이 아닙니다. 봉제 인형 같은 카툰 비율의 크리처도 빠른 추격 장면에서 털 색과 둥근 형태를 유지했습니다. 모델이 글에서 추측하지 않고 디자인을 그대로 따라 그렸기 때문입니다.

대부분의 변형 문제는 프롬프트가 아니라 입력 자료에서 시작됩니다

흔들리지 않는 참고 이미지 고르는 법

  • 01

    이미지 한 장에 역할 하나

    참고 이미지마다 역할을 하나만 주세요. 얼굴, 의상, 제품, 공간처럼요. 복잡한 콜라주는 무엇이 중요한지 모델이 판단하게 만들고, 그 판단은 자주 틀립니다.

  • 02

    선명하고 조명이 고른 얼굴

    인물은 초점이 맞고 정면을 보며 조명이 고르고 눈이 가려지지 않은 사진을 쓰세요. 강한 필터, 선글라스, 극단적인 각도가 영상 중간에 얼굴이 바뀌는 주된 원인입니다.

  • 03

    인물과 의상을 분리

    의상이 중요하다면 얼굴 클로즈업과 별도로 전신 사진을 참고 자료로 추가하고, 프롬프트에서 둘 다 태그해 같은 사람이라는 것을 모델에 알려 주세요.

  • 04

    제품은 단색 배경으로

    흰색이나 무채색 배경의 제품 사진은 제품이 작게 나오거나 일부가 가려진 연출 사진보다 라벨, 색상, 비율을 훨씬 정확하게 재현합니다.

  • 05

    동작은 영상으로, 목소리는 오디오로

    짧은 참고 영상은 춤 동작, 카메라 경로, 제스처를 보여 주는 가장 명확한 방법입니다. 참고 오디오는 목소리와 리듬을 안내합니다. 둘 다 짧고 핵심만 담으세요.

  • 06

    모든 참고 자료를 프롬프트에서 태그

    프롬프트 창에 @를 입력하면 이미지 1, 동영상 1, 오디오 1을 필요한 위치에 바로 넣을 수 있습니다. 예: "이미지 1이 이미지 3의 카페로 들어가며 이미지 2의 병을 들고 있다." 태그하지 않은 자료도 전송되지만, 역할은 모델이 추측해야 합니다.

참고 이미지로 AI 동영상을 만드는 3단계

업로드부터 완성 클립까지

  1. 1

    참고 자료 업로드

    프롬프트 위 업로드 바에 이미지를 최대 9장, 필요하면 참고 영상과 오디오도 추가하세요. 업로드한 자료는 프롬프트 안에 번호가 붙은 태그로 나타나며 드래그해 위치를 바꿀 수 있습니다.

  2. 2

    장면을 설명하고 참고 자료 태그

    무슨 일이 어디서 일어나고 카메라가 어떻게 움직이는지 쓴 다음, @를 눌러 각 피사체에 맞는 참고 자료를 지정하세요. 정교한 4–15초 장면에는 Seedance 2.0, 최대 30초·1080p 영상에는 Wan 3.0을 선택하세요.

  3. 3

    생성, 확인, 다듬기

    길이, 해상도, 사운드를 고른 뒤 생성하세요. 디테일이 흐트러지면 프롬프트 전체를 다시 쓰기보다 더 선명한 참고 이미지로 바꾸거나 태그 위치를 더 구체적으로 지정하세요.

FAQ

레퍼런스 투 비디오 FAQ

레퍼런스 투 비디오, 멀티 레퍼런스 비디오 AI, 캐릭터 일관성 유지에 관한 질문.

레퍼런스 투 비디오 AI란 무엇인가요?

내 자료로 방향을 잡는 동영상 생성 방식입니다. 캐릭터를 글로 묘사하고 매번 같은 사람이 그려지기를 바라는 대신, 이미지(필요하면 영상이나 오디오도)를 업로드하면 모델이 이를 피사체의 외모, 움직임, 목소리의 기준으로 사용합니다.

이미지 투 비디오와 무엇이 다른가요?

이미지 투 비디오는 사진 한 장을 첫 프레임으로 삼아 움직이게 하므로 장면이 그 사진에서 시작됩니다. 레퍼런스 투 비디오는 여러 자료를 가이드로 삼아 완전히 새로운 장면을 만들기 때문에 캐릭터가 어디서든, 어떤 각도로든 등장할 수 있습니다. 첫 장면이 중요하면 이미지 투 비디오를, 인물의 일관성이 중요하면 이 도구를 사용하세요.

참고 자료는 몇 개까지 쓸 수 있나요?

이미지는 최대 9장, 참고 영상과 참고 오디오는 각각 최대 3개까지입니다. Wan 3.0에서는 참고 영상 합계 15초, 참고 오디오 합계 15초까지이며, 참고 영상 길이와 생성 길이의 합이 30초를 넘을 수 없습니다. 이 제한은 제출 전에 도구가 자동으로 확인합니다.

어떤 모델을 골라야 하나요?

480p 또는 720p로 물리적으로 자연스러운 4–15초 장면을 원하면 Seedance 2.0, 비용을 줄이려면 Seedance 2.0 Mini가 좋습니다. Wan 3.0은 2–30초의 긴 클립, 최대 1080p, 네이티브 오디오 생성을 지원합니다. 크레딧은 출력 영상의 초 단위로 차감되며, 정확한 비용은 생성 전에 생성 버튼에 표시됩니다.

실제 인물 사진을 참고 자료로 써도 되나요?

사용 권한이 있는 사진만 가능합니다. 알아볼 수 있는 사람을 영상으로 만들기 전에는 본인의 동의를 받으세요. 유명인이나 다른 사람을 사칭하려고 사진을 올려서는 안 됩니다. 프롬프트와 참고 이미지는 콘텐츠 검수를 거칩니다.

그래도 장면마다 캐릭터가 바뀌는 이유는?

대개 참고 이미지가 모호하기 때문입니다. 해상도가 낮거나, 얼굴이 일부 가려졌거나, 한 장에 여러 사람이 있는 경우입니다. 피사체 한 명만 남도록 자르고, 다른 각도의 참고 이미지를 추가하고, 그 캐릭터가 할 동작 바로 옆에 태그하세요. 아주 빠른 움직임과 극단적인 클로즈업은 미디엄 숏보다 일관성을 유지하기 어렵습니다.

생성한 영상을 상업적으로 사용할 수 있나요?

유료 플랜에서 생성한 영상은 참고 자료의 사용 권한이 있다면 내 프로젝트, 광고, SNS 콘텐츠에 사용할 수 있습니다. 소유하지 않은 저작권 캐릭터, 로고, 브랜드는 피하세요. 참고 자료로 쓴다고 해서 생성된 영상에 권리가 생기지는 않습니다.

모든 장면에서 캐릭터를 그대로 유지하세요

참고 자료로 시작하기