AI 모션 컨트롤

참조 클립과 내 캐릭터를 주면 움직임이 그대로 옮겨집니다 — 춤, 제스처, 표정까지. 동작은 정확하게, 캐릭터는 여전히 내 것으로.

주요 기능

움직임은 참조 클립을 따릅니다

참조 클립은 말보다 훨씬 정확하게 동작을 지정합니다 — "춤춰줘"는 모델의 즉흥을 주지만, 참조는 바로 그 춤을 줍니다.

캐릭터는 그대로 내 것

움직임은 참조에서, 외형은 내 캐릭터 이미지에서. 두 가지가 따로 제어됩니다.

사진을 움직이게

정지된 인물 사진 한 장에 참조 모션을 더하면, 그 사람이 그 동작을 하는 영상이 나옵니다.

하나의 동작을 여러 캐릭터에

같은 참조를 서로 다른 캐릭터에 적용해, 동작은 같고 인물만 다른 클립 세트를 만들 수 있습니다.

사용 사례

사진을 움직이게

사진을 움직이게

정지된 인물 사진이 참조 동작을 그대로 수행합니다 — 촬영이 필요 없습니다.

댄스와 액션 영상

댄스와 액션 영상

춤을 참조로 주고 내 캐릭터가 같은 박자로 추게 하세요.

캐릭터끼리 동작 맞추기

캐릭터끼리 동작 맞추기

하나의 동작을 여러 캐릭터에 적용해 통일된 세트를 만듭니다.

버추얼 발표자와 캐릭터 콘텐츠

버추얼 발표자와 캐릭터 콘텐츠

고정된 캐릭터와 녹화된 모션으로, 같은 인물을 유지한 채 대량으로 제작합니다.

사용방법

01

AI 모션 컨트롤을 열고 캐릭터 이미지나 클립을 업로드하세요.

02

옮기고 싶은 동작을 지정할 참조 모션 클립을 업로드하세요.

03

결과를 다운로드하거나 캔버스로 보내 편집을 이어가세요.

딥 다이브

동작은 설명이 아니라 클립으로 지정합니다

영상 생성기에 "춤춰줘"라고 쓰면 모델이 생각하는 춤이 나옵니다. 괜찮을 수도 있지만, 당신이 떠올린 그 춤은 아닙니다. 동작은 텍스트에 담기에는 정보량이 너무 큽니다. 템포, 진폭, 포즈의 디테일은 프롬프트에 들어가지 않습니다.

모션 컨트롤은 입력 자체를 바꿉니다. 참조 클립을 건네는 것이죠. 동작은 영상에서 추출되고 외형은 캐릭터 이미지에서 오며, 둘은 따로 제어됩니다. 그래서 내 캐릭터가 바로 그 동작을 수행합니다.

참조에는 읽히는 동작이 필요합니다

참조의 화질은 중요하지 않습니다 — 참조는 동작만 공급하고 외형은 전부 캐릭터에서 오기 때문입니다. 중요한 것은 동작이 읽히느냐입니다.

  • 피사체가 온전할 것 — 전신 동작에는 전신이, 손동작에는 보이는 손이 필요합니다
  • 가림이 없을 것 — 가려진 팔다리는 추출할 수 없는 동작입니다
  • 너무 어둡지 않을 것 — 윤곽이 보이지 않으면 포즈도 읽히지 않습니다
  • 되도록 한 사람 — 여러 명이 동시에 움직이면 모델이 누구를 따라야 할지 모릅니다

한 가지 더 맞춰 두면 좋은 것이 프레이밍입니다. 전신 댄스 참조에 상반신만 있는 캐릭터 이미지를 넣으면 모델이 없는 하반신을 지어내야 하고, 그 결과가 내 캐릭터와 맞지 않을 수 있습니다. 두 프레이밍이 비슷할수록 결과가 의도에 가깝습니다.

다른 도구를 써야 할 때

  • 동작이 정확할 필요가 없을 때 — 영상 생성기가 더 빠릅니다. 한 문장 쓰고 즉흥에 맡기면 됩니다.
  • 맞추려는 것이 입일 때 — 립싱크는 오디오를 기준으로 발화를 담당합니다.
  • 시작과 끝 프레임이 정확해야 할 때 — 첫·마지막 프레임 지정으로.
  • 룩을 바꾸고 싶을 때 — 영상 편집으로.

합리적인 판단 기준

이 페이지의 가치는 동작의 확실성입니다. 그래서 두 상황에 맞습니다. 반드시 재현해야 하는 움직임이 있을 때(특정한 춤, 특정한 제스처), 그리고 캐릭터만 다르고 동작은 똑같은 클립 묶음이 필요할 때.

반대로 동작이 아무래도 상관없고 "움직이기만 하면 될 때"는 영상 생성기가 손이 덜 갑니다. 참조를 준비할 필요 없이 한 문장이면 충분하니까요.

자주 묻는 질문

이미지-투-비디오와 무엇이 다른가요?+

이미지-투-비디오에서는 모델이 동작을 정하고 사용자는 말로 느슨하게만 유도할 수 있습니다 — "춤추는"이라고 쓰면 모델이 생각하는 춤이 나오죠. 모션 컨트롤은 실제 클립을 동작 템플릿으로 쓰기 때문에 일어나는 일이 바로 그 동작입니다. 동작이 정확해야 할 때는 이 페이지를, 모델의 아이디어가 궁금할 때는 이미지-투-비디오를 쓰세요.

참조 클립에는 어떤 조건이 필요한가요?+

동작이 뚜렷하고 피사체가 온전한 것이 가장 중요합니다. 전신 동작에는 전신이 보여야 하고, 손동작에는 손이 보여야 합니다. 가림, 아주 낮은 조도, 여러 사람이 동시에 움직이는 상황은 모두 추출을 방해합니다. 참조 영상의 화질은 상관없습니다 — 참조는 동작만 공급하고 외형은 내 캐릭터에서 오기 때문입니다.

참조가 내 캐릭터 외형에 영향을 주나요?+

설계상 주지 않습니다 — 동작은 참조에서, 외형은 캐릭터에서 옵니다. 다만 둘의 프레이밍 차이가 클 때(전신 댄스 참조에 상반신만 있는 캐릭터 이미지)는 모델이 없는 부분을 지어내야 하고, 그 부분은 내 캐릭터와 정확히 맞지 않을 수 있습니다.

립싱크와는 어떤 관계인가요?+

담당 영역이 다릅니다. 립싱크는 입을 오디오에 맞추고, 모션 컨트롤은 몸의 움직임과 포즈를 옮깁니다. 움직이면서 말하는 캐릭터를 만들려면 보통 모션을 먼저, 립싱크를 나중에 적용합니다.

더 많은 모델