영상 모델 가이드를 열 개쯤 읽었는데 표현만 다르고 하는 말이 거의 같았어요. Seedance 2.0 공식 가이드 해설과 Kling 3.0 가이드들에서 겹치는 것만 남겼습니다 ☕
가장 흔한 실수로 꼽히는 게 사진을 묘사하는 프롬프트예요. 영상 모델에는 "무엇이 있다"가 아니라 "몇 초 동안 무엇이 어떻게 바뀐다"를 줘야 합니다. "김이 나는 커피잔" 대신 "커피를 따르자 김이 올라오고 잔 위로 퍼진다".
Seedance 가이드가 제일 강조하는 규칙이에요. 밀기(push-in)·빼기(pull-out)·팬·트래킹·오빗·항공·핸드헬드·고정 중 하나만 고릅니다. "돌면서 다가가며 올라간다"처럼 섞으면 흔들리거나 무시됩니다.
"카메라가 천천히 다가간다. 인물은 고개를 돌린다." — 두 문장으로 나눕니다. 한 문장에 섞으면 누가 움직이는지 모델이 헷갈려요.
첫 시도는 slow drift, gentle rotation, soft pan 같은 약한 움직임 단어로 시작하는 게 부드럽게 나온다는 얘기가 Kling 쪽에서도 Seedance 쪽에서도 나와요. 빠른 움직임은 품질을 떨어뜨리기 쉽다고요.
Seedance: 주제 → 동작 → 환경 → 카메라 → 스타일 → 제약. Kling 3.0 가이드들은 카메라 → 주제와 동작 → 환경·조명 → 질감 → 소리·감정 순서를 권해요. 순서는 달라도 요소는 같습니다. 길이는 60~100단어 정도가 좋다고 하고, "amazing", "beautiful" 같은 빈 형용사는 빼라고 해요. 인물 영상이면 끝에 avoid jitter and bent limbs 같은 제약을 붙이는 예시도 있습니다.
예시(공식 해설): A skateboarder lands a clean trick in an empty dawn parking lot, camera low tracking shot then subtle rise, modern cinematic contrast, 6 seconds, 16:9, avoid jitter and bent limbs.
Seedance 2.5의 드래프트(480p)가 이 실험에 딱이에요. 카메라 단어 하나만 바꿔 가며 드래프트로 여러 번 보고, 마음에 드는 것만 최종본으로 뽑습니다.
참고한 글