AI 영상이 이상하게 나올 때 고치는 프롬프트 7가지
증상별로 정리한 AI 영상 문제 해결법. 일그러진 얼굴, 무시된 동작, 장면 표류, 깨진 글자, 떨림, 입 모양 불일치를 각각 한 번의 수정으로 잡는 프롬프트 7가지입니다.

실패한 AI 영상 클립은 대부분 모델 문제가 아닙니다. 특정한 결함이 하나 있는 프롬프트이고, 그 결함은 지문을 남깁니다. 녹아내리는 손, 가만히 서 있는 피사체, 끝까지 움직이지 않는 카메라, 중간에 색이 바뀌는 재킷이 그렇습니다. 지문을 읽을 수 있게 되면 아래의 프롬프트 수정은 각각 한 번의 편집으로 끝납니다.
이 글은 원리가 아니라 증상 순으로 정리했습니다. 피사체와 스타일, 조명, 구도 같은 기초가 필요하다면 더 좋은 프롬프트 쓰는 방법에서 시작한 뒤, 특정 생성 결과가 말을 듣지 않을 때 여기로 돌아오세요. 아래 내용은 이미 그럭저럭 괜찮은 프롬프트를 쓰고 있고, 클립이 실패할 때 어떤 단어를 바꿔야 하는지 알고 싶은 상황을 전제로 합니다.
예시는 OmniArt 영상 작업 공간에서 쓸 수 있는 모델을 씁니다. Seedance, Veo 3.1, Kling, Grok Imagine, PixVerse V6과 C1입니다. 어떤 증상은 프롬프트를 더 쓰는 것보다 다른 모델로 푸는 편이 낫다는 것을 알아보는 일도 문제 해결의 일부이기 때문입니다.
한 번에 변수 하나만 바꾸기
개별 해결책으로 넘어가기 전에, 그 모두를 빠르게 만들어 주는 습관을 들이세요. 생성 한 번에 한 가지만 바꾸는 것입니다. 결과가 나쁠 때마다 프롬프트 전체를 다시 쓰면 배우는 것이 없습니다. 어떤 수정이 효과가 있었는지 알 수 없으니까요.
길이와 해상도, 화면비, 참조 이미지도 표현만큼이나 결과에 영향을 주므로 프롬프트 문구와 함께 설정도 기록해 두세요. 의도를 갖고 두세 번 돌리는 것이 열 번 다시 쓰는 것보다 낫습니다.
팁
수정 1: 클립 중간에 얼굴과 손, 팔다리가 일그러진다
보이는 증상: 첫 프레임은 깔끔한데 이후 손가락이 붙고, 얼굴이 두개골에서 흘러내리고, 몸을 돌리는 동안 팔이 하나 더 생깁니다.
원인: 프롬프트가 설명하지 않은 자세들을 지나 모델이 신체를 보간하고 있는 것입니다. 빠른 팔다리 움직임, 손을 바짝 잡은 프레이밍, 가림(손이 얼굴 앞을 지나가는 것), 긴 길이는 모두 모델이 만들어 내야 하는 프레임 수를 배로 늘립니다.
해결: 만들어 내야 하는 양을 줄이세요. 프레이밍을 한 단계 물리고, 신체 역학을 명시적으로 지목하고, 손은 정지 상태로 두거나 단순한 경로로만 움직이게 하세요. 글자가 아니라 깔끔한 이미지에서 출발하는 것도 신체 구조를 고정해 줍니다. 모델이 몸을 짐작하는 대신 올바른 몸을 물려받기 때문입니다.
수정 전: "요리사의 손이 채소를 빠르게 썰어 팬에 던져 넣는 클로즈업."
수정 후: "나무 조리대 앞에 있는 요리사의 미디엄 숏. 오른손으로 일정한 썰기 동작 한 번, 왼손은 도마 위에 평평하게 올려 둘 것. 손은 프레임 안에 머물고 컷 없음. 50mm, 카메라 왼쪽에서 들어오는 부드러운 창광."
사람 중심 컷에서는 Veo 3.1과 Kling이 한 테이크 내내 신체 구조를 잘 유지하는 편이고, 신체 구조가 실패 지점일 때는 어떤 모델이든 이미지-영상 변환이 텍스트-영상 변환보다 낫습니다. 클로즈업을 꼭 지켜야 한다면 클립을 짧게 하고 동작 두 개 대신 하나를 받아들이세요.
수정 2: 피사체가 요청한 동작을 무시한다
보이는 증상: 프레이밍과 조명, 스타일은 프롬프트와 다 맞는데 피사체가 그냥 서서 숨만 쉬거나, 지정한 동작 대신 정체를 알 수 없는 어정쩡한 움직임을 합니다.
원인: 동작이 묻혀 있습니다. 동사가 길게 묘사한 문장의 끝에 놓이거나 다른 동사 셋과 경쟁하면, 모델은 그것을 정지된 장면의 또 하나의 속성으로 취급합니다. "교류한다", "즐긴다", "탐험한다" 같은 막연한 동사는 시각적 형태가 아예 없으므로 아무 일도 일어나지 않습니다.
해결: 피사체와 동작을 앞에 두고, 구체적인 물리 동사 하나를 현재형으로 쓰고, 동작이 끝나는 지점을 설명하세요. 렌즈와 색조, 분위기 같은 스타일 요소는 모두 동작 뒤로 옮겨, 주된 절이 아니라 장식으로 읽히게 하세요.
수정 전: "네온 반사와 증기가 있는 비 젖은 밤 골목, 극적이고 분위기 있는 곳에서 배달원이 주변을 탐험하고 주위와 교류하는 모습."
수정 후: "배달원이 몸을 낮춰 떨어진 봉투를 집어 든 뒤, 일어서서 왼쪽을 본다. 비 젖은 밤 골목, 젖은 아스팔트 위 네온 반사, 배기구에서 나오는 증기. 손에 들고 찍은 미디엄 숏."
Seedance는 이런 촬영 목록식 표현에 잘 반응하고, 돌아서기나 손 뻗기, 제품 공개처럼 통제된 동작 한 박자가 과제일 때는 PixVerse C1이 합리적인 선택입니다.
수정 3: 카메라 움직임이 일어나지 않거나 피사체와 부딪힌다
보이는 증상: 달리 인을 요청했는데 고정된 프레임을 받았습니다. 또는 카메라는 움직이는데 피사체가 배경에 대해 이상하게 미끄러져서, 공간을 통과하는 움직임이 아니라 사진이 일그러진 것처럼 보입니다.
원인: 원인이 둘인데 겉모습이 비슷합니다. 움직임이 동기 없이 효과로만 적혀 있거나("줌 인", "영화 같은 카메라 움직임"), 서로 모순되는 지시를 쌓아 올린 경우입니다. 피사체가 카메라를 향해 걸어오는 동안 전진하기, 4초 클립 하나에 팬과 틸트, 크레인 움직임을 함께 담기 같은 것이죠.
해결: 클립당 카메라 움직임 하나만, 영화 용어로 지목하고, 프레임 안에서 벌어지는 일과 연결하세요. 그다음 충돌을 확인하세요. 피사체가 렌즈 쪽으로 움직인다면 카메라는 멈춰 있거나 물러나야 하고, 전진하면 안 됩니다.
수정 전: "웅장한 영화적 카메라 움직임, 주인공이 카메라를 향해 달릴 때 줌 인하며 주위를 팬, 역동적인 앵글."
수정 후: "주인공이 복도를 따라 카메라를 향해 달린다. 카메라는 그 앞에서 일정한 속도로 물러나며 주인공을 미디엄 프레이밍에 유지한다. 로우 앵글, 광각 렌즈, 다른 카메라 움직임 없음."
Kling과 Seedance 모두 명시적인 카메라 지시를 잘 받아들이고, 정확한 프레이밍보다 느낌이 중요한 자유롭고 활기찬 움직임에는 Grok Imagine을 한 번 시도해 볼 만합니다. 그래도 움직임이 반영되지 않는다면, 장비를 지목하는 대신 관객이 보는 화면의 변화를 설명하세요. "스카이라인이 아래쪽에서 프레임 안으로 들어온다"처럼요.
수정 4: 장면이 표류하거나 클립 중간에 인물이 바뀐다
보이는 증상: 피사체가 한 사람으로 시작해서 그 사람의 사촌쯤으로 끝납니다. 빨간 재킷이 버건디로 변하고, 배경의 가게가 스스로 재배치되고, 방에 창문이 하나 더 생깁니다.
원인: 생성 과정에서 외형을 고정하는 것이 아무것도 없습니다. 텍스트 프롬프트는 개체가 아니라 범주를 설명하므로, 모든 프레임이 "빨간 재킷을 입은 젊은 여성"을 조금씩 다르게 해석할 자유를 갖습니다. 길이가 길고 배경이 복잡하면 표류가 빨라집니다.
해결: 이미지로 고정한 다음 변하는 것만 설명하세요. 참조나 시작 프레임을 올린 상태에서 프롬프트에 외형 전체를 다시 적으면 오히려 해가 됩니다. 글자가 이미지와 경쟁하기 때문입니다. 배경은 단순하게 유지하고, 긴 아이디어는 하나의 긴 테이크 대신 짧은 컷 여러 개로 나누세요.
수정 전: "갈색 머리에 빨간 재킷을 입은 젊은 여성이 붐비는 시장을 걷는다, 10초, 디테일 풍부하게, 사람과 노점 많이."
수정 후: "참조된 피사체의 얼굴과 머리, 빨간 재킷을 그대로 유지할 것. 그녀가 노점 두 곳을 지나 앞으로 걸어간 뒤 멈춰서 오른쪽을 본다. 얕은 피사계 심도로 뒤쪽 시장은 부드럽게 유지. 5초, 끊김 없는 단일 컷."
참고
수정 5: 글자와 로고가 깨져서 나온다
보이는 증상: "SHOPP"이라고 적힌 간판, 글자 비슷한 것으로 녹아 버리는 제품 라벨, 몇 프레임마다 변형되는 로고입니다.
원인: 영상 모델은 글자를 자형이 아니라 질감으로 생성하며, 움직임이 있으면 그 질감이 프레임마다 다시 렌더링됩니다. 작은 글자, 곡면이나 움직이는 표면 위의 글자, 원근이 들어간 면의 글자가 최악의 경우입니다.
해결: 영상 모델에 글자를 짜 달라고 하지 마세요. 서체를 저렴하게 반복해 볼 수 있는 이미지 모델에서 프레임을 만들고, 그 프레임을 움직이게 하세요. 영상 프롬프트에서는 정확한 문자열을 인용부호로 적고, 짧게 유지하고, 글자가 있는 면을 가능한 한 평평하고 안정되게 두세요.
수정 전: "카메라가 스치듯 지나가는 카페 외관, 큼직하고 디테일한 간판과 메뉴판, 많은 사인물."
수정 후: "제공된 프레임을 움직이게 할 것. 'DAYLIGHT'이라고 적힌 간판은 카메라에 평평하게, 변하지 않은 상태로 유지. 오른쪽으로 느린 수평 이동, 간판은 내내 프레임 안에 완전히 보이고, 다른 글자는 보이지 않음."
OmniArt에서는 그 첫 단계를 GPT Image 2나 Seedream 5.0 Pro 같은 이미지 모델로 돌린 다음, 승인한 프레임을 같은 작업 공간의 영상 모델로 보낼 수 있습니다. 클라이언트에게 보여 줄 것이라면 읽히는 글자는 기본적으로 이미지 먼저 처리하는 작업으로 다루세요.
수정 6: 움직임이 너무 빠르거나 떨리거나 뚝뚝 끊긴다
보이는 증상: 클립이 1.5배속처럼 재생되거나, 피사체가 미세하게 진동하거나, 움직임이 매끄럽게 이어지지 않고 눈에 보이는 단계로 넘어갑니다.
원인: 강도를 나타내는 형용사는 속도로 읽힙니다. "역동적인", "폭발적인", "에너지 넘치는", "액션 가득한" 같은 말은 같은 프레임 수에 더 많은 변화를 밀어 넣게 만듭니다. 또 다른 흔한 원인은 너무 짧은 시간에 너무 많은 사건을 요구하는 것입니다. 4초에 세 박자를 담으면 어느 것에도 프레임이 남지 않습니다.
해결: 강도 단어를 지우고 대신 속도를 지정하세요. 클립당 한 박자만 주고, 컷이 끊기지 않는다고 명시하고, 동작에 정말 시간이 더 필요하다면 더 빠른 연기가 아니라 더 긴 길이를 요청하세요.
수정 전: "폭발적이고 역동적인 액션 숏, 스케이트보더가 트릭을 하는 모습, 빠르고 에너지 넘치는 움직임, 빠른 컷 전환."
수정 후: "스케이트보더가 램프를 타고 올라가 정점에서 느린 올리 동작 하나를 한다. 일정하고 고른 속도, 끊김 없는 단일 컷, 컷 전환 없음. 카메라는 같은 속도로 옆에서 따라간다."
떨림이 구조적인 것이 아니라 미세한 것이라면, 같은 모델 계열의 상위 등급을 시도해 보세요. 고속형이나 경량형 대신 표준형입니다. 낮은 등급은 시간축 안정성을 속도와 비용과 맞바꾸기 때문입니다.
수정 7: 소리와 입 모양이 맞지 않는다
보이는 증상: 입이 말보다 먼저 또는 나중에 움직이거나, 입술이 닫혀 있는데 대사가 계속되거나, 모델이 알아서 넣은 음악에 말소리가 묻힙니다.
원인: 입 모양 맞추기에는 입이 보여야 하고 대사가 클립 길이에 들어갈 만큼 짧아야 합니다. 5초 컷에 긴 대사를 넣으면 모델은 입을 서둘러 움직이거나 동기화를 포기하게 됩니다. "웅장한 사운드트랙과 함께" 같은 분위기 설명은 목소리와 경쟁하는 배경 음악을 불러들입니다.
해결: 화자 한 명, 인용부호로 감싼 짧은 대사 한 줄, 명확하게 잡히고 가려지지 않은 입, 그리고 경쟁하는 소리 지시 없음입니다. 무엇이 들려야 하는지만큼 무엇이 조용해야 하는지도 명시하세요.
수정 전: "웅장한 사운드트랙과 도시 소음 속에서 제품 출시에 대해 이야기하는 두 사람, 클로즈업."
수정 후: "카메라를 마주 본 여성 한 명의 미디엄 클로즈업, 입이 완전히 보임. 그녀가 말한다: '저희는 금요일에 출시합니다.' 그다음 잠시 멈추고 미소 짓는다. 조용한 룸 톤만, 음악 없음."
Veo 3.1은 대사를 포함한 소리를 자체 생성하고, PixVerse V6은 OmniArt 무료 플랜에서 소리를 지원합니다. 원하는 모델에 자체 사운드가 없을 때 믿을 만한 경로는 클립을 무음으로 생성하고 목소리는 MiniMax Speech 2.8이나 ElevenLabs 같은 음성 모델로 따로 만든 뒤 편집으로 붙이는 것입니다. 이렇게 하면 화면을 다시 생성하지 않고 낭독만 다시 딸 수도 있습니다.
증상별 해결 빠른 참조
클립이 잘못 나왔을 때 분류표로 쓰세요. 다른 것을 건드리기 전에 첫 열의 항목을 바꾸면 됩니다.
| 증상 | 먼저 바꿀 것 | 모델 참고 |
|---|---|---|
| 얼굴이나 손이 일그러짐 | 프레이밍을 넓게, 클립을 짧게, 시작 이미지 사용 | 사람 움직임에는 Veo 3.1, Kling |
| 동작이 무시됨 | 동사를 앞으로, 구체적인 동작 하나 | Seedance, PixVerse C1 |
| 카메라 움직임이 없음 | 지목되고 동기가 있는 움직임 하나, 충돌 제거 | Kling, Seedance, Grok Imagine |
| 장면이나 인물이 표류 | 참조 이미지 사용, 변하는 것만 설명 | PixVerse C1 참조, V6 다중 컷 |
| 글자가 깨짐 | 프레임을 먼저 이미지 모델에서 생성 | GPT Image 2, Seedream 5.0 Pro 이후 아무 영상 모델 |
| 움직임이 너무 빠르거나 떨림 | 강도 단어 삭제, 속도 지정, 길이 늘리기 | 고속형이나 경량형보다 표준형 |
| 입 모양이 안 맞음 | 인용한 짧은 대사 한 줄, 입이 프레임 안에, 음악 없음 | Veo 3.1, PixVerse V6, 또는 음성을 따로 붙이기 |
OmniArt에서 시작하기
가장 최근에 실패한 클립을 골라 위의 일곱 가지 증상에 대조해 진단하세요. 정확히 한 가지만 수정하고, 다시 생성하고, 비교하세요. 두 번만 돌려 보면 문제가 프롬프트였는지 모델 선택이었는지 대개 알 수 있습니다. OmniArt는 이미지와 영상, 소리 모델을 한 작업 공간에 두므로, 잘 안 되는 컷은 설정을 다시 갖추지 않고도 다른 접근으로 옮길 수 있습니다. 이미지 모델로 고정하거나, 두 번째 영상 모델에서 다시 시도하거나, 목소리를 따로 붙이는 식으로요.
제작 작업 공간을 열고, 고친 프롬프트를 붙여 넣고, 버텨 주는 테이크를 남기세요.
제작할 준비가 되셨나요?
AI로 멋진 콘텐츠를 생성하세요