온천 료칸 Vlog · 일본어 피치 악센트까지 프롬프트에 적어넣다

Seedance 2.5리얼리즘Vlog여행푸드립싱크세로영상일본풍구조화 프롬프트7초
7초 2단락 구성. 여행 인플루언서가 아타미의 온천 료칸 입구에서 셀카를 찍으며 인사하고, 시간을 건너뛰어 저녁 식사에서 긴메다이 조림을 한입 먹고 "맛있다"라고 말한다. 이 일본어 프롬프트의 가장 특별한 점은 대사의 발음과 높낮이 악센트를 음절 단위로 표시했다는 것이다. 가상의 료칸 이름을 어떻게 읽어야 하는지, 어디서 숨을 쉬어야 하는지까지 규정되어 있다.
PROMPT · 영상 생성 프롬프트
AI로 창작 시작
[소재] @画像1 = 주인공의 얼굴형・헤어스타일・체형・평상복・유카타 기준 @画像2 = 료칸 외관・현관・노렌(포렴)・조경 @画像3 = 객실(테이블・창문・가구 배치) @画像5 = 금눈돔 조림・그릇・플레이팅(배경 없이 @画像3의 테이블에 세팅) [한마디로] 7초|세로 9:16|24fps. 34세 여성 여행 인플루언서가 아타미의 온천 료칸 「시오나기안」에 도착해 셀카를 찍으며 말을 걸고, 시간을 건너뛰어 객실에서의 저녁 식사 때 금눈돔을 한입 먹고 음미하는, 실사 여행 Vlog. [전체 설정] 기본 환경과 질감: 9월. 전반부는 현관 앞 오후의 부드러운 자연광, 후반부는 객실 저녁 식사 시간대의 따뜻한 실내조명. 사실적인 물리적 질감을 최대한 강조한다. 비주얼: 실사, 얕은 심도, 자연광에서 실내조명으로 자연스럽게 전환. 카메라 언어: 컷마다 카메라 움직임은 하나만. 전반부는 본인이 카메라를 든 자연스러운 미세한 흔들림의 셀카 촬영. 후반부는 얼굴과 어깨를 중심으로 한 고정 카메라. 인물: @画像1의 얼굴형・헤어스타일・체형을 전편에서 엄격히 고정. 전반부는 평상복, 후반부는 유카타. 진짜 같은 미세한 모공과 피부 질감을 유지. 연기의 핵심: 솔직하고 친근한 여행 인플루언서. 목소리를 높이지 않고, 부드럽고 자연스러운 일본어. 친구 한 명에게 말을 거는 듯한 거리감. 광고 낭독 톤으로 하지 않는다. 금지: 자막 없음, BGM 없음, 촬영 장비가 화면에 나오지 않음, 걷거나 문을 여는 동작을 추가하지 않음, 음식을 젓가락으로 든 채 포즈를 취하지 않음. [타임스탬프] 0-3s [도착・인사] 장면: @画像2의 료칸 현관 앞. 동작: 평상복을 입은 주인공이 멈춰 서서 한 손으로 셀카를 찍는다. 가슴 위쪽 구도, 얼굴은 화면 중앙보다 살짝 위, 뒤로는 현관과 노렌. 자연스러운 미소로 렌즈를 보며 말한다. 대사: 「きょうの おやどは、しおなぎあん。みて、いいかんじ」 (한자가 아니라 히라가나 그대로 발화시킨다) 발화법: 「きょうの」는 평범한 속도로 가볍게. 「おやどは、」다음에 살짝 사이를 둔다. 여기서 한 번 숨을 쉰다. 「しおなぎあん」은 나누지 않고 한 호흡에 부드럽게 말하는 고유명사. 「みて、いいかんじ」는 밝고 튀는 톤으로 전환한다. 「みて」에서 현관 쪽으로 시선을 가볍게 돌려 배경을 함께 보여준다. Pronunciation / Pitch: KYOU[H]->NO[L] / きょ↑う→の→ ("오늘"・실제 존재하는 단어・두고형(頭高型)) O[L]->YA[H]->DO[H] / お→や↑ど→ ("여관/숙소"・실제 존재하는 단어・평판형(平板型). 조사「は」도 높은 음 그대로 이어진다) SHI[H]->O[L]->NA[L]->GI[L]->AN[L] / し↑お↓な→ぎ→あん→ ("시오나기안"・조어이므로 표준 악센트 없음. 연출상의 리듬으로 두고형을 지정. 「しお」에서 올라가고 「なぎあん」은 낮게 유지한 채 평평하게 이어가며 끊지 않는다) MI[H]->TE[L] / み↑て→ ("봐"・실제 존재하는 단어・두고형) I[L]->I[H]->KAN[H]->JI[H] / い→い↑かん→じ→ ("느낌 좋다"・실제 존재하는 단어・평판형) 의도: 도착의 기쁨이 자연스럽게 드러나는 표정. 뺨과 눈가도 입 모양에 맞춰 부드럽게 움직인다. 호흡・눈 깜빡임・작은 시선 이동을 남긴다. 카메라: 셀카 고정, 자연스러운 원근감. 광각으로 얼굴이나 팔을 왜곡시키지 않는다. [컷 사이] 객실・온천・목욕 후・저녁 식사 세팅까지의 몇 시간은 생략한다. 딱딱한 전환을 금지하고, 자연스러운 컷 전환으로 이어준다. 시간은 낮에서 저녁으로 진행하며 되돌아가지 않는다. 3-7s [한입・감상] 장면: @画像3의 객실 테이블. 유카타 차림의 주인공이 자리에 앉아 있다. @画像5의 금눈돔 조림이 이미 세팅되어 있다. 동작: 작게 발라낸 금눈돔 살을 오른손 젓가락으로 입가로 가져가는 데서 시작한다. 입에 넣고 젓가락을 내린다. 녹아내릴 듯 부드러운 생선을 한입 먹는 동작. 세게 씹지 않고, 입 안에서 자연스럽게 풀어지도록 둔다. 음식 질감: 흰살 생선 조림. 젓가락을 대면 사르르 풀어질 만큼 섬세하게 조려진 살. 수분을 가득 머금어 녹아내릴 듯 부드럽다. 소리: 살이 입 안에서 부드럽게 풀어지며, 촉촉한 지방과 조림 국물을 머금은 낮고 작은 씹는 소리. 희미하게 촉촉한 「もぐ、もぐ」 소리만 들린다. 의도: 천천히 자연스럽게 씹고, 서두르지 않고 삼킨다. 삼킨 뒤 음식에서 렌즈로 시선을 되돌리고, 입가가 자연스럽게 풀리며 말을 시작한다. 대사: 「うん、おいしい」 의도: 만족감이 배어나는, 힘이 빠진 미소. 카메라: 고정, 움직임 없음. [마무리] 전편에서: 목소리 질감・말하는 거리감・음량을 통일. 대사는 지정된 대로. 입 모양과 동기화시킨다. 환경음: 전반부는 실외의 바람 소리만. 후반부는 조용한 실내 소리・작은 그릇 소리・부드러운 씹는 소리만. BGM 없음. 순수한 영상. 자막 없음. 진짜 같은 미세한 모공과 피부 질감을 유지. 인물의 얼굴・의상을 바꾸지 않는다.
✍️ 편집자 해설

이 프롬프트는 소재 목록→한 줄 소개→전체 설정→타임스탬프별 장면→마무리의 5단 구조로 짜여 있고, 각 구간의 역할이 분명하다. 진짜 노림수는 대사 처리 방식에 있다. 대사를 한자가 아니라 히라가나로 적어 모델이 한자 발음으로 읽어버리는 걸 막고, 별도로 'Pronunciation/Pitch' 줄을 두어 각 단어를 음절 단위로 쪼개 로마자 표기, H/L 고저 악센트, 일본어식 악센트 기호(↑↓→)를 함께 표기한다. 표준 악센트가 없는 가상의 료칸 이름 '汐凪庵'조차 연출상 두고형(頭高型) 리듬을 지정하고, 어디서 숨을 쉬고 어디를 한 호흡에 말할지까지 정해 놓았다. 이렇게 '말하기 전에 발음 대본을 먼저 주는' 방식은 대사를 단순한 텍스트에서 정밀하게 제어 가능한 소리 이벤트로 바꿔준다. 외국어를 말하는 캐릭터를 생성해야 하는데 모델이 악센트나 발음을 잘못 낼까 걱정되는 상황에 참고할 만한 기법이다.

AI로 창작 시작
관련 작품
×