一起来看一下成品:
准备工具
Nano banana pro https://labs.google/fx/tools/flow
Gemini https://gemini.google.com/
即梦 https://jimeng.jianying.com/ai-tool/home/
第一步:生成模特素材与服装融合
首先,我们需要确定MV的主角形象。这里使用 Nano Banana Pro 进行人物生成与服装替换。
1.生成初始人物:
使用以下提示词生成两位角色(可通过微调发型描述来区分角色):
YOUNG ASIAN FEMALE (AGE 20), SLIM, VERY ATTRACTIVE K-POP IDOL LEVEL BEAUTY, FLAWLESS SKIN, SOFT SYMMETRICAL FEATURES, EXPRESSIVE EYES. Long hair, smooth hairstyle OUTFIT: FUTURISTIC MECHANIC TECHWEAR - SHORTS, LAYERED FABRICS, STRAPS, SMALL DETAILS, SLIGHTLY WORN WITH STICKERS/DOODLES. WHITE STUDIO BACKGROUND, SOFT CINEMATIC LIGHTING, REALISTIC, HIGH-END FASHION STYLE. 中文翻译:年轻亚裔女性(20 岁),身材纤细,颜值出众,达到韩国偶像级别,肌肤无瑕,五官柔和匀称,眼神灵动。长发,发型顺滑流畅。服装:未来感机械机能风穿搭 —— 短裤,多层面料,配有绑带,细节丰富,略带做旧质感,装饰有贴纸 / 涂鸦。白色影棚背景,柔和电影级灯光,写实效果,高端时尚大片风格。
这套提示词来源于 Higgsfield AI

得到这俩个人物(需要多次抽卡生成哦)


2.精准换装与“人物版”制作:
找参考: 去 Pinterest /小红书等网站搜索高质感的 K-pop 打歌服。


融合与定型: 使用 Nano Banana Pro 的图像编辑功能,将生成的人物与服装无缝融合,并且生成人物版。
输入提示词:
图1的角色穿上图2的一套服装穿搭,保持模特韩国女团高挑的身材比例,画面左半部分生成A字站立的前视图与后视图。画面右半部分生成面部特写正面图,面部特写侧面图,面部特写后面图,以及上半身正面特写图,保持背景纯白


第二步:注入灵魂(创作专属电子风音乐)
一首踩点精准、节奏强烈的音乐是舞蹈 MV 的核心。我们不需要自己懂乐理,交给 AI 即可。
利用大模型推导音乐提示词: 将你的需求发给 Gemini 等大语言模型:
“我要制作一首 K-pop 韩国女团风格的电子曲,请给我一段适合在 Suno 中使用的提示词(Style of Music),不要生成音频。”
(AI 会返回类似:K-pop girl crush, heavy bass, EDM, fast tempo, catchy electronic synth 等精准词汇)

AI给我的提示词
K-pop, Girl Group, Electropop, Future Bass, Sparkly Synths, High Energy, Catchy Hook, Female Vocals, Dance-pop, Polished Production, 125 BPM
生成专属歌词: 继续让大模型为你写一段英文歌词 。

Suno 一键成曲:
打开 Suno 平台,填入刚才获取的“音乐风格提示词”和“歌词”,点击生成。

挑选一首抓耳、鼓点清晰的曲目下载备用。
第三步:搭建舞台(寻找环境参考)
舞蹈需要极具氛围感的背景来烘托情绪。
平台推荐: Pinterest 或 Behance。
搜索关键词: MV stage design(MV舞台设计)、Kpop set design(Kpop布景)。

挑选建议: 尽量选择空间纵深感强、有明显灯光射线、且地面平整干净的图片。


第四步:化身 MV 导演(推导视频分镜与动态提示词)
这是最拉开差距的一步!不要干巴巴地让 AI “跳个舞”,我们需要用导演的思维来拆解镜头。
1.生成专业分镜脚本: 将第一步的【人物图】、第三步的【环境图】以及第二步的【音乐节奏】,连同以下指令发送给大语言模型:
“基于图1、图2的人物,图3的环境,配合一段 12 秒的强节奏 K-Pop 英文电子舞曲,写一段视频分镜。歌曲节奏:前10秒跟着音乐舞动,10-12 秒高潮结尾。请你作为音乐录影带(MV)导演,将 12 秒拆分为 4 个具体的镜头段落。每个段落必须包含:景别(如全景、特写)、主角动态、运镜方式(如推镜、跟拍)、构图。整体风格设定为 K-Pop Girl Crush 风格。”

2.整合成最终 AI 提示词: 确认分镜逻辑流畅后,发送最终指令:
“现在,请把刚才的 4 个分镜组合成一段完整连贯的 AI 视频生成提示词。不要过多的形容词,开头先描述整体,随后按照时间顺序,描述画面,直接给我可用于视频生成的英文提示词即可。”

(这一步能帮你把复杂的中文分镜,完美转化为视频模型最容易理解的、带有时间轴的 Prompt。)
得到以下视频提示词:
制作一段 8 秒的高级时尚风音乐视频表演片段,以 图片1图片2为基准锁定人物整体形象、服装造型、银色遮面墨镜及场景环境,并以 @音频 1 为精准人声与歌曲节奏参照。两位女性在视频全程均佩戴图片4墨镜。场景设定在图片3中质感流畅的未来风隧道内,地面带有反光效果、精致时尚大片造型风格,以及高品质音乐录影带氛围。演唱需从第一秒起完全贴合 @音频 1:歌词精准、旋律精准、断句精准、演唱节奏精准、口型精准,不得修改歌词、不得改动旋律、不得替换词句、不得调整节奏。0-2 秒:开篇为图片1 单人中近景跟拍镜头,从第一秒起直视镜头演唱,口型与 @音频 1 精准同步,自信抬头,肩部轻微律动,佩戴墨镜,镜头缓慢推进。2-4 秒:切换至图片2 单人中景跟拍镜头,配合柔和环绕运镜,她精准演唱 @音频 1 的下一句歌词,带着凌厉气场转向镜头,口型与节奏完全契合,佩戴墨镜。4-6 秒:广角移动镜头,两位女性一同入镜并并肩在隧道中前行,随后切换为低角度跟拍镜头,重点展现靴子、腿部与同步的台步步态,跟随 @音频 1 的节拍在正面与侧面角度间快速甩镜切换。6-8 秒:两位女性并肩面向镜头前行,气场同步且极具张力,演唱与 @音频 1 完全同步,快速交替切换两人特写镜头与全景主镜头,配合镜头推进与横向跟拍,最终以双人强势造型定格在画面中心。风格:极致电影感时尚音乐录影带,韩式偶像时尚大片质感,高品质商业级成片效果,动态节拍同步剪辑转场,丰富镜头角度与画面切换,精致反光棚拍质感,无屏幕文字,人物比例正常无拉伸。图片2
还有一段提示词如下:
制作一段 15 秒的韩国流行音乐视频表演片段,锁定两位女性的整体形象与服装造型:女性一以 @图1 为基准(长直黑发,黑色镂空无袖上衣,十字架项链,金属链条腰带,黑色短裤与黑靴);女性二以 @图2 为基准(黑色短卷发,黑色心形天鹅绒透视上衣,铆钉腰带,黑色短裤,带十字架的长袜与黑色毛绒鞋)。场景以 @图3 为基准,设定在一个极简未来的发光科技长廊中,两侧倾斜的条形冷白发光墙面向远处的城市天际线延伸,地面为极具质感的高反光镜面。为增加舞台酷感,两位女性在视频全程均佩戴充满未来感的银色墨镜。并以 @音频 1 为精准人声与歌曲节奏参照。0-2 秒:全景主镜头,两位佩戴银色墨镜的女性已在充满未来感的发光长廊中央同步歌舞,呈现整齐划一的韩国流行(Girl Crush风格)编舞,采用电影感缓慢推镜镜头,画面居中对称感强烈,背景是远处朦胧的城市天际线。2-3 秒:交替紧凑的中近景镜头,二人持续跳舞并直视镜头演唱,银色墨镜的反光为画面视觉重点,口型精准同步,采用音乐录影带快切节奏,配合快速推进与轻微环绕运镜。3-5 秒:低角度跟拍镜头环绕两位女性,二人同步完成力度更强的舞蹈动作,手臂线条利落、步伐连贯、胯部动作突出、发丝自然飘动,画面中清晰展现倒映着两人舞步的高反光镜面地板与两侧倾斜的发光墙壁。5-7秒:流畅的侧面跟拍镜头与二人平行移动,捕捉同步舞蹈动作,背景的条形发光线条快速向后掠过带来速度感,随后快速正面冲镜,二人转向镜头共同演唱下一句歌词。7-9 秒:广角移动镜头搭配轻微升镜效果,展现长廊尽头广阔的城市天际线与纵深感极强的发光通道,二人完成队形清晰、剪影感强烈的同步编舞。9-11 秒:快速连贯的特写镜头组,依次呈现银色墨镜的未来感反光、演唱的唇部、图1的金属链条腰带与图2的心形透视上衣细节、肩部发力动作、手部编舞,随后快速切换双人中景,二人持续舞蹈且口型始终同步。11-12 秒:最终高潮段落,两位女性立于长廊中心同步歌舞,采用正面与侧面快速交替的音乐录影带剪辑方式,随后镜头高速平稳冲镜对准二人,结尾定格在两人佩戴银色墨镜、神情凌厉的静态定点画面,背后的城市天际线与两侧的发光线条依旧璀璨。
第五步:Seedance 2.0 视频生成
素材全部就位,接下来就是组装的时刻。
1.打开 即梦Seedance 2.0 平台。(即梦官网的seedance2.0无法生成真人,可以试试其他平台接入的seedance2.0。例如Flowpix可以直接生成真人。)
2.输入视觉参考: 依次导入你的“人物版参考图”和“舞台环境参考图”。
3.输入听觉参考:
因为直接生成的音频很长,音频需要进行裁剪处理,看你生成的时间多久,就裁剪多长的音频。
4.输入动作指令: 将第四步大模型为你推导好的英文视频提示词复制到文本框中。
5.点击生成! 等待系统渲染完毕,由于我们前期给足了多角度的人物参考和精确的镜头描述,你会得到一支人物一致性极高、运镜专业、且动作完美卡点的女团舞蹈 MV!

第六步:精修与成片
AI 视频生成具有一定的随机性,想要达到完美的 MV 视觉效果,后期的“优中选优”和剪辑包装必不可少。我们可以借鉴真实 MV 拍摄中的“多机位”概念来完成最终作品。
1.多组生成(增加素材库): 在 Seedance 2.0 中,不要只满足于第一次生成的结果。保持人物参考、环境图和音频不变,点击生成 3 到 5 次。每一次 AI 都会演绎出略微不同的舞蹈编排和运镜细节。
2.专业剪辑与卡点拼接: 将挑选出的几段优秀视频导入剪辑软件(如剪映、Premiere 等),进行最终的缝合。
锁定音频: 首先,将原始的 Suno 高清音频单独拖入音频轨道,确保音质不受损。
多机位混剪: 关掉所有视频原声。根据音乐的鼓点和情绪起伏,将不同视频的高光画面拼接在一起。
核心技巧: 这种“多素材、频切换”的剪辑手法,不仅能巧妙掩盖单条 AI 视频可能存在的局部瑕疵,还能极大地增强画面的节奏感。

最后导出
视频生成执行卡
把这节课压缩成一张可执行卡片:看重点、照步骤、避坑,再复制模板直接开做。
这节课不是先追求炫技成片,而是围绕「零基础AI视频教程:5步打造K-pop女团舞蹈MV」先把主体、动作、镜头和节奏稳住。
按原文节奏走最稳:先吃透「准备工具」,再把「第一步:生成模特素材与服装融合」定住,接着处理「第二步:注入灵魂(创作专属电子风音乐)」;最后用「第三步:搭建舞台(寻找环境参考)」收口。
- 先把「准备工具」里的主体和动作定死。
- 按「第一步:生成模特素材与服装融合」去统一气质,不要只改表面。
- 做完「第二步:注入灵魂(创作专属电子风音乐)」后,先查连贯性和穿帮。
- 围绕「第三步:搭建舞台(寻找环境参考)」只取局部结构,别整张照搬。
- 把「第四步:化身 MV 导演(推导视频分镜与动态提示词)」整理成可复制版本,后面直接复用。
- 做完「第五步:Seedance 2.0 视频生成」后,先查连贯性和穿帮。
不要一上来就生成最终片;先拆镜头、定主体和运动,再逐段生成,否则容易跳轴、穿帮、节奏混乱。
检查主体是否稳定;镜头运动是否明确;前后画面是否连贯;节奏是否服务主题;是否有明显变形或穿帮。
请围绕「零基础AI视频教程:5步打造K-pop女团舞蹈MV」帮我做一个可直接执行的方案。 我的目标是:【填写你的具体目标】 我的素材/产品/角色信息是:【填写已有素材和限制】 请输出:核心创意、分镜表、每个镜头的画面描述、视频生成提示词、剪辑顺序和成片自检清单。要求主体稳定、动作明确、镜头连贯。