一起来看一下成品:
准备工具
这里我使用了一个剧本 Skill(复制到浏览器下载)(来源于Github @山音)。
https://github.com/Shanyin-ai/shanyin-screenwriting-master
此次教程的工作流
https://www.flowpix.club/bj/21400.html?token=8db4f362b05e86f86aba0db9eab8216b

第一步:确定短片的视觉风格
在正式写剧本之前,我先确定了整支短片的影像方向。
我选择参考日本摄影师濱田英明的作品,因为他的画面比较适合日系青春短片:自然光、低饱和、生活感强,人物状态也比较安静。

1.这里我让AI(大语言模型)总结一下这几张图片在风格与影调上的共性是什么
prompt:帮我总结这几张图的风格与影调的共性

prompt:帮我分析这几张张图的风格,告诉我这这张图生成时有哪些不可变的条件

prompt:帮我把这些上面的内容给我的内容整合在一起,分成空间与构图,光线与氛围、色彩与质感、限制与规则这四个板块
空间与构图
构图偏向极简风格,大量引入天空、海面或干净的建筑作为背景,进行大面积留白,使画面显得空旷透气。视觉中心明确,多采用平视或略带仰视的客观记录视角,保持几何线条横平竖直。镜头语言上,模拟中长焦镜头配合大光圈产生的浅景深效果,使背景呈现柔和虚化,主体保持清晰,以此强化画面的空间层次与呼吸感。
光线与氛围
照明全部依赖自然光,模拟晴朗白天的充足日光。光线处理极为柔和,强调空气中的光线散射效果,制造出通透的朦胧感。常使用逆光或侧逆光,在人物边缘、发丝或物体轮廓形成柔和的泛光与高光溢出现象,削弱光影的锐利边缘,去除强烈的明暗反差。场景属性聚焦于生活化、非戏剧性的瞬间,如散步、拍照、航行等日常切片。整体氛围传达出轻松、宁静、青春与怀旧的情绪基调,具有强烈的治愈系夏日或春日感。
色彩与质感
整体呈现典型的日系小清新胶片摄影风格,带有传统彩色负片的色彩映射特征,不追求极致的现代数码锐度。画面被统一的青蓝色调主导,带有明显的冷色滤镜感。核心色板以青蓝色、白色、浅绿色为主,色彩饱和度被统一压低,呈现马卡龙或粉蜡笔般的清淡柔和感。采用高调摄影手法,画面整体亮度偏高。高光区域明亮且边缘柔化,暗部被大幅度提亮并附带青蓝或灰绿色偏,画面中几乎没有深邃的纯黑色。整体对比度偏低,明暗过渡非常平滑,赋予画面透明、轻盈的视觉质感。
限制与规则
必须保持高明度、低饱和、低对比度的视觉特征,强制画面整体亮度偏高并保留刻意且轻微的过曝区域。严禁使用浓烈的色彩冲击和深邃的绝对黑色。光源仅限纯自然光,禁止出现锐利的光影边缘和强烈的明暗反差。构图必须包含大面积留白,避免复杂拥挤的元素堆砌。拍摄题材严格限制在日常、安静的非戏剧性瞬间,必须维持治愈、宁静的整体基调。

第二步:用AI语言大模型生成30秒短片剧本
风格确定之后,我开始写剧本。
我在AI语言大模型中使用编剧方向的skill(skill在准备工具中),
将skill直接丢进大模型中,输入启用这个skill

把第一步整理出的四个板块输入进去,让它根据这个视觉风格设计一支30秒左右的日系电影短片。

随后更改为日系电影预告片

以下就是视频的剧本:

第三步:根据剧本生成场景图
剧本确定后,我先不急着生成人物,而是先生成环境。
我把剧本拆成一个个场景,比如:
海边道路;公交车站;旧书出现的房间或书桌;放着汽水的画面;车票特写;男女主可能相遇的街道。
每个场景单独生成。
我使用image2.0(生图模型)生成四宫格图。
四宫格的好处是一次可以看到四个不同版本,方便选择最合适的画面。
生成场景时,我会在提示词里加入第一步整理出的规则。
并且在前面加上你要的场景提示词(使用GPT image2.0生成):
你是一个专业的摄影师,你现在需要依据指南设计四个日系不同的海边公路公交站场景,超写实,电影感日系胶片风格,纯净画面,氛围感拉满,R3D素材,逆光,形成2x2网格,不要人物出境,不要出现字幕 空间与构图 构图偏向极简风格,大量引入天空、海面或干净的建筑作为背景,进行大面积留白,使画面显得空旷透气。视觉中心明确,多采用平视或略带仰视的客观记录视角,保持几何线条横平竖直。镜头语言上,模拟中长焦镜头配合大光圈产生的浅景深效果,使背景呈现柔和虚化,主体保持清晰,以此强化画面的空间层次与呼吸感。 光线与氛围 照明全部依赖自然光,模拟晴朗白天的充足日光。光线处理极为柔和,强调空气中的光线散射效果,制造出通透的朦胧感。常使用逆光或侧逆光,在人物边缘、发丝或物体轮廓形成柔和的泛光与高光溢出现象,削弱光影的锐利边缘,去除强烈的明暗反差。场景属性聚焦于生活化、非戏剧性的瞬间,如散步、拍照、航行等日常切片。整体氛围传达出轻松、宁静、青春与怀旧的情绪基调,具有强烈的治愈系夏日或春日感。 色彩与质感 整体呈现典型的日系小清新胶片摄影风格,带有传统彩色负片的色彩映射特征,不追求极致的现代数码锐度。画面被统一的青蓝色调主导,带有明显的冷色滤镜感。核心色板以青蓝色、白色、浅绿色为主,色彩饱和度被统一压低,呈现马卡龙或粉蜡笔般的清淡柔和感。采用高调摄影手法,画面整体亮度偏高。高光区域明亮且边缘柔化,暗部被大幅度提亮并附带青蓝或灰绿色偏,画面中几乎没有深邃的纯黑色。整体对比度偏低,明暗过渡非常平滑,赋予画面透明、轻盈的视觉质感。 限制与规则 必须保持高明度、低饱和、低对比度的视觉特征,强制画面整体亮度偏高并保留刻意且轻微的过曝区域。严禁使用浓烈的色彩冲击和深邃的绝对黑色。光源仅限纯自然光,禁止出现锐利的光影边缘和强烈的明暗反差。构图必须包含大面积留白,避免复杂拥挤的元素堆砌。拍摄题材严格限制在日常、安静的非戏剧性瞬间,必须维持治愈、宁静的整体基调。


生成后,我会从四张图里挑选一张最接近短片气质的图。
挑选标准主要看:
构图是否干净;光线是否自然;颜色是否统一;场景是否适合后面放入人物;有没有多余杂乱元素;是否符合日系青春短片的感觉。
选好后,再用nanobanan 2把想要的那一张单独提取出来,作为后续人物合成和视频生成的基础画面。

以下是我生成的多个场景图

第四步:制作男女主角
场景确定后,我开始制作男女主角。
这一步的重点是人物一致性。
如果不先做角色设定,后面每个镜头里的人物都会不一样,脸型、发型、衣服都会变化。
我先找了一些网上的脸模和服装作为参考。

脸模参考

服装参考
男主和女主分别制作。
1.我会先使用nanobanan pro生成人物的脸部三视图
prompt:角色三视图, 正面, 纯侧面, 四分之三侧面, 一个美丽的20岁中国女孩, 精致的五官, 瓜子脸, 面部特写,脸上有真实的毛孔细节,以及绒毛细节。白皙皮肤, 黑色长直发,, 照片级真实感, 工作室灯光, 纯白色背景, 8K, 超高细节。


2.再生成服装的三视图
prompt:生成这一整套衣服,装饰的三视图,干净的肤色假人全身人体模特,超模的身材,白底电商风格,光影感超强,超写实。形成1x3网格。


3.服装设计图
prompt:你是一个全球知名的摄影师,现在规划这件衣服的7个角度进行拍摄。细节,材质,纹理,走线。日系电影感女主风,光影感超强。现在制作16:9的展板,排版需要有主次,灵活排版,英文,国际设计竞赛风格,高级感,白底,超写实风格


随后将这三张图片结合
prompt:图3人物穿着图2的一整套服装,服装细节参考图1,白底电商风格,正面照片,整体画面明亮。对比度较低。超写实,细节丰富,超模身材。


确定全身图后,我继续生成三类角色参考图。
1. 脸部三视图
prompt:参考图2的脸部特征,生成图1人物的近景人物肖像,需要正面,半侧面,侧面。超写实细节。


2. 半身三视图
prompt:参考图2的脸部特征,生成图1人物的人物大腿以上肖像图,需要正面,半侧面,侧面。超写实细节。


3. 全身三视图
prompt:参考图2的脸部特征,生成图1人物的人物大腿以上肖像图,需要正面,半侧面,侧面。超写实细节。


男角色也是按照这个流程制作
第五步:把人物、场景和道具合成分镜图
有了场景图和人物三视图后,我开始制作正式分镜。
我会按照剧本,一个镜头一个镜头地生成画面。
比如剧本里有一个镜头是:女主站在公交站旁,手里拿着一张旧车票,
那我生成时就会输入:
女主三视图;公交站场景图;车票素材;第一步整理出的色彩和质感规则;当前镜头的动作描述。如果镜头里需要特殊道具,我也会一起加入。
生成时,我依然使用四宫格图生成。


提取图片prompt:
单独生成【第2行第2列】的分镜图像

以下就是生成的分镜


每一张分镜图都要同时满足:人物稳定、场景正确、氛围统一。
第六步:根据分镜图生成视频
所有关键分镜确定后,我开始生成视频。
这一步我不会直接写很复杂的提示词,而是根据每个镜头单独写。
一个镜头对应一个视频提示词。
基础的prompt(其他的提示词可以在工作流里查看):
日系胶片风电影,逆光,氛围感,r3d素材,大光圈,不要生成任何bgm,但是保留音效。相机拍摄的呼吸效应。
其他的提示词可以自己依据画面进行描写
第七步:剪辑视频拼接
按照剧本将生成的视频进行拼接

搭配一些BGM,以及视频转场即可。
总结
角色设计执行卡
把这节课压缩成一张可执行卡片:看重点、照步骤、避坑,再复制模板直接开做。
这节课不是让你照着参考图抄脸,而是围绕「用AI做一支30秒日系预告短片,我是这样完成的」把原创角色脸拆成结构、比例、五官主次和妆造记忆点。
按原文节奏走最稳:先吃透「准备工具」,再把「第一步:确定短片的视觉风格」定住,接着处理「第二步:用AI语言大模型生成30秒短片剧本」;最后用「第三步:根据剧本生成场景图」收口。
- 先把「准备工具」里说的脸型或气质定住。
- 按「第一步:确定短片的视觉风格」去统一气质,不要只改表面。
- 做完「第二步:用AI语言大模型生成30秒短片剧本」后,先确认角色还是原创。
- 先把「第三步:根据剧本生成场景图」里说的脸型或气质定住。
- 围绕「第四步:制作男女主角」收一收五官,不要让每个部位都抢戏。
- 做完「第五步:把人物、场景和道具合成分镜图」后,先确认角色还是原创。
不要直接套真人脸或影视角色脸;不要把所有五官都做成强特征,否则容易撞脸、割裂、不稳定。
检查角色是否有清晰记忆点;年龄感和气质是否一致;换妆造后脸是否稳定;是否不像任何明确真人或影视角色。
请围绕「用AI做一支30秒日系预告短片,我是这样完成的」帮我做一个可直接执行的方案。 我的目标是:【填写你的具体目标】 我的素材/产品/角色信息是:【填写已有素材和限制】 请输出:角色定位、脸型方向、三庭五眼比例、五官主次、妆造记忆点、完整生图提示词。要求原创、有辨识度、避免撞脸和网红脸。