学习模式

【实用教程】零成本打造“像真人一样”的知识博主数字人!

5个月前 AI数字人生成 作者:西瓜
AI
AIGC
人工智能
AI数字人
黑科技
AI教程
干货分享
数字人制作
分享一套‘生活区博主’专用工作流:用 MiniMax 搞定人声,再把可灵的动作指令‘搬运’到即梦里。拒绝假脸假动作,效果堪比真人实拍。

一起来看一下成品:

那么接下来,按照我的思路和步骤,你也可以做出这样的作品,一起来实操吧~

准备工具


即梦 (https://jimeng.jianying.com/ai-tool/generate)

可灵(https://app.klingai.com/cn/ai-human/image/new)

MiniMAX (https://www.minimax.io/audio/text-to-speech)



第一步:打造“有灵魂”的皮囊


市面上的数字人为什么一眼假?因为底图太像‘证件照’了!我们要做的,是更有生活气息的 YouTuber 风格。

image.png


这里可以自定义想要的角色风格

image.png


随后只需要点击一键生成即可

image.png


刺猬星球海外联名工作流正在内测中,我将提示词给出,同学们可以自己使用

文本模型是Gmini3 pro 图片模型是 nano banana pro


模特形象提示词:

Role
你是一位专为治愈系/陪伴型/生活类头部博主打造视觉形象的创意总监。你极度擅长捕捉 “邻家感” (The Girl/Boy Next Door) —— 你的设计能让观众卸下防备,感到被接纳、被倾听。你极度反感“高高在上”或“咄咄逼人”的精英形象。

Task
基于我输入的“年龄”、“性别”、“人种”、“特点”、“头发”,构思 3 个 极具亲和力/邻家风格 的桌面半身策划方案。

Critical Constraints (必须严格遵守)
风格红线(拒绝精英感):

严禁:所有带有“都市精英”、“霸道总裁”、“高冷商务”暗示的风格。

拒绝:笔挺的深色西装、锐利的眼神、冷冰冰的玻璃/金属背景。

核心基调:Soft & Relatable (柔软且接地气)。风格必须是“温暖的”、“干净的”或“舒适的”。

构图与姿态 (Frontal & Gentle):

视角:Frontal Tabletop Shot (正对镜头桌面视角)。视线平齐。

姿态:坐在桌前,坐姿端正(体现精气神),但肩膀必须完全放松,身体线条柔和。

手部:双手自然搭在桌面上,增加真实的生活气息。

神态:直视镜头。表情必须是 温柔的微笑 (Soft Smile) 或 真诚的倾听状,毫无攻击性。

光影与背景 (温暖暗调):

人亮背景暗:坚持 Separation Lighting,但光质要 Soft & Warm (柔和偏暖),像午后的自然光或温暖的室内灯光,绝不能用冷峻的硬光。

背景:Dim & Cozy (暗调且舒适)。使用虚化的家居角落、书房一角或带有木质纹理的背景,营造安全感。

Input Data
年龄:{年龄} 性别:{性别} 人种:{人种} 特点:{特点} 头发:{头发}

Output Format
请严格按照以下格式输出 3 个方案(请根据人物特点,构思 3 种不同侧重点的“邻家”风格):

方案 1:[风格代号:例如 温暖居家风 / Cozy Home Vibe]
人设基础:[年龄] + [性别] + [人种] + [特点] + [头发]

画面构图:Frontal Tabletop Shot - 正对镜头,坐姿端正但身体放松,双手轻搭在木质桌面上。

外貌气质:[发型(偏柔顺/自然)] + [眼神清澈、嘴角上扬的治愈系神态] + [健康自然的肤质]

邻家穿搭:[重点描述柔软的材质。例如:Soft cotton t-shirt / Loose knit cardigan / Flannel shirt. 颜色偏暖或莫兰迪色系]

环境氛围:Dim Cozy Room. [例如:Blurred bookshelf with warm fairy lights / Softly lit living room corner in the dark / Warm wooden textures]

光影设计:Soft Warm Lighting. Gentle light on the face creates a healthy glow, separating the subject from the cozy dark background.

方案 2:[风格代号:例如 清新书卷气 / Soft Academic]
人设基础:(同上)

画面构图:(同上,强调端正但不严肃)

外貌气质:(同上,强调乖巧/斯文感)

邻家穿搭:[重点描述干净的材质。例如:White oxford shirt with rolled sleeves (no tie) / Soft beige sweater vest / Simple linen top]

环境氛围:Quiet Study Corner. [例如:Dark blurred library background / Desk lamp glow in the background / Muted dark tones]

光影设计:Natural Window Look. Simulates soft window light falling on the face, with a darker room behind.

方案 3:[风格代号:例如 随性自然派 / Clean & Natural]
人设基础:(同上)

画面构图:(同上,强调真诚交流感)

外貌气质:(同上,强调阳光/活力感)

邻家穿搭:[重点描述简约舒适。例如:Simple hoodie (solid color) / High-quality plain crewneck / Denim shirt. 拒绝花哨]
rey textured wall / Simple plants in the dark background (bokeh) / Clean shadows]

光影设计:Balanced Soft Light. Even lighting that makes the subject look approachable and trustworthy.


Gemin会给出三个策划,直接复制进nano banana pro进行生成即可。


image_node_18 (2) 1.pngimage_node_17 (1) 1.pngimage_node_16 (2) 2.png



第二步:注入“有情感”的声音


有了好看的皮囊,还得有会说话的嘴。这里我们用 MiniMax,它的语音抑扬顿挫,非常接近真人。

(这里有同学要问:为啥不直接用即梦数字人直接输入文案进行生成?因为即梦生成的声音比较假,我们要在所有环节都用最好用的平台,达到最好的效果)


这里可以选择语言,性别等等。

image.pngimage.png


此处输入文案

image.png


生成后点击下载,就能获得一个mp3文件

image.png



第三步:白嫖“动作指令”


打开可灵 AI 的“视频生成”或“数字人”界面。

上传你在第一步做好的人物底图。


image.png


他会自动生成角色表现,这段文案可以直接复制。



第四步:最终合体


最后,我们把所有素材喂给即梦,见证奇迹的时刻。


打开即梦 AI -> 数字人功能。


上传形象: 导入第一步生成的“生活照”。


上传音频: 导入第二步 MiniMax 生成的音频。


角色表现/动作描述: 粘贴第三步从可灵那里“偷”来的动作描述!


image.png


最后点击生成

最后在评论区上传您的作品,一起讨论吧~


速用卡

提示词结构执行卡

把这节课压缩成一张可执行卡片:看重点、照步骤、避坑,再复制模板直接开做。

一句话重点

这节课的重点不是堆形容词,而是围绕「零成本打造“像真人一样”的知识博主数字人!」把提示词写成能执行、能复用、能检查的结构。

落地顺序

按原文节奏走最稳:先吃透「准备工具」,再把「第一步:打造“有灵魂”的皮囊」定住,接着处理「第二步:注入“有情感”的声音」;最后用「第三步:白嫖“动作指令”」收口。

照着做清单
  1. 先把「准备工具」里的变量写全。
  2. 这一段别堆词,先把作用分清。
  3. 做完「第二步:注入“有情感”的声音」后,把可复用句子留下。
  4. 把「第三步:白嫖“动作指令”」这一点先定准,再往下走。
最容易踩坑

不要只堆形容词;提示词要写清主体、场景、镜头、光线、动作、限制条件和验收标准。

成品自检

检查提示词是否有清晰主体;是否说明画面关系;是否有可执行动作;是否包含避免跑偏的限制条件。

可直接复制的万能模板
请围绕「零成本打造“像真人一样”的知识博主数字人!」帮我做一个可直接执行的方案。
我的目标是:【填写你的具体目标】
我的素材/产品/角色信息是:【填写已有素材和限制】

请输出:提示词结构拆解、中文提示词、英文提示词、负面限制词、生成后修改建议和自检清单。要求每个词都有明确作用。