提示词教程
第三节课:为什么你的提示词总是出错
拆解提示词常见错误:主体不清、动作冲突、镜头和场景约束不足,以及如何改写成稳定输出。
第三节课:为什么你的提示词总是出错
成片观看 [12星座B.mp4] 本期主要内容是教会你可以迁移到任何题材的控图控视频底层方法论。 写在前面:提示词出错的真正原因
先看一个效果: (提示词:长得像牛的羊)


还有一些垃圾图:

你会发现,虽然我们脑子里有画面,我就想要一只胖胖的,肥肥的,角比较犀利的羊,怎么出来的都是牛,完全不符合我想要的感觉。
这就延伸到我们本期要讲的内容了,你所想象到的画面,跟AI理解的画面,完全不一样: 因为大多数人写提示词的路径是这样的:
Plain Text 脑子里的印象 → 直接写提示词 → 出图不对 → 改提示词 → 还是不对 但AI不知道你脑子里的画面,它只认你写的文字。
所以我们要尽可能的去找参考图 → 把图看透 → 按图写提示词 → 稳定出图 本期课程就是围绕这条路径展开的。
一、选题与参考
1.1 灵感来源 灵感来源有很多方式,包括你平时刷到的视频、你突发奇想的东西、你听到某首歌带来的感觉等等,我以我们这期的灵感来源来说,这是我抖音刷到的一个小姐姐,我就觉得这种弘扬中华文化的内容非常不错,既弘扬中国传统服饰,又弘扬中国传统十二星座的文化,于是就突发奇想,我能不能也做一个类似的内容。
[20260404-中式十二星次决定你的专属性格#耳朵的变装册 #中.mp4] 一定要先去刷,找到你觉得「就是这个感觉」的图或视频,保存下来,这是后续所有工作的锚点。
于是我就把这个选题包括了下来,说不定以后什么时候就用得上了。终于有一天,我在浏览midjourney画廊的时候,突然看到了这张图。

(非原图,二次生成演示) 这时候我就在想,能不能制作出12星座的玩偶,然后每个玩偶对应一个变装。 1.2 用AI反推提示词
现在几乎所有的AI软件都可以做提示词的反推,我常用的就是midjourney的 /describe 以及claude,claude 的好处是他带着画布功能,方便复制粘贴。


(上方的按钮是可以选择的) 我的思路是这样,给到参考图,让AI一边参考图反推,一边出提示词:


丨我给到的是这两张图,提示词为:我想制作一个短片,把这9个玩偶变成12星座的服装玩偶,然后这些人偶又会变成真人穿着对应星座的服装,类似于图2,需要不同的提示词来生成玩偶和真人的12星座的提示词,请用画板功能演示
这个步骤的核心逻辑:让AI来看图,不要让自己的印象来替代看图。
二、提示词结构化写法
2.1 提示词的分层结构 我们在一开始的时候就需要用以下这个框架对提示词进行框柱,方便让AI更全面的去书写提示词:
【主体】 → 人物基础设定
【服装】 → 颜色/材质/细节/纹样
【发型与头饰】 → 发型/发色/发饰形状/材质
【妆容】 → 眼影/唇色/特殊妆容
【道具】 → 手持物/形状/材质/发光与否
【特效】 → 粒子/烟雾/光效/氛围效果
【背景】 → 颜色/图案/光源/文字
【品质】 → 渲染质量/风格指定
提示词模板(以天蝎座为例) 【主体】Q版3D盲盒风格女性玩偶,chibi比例,头大身小,
面部精致神秘,大眼睛但瞳孔发出深红光芒,
浓黑烟熏妆,深红唇,瓷白肌肤
【服装】深黑色蝎尾鳞片战甲裙,鳞片边缘镶深红色,
裙摆呈蝎尾形,胸甲有天蝎座符号
【发型与头饰】蓬松黑色波浪发,头顶有蝎钳形黑金发冠,
气质阴冷神秘
【特效】脚下涌现深色烟雾,红色毒液光效从尾刺滴落,
背后延伸一条曲线蝎尾,尾刺发红色威胁光芒
【背景】纯浅灰色背景 #CCCCCC,无阴影,无杂物
【品质】3D超写实渲染,8K精细质感,边缘打光清晰,
工业级产品摄影光线


三、修改提示词



用AI简单出图后,就要进行修改提示词重新生图的过程。 因为我们这次做的是变装,所以要对提示词进行拆解和构建,比如:
点击图片可查看完整电子表格 比如这里提示词竟然写着:

而我们实际想要的画面是:(这个根据玩偶来的) 翠绿色汉服,金色暗纹 头戴金色植物卷曲花冠(不是羊角!)
周围是大朵白色和金色牡丹花 中式古典室内场景,暖黄宫灯 左上角「白羊」毛笔书法字

包括一开始生出来的玩偶几乎全是男性玩偶,改了提示词之后优化好的结果:


四、香蕉改图
我们做好之后就可以用香蕉进行改图了。首先就是做字体的更改:


之前生的所有的图几乎都是字体混乱的:



另外还有手部脚部和其他错误点细节的更改:


有的需要加字:



饱和度更改:


还要进行扩图:



提高清晰度:


这些步骤都是要有的,只有做完了这些步骤,我们才能进行下一步。
五、生成视频
本期我们用到的生视频工具为可灵 3.0 omni,所用到的模式是首尾帧生视频,或者直接叫做首帧图生视频,这也是传统的生视频形式了。
先给大家看首帧视频生成逻辑: 首帧图 + 提示词 → AI补全后续动态 首帧图决定了人物长什么样,提示词决定了接下来发生什么。
和生图不同,视频提示词需要多描述一个维度:时间和运动。 按照以下四层分开写,不要混在一起: 第一层:首帧画面完整还原 把首帧图里的所有视觉元素再描述一遍,AI需要确认它「看到」了什么。
画面主体:一位妖冶危险的古装美女,侧身3/4面对镜头,
微微俯身前倾,单手微抬,眼神锐利下视... 第二层:人物动作 描述人物做了什么动作,动作要具体,不要模糊。
美女缓缓抬起单手,手指微张,指尖发出红色幽光, 衣袖随手臂动作拖曳飘动,布料如液体流动 第三层:背景与粒子特效 描述背景的动态变化和粒子效果,这是氛围感的核心。
深红色圆月有低频率的脉冲闪烁,边缘有红色暗焰跳动; 深红色血滴状粒子从指尖缓缓滴落, 红色烟雾从裙摆底部缓缓向上蔓延
第四层:文字特效 画面内的书法文字是否参与动效,如何参与。 「帝天蝎」黑色字体,边缘有深红色血迹渗出感, 字体随人物动作轻微颤动,有诡异感
完整视频提示词示例(天蝎座) Plain Text
【首帧画面完整还原】
画面主体:一位妖冶危险的古装美女,侧身3/4面对镜头,
微微俯身前倾,单手微抬,眼神锐利下视,气场摄人。
服装:深红色与黑色双色汉服,衣身大面积暗红色提花面料,
领口V形开深,袖摆宽大有黑色暗纹,布料有丝绒质感。
发型:大量黑色发丝堆叠成不规则高髻,插黑红色发饰,
发丝有蓬松凌乱感,增强危险气质。
背景:极深暗背景,中央有一个大型深红色圆月,
圆月表面有暗纹肌理,背景整体深暗。
右侧有黑色毛笔书法「帝天蝎」竖排字。
【动态效果】
人物:美女缓缓抬起单手,手指微张,指尖发出红色幽光,
衣袖随手臂动作拖曳飘动,布料如液体流动。
圆月:背后圆月有低频率的脉冲闪烁,边缘有红色暗焰跳动。
粒子:深红色血滴状粒子从指尖缓缓滴落,
红色烟雾从裙摆底部缓缓向上蔓延。
光效:红色眼瞳发光效果持续闪烁,如幽冥之火。
【文字特效】
「帝天蝎」黑色字体,边缘有深红色血迹渗出感,
字体随人物动作轻微颤动,有诡异感。
【整体氛围】
暗黑妖冶,哥特古风,深红+极黑调,
唯一光源是圆月的红色冷光,
人物轮廓被红月光边缘勾勒。

粒子特效描述参考库 以下是各类特效的标准描述方式,可直接套用: 点击图片可查看完整电子表格
六、变装衔接
让变装衔接稳定的四个要点 要点一:提示词保持同色调 要点二:首帧描述要包含触发状态 不要首帧只写静态站立,要写一个能量蓄积状态
(相信很多小伙伴有经验,如果没有状态动作展示,AI会让你的视频像是图片动起来的感觉) 要点三:过程提示词要有过渡介质
点击图片可查看完整电子表格 要点四:不要有太大的动作幅度,否则AI会失真 对比:同模型不同提示词的不同产出效果:
[Video 13 (2).mp4] [Video 15 (1).mp4] [Video 8 (1).mp4]
[Video 22 (1).mp4] 记住,AI不是天马星空,而是要对作品本身负责。 变装视频完整提示词模板
Plain Text
【首帧】[星座]Q版3D盲盒女玩偶,正面站立,纯灰背景
【变身过程】
玩偶全身开始发出[对应颜色]光芒,光芒越来越强烈;
[过渡介质]从玩偶身上涌现/蔓延/爆发,[动作描述];
[介质消散/散开/落下]后,显现出身着[对应汉服描述]的古装美女,
她的姿态与玩偶相同,背景同步切换为[对应背景色调]
【尾帧】汉服美女在[背景描述]中优雅亮相,衣袂微微飘动
【节奏】整个变身过程约2秒,有[风格感],不突兀
【品质】4K电影级画质,光效真实
七、剪映后期:节奏与音效对齐
这个主要是看你怎么包装了,确实需要运用到一定剪辑技巧,本期视频主要是演示。后面会专门讲如何剪辑。