基础结构:主体+动作+场景+风格
第一步,明确核心主体。用名词锁定视觉焦点,比如“穿红裙的亚洲少女”就比“一个女孩”可控得多,不要留模糊空间。
第二步,添加具体动作动词。比如“单膝跪地→缓缓抬头→指尖轻触水面”,这种动词链远比“在跳舞”这种宽泛表述有效。AI需要精确的动作指令,而不是一个模糊的动词。
第三步,限定场景环境。例如“黄昏海边礁石区→背景有模糊飞鸟剪影”。不写场景时,AI默认填充随机背景,常常与主体产生冲突,导致画面割裂。
第四步,指定风格关键词。风格词要放在句末,比如“胶片质感→浅景深→柯达5219色库”。风格词前置容易被动作描述覆盖,后置才能稳定生效,这是经验之谈。
人物类提示词避坑写法
方法一:用“正面/侧面/仰视/俯视”替代“看起来”“看上去”——后者是主观描述,AI无法解析。直接告诉AI镜头角度,效果立竿见影。
方法二:五官细节必须量化。比如“双眼皮+瞳孔直径占眼部1/3+嘴角上扬5度”,这比“漂亮微笑”有效十倍。AI理解数字,不理解模糊的主观感受。
方法三:服装材质写实化。例如“哑光醋酸纤维衬衫→左袖口微卷至小臂中段→衣领第三颗纽扣未系”,避免“时尚衣服”这种无效信息。特别注意:未标注服装颜色时,AI默认生成灰褐色系,极易偏离预期,所以颜色信息必须明确给出。
运镜与节奏控制技巧
① 镜头类型直接写英文缩写:FS(full shot)、MS(medium shot)、CU(close-up)、ECS(extreme close-up),这些是行业通用语言,AI识别效果最好。
② 运动方式用短语衔接:“dolly in slowly→tilt up 15°→hold for 0.8s”,精准描述每个动作的持续时间和角度。
③ 时间参数必须带单位:“pan left over 2.3 seconds”比“向左平移”精确得多,AI能精确控制时长。
④ 帧率与动态模糊需显式声明:“60fps→motion blur 0.4”,否则默认24fps且无运动模糊,快速动作会卡顿,画面节奏感全无。
常见风格词速查表
赛博朋克:neon-lit→rain-slicked asphalt→holographic ads flickering→vintage CRT scanlines
水墨风:ink wash gradient→dry brush texture→negative space dominant→monochrome with single accent color
皮克斯动画:subsurface scattering→soft rim light→exaggerated squash & stretch→warm ambient occlusion
故障艺术:VHS tracking error→RGB channel misalignment→scanline jitter→digital decay overlay
负面提示词必须加的三类词
方法一:规避畸变——“deformed fingers, twisted limbs, extra limbs, fused joints”
方法二:屏蔽干扰元素——“text, logo, watermark, UI elements, border, frame, timestamp”
方法三:压制低质渲染——“blurry, low-res, jpeg artifacts, grainy, oversaturated, flat lighting”漏掉第一类词,90%以上人手/脚部会严重扭曲,这是很多新手翻车的根源。
