已复制到剪贴板
Prompt Engineering · Visual Direction

从文字到镜头文生图提示词的视觉控制系统

把提示词从“形容词集合”升级为一份可以拆解、诊断与迭代的镜头计划。用结构控制画面,用锚点保持人物,用五个镜头完成一次真正的短剧转化。

08提示词模块
05电影分镜
01控制系统
00 / COURSE SYNTHESIS

先建立生产链,
再讨论提示词。

课程真正有价值的不是某个按钮,而是把不稳定的生成过程拆成可检查的阶段。每一步都在缩小下一步的随机空间。

01

剧本文字

定义发生什么:人物、冲突、转折与结果。

02

分镜描述

定义观众看到什么:拆成可生成的视觉单位。

03

结构提示词

定义模型如何构造画面与注意力顺序。

04

关键帧

先验证角色、构图、光线与空间连续性。

05

动态生成

控制动作、表情、运镜与时间变化。

06

剪辑成片

用节奏、声音和取舍把素材组织成故事。

↳
我的判断:AI视频的稳定性,不是从“视频生成”阶段才开始控制。

人物、镜头和情绪是否成立,早在剧本拆解与关键帧提示词阶段就已经被决定。

01 / PROMPT ANATOMY

一条完整提示词,
是一组有顺序的决策。

点击左侧八个模块,观察它在完整提示词中的位置、功能和失控症状。顺序不是语法规定,而是为了先锁定“不可变”,再开放“可变化”。

缺失模块诊断器

关闭任意模块,模拟一条提示词为什么会失控。

当前可控度

100/ 100
八个模块完整,画面具备可诊断基础
02 / BEFORE × AFTER

不是写得更长,
而是控制得更准。

同一个凌晨便利店场景。优化前只表达题材,优化后明确视觉对象、镜头位置、光色关系与叙事悬念。

优化前的普通便利店场景优化后的悬疑分镜
03 / CRITICAL THINKING

提示词不是描述画面,
而是在安排模型的注意力。

模型不会像人一样“看见”现实,它根据训练数据中概念之间的统计关系重建视觉世界。写提示词,就是选择哪些关系被优先激活。

04 / STORY PRACTICE

从一句悬念,
到五个可生成镜头。

实战不是展示几条漂亮提示词,而是证明同一角色、同一场景和同一视觉语法能否跨镜头持续成立。

凌晨雨夜便利店外景
ORIGINAL MICRO-DRAMA / SUSPENSE

凌晨 02:17
监控里多出来的人

夜班店员在监控中发现,自己身后站着一个穿红色雨衣的人。她回头,货架间空无一人;再次看向监控,那个人已经贴到了摄像头前。

分镜图
05 / CONSISTENCY SYSTEM

人物一致性,
本质是资产管理。

将人物属性拆成固定变量与可变变量。每一镜重复固定锚点,只让动作、机位和光线随剧情变化,避免模型自行“重新选角”。

夜班店员角色

角色 A / 夜班店员

Character Anchor v1.0 · 跨镜头复用

26岁东亚女性,齐下颌黑色短发,偏窄鹅蛋脸,左眉尾一颗小痣,米白色衬衫,深墨绿色便利店围裙,银色方形工牌。

必须固定 / LOCK

年龄与人物身份发型、脸型和小痣衬衫、围裙和工牌写实电影风格冷青与暗红配色

允许变化 / FLEX

表情与动作景别与摄像机位置画面中的站位光线强弱红衣人与镜头距离
失控症状
根因判断
定向修正
人物在不同镜头换脸
主体锚点过于笼统
固定五官、发型、标志特征;复用参考图
服装颜色与款式漂移
每镜重新自由描述
原样复用服装锚点,不使用近义词改写
背景多出无关顾客
场景边界没有声明
明确“店内仅一名店员,无其他顾客”
红衣人变成具体人物
反派身份描述过多
只固定红色连帽雨衣,面部完全隐藏
镜头间像不同影片
风格与光色没有继承
统一时间、冷青荧光、暗红反射与胶片颗粒
◎
FINAL JUDGEMENT

好的提示词,不是写得更多,
而是让模型知道什么必须出现,什么不能改变。

提示词优化不是寻找一句神奇咒语,而是在建立一套可以观察、诊断、逐项修正并跨镜头复用的视觉控制系统。