开启 3 天免费试用
注册即可免费体验全部高级功能。
*仅限新用户;每位用户只能获得一次试用。


用 AI 创建视频脚本和分镜时,先建立有来源的创作简报,再把目标拆成节拍表、脚本和可审核的镜头矩阵。AI 可以提出结构和备选方案,但事实、权利、时长、连续性、无障碍和最终生产计划必须由人批准。
本文止于视频前期规划,不生成视频、不拍摄、不剪辑、不发布。若不熟悉受控 AI 工作,可先看如何使用 AI。
关键要点
- 写提示词前固定受众、时长、目标、目的地和批准人。
- 建立有来源的事实简报,避免旁白悄悄发明主张。
- 先用节拍表控制节奏,再润色台词和镜头语言。
- 镜头矩阵应包含时长、证据、连续性、字幕、权利和审批字段。
- 生成素材或投入拍摄前,逐镜头完成人工批准。
它产出四个相互关联的文件:事实简报、节拍表、脚本和镜头矩阵。事实简报决定可以说什么;节拍表决定顺序;脚本决定旁白、对白和动作;矩阵决定团队需要拍摄、生成、许可、核查和批准什么。
OpenAI Academy 的 Sora 教程以带时间戳的视觉卡片组织分镜,说明时间与镜头顺序应显式规划。[1]Adobe 当前视频提示词指南建议描述镜头类型、人物、动作、地点和美学,并说明角度与运动会影响结果。[2]这些是平台示例,不是通用按钮;规划文件应在换工具后仍有用。
分镜不证明镜头能够安全生成、预算可行、获得许可或顺利剪辑。它只是暴露决策和假设的界面。未经解决的事实与权限不能被漂亮画面掩盖。
发言人、客户、产品屏幕、地标或事件即使被画得很可信,也不代表获得使用授权。所有未解决输入都要显式标记,并在责任人完成核对前阻止该行进入批准状态。
按这十步操作,可以从边界明确的简报推进到可复核的前期制作包,而不会把 AI 输出当成人工批准。
分别写清:
例如:“为新编辑制作 75 秒、16:9 的内部培训视频,讲清如何记录图片来源;观看后能填写一条来源记录;不使用产品主张、客户数据或真实账号屏幕。”这比“做一段有吸引力的 AI 来源视频”更可验收。
把创意选择和事实主张分开:
| 主张 ID | 允许陈述 | 来源 | 核对日期 | 视觉证据 | 状态 |
|---|---|---|---|---|---|
| F1 | 来源记录标识出处和允许用途 | 内部政策 | 2026-08-24 | 示例记录 | 已批准 |
| F2 | 分镜把计划镜头映射到时间 | 官方教程 | 2026-08-24 | 时间线图 | 已批准 |
| F3 | 平台功能会变化 | 当前帮助页 | 2026-08-24 | 无需 | 已批准 |
要求 AI 只使用批准主张,并在每个事实句后标注 ID;缺少来源时写 [需要来源],不能发明过渡信息。不要把客户访谈、未发布数字或个人数据粘贴到未经批准的服务;敏感素材先看AI 隐私风险清单。
节拍是观众理解或注意力的一次变化。75 秒说明视频可以分成开场、问题、方法、检查和结尾五段,分别分配时间、观众问题和目的。
| 节拍 | 时间 | 观众问题 | 目的 |
|---|---|---|---|
| 开场 | 0–8 秒 | 为什么要保存来源记录? | 说明上下文丢失的代价 |
| 问题 | 8–23 秒 | 哪些信息最容易消失? | 明确缺口 |
| 方法 | 23–48 秒 | 应记录哪些字段? | 演示填写方法 |
| 检查 | 48–65 秒 | 怎样复核记录? | 展示批准标准 |
| 结尾 | 65–75 秒 | 下一步做什么? | 给出一个行动 |
让 AI 提供两至三个顺序备选,人工选择后再写旁白。脚本和分镜完成后才调整节拍,会产生大量重写和连续性错误。先检查总时长:15 秒无法容纳 30 秒内容。
把批准的事实简报与节拍表交给模型,要求输出时间范围、旁白、画面动作、屏幕文字、主张编号和开放问题。
提示中明确:“只用 F1–F3;事实句后写 ID;无来源内容标记 [需要来源];不发明引用、统计、产品 UI、客户故事或法律结论。”
用计时器朗读。口语需要短句、停顿和视觉空间。删除画面已经清楚表达的重复旁白,但不能让重要信息只靠视觉传达。
字数只能用于初步估算,真实朗读更可靠,因为姓名、数字、重音和停顿都会改变速度。视障听众必须获得的关键信息不能只交给画面,有声内容也不应无意义地重复眼前已经清楚的动作。
场景段是一个地点或一个连续的想法;镜头是其中的一个机位或视觉设置。把“展示流程”这类宽泛的指令拆成可见的单元。
对每个镜头,定义:
让镜头语言有明确目的。“在最后一个字段完成时,缓慢推近纸质记录”传达了一个可见的变化。一堆镜头焦段、运动和电影感形容词可能相互冲突,也让镜头更难审核。
每个镜头一行。矩阵比一组漂亮卡片更容易发现证据、权利和连续性缺口。
这是确定性绘制的前期规划矩阵,不是产品界面、生成视频或生产结果。
字段应包括镜头编号、起止时间、画面、音频、镜头、连续性、证据、无障碍、权利和审批。OpenAI 的分镜示例使用时间戳卡片控制顺序。[1]工具无关的矩阵也应保证每个画面属于确定时间和叙事目标。
| 字段 | 记录内容 |
|---|---|
| 镜头编号 | 稳定标识,例如 S02-B |
| 时间 | 起点、终点和计划时长 |
| 画面 | 主体、动作、环境和构图 |
| 音频 | 旁白、对白、环境声和音乐提示 |
| 镜头设计 | 取景、角度、运动和转场 |
| 连续性 | 服装、道具、方向、光线和屏幕状态 |
| 证据 | 主张编号、来源地址或素材许可记录 |
| 无障碍 | 字幕、文字稿和必要的音频说明 |
| 权利 | 人物、地点、品牌、音乐和素材许可 |
| 审批 | 负责人、决策、备注和日期 |
不仅看单个镜头,还要比较相邻镜头。人物的衣服、惯用手、年龄和位置不能无故改变;道具不能消失;光线、天气、屏幕状态和背景地理应一致。
为重复元素建立连续性台账,记录固定属性、允许变化和出现镜头。例如纸质记录的版式固定,只允许字段逐步填写;铅笔可以从桌面移动到手中;所有桌面镜头保持左侧柔和窗光。
| 元素 | 固定属性 | 允许变化 | 出现镜头 |
|---|---|---|---|
| 来源记录纸 | 白色 A4、六个字段、黑色印字 | 字段逐步填写 | S02-A 至 S03-B |
| 铅笔 | 原木色、位于纸张右侧 | 移到手中 | S02-B 至 S03-A |
| 光线 | 左侧柔和窗光 | 结尾略暗 | 全部桌面镜头 |
生成的分镜图若只用于构图参考,应明确标注,不能让合成产品屏幕或虚构数据成为生产规格。
脚本仍可修改时就规划字幕。字幕必须匹配批准的口语,并在需要时标注说话者和声音。无声观看时应能理解视觉顺序;只听声音时也应获得必要信息。记录需要音频描述的镜头。
避免快速闪烁、停留过短的卡片、过小文字和只靠颜色传递的信息。无障碍是分镜约束,不是剪辑完成后的补丁。
逐项标注素材将由拍摄、生成、授权购买、组织提供还是官方产品来源获得;记录人物与地点许可、音乐与图库素材授权、Logo 和产品界面权限。
C2PA Content Credentials 可以携带来源和编辑声明,但不能代替人物许可、素材许可、事实核查和编辑判断。[3]不要用生成式肖像、克隆声音、虚构见证或模拟新闻场景绕过同意。
美国版权局把数字替身、AI 生成内容的可版权性和 AI 训练分别视为不同议题。相关资料只可作为美国范围的背景指引,不能据此对计划中的人物形象、脚本、分镜画面或生产素材给出个案结论。[4]
每行必须有负责人和明确决策:批准、修改、缺来源阻塞、缺权利阻塞或删除。“看起来不错”不是批准。
逐项确认:
冻结批准版本并保留被拒方案;后续生产必须从审核后的文件包开始,不能从散乱聊天记录开始。
它止于一份获批准的前期制作包。它不选择视频生成器,不承诺某一帧分镜能被一致地渲染出来,不创建合成语音,不生成素材,不剪辑时间线,也不发布结果。
这些活动会引入额外的控制,涉及模型能力、身份、素材授权、音频、安全、导出质量、平台披露和最终播放。把边界写清楚,能防止一份规划指南变成一条未经审核的制作捷径。
可以起草,但一个提示词无法解决事实来源、时长、权利、连续性和无障碍,必须经过结构化审核。
节拍表描述叙事变化与节奏;分镜把它们转换为带时间、画面、动作、音频、证据和审批的镜头。
应详细到审核者能判断需要展示、听到、取证、授权和保持连续的内容;在这些问题解决前,不必追求成品画面。
只有选择生成作为生产方式时才需要。拍摄、授权或确定性素材仍需要视觉规格和来源边界。
提供允许主张表,要求每个事实句标注 ID,缺失内容写 [需要来源],并由人核对映射。
为外观、服装、道具、位置、光线和方向建立连续性账本,并比较相邻镜头。
不等于。它只批准计划;实际素材仍需质量、事实、权利、安全、无障碍和最终播放审核。
免责声明:本文提供一般创作流程信息,不构成法律意见。请确认具体用途的权利、同意、披露、无障碍、平台条款和生产要求。
来源:
Sources checked 2026 年 8 月 24 日。
延伸阅读:
注册即可免费体验全部高级功能。
*仅限新用户;每位用户只能获得一次试用。