开启 3 天免费试用
注册即可免费体验全部高级功能。
*仅限新用户;每位用户只能获得一次试用。


用文字生成 AI 图片时,可靠方法不是不断点击“重新生成”,而是先写清视觉创作简报,把它转成可观察的提示词,生成少量候选,再用同一套标准淘汰不合格结果。第一张好看的图只是草稿;真正可用的图片必须符合用途、权限边界和最终版式。
如果还不熟悉受控 AI 工作流,可先看如何使用 AI。本文只讲通用文生图流程,不讨论特定平台的地区可用性或连接排障。
关键要点
- 写提示词前先确定用途、受众、权限、比例和审核人。
- 用可见事实描述主体、动作、环境、媒介和构图。
- 每轮只生成少量候选,并记录淘汰理由。
- 检查文字、结构、手、脸、反射、Logo、裁切和误导风险。
- 保存提示词、设置、输入来源、版本和最终决策。
采用“创作简报—提示词—候选—检查—单变量修改—留档”的闭环。OpenAI 当前帮助文档说明,图片工具可以根据描述创建图片、接受比例要求,并在部分流程中编辑结果;界面和功能会变化,因此实际操作应以当日官方说明为准。[1]
方法比平台更重要。按主体、环境、构图和约束写出的提示词可以迁移到其他工具;如果一张图只靠反复生成才偶然出现,就很难解释、复现,也无法可靠地交给下一位审核人。
用一句话写清图片在哪里出现、观众应该理解什么。例如:“一张用于博客头图的宽幅创作工作台照片,表达先比较候选再选择,不显示产品界面。”这比“生成一张很酷的 AI 图”更容易验收。
至少记录以下条件:
| 决策 | 示例 | 作用 |
|---|---|---|
| 用途 | 博客头图 | 决定裁切与细节密度 |
| 受众 | 非设计专业读者 | 控制视觉复杂度 |
| 信息 | 先比较候选 | 给场景明确动作 |
| 格式 | 16:9 横图 | 避免后期破坏性裁切 |
| 必须保留 | 左侧留白 | 保护版式与移动端 |
| 必须避免 | Logo、账号数据、虚构 UI | 建立事实与权限边界 |
先判断是否应该使用生成图。真实产品教程应采用真实 UI;新闻证据应采用真实材料;精确几何图更适合确定性矢量工具。只有当合成插画、概念场景或纹理对用途是诚实表达时,才使用生成流程。
按这七步操作,可以让整个生成过程从输入到最终决策记录都便于复核。
即使只输入文字,也可能涉及真人、角色、品牌、摄影作品或特定艺术风格。上传参考图前,要确认所有权、授权、人物同意、平台条款和发布用途。
不要为了改善构图上传身份证件、私人家庭照、客户资料、未发布活动、医疗图片或内部截图。可以改用自有的中性测试素材。更完整的数据最小化原则见AI 隐私风险指南。
还要问:输出是否可能被误认为真实事件的证据?目的地是否要求披露或许可审查?最终由谁承担发布决定?任何一项不清楚,都应暂停。
在生成前逐项回答:
把答案写下来,不能用“工具允许上传”代替权利判断。
美国版权局把数字替身、AI 生成内容的可版权性以及受版权保护作品用于训练分别作为不同议题。相关资料只能作为美国范围的背景指引,不能替代具体个案的法律意见。[4]
从五个部分开始:主体、动作、环境、视觉处理和构图;约束只用于保护已知边界。
木质工作台上放着三张打印图片样张,其中一张贴有可移除的纸质标签;柔和侧面日光,真实纸张纹理,三分之四俯视,宽幅构图,左侧留白;无人、无 Logo、无可读私人信息。
这段提示词提供了可核对的事实:三张样张、标签、桌面、光线、视角和留白。若结果出现五张纸或把留白放到右边,淘汰理由很明确。更细的写法见AI 图片提示词结构指南。
第一版无需追求“杰作”,而要提供可观察的验收点。提示词应保持足够简单,让你能判断哪一句改变了画面;否则即使结果更漂亮,也说不清改进来自哪里。
避免互相冲突的指令。不要堆叠“极简但元素繁多”“纪实但梦幻失真”等要求,也不要复制一长串流行修饰词。每个词都应对应一个可见变化。
先确定主导意图。需要写实编辑照片时,就移除插画、超现实几何和不可能光线等相反要求;只有当某种视觉张力本身就是创意目标,而且能被清楚验收时,才保留它。
先设定比例和目标裁切。OpenAI 当前文档同时介绍了比例控件和在提示词中表达比例的方法。[1]Adobe 当前文生图说明也把比例、内容类型和效果作为影响生成的选择,但不同平台的控件名称并不通用。[3]应记录实际使用的设置。
考虑最终卡片和移动端裁切,把主体放在安全区域,保留呼吸空间,不要让关键信息贴近边缘。若只能生成相近比例,应等比裁切,不能非等比拉伸。
检查真实版式,不只看生成画布。一张宽幅图片还可能出现在窄卡片或小缩略图里,细小关键内容会消失。候选无法承受实际裁切时,应淘汰,而不是用拉伸修补构图。
这是 Adobe 官方支持页中的 Firefly 英文界面截图,展示真实的候选列表控件;它不是我们的本地账号、已提交提示词或生成结果,也不证明所有地区的界面完全一致。
第一轮生成三至四张即可,立即标记 A、B、C、D。等全部候选到齐后再并排比较,避免被第一张醒目图片锚定判断。
| 候选 | 简报匹配 | 结构问题 | 权利或品牌风险 | 裁切 | 决策 |
|---|---|---|---|---|---|
| A | 主体正确,留白方向错误 | 多出纸张 | 未见 | 移动端弱 | 淘汰 |
| B | 构图正确 | 标签轻微变形 | 未见 | 良好 | 修改 |
| C | 场景错误 | 物体重复 | 疑似 Logo | 良好 | 淘汰 |
| D | 场景与光线正确 | 未见明显问题 | 未见 | 良好 | 入围 |
淘汰理由会告诉下一轮应该改构图、数量、光线还是约束;只写“再试一次”不会积累可复用信息。
每张候选到齐前不要急着选择。第一张抢眼的图容易锚定判断,使安静但更准确的构图看起来不够突出;并排完成同一轮比较,才能让每张图接受相同标准。
先看全图的信息、层级、平衡、光线和裁切,再放大检查边缘、连接处、文字、反射、重复纹理、手、脸、首饰、线缆、屏幕和 Logo。
逐张使用同一组问题:
同时检查连接处、边缘、屏幕、线缆、首饰和重复纹理。所有候选使用同一问题顺序,避免因为偏爱某张图而降低标准。
不要用模糊、压缩或紧裁切隐藏结构错误。如果核心主体畸形或场景构成虚假主张,应直接淘汰。
选择最强的候选,找出它最重要的一处偏差。只修改控制该属性的那条指令,保持提示词的其余部分和输出格式不变。
示例:
每一轮之后,记录这次修改,并与上一张候选对照。如果同时改变光线、镜头角度、物体数量、色调和媒介,你就无法判断是哪一处修改改善了结果。
当反复几轮都产生同样的缺陷、却没有带来新信息时,就停下来。这个工具可能不适合所需的几何结构或文字。改用确定性的图表、授权摄影、人工设计或其他工作流,而不是降低验收标准。
除最终图片外,还应保存创作简报、提示词、平台、日期、比例、参考图来源、候选编号、淘汰原因、允许的后期调整、审核人和用途。
C2PA Content Credentials 可以携带有关来源和编辑历史的签名声明,但来源信息本身不能证明画面真实、授权完整或陈述准确。[2]即使文件元数据可能在后续流程丢失,也要保留独立的人类可读记录。
一份紧凑记录可以这样写:
| 字段 | 记录内容 |
|---|---|
| 创作简报 | 用宽幅编辑视觉表达候选比较 |
| 输入权利 | 仅文字;没有私人或第三方参考图 |
| 提示词 | 原文、平台和生成日期完整保存 |
| 候选决策 | 选择 D;保留 A 至 C 的淘汰原因 |
| 后期调整 | 只做等比裁切和文件输出 |
| 审核人 | 具名负责人 |
| 披露 | 按发布位置的适用政策处理 |
后续若再编辑图片,应追加一次操作记录,不要覆盖原始条目。有决策链的资产比一张没有历史的精美成图更容易复核。
当必需元素缺失、几何无法修复、文字不可靠、身份或同意不明确、存在未解决的品牌风险、场景可能误导真实事件,或图片无法适应最终裁切时,都应淘汰。图片漂亮不等于完成任务;选择必须回到创作简报。
如果整组候选都违反必需条件,应修改创作简报或改用其他制作方式,而不是把最不差的一张勉强通过。能解释为什么入选、又能说明其他候选为何出局,才是可审核的编辑决定。
先写一个主体、一个环境、一种视觉处理和一种构图,生成三至四张候选,对照书面创作简报,再只修改最大偏差。
不一定。只有新增文字描述了兼容且可见的属性时,长度才有帮助。互相冲突的形容词会降低可控性。
第一轮三至四张就够了。先编号并记录淘汰理由,再开始下一轮,让后续生成回应检查证据,而不是随意多试。
只有在你有权上传和复用、且符合平台与目的地规则时才可以。记录来源与允许用途,不要假设生成器会替你取得所有权或同意。
放大后逐字抄录核对。若文字必须准确,最好用确定性设计工具后加,而不是依赖生成结果。
遵循适用的平台、司法管辖区、客户和组织政策。即使不要求公开披露,也应保留来源记录。
不能。它有助于说明来源和变化,但真实性仍取决于基础证据、画面陈述和编辑审核。
免责声明:本文提供一般创作流程信息,不构成法律意见。请按具体用途确认权利、同意、平台条款和披露要求。
来源:
Sources checked 2026 年 8 月 24 日。
延伸阅读:
注册即可免费体验全部高级功能。
*仅限新用户;每位用户只能获得一次试用。