一套可复用的四段式提示词框架,让你的出图命中率提升 80%。
很多创作者写提示词的方式是"想到什么写什么",把一堆词堆在一起,然后反复重抽,期待运气好能碰到一张满意的。这种方式不仅浪费时间,而且很难复现和迭代。
提示词本质上是一份"需求文档",你在给 AI 下设计指令。一份好的需求文档需要结构清晰、要素完整。下面介绍一套经过大量实践验证的四段式框架。
主体是画面要表现的中心对象,也是信息量最大的部分。写好主体需要回答三个问题:
示例:a young woman with short curly black hair, wearing a beige trench coat, holding a coffee cup, smiling gently, looking to the side
环境交代画面发生的场景,决定了背景和氛围。一个常见的错误是完全不写环境,让 AI 自行决定,结果背景经常随机且不可控。
示例:standing on a cobblestone street in autumn, yellow leaves on the ground, small European cafe in the background
风格词决定"怎么画",是最容易缺失也最容易补齐的部分。你可以参考风格词大全,选择与你的内容调性匹配的词。
示例:cinematic photography, 85mm lens, shallow depth of field, film grain
光影是让画面从"平"变"有层次"的关键。很多创作者忽略这一段,导致画面虽然内容对但缺乏质感。
示例:golden hour lighting, warm backlight, soft shadows on face
把四段拼起来:
a young woman with short curly black hair, wearing a beige trench coat,
holding a coffee cup, smiling gently, looking to the side,
standing on a cobblestone street in autumn, yellow leaves on the ground,
small European cafe in the background,
cinematic photography, 85mm lens, shallow depth of field, film grain,
golden hour lighting, warm backlight, soft shadows on face
并非每张图都需要四段齐全。根据画面类型,权重有所不同:
| 图片类型 | 主体 | 环境 | 风格 | 光影 |
|---|---|---|---|---|
| 人物肖像 | 最高 | 低 | 高 | 高 |
| 风景场景 | 中 | 最高 | 高 | 高 |
| 产品图 | 最高 | 中 | 中 | 高 |
| 概念插画 | 高 | 高 | 最高 | 中 |
| 错误写法 | 问题 | 改进 |
|---|---|---|
a girl |
主体信息不足,AI 会随机补全 | 补充发型、服装、动作、表情 |
in a nice place |
环境模糊,无法指导生成 | 写具体场景元素和道具 |
beautiful, amazing, stunning |
空洞形容词,AI 无从执行 | 换成可量化描述,如"对称构图""高饱和" |
| 不写光影 | 画面平淡、缺乏层次 | 至少加一个光源方向或时段 |
部分模型对提示词的解析受标点影响。用逗号分段是基础做法,你还可以用换行或自然语言短句增强可读性。关键原则是:信息从核心到辅助依次排列。把最重要的主体放在最前面,风格和光影放后面,这样模型在计算注意力时会给核心内容更高权重。
在配音魔方的图片生成功能中,你可以直接使用这套结构来编写提示词。当你的提示词有清晰结构时,迭代次数会显著减少,出图质量也会更稳定。