文生图模型对提示词的理解偏「关键词」而非语法,写的时候把要素拆开、用逗号分隔,效果通常比写长句更好。
四段式结构
- 主体:谁/什么在画面中,动作与状态(一个穿汉服的女孩在雨巷中撑伞)
- 风格:画风与媒介(水彩、赛博朋克、吉卜力、摄影写实、3D 渲染)
- 光照与氛围:光线、色调、情绪(柔和的黄昏逆光、冷色调、梦幻)
- 镜头与画质:视角与清晰度(特写、广角、8K、高细节)
示例
正向示例:「一个穿汉服的女孩,在江南雨巷撑油纸伞,水彩插画风格,柔和逆光,青灰色调,电影感,高细节」
负向提示词(Negative Prompt,SD 系支持):「模糊,低分辨率,多余的手指,畸形的脸,文字,水印」——用于排除常见瑕疵。
参数速记
- Midjourney:--ar 16:9 控制比例,--v 6 控制版本,--q 控制质量
- Stable Diffusion:在 WebUI 中调采样器、步数、CFG、Seed
- 重复同样的 Seed 但微调提示词,可以快速迭代构图