文生图模型对提示词的理解偏「关键词」而非语法,写的时候把要素拆开、用逗号分隔,效果通常比写长句更好。

四段式结构

  • 主体:谁/什么在画面中,动作与状态(一个穿汉服的女孩在雨巷中撑伞)
  • 风格:画风与媒介(水彩、赛博朋克、吉卜力、摄影写实、3D 渲染)
  • 光照与氛围:光线、色调、情绪(柔和的黄昏逆光、冷色调、梦幻)
  • 镜头与画质:视角与清晰度(特写、广角、8K、高细节)

示例

正向示例:「一个穿汉服的女孩,在江南雨巷撑油纸伞,水彩插画风格,柔和逆光,青灰色调,电影感,高细节」

负向提示词(Negative Prompt,SD 系支持):「模糊,低分辨率,多余的手指,畸形的脸,文字,水印」——用于排除常见瑕疵。

参数速记

  • Midjourney:--ar 16:9 控制比例,--v 6 控制版本,--q 控制质量
  • Stable Diffusion:在 WebUI 中调采样器、步数、CFG、Seed
  • 重复同样的 Seed 但微调提示词,可以快速迭代构图