AI 图像生成不是一个单一功能,而是一套能力组合。先用十分钟搞清楚「能做什么、不能做什么」,比立刻装软件更重要。

核心能力

  • 文生图(Text-to-Image):一句话生成图片,适合概念稿、封面、插画
  • 图生图(Image-to-Image):给参考图改风格、改元素
  • 局部重绘(Inpainting):擦掉/改掉图片的某一块
  • 放大与修复:低分辨率图高清化、去噪点

能做什么、不能做什么

  • 适合:电商素材、配图插画、概念设计、风格探索、头像壁纸
  • 不适合:精确文字排版(招牌、海报文字易乱)、复杂多人细节、需要严格一致的品牌图
  • 文字渲染:新一代模型已大幅改善,但仍需抽卡或用专门的文字模型

上手路径

  1. 先玩在线工具(即梦、可灵、Liblib、Midjourney),建立手感
  2. 学提示词结构:主体 / 风格 / 光照 / 镜头
  3. 再进阶本地工具(Stable Diffusion、ComfyUI),获得完全控制
  4. 最后学 ControlNet、LoRA,把成品率提上来
把 AI 图像当成「无限草稿纸」:用来探索风格与构图,比直接追求「一张定稿」高效得多。