AI 图像生成不是一个单一功能,而是一套能力组合。先用十分钟搞清楚「能做什么、不能做什么」,比立刻装软件更重要。
核心能力
- 文生图(Text-to-Image):一句话生成图片,适合概念稿、封面、插画
- 图生图(Image-to-Image):给参考图改风格、改元素
- 局部重绘(Inpainting):擦掉/改掉图片的某一块
- 放大与修复:低分辨率图高清化、去噪点
能做什么、不能做什么
- 适合:电商素材、配图插画、概念设计、风格探索、头像壁纸
- 不适合:精确文字排版(招牌、海报文字易乱)、复杂多人细节、需要严格一致的品牌图
- 文字渲染:新一代模型已大幅改善,但仍需抽卡或用专门的文字模型
上手路径
- 先玩在线工具(即梦、可灵、Liblib、Midjourney),建立手感
- 学提示词结构:主体 / 风格 / 光照 / 镜头
- 再进阶本地工具(Stable Diffusion、ComfyUI),获得完全控制
- 最后学 ControlNet、LoRA,把成品率提上来
把 AI 图像当成「无限草稿纸」:用来探索风格与构图,比直接追求「一张定稿」高效得多。