2026-08-26·AI, 生图, 工作流, Cursor, 设计

我用 AI 做图的习惯:先图层,再合成

我也试过:对着 Cursor(或别的生图助手)写一大段提示,指望一次吐出能上线的封面。结果通常是——脸漂了、字糊了,改技术栈还得整张重出。

后来想通一件事:成品里其实混了两类需求。一类是「得像某个人 / 某种光」,模型挺擅长;另一类是「字要对齐、以后还要改」,模型几乎帮不上。塞进同一张生成图,微调就会把已经对的地方一起打乱。

我现在的习惯可以收成一句:

模型只出没有字、可以替换的图层;必须精确的东西用代码或设计工具叠上去。身份和风格分开锁。一次只改一个变量。

立绘、角色卡、商店图、图标组,我都按这套走。下面先讲习惯,文末用自己的 GitHub Profile Banner 对照一遍。


1. 先分类,再动手

动手前我会把画面拆成两类:

生成类交给模型,精确类用工具

生成类(交给模型)

  • 角色、场景、光影、材质、氛围
  • 允许有风格、允许每次略有不同
  • 失败了可以整层扔掉重来

精确类(不交给模型)

  • 文字、数字、指定字体
  • 对齐、边距、安全区、固定比例
  • Logo、图标、已定稿的 UI
  • 以后一定要改的信息(名字、版本号、技能列表)

我自己的判断标准很土:改一个字还不想重画整张脸,它就是精确类。

模型写出来的字,我几乎都没用过。指定字体、像素级对齐、可维护文案,还是代码或设计工具靠谱。


2. 两把锁:身份锁、风格锁

生角色时,我不再把提示写成一篇散文,而是拆成两把锁:

身份锁管长相,风格锁管光影,一次只拧一把

  • 身份锁:抄哪张设定——脸、发型、衣服、标志性姿势。我会写明「不要美化、不要换成另一张脸」。
  • 风格锁:抄哪张的光和画风——勾边、色温、阴影。写明「只抄光,别把那张图里不想要的表情或配件一起抄过来」。

两张参考各管一件事。早年我用成品图同时当身份又当风格,模型把眯眼、饰品、构图全带过来,眼睛修了好几轮。

一次提示我尽量只动一把锁。眼睛坏了就只修眼睛,不顺便重写光影和构图。


3. 生「可替换的层」,不生整张卡

生成目标我会定成图层,而不是海报。

我一般怎么要求
主体纯色背景(绿幕或纯白),构图留抠图余量
场景不要人、不要 UI、不要字
装饰 / 图标单独出,背景干净

绿幕不是为了好看,是为了抠图可重复。框、字、水印如果画进生成图,等于把精确类焊死在生成类上,后面每一版都要连人一起重画——我试过,很痛。

画幅也按层来:人像竖图、场景横图、图标方图。用最终成品比例去生成角色,角色容易被压扁或顶出画面。


4. 合成顺序也写进流程

图层顺序我尽量固定下来,少靠临场感觉:

从场景叠到主体,主体在最上层

场景 → 氛围/几何装饰 → 结构框 → 信息层(字、图标)→ 主体(最上层)

主体我放最后贴。框和字压到脸上的那几版,自己看都像事故。

需要「人站在框前面」时,用叠层解决就好。让模型在一张图里同时画框和人,它经常分不清谁在上。


5. 版本:一版一文件,底稿不覆盖

  • 每一版输出新文件:v1v2v3
  • 底稿、设定图、已上线的那张,本地试验也不覆盖
  • 哪一层、什么坐标、什么缩放,用一份清单记着

这样回头才能说清「上一版为什么更好」。没有版本,就只剩感觉,很难回退。

上线我只提交「选中的那一张 + 引用它的页面」,中间层和试验图留在本地。


6. 迭代:一次只问一个问题

评审时我尽量只盯一个点,例如:

  • 是不是同一个人?
  • 光对不对?
  • 字清不清晰?
  • 有没有被框挡住?
  • 某一角是不是空?

一次只改对应的那一层或那一把锁。脸、光、排版一起动,最后也不知道哪一步有效。

过关清单可以很短,但我会在合成之后看——绿幕上的角色和叠进场景后的角色,不是同一回事。


7. 什么时候我先不用生成

这些情况我会优先手绘、代码、或已有素材:

  • 细线、细环、浅色装饰贴在高光背景上(对比不够,生成也救不回来)
  • 必须用某款字体的段落
  • 已经定稿、只需改文案的信息区
  • 需要像素级重复的边框、网格、角标

我把生成当成「像某风格的像素来源」,而不是「可维护的版式系统」。


习惯收束

对我来说,四条就够用:

  1. 分类:生成类和精确类分开。
  2. 双锁:身份一张图,风格一张图,一次只拧一把。
  3. 分层:模型出可抠图层,工具出字和结构,主体在最上层。
  4. 单变量版本:一版一文件,一次改一件事,底稿不覆盖。

封面、立绘、商店图、角色卡,换的是图层内容,不是这套习惯。习惯对了,提示词可以很短;不对的话,提示词再长也是在赌一张成品。


案例:GitHub Profile Banner

上面不是空原则。我给自己的 GitHub 主页换 Banner 时,完整走了一遍。

目标很具体:蔚蓝档案那种学生展示卡。角色在右,情报在左,晴空屋顶当背景。

分类

生成类精确类
角色立绘、屋顶背景、校徽图形名字、校名、星级、STRIKER、技术栈
档案风的光和勾边指定字体
L 形角标、HUD 连线、画布比例

如果让模型「直接生成一张 GitHub 封面」,它会同时画脸和写字。脸漂了,字也糊了,改技术栈还得整张重出——这就是我开头说的那种痛。

双锁

身份锁只认角色设定图:齐刘海实色黑发、红粉开眼、宝蓝卫衣、V 手。(设定图不公开。)

风格锁只认已有档案风参考图的光:高调日光、发缘勾边、屋顶。不抄那张图里的眯眼和头上光环——除非后面明确要加。

档案风参考,风格锁;名牌当时还是一整块卡片

早期用成品 Banner 当身份参考,模型把眯眼一起学过来,眼睛反复被画坏。分开锁之后才稳住。

校徽也是单独生成、单独导出的图层,不焊在封面里。(校徽原图不公开。)

分层怎么做

  1. Cursor Generate Image 出绿幕角色(3:4 竖图)、空屋顶、校徽。
  2. 抠图后清理绿边;黑发暗部把透明度拉实,避免发尾变灰。
  3. 用脚本画 HUD 和短角标,不画四边封死的金框。
  4. 每一层的文件、坐标、缩放记在清单里,合成顺序固定为:
背景 → 几何装饰 → 边框 → HUD → 角色

角色最后贴。整圈边框曾经盖在头发上,看起来像被卡片裁切,所以改成只留短 L,右边敞开。

画布试过两种:宽版 1536×864 和更扁的 1536×420。矮条更像封面图,最终还是宽版好看。方法允许并排出两套合成配置,用眼睛选,而不是在提示词里赌比例。

单变量迭代在改什么

名牌先做成一整块时,信息全挤在左下,左上只剩天空:

HUD 仍挤在左下,左上偏空

只改 HUD、不动角色:校徽和校名上移,名字留左下,字加大——这是排版问题,不是再生一张更满的图。

HUD 拆开之后

每一版只回答一个问题:

  • 眼睛不像设定 → 只重生角色层
  • 头发变灰透明 → 只改抠图
  • 名牌像一张死卡片、左上太空 → 只改 HUD
  • 右边缺收口 → 只加短角标和淡几何,不加第二段字
  • 头上加档案光环 → 细白环贴在晴空上几乎看不见 → 这一层删掉

光环就是第 7 条的现场例子:浅色细环叠在高光天空上,生成和描边都救不了对比。不该用生成硬撑的东西,去掉比继续调提示更正确。

原底图全程不覆盖。本地从试验版排到定稿,上线只提交选中的那一张和页面引用。

定稿

定稿:无光环,HUD 拆开,角色在最上层

这个案例想验证的不是「档案风封面要这样画」,而是:

  • 脸和光可以交给模型,名字和技术栈不行
  • 框和人的前后关系用叠层解决,不要让模型在一张图里同时画
  • 左上空、右边空,是排版问题,用挪图层解决,不是再生成一张更满的图
  • 好看但看不清的装饰,属于不该生成的那一类,删掉即可

下次如果换 Steam 胶囊图、角色立绘卡或商店头图,图层内容会变,这四条我还会继续用。欢迎对一下你自己的工作流——哪里对得上、哪里你会换做法,都欢迎聊。

SYSTEM ACCESS

[ACCESS GRANTED]

OPERATOR:UNDESIGNATED

CLEARANCE:LEVEL 7

STATUS:ACTIVE

You found the secret...