从设计小白到 AIGC 高手的成长路径
上周,一位学员在社群里发了一张图:她用 Midjourney 生成了一只“赛博朋克风格的猫”,但出来的结果却是猫脸扭曲、霓虹灯文字乱码、整体构图失衡。她沮丧地问:“为什么我看了那么多教程,还是做不出那种高级感?”
这个问题我每个月都会听到几十次。很多人以为 AIGC 设计就是“输入一句话,点击生成”,但真正的差距,从来不在工具本身,而在于你对“提示词工程”和“设计语言”的理解深度。
今天,我不讲虚的,直接拆解我从零基础到带出数百名 AIGC 设计师的完整路径,包含具体操作步骤、参数调优和避坑指南。
第一阶段:打破“咒语迷信”,建立结构化提示词思维
大多数小白卡在第一步的原因,是把提示词当成“魔法咒语”——以为堆砌更多形容词就能得到好结果。实际上,专业 AIGC 设计师的提示词是结构化的。
核心公式:主体 + 环境/背景 + 风格/媒介 + 光影/色调 + 构图/镜头 + 细节/质感 + 负面词
以 Midjourney V6 为例(当前最新版本,2024年12月更新),我让学员做一个“未来主义咖啡馆”的场景设计,对比一下两种写法:
小白版: `a futuristic cafe, cool, stylish, neon lights, coffee, people, 8k, ultra detailed`
高手版: `wide-angle shot of a futuristic cafe interior, curved white concrete walls with embedded LED strips, holographic menu floating above the counter, barista in a minimalist grey uniform, morning sunlight streaming through floor-to-ceiling windows, volumetric fog, cinematic color grading, shot on Sony A7R IV, 24mm lens, f/2.8 –ar 16:9 –v 6 –style raw`
差距在哪里? 高手版包含了:
- 镜头语言(wide-angle shot, 24mm lens)
实操步骤:
1. 打开 Midjourney,在 `/settings` 中确认选择 V6 版本,`–style raw` 模式(避免默认风格过度污染)。
2. 用上述公式写出你的第一版提示词,每个冒号后面只写一个具体描述,不要用逗号堆叠模糊概念。
3. 生成后,用 `–vary` 按钮(V6 新增功能)进行局部微调,而不是重新输入整���提示词。
关键参数速查表:
| 参数 | 作用 | 推荐值 |
|——|——|——–|
| `–ar` | 宽高比 | 海报用 2:3,壁纸用 16:9,方图用 1:1 |
| `–stylize` | 艺术化程度 | 默认100,插画风调至 250-400,写实风调至 50-100 |
| `–chaos` | 变化程度 | 探索期用 50-80,定稿期用 0-10 |
| `–tile` | 无缝纹理 | 做图案/壁纸时开启 |
第二阶段:从“生成图片”到“控制设计”——用 ControlNet 实现精准构图
很多学员在 Midjourney 里玩得溜了,但遇到商业项目就崩——因为 MJ 的随机性太强,无法精确控制元素位置。这时候,你需要进入 Stable Diffusion + ControlNet 的领域。
真实案例: 一位学员接到一个茶饮品牌的包装设计需求,甲方要求“茶叶漂浮在透明玻璃瓶中,背景是水墨山水,LOGO 位置在左上角 1/4 处”。用 Midjourney 反复抽卡 20 次,没有一次构图达标。
解决方案:
1. 安装 SD WebUI(推荐使用 Stability Matrix 或 SD.Next 整合包,避免环境配置地狱)。
2. 下载 ControlNet 扩展(版本 1.1.4+)以及模型 `control_v11p_sd15_softedge`(用于���缘检测)。
3. 在 Photoshop 或 Figma 中,用简单的黑白线条画出构图草图——左边一个瓶子轮廓,右上角预留 LOGO 区域,底部留白。
4. 在 SD WebUI 中,将草图拖入 ControlNet 面板,选择 “Soft Edge” 预处理,权重设为 `0.8`,引导时机 `0.4-0.6`(让 AI 前期自由发挥,后期锁定边缘)。
5. 主提示词写:`transparent glass bottle with green tea leaves floating inside, ink wash mountain background, minimalist product photography, soft studio lighting, high-end packaging design`
6. 负面词写:`text, watermark, logo, deformed, distorted, oversaturated`
结果: 第 3 张出图,构图完全符合要求,且水墨背景与玻璃瓶的光影融合度远超 MJ 的产出。后续只需在 PS 中叠加品牌 LOGO 即可。
进阶技巧: 如果你需要精确控制主体姿态(比如人物手部动作),改用 `control_v11p_sd15_openpose`(骨骼提取),配合 `depth` 模型控制前后景关系。记住:ControlNet 不是滤镜,而是“设计约束器”——权重越高,AI 的自由度越低,但构图越可控。
第三阶段:工作流自动化——用 ComfyUI 搭建可复用的设计流水线
当你已经能稳定出图,下一个瓶颈是效率。手动在 WebUI 里调参、跑图、修图,一天最多产出 30 张合格素材。但用 ComfyUI 节点式工作流,同样的时间能产出 200 张,且质量更稳定。
实操案例: 我给学员布置的进阶项目——批量生成 100 张“不同风格的咖啡包装设计”,要求每张图都是 3D 渲染质感,且颜色方案从 10 种预设中随机抽取。
搭建步骤:
1. 打开 ComfyUI(推荐使用官方便携版,Python 3.11+)。
2. 加载基础工作流模板:`Load Checkpoint` → `CLIP Text Encode`(正向/负向)→ `KSampler` → `VAE Decode` → `Save Image`。
3. 在 `Load Checkpoint` 中,选择 Realistic Vision V5.1(写实渲染最强)或 Juggernaut XL(适合产品设计)。
4. 关键节点:在正向提示词中,将“风格描述”部分替换为 `{style_prompt}` 变量,然后添加一个 `Primitive Node` 连接至 `Text Concatenate`,输入你的 10 种风格描述(如“北欧极简风”“日式侘寂风”“赛博朋克风”等)。
5. 在 `KSampler` 中,设置 `seed` 为 `-1`(随机),`steps` 为 `30`,`cfg` 为 `7`,`sampler_name` 为 `dpmpp_2m`,`scheduler` 为 `karras`。
6. 添加 `Loop` 节点(使用 `Efficiency Nodes` 插件),设置循环 10 次,每次自动更换 `style_prompt` 和 `seed`。
7. 点击运行,去喝杯咖啡,回来就有 100 张成品图。
为什么推荐 ComfyUI 而非 WebUI? 因为节点式工作���可以版本化管理——你调整过的每一��参数都可视化,且能打包成 JSON 文件分享给团队。对于商业化项目,这意味着可复制、可培训、可迭代。
总结:高手与小白的本质区别
回顾这三个阶段,你会发现一个残酷的事实:工具只是放大器,审美和逻辑才是底层能力。小白用 Midjourney 生成 1000 张图,可能只有 5 张能用;高手用同样的工具,可能在 50 张内就锁定方向,然后用 ControlNet 和 ComfyUI 把方案打磨到极致。
我的建议路径:
1. 第 1-2 周: 死磕 Midjourney 结构化提示词,每天精修 10 张图,建立“设计语言”直觉。
2. 第 3-4 周: 学习 Stable Diffusion 基础,重点掌握 ControlNet 的 5 个核心模型(Canny、Depth、OpenPose、SoftEdge、MLSD)。
3. 第 5-8 周: 用 ComfyUI 搭建 3 条完整工作流(人物海报、产品渲染、场景插画),并尝试接入 API 实现自动化。
4. 长期: 每周收集 50 张优秀设计作品,用提示词反向拆解,建立自己的“风格库”。
常见问题 FAQ
Q1:Midjourney 和 Stable Diffusion 到底学哪个?
A:两个都要学,但分工不同。MJ 适合快速探索创意方向、生成氛围图;SD 适合需要精确控制、批量产出、商业落地的场景。建议先 MJ 建立审美,再 SD 学控制。
Q2:我的电脑配置不高,能跑 SD 吗?
A:最低要求 8GB 显存(GTX 1080Ti 级别),推荐 12GB 以上。如果只有 4GB,可以用云端服务(如 RunComfy、Google Colab),或者使用 SD-Turbo 模型(4 步出图,显存需求减半)。
Q3:生成的图片有版权问题吗?
A:MJ 付费版和 SD 开源模型的商用法则不同。MJ 付费用户拥有商用权,但需注意“模仿特定艺术家风格”的条款限制;SD 模型若基于 Stable Diffusion 开源权重,生成的图可商用,但训练素材的版权需自行排查。商业项目务必记录提示词和模型版本。
Q4:为什么我用了 ControlNet,构图还是偏?
A:大概率是权重设置问题。如果主体位置偏移,提高权重至 0.9-1.0;如果边缘太生硬,降低权重至 0.5-0.7,并调整“引导时机”(Start/End Step)。另外,草图线条越粗,AI 的自由度越低。
Q5:如何快速提升 AI 设计作品的“高级感”?
A:三个字:做减法。删掉提示词中所有模糊形容词(如“beautiful”“awesome”),替换为具体的材质、光线、镜头参数。记住:高级感来自光影的层次(如体积光、边缘光)和材质的真实度(如拉丝金属、哑光塑料),而不是滤镜堆砌。

评论(0)