设计师如何建立自己的 AIGC 工具箱

上周有个学员找到我,说自己在做电商大促海报时,客户要求在一天内出6版不同风格的视觉方案。他翻遍了素材库,试了各种滤镜,最后熬到凌晨3点,只憋出2版勉强能看的。他问我:“老师,我是不是不适合做设计了?”

我告诉他,不是你不适合,是你的工具箱里只有锤子。在AIGC时代,一个优秀的设计师必须具备“工具思维”——不是被AI取代,而是用AI武装自己。今天,我就以火星人教育AIGC实战课的经验,带你一步步建立属于自己的AIGC工具箱。

一、从“画图工”到“指挥家”:理解AIGC工具箱的核心逻辑

很多设计师对AIGC的理解还停留在“用Midjourney生成一张图”。这就像你拿到了一台单反,却只会按快门——你永远拍不出好照片,因为你没理解光圈、快门、ISO之间的配合。

AIGC工具箱的核心逻辑是“输入-处理-输出”的三段式工作流:

  • 输入层:文字提示词(Prompt)、参考图(Reference Image)、风格控制(ControlNet)
  • 处理层:AI模型(Stable Diffusion、Midjourney、DALL·E 3)、LoRA微调、Inpainting/Outpainting
  • 输出层:高清放大(ESRGAN、Upscale)、格式转换、图层导出
  • 实操案例1:用“提示词工程”精准控制输出

    假设你要设计一张“赛博朋克风格的城市夜景海报”,新手可能会写:“cyberpunk city, night, neon lights”。结果生成一堆杂乱无章的图。

    正确的做法是使用结构化提示词模板(以Midjourney v6.1为例):

    /imagine prompt: A futuristic cyberpunk city street at midnight, heavy rain, neon signs in magenta and cyan, reflections on wet asphalt, cinematic lighting, shot on 35mm film, ultra-detailed, 8k --ar 16:9 --v 6.1 --s 750
    

    参数说明:

  • `–ar 16:9`:宽高比,适合海报
  • `–v 6.1`:模型版本,6.1对光影和细节的控制更强
  • `–s 750`:风格化程度,值越高越艺术化(默认100,范围0-1000)
  • 这里的关键是把视觉元素拆解成关键词:场景(城市街道)、氛围(午夜、大雨)、色彩(品红、青色)、质感(胶片、超细节)。你的提示词越具体,AI的生成越可控。

    Midjourney提示词结构示意图

    二、工具链搭建:从生图到交付的全流程方案

    很多设计师抱怨AI生成的图“不能用”,原因往往出在后处理环节。一个完整的AIGC工具箱必须覆盖从创意到交付的每个环节。

    2.1 生图工具选择

    | 工具 | 适用场景 | 版本 | 核心优势 |
    |——|———-|——|———-|
    | Midjourney | 概念设计、氛围图 | v6.1 | 美学质量极高,艺术感强 |
    | Stable Diffusion WebUI | 商业落地、精准控制 | v1.10.0 (2024年7月版) | 开源可控,支持ControlNet |
    | DALL·E 3 | 文字渲染、复杂场景 | 集成在ChatGPT Plus | 理解自然语言能力强 |

    实操案例2:用Stable Diffusion WebUI生成电商主图

    假设你要为一家咖啡品牌生成一张“手冲咖啡”的主图,要求:浅色背景,产品居中,有光影层次。

    步骤1:安装环境

  • 下载Stable Diffusion WebUI(推荐使用秋叶整合包,版本v1.10.0)
  • 安装必备扩展:ControlNet v1.1.464、Tiled Diffusion、Ultimate SD Upscale
  • 步骤2:编写正向提示词

    (masterpiece:1.2), (best quality:1.2), pour-over coffee on a wooden table, ceramic dripper, steam rising, warm golden lighting, soft shadows, minimalist composition, shallow depth of field, bokeh background, product photography style, 8k, photorealistic
    

    步骤3:使用ControlNet控制构图

  • 上传一张手绘草图(或用手机拍一张简单摆放图)
  • 选择ControlNet模型:`control_v11p_sd15_canny`(边缘检测)
  • 权重(Weight)设为0.8,引导强度(Ending Step)设为0.7
  • 这样AI会遵循你的构图,同时自由发挥光影和材质
  • 步骤4:高清放大

  • 开启Tiled Diffusion,分块处理避免显存溢出
  • 使用Ultimate SD Upscale,选择4x-UltraSharp模型,放大倍数设为2
  • 最终输出分辨率可达2048×2048
  • Stable Diffusion WebUI工作界面

    2.2 后处理与交付

    生成图不等于成品图。你还需要:

  • Photoshop Beta(v25.9+):内置“生成式填充”功能,可以快速去除背景瑕疵、扩展画布
  • Topaz Gigapixel AI(v7.1):专业级放大软件,比SD自带放大更稳定,尤其适合印刷级需求
  • Cleanup.pictures:在线工具,快速去除水印、杂物
  • 三、进阶技巧:让工具箱“自适应”你的设计风格

    工具是死的,但你的工具箱可以是活的。我见过最聪明的设计师,他们不是复制别人的工作流,而是建立自己的风格库

    3.1 训练自己的LoRA模型

    如果你经常需要某种特定风格(比如水墨风、儿童插画风),不要每次都写长提示词。用LoRA(Low-Rank Adaptation)模型固化风格。

    操作步骤(以Kohya_ss为例,版本v23.1.0):

    1. 准备20-30张同风格图片,统一分辨率512×512
    2. 用BLIP自动生成描述文本(Captioning)
    3. 设置训练参数:batch size=1,epoch=20,learning rate=0.0001
    4. 训练完成后,在SD WebUI中加载LoRA,权重设为0.6-0.8

    这样,以后你只要写 `(style_lora:0.7)`,就能稳定输出该风格。

    3.2 建立提示词模板库

    不要每次从零开始写提示词。用Notion或Obsidian建立你的提示词库,按场景分类:

  • 电商类:产品摄影、场景搭建、模特换装
  • UI/UX类:图标生成、界面原型、插画元素
  • 品牌设计类:logo概念、包装效果图、VI应用
  • 每个模板包含:正向提示词、负向提示词、参数设置、参考图链接。

    提示词模板库截图

    四、总结与进阶建议

    建立AIGC工具箱不是一蹴而就的事。我建议你按以下路径逐步完善:

    1. 第一周:只用一个工具(推荐Midjourney),掌握结构化提示词写法
    2. 第二周:引入Stable Diffusion,学习ControlNet控制构图
    3. 第三周:搭建后处理流程,学会用Photoshop Beta修复瑕疵
    4. 第四周:尝试训练自己的LoRA,建立风格模板库

    记住,AIGC工具是放大器,不是替代品。你的审美、构图能力、色彩感觉,才是决定作品上限的关键。工具只能帮你更快地实现想法,但想法本身,永远属于你。

    如果你在搭建过程中遇到问题,欢迎在评论区留言。下节课,我会深入讲解如何用ComfyUI搭建更高级的节点化工作流。

    常见问题 FAQ

    Q1:电脑配置不够,能学AIGC吗?
    A:可以。Midjourney和DALL·E 3都是云端运行,不需要本地显卡。Stable Diffusion WebUI最低需要4GB显存(推荐8GB),如果配置不够,可以使用AutoDL或Colab等云GPU服务。

    Q2:AI生成的图版权属于谁?
    A:目前主流平台(Midjourney、OpenAI)都允许商业使用,但需注意:如果你使用他人风格的LoRA或模型,可能需要获得授权。建议商用前仔细阅读各平台的服务条款。

    Q3:提示词总是写不好,怎么办?
    A:推荐两个方法:1)用ChatGPT帮你生成提示词,描述你的需求,让AI帮你转成英文关键词;2)在Midjourney中使用`/describe`命令,上传参考图,让AI反推提示词。

    Q4:AI生成图的分辨率不够,怎么解决?
    A:使用高清放大工具。Stable Diffusion WebUI内置的Tiled Diffusion+Ultimate SD Upscale可以放大到4K。Topaz Gigapixel AI则适合处理已有的低分辨率图片。

    Q5:学AIGC需要会编程吗?
    A:不需要。Midjourney和DALL·E 3完全不需要编程。Stable Diffusion WebUI虽然有命令行界面,但主流整合包都提供了图形界面,像操作软件一样简单。

    声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。