Midjourney 进阶技巧:从提示词到商业级出图

上周三晚,学员小林在群里发了一张图:主体是赛博朋克风格的机车少女,背景是霓虹闪烁的雨夜街道。乍看之下光影氛围相当惊艳,但仔细一看,人物的右手手指有六根,并且关节扭曲得像藤蔓。紧接着他发来第二张,机车的前轮完全陷进了沥青路面里,像融化了一样。

“老师,我已经把提示词写到 300 多字符了,什么 8k、hyper detailed、cinematic lighting 全堆上去了,为什么每次放大后,细节还是崩?”

这个问题非常典型。很多玩家在 Midjourney 上花了几百个小时,却始终卡在“抽卡”的循环里——不停地改词、Roll 图、放大、不满意、再改词。你缺的不是提示词的数量,而是对 Midjourney 底层逻辑的深度理解,以及一套可复用的“商业级”工作流。

今天,我们不讲基础语法,直接进入进阶层面。我会用 3 个核心章节,带你从“能出图”走向“能出好图、能出能卖钱的图”。

第一章:拆解提示词的结构化公式——告别“词海战术”

很多学员把提示词当成“咒语”,以为堆砌越多高级形容词,效果越好。但实际上,Midjourney 的文本编码器(基于 CLIP 的变体)对名词和动词的敏感度远高于形容词。你写 10 个形容词,不如写 2 个具体名词。

商业级提示词的核心公式:

`[主体描述] + [环境/场景] + [光线/色彩] + [镜头/构图] + [风格锚点] + [负面排除]`

注意最后一项——负面排除。在 Midjourney V6 及后续版本中,`–no` 参数虽然存在,但效果不如 Stable Diffusion 的 Negative Prompt 那么精准。真正有效的做法是,在提示词里用 “正面对比” 来引导。

实操案例 1:产品广告级香水瓶

我们以“拍一支木质调男士香水”为例。初级玩家会写:

> a perfume bottle, luxury, elegant, 8k, hyper detailed, studio lighting

出图结果通常是:背景杂乱,瓶身反射混乱,甚至瓶盖会变形。

进阶写法(结构化):

> A clear glass perfume bottle with a dark amber liquid, surrounded by a thin wisp of smoke, placed on a wet black slate stone, background is a blurred dark forest with bokeh, dramatic rim lighting, low-key photography, 85mm lens, f/2.8, centered composition, minimalist, Tom Ford aesthetic

拆解:

  • 主体:明确材质(clear glass)+ 内容物颜色(dark amber liquid)+ 状态(wisp of smoke)
  • 环境:wet black slate stone(湿黑色板岩,提供反射)、dark forest with bokeh(背景虚化森林,提供纵深感)
  • 光线:dramatic rim lighting(戏剧性轮廓光,这是商业摄影的灵魂)
  • 镜头:85mm f/2.8(直接告诉 AI 你想要的景深和透视压缩感)
  • 风格锚点:Tom Ford aesthetic(比“luxury”这个词具体 100 倍)
  • 参数设置: 建议使用 `–ar 3:4`(竖构图适合电商主图),`–style raw`(降低默认美化,保留更多摄影真实感),`–v 6.1`(目前最稳的版本)。

    结构化提示词示例

    第二章:–cref 与 –sref 的魔法——解锁“角色一致性”与“风格迁移”

    这是 Midjourney 从 V6 版本开始真正震撼业界的两个参数。如果你还在靠“seed 值 + 长描述”来维持人物一致性,那你的效率至少低了 3 倍。

    –cref(Character Reference):角色参考。你需要先垫一张图(可以是生成的,也可以是真人照片,但要注意版权),然后通过 `–cref URL` 来锁定人物面部特征。

    –sref(Style Reference):风格参考。这是商业项目中的核武器。客户说“我要那种莫奈的朦胧感,但又要有点赛博朋克”,你不需要在提示词里写“Monet style cyberpunk”(这通常会出车祸),你只需要找到两张参考图,或者用 Midjourney 的 `/blend` 命令混合出一张风格图,然后用 `–sref` 锁定。

    实操案例 2:电商模特图重绘

    假设你有一张客户提供的模特实拍图(光线一般,背景杂乱),需要重绘成“在东京街头,夜晚,雨景,穿着该品牌冲锋衣”的广告图。

    第一步:上传原图,获取 URL(假设为 A)。
    第二步:输入命令:

    > `/imagine prompt: [A URL] a female model wearing a technical shell jacket, walking in Shibuya crossing at night, heavy rain, neon reflections on wet asphalt, motion blur on background pedestrians, cinematic still, shot on Sony A7R V, 35mm lens –cref [A URL] –cw 0 –sref [风格参考图URL] –v 6.1`

    关键参数解析:

  • `–cw 0`:这个值控制角色参考的强度。默认是 100,但如果你只想要“脸像”,不想要“衣服像”(因为要换衣服),必须把 `–cw` 降到 0 或 50。很多新手不知道这个参数,导致换衣服永远不成功。
  • `–sref`:这里的风格参考图,可以用 Midjourney 官网的 Explore 功能找一张“雨夜霓虹”风格极强的图,或者自己用 `/blend` 生成。
  • 进阶技巧: 如果出来的图脸像了,但光线方向不对,可以配合 `–rel`(相对光照)参数,让 AI 根据参考图的光照重新计算,而不是强行复制。

    角色一致性参数应用

    第三章:从“单张”到“系列”——用 Pan 与 Zoom 构建商业视觉方案

    商业项目中,客户很少只要一张图。他们要的是“一套图”,比如 6 张不同角度的产品图,或者 3 张场景连贯的 KV(主视觉)。

    –pan 与 –zoom 是 V6 版本后最被低估的功能。

    实操案例 3:生成无缝衔接的横幅长图

    假设你接到一个任务:为一家咖啡品牌设计一张极长的网页首屏横幅(类似全景图)。

    1. 先正常生成一张基础图:`/imagine prompt: a cozy coffee shop interior, warm morning sunlight, steam rising from a ceramic cup on a wooden table, wide angle, photorealistic –ar 16:9`
    2. 得到满意的图后,点击下方的 Zoom Out 2x 按钮(或者输入 `/imagine` 并附上原图 URL + `–zoom 2`)。这会让画面向外扩展,AI 会自动补全边缘细节。
    3. 关键一步:点击 Pan LeftPan Right。这会让画面像摄像机平移一样,生成一个无缝衔接的新画面。注意:Pan 的幅度是固定的,但你可以通过多次 Pan 再配合 Zoom 来获得超宽画幅。

    商业技巧: 将 Pan 后的图放进 Photoshop,使用 Generative Fill(生成式填充) 对边缘进行微调,然后利用 Camera Raw 滤镜 统一色调。这样出来的图,完全具备 4A 广告公司的提案质感。

    参数提醒: 使用 Pan 和 Zoom 时,建议关闭 `–tile`(平铺参数),否则会出现重复纹理。

    全景图生成技巧

    总结与进阶建议

    从“提示词堆砌”到“结构化公式”,从“赌 seed”到“–cref/–sref 精准控制”,再到“Pan/Zoom 构建系列视觉”,你已经掌握了 Midjourney 商业化的三条核心路径。

    但请记住:Midjourney 是杠杆,不是引擎。 真正的商业价值在于你的审美判断力——能否在 10 张图中一眼挑出那张“对”的图,以及你的后期能力——能否用 PS 或 Lightroom 把 AI 的“毛坯房”精装修成“样板间”。

    给你们的下一步行动建议:
    1. 建立你的风格库:每天用 `–sref` 收集 5 张你喜欢的风格图,分类归档(摄影类/插画类/3D 类)。一个月后,你就有 150 张风格弹药。
    2. 死磕一个垂直品类:比如只做“香水瓶”或“运动鞋”,用本文��公式反复迭代,直到你能闭着眼写出该品类 80 分的提示词。
    3. 学习一点摄影布光知识:去 B 站搜“伦勃朗光”“蝴蝶光”教程,这些知识用在提示词里,比任何形容词都管用。

    常见问题 FAQ

    Q1:为什么我用了 –cref 但脸还是不像?
    A:首先检查 `–cw` 值是否过低(低于 50 可能会丢失特征)。其次,参考图的分辨率要足够高,且面部没有被遮挡。最后,V6.1 版本对 `–cref` 的响应优于 V6.0,建议升级。

    Q2:–sref 和 –style 有什么区别?
    A:`–style` 是官方预设的艺术风格(如 `–style raw` 或 `–style expressive`),是粗颗粒度的。而 `–sref` 是像素级的风格迁移,它能精确捕捉参考图的色彩分布、笔触纹理和光影逻辑。建议优先使用 –sref。

    Q3:生成的图放大后细节还是糊,怎么办?
    A:试试 `–stylize 250`(默认是 100),这个参数控制 AI 的“自由发挥程度”。数值越高,细节越丰富,但也越容易偏离你的描述。另外,可以配合 `–upbeta`(测试版放大器)或 `–uplight`(轻度放大)来获得不同锐化效果。

    Q4:如何让生成的图没有“AI 味”?
    A:AI 味主要来自“过度平滑的皮肤”和“不合理的反射”。在提示词中加入 `film grain`(胶片颗粒)、`lens distortion`(镜头畸变)、`imperfect skin texture`(不完美皮肤纹理)能有效中和。最关键的是,不要用默认的 –v 6.0,用 –style raw 会显著降低“美颜感”。

    Q5:Midjourney 生成的图能商用吗?
    A:付费用户(Standard Plan 及以上)拥有商用权,但前提是你的输入内容(比如参考图)不侵犯他人版权。注意:如果你用 –cref 上传了真人照片,需要获得该人物的肖像权授权。 这是商业项目中最大的合规红线。

    声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。