AI 短剧制作:从脚本生成到画面渲染的全链路

上周,一位在短视频平台拥有 30 万粉丝的学员找到我,她的痛点非常典型:“老师,我一周要更新 3 条短剧,但写剧本就要花掉两天,拍摄和剪辑又得两天,根本忙不过来。用 AI 写的脚本又太‘AI 味’,画面感全无。”

她不是个例。2024 年短剧市场规模突破 500 亿,但 90% 的创作者卡在“产能”与“质量”的矛盾上。今天,我不讲虚的,直接拆解一套我用 Midjourney + ChatGPT + 剪映 + After Effects 跑通的全链路工作流,从 0 到 1 产出一条 60 秒、具备电影质感的 AI 短剧。你会看到具体的提示词、参数设置,以及如何规避 AI 生成内容最常见的“塑料感”。

AI短剧制作流程图

第一幕:脚本生成——用“角色卡”代替“写故事”

很多学员用 ChatGPT 写剧本,得到的永远是“在一个宁静的小镇,主人公小明发现了一个秘密……”这种流水账。问题出在:你没有给 AI 建立“导演思维”的上下文。

实操案例 1:从一句话到分镜脚本

假设我��要做一���悬疑反转短剧,核心梗是“闺蜜送了我一面镜子,镜子里的人比我慢半拍”。

第一步:构建角色卡(Character Sheet)

打开 ChatGPT 4o(或 Claude 3.5 Sonnet),不要直接说“写剧本”,而是输入以下结构化指令:

你是短剧导演。请为以下角色生成详细设定卡:
角色A:林薇,28岁,表面温柔实则心机,职业是画廊策展人。口头禅是“这世界需要一点假象”。
角色B:小雅,26岁,单纯善良,但观察力极强,职业是纹身师。
设定卡需包含:外貌特征(用于AI绘画)、核心欲望、内心恐惧、说话风格(带2句示例台词)。

这一步的关键在于“用于 AI 绘画”——你在为后续 Midjourney 生图埋下伏笔。生成的角色卡越具体,画面一致性越高。

第二步:生成分镜脚本

拿到角色卡后,输入:

基于以上角色卡,生成一个60秒的悬疑短剧脚本。要求:
1. 共8个镜头,每个镜头时长7-8秒。
2. 每个镜头必须包含:景别(特写/中景/全景)、画面描述(具体到光线和色彩)、台词、音效提示。
3. 最后必须有一个反转结局。
4. 画面描述中避免出现“美丽的”“巨大的”等抽象词,改用“冷白色顶光”“布满裂纹的洗手台镜面”等具象词。

ChatGPT 会给你一个表格化的脚本。此时,你需要做一件重要的事:用红笔划掉所有“对话推动剧情”的部分,改为“动作推动”。短剧的黄金法则是:前 3 秒没有视觉冲突,观众就划走了。

以我学员的实战为例,ChatGPT 生成的第一个镜头是“林薇在咖啡馆等小雅,内心忐忑”。我让她改成:“林薇的手指无意识地敲击着咖啡杯,杯中的拉花是一个倒置的人脸。”——这一个画面,比十句旁白都有力。

脚本分镜表示例

第二幕:画面生成——Midjourney 的“一致性”破局

这是全链路中最容易翻车的一环。直接输入“一个女孩在照镜子”,Midjourney 会给你画出 4 张完全不同的人脸。短剧需要的是“同一张脸”贯穿始终。

实操案例 2:用“种子值 + 垫图”锁定主角

第一步:生成主角基准图

在 Midjourney(V6 版本)中输入:

/imagine prompt: Chinese female, 26 years old, tattoo artist, short black hair with silver earrings, wearing a black apron, half-body portrait, cinematic lighting, 35mm lens, shot on ARRI Alexa --ar 9:16 --seed 20240607

注意三个关键参数:

  • `–ar 9:16`:竖屏短剧专用比例,千万别用方形。
  • `–seed 20240607`:固定随机种子,这是后续所有变体的“基因锚点”。
  • `–style raw`:如果你想要更真实的电影质感,加上这个参数,减少 Midjourney 默认的“糖水片”风格。
  • 第二步:用垫图保持一致性

    生成满意的基准图后,右键复制图片链接。后续所有镜头,都用这个格式:

    /imagine prompt: [角色A图片链接] [角色B图片链接] 林薇站在昏暗的走廊尽头,手持一面复古铜镜,镜面反射出小雅扭曲的脸,冷蓝色调,惊悚氛围,广角镜头 --ar 9:16 --seed 20240607 --iw 1.5
    

    这里的 `–iw`(Image Weight)参数至关重要。数值范围 0.5-2.0,建议设为 1.5。太高会完全复制原图动作,太低会失去人物特征。我测试过,1.5 是“服装、脸型、发型”与“新姿势、新场景”之间的最佳平衡点。

    第三步:批量生成与筛选

    一个 8 镜头的短剧,我建议每个镜头生成 2-3 个变体(用 `–v 1`、`–v 2` 或点击 U1/U2 放大)。不要贪多,否则后续剪辑时选择困难症会逼疯你。

    避坑指南:

  • 千万别用 Midjourney 直接生成“手部特写”,AI 目前画手指依然是重灾区。如果需要手部动作,用剪映的“画中画”���加实拍素材,或者用 Runway 的“运动笔刷”局部重绘。
  • 文字类画面(如手机短信截图)别让 AI 生成,必然乱码。用 PS 或者 Canva 做一张静态图,再导入剪映加关键帧动画。
  • 第三幕:动态化与剪辑——从“静帧”到“电影感”

    这是把“连环画”变成“短剧”的核心环节。目前国内创作者最常用的组合是:剪映专业版(免费)+ Runway Gen-2 / Pika Labs(付费)

    实操步骤:让静态图“动起来”

    第一步:Runway 动态化

    将 Midjourney 生成的关键帧图上传至 Runway Gen-2,输入运动指令:

    Motion: camera slowly pushes in, character's eyes flicker, hair moves slightly in wind, mirror reflection ripples like water
    

    注意,Runway 对“物理运动”的理解有限。不要让它做“转身”“走路”等大动作,会扭曲变形。只做“镜头推拉摇移”和“微表情变化”,成功率能提升 80%。

    第二步:剪映二次创作

    将动态视频导入剪映专业版(版本 5.6 以上),进行关键操作:

  • 变速:短剧节奏要快,将每个镜头的基础速度调至 1.2 倍,但关键反转镜头(如镜子碎裂)调至 0.8 倍慢放,形成节奏反差。
  • 音效:这是最容易出质感的地方。在剪映的“音频-音效素材库”里搜索“心跳声”“低频嗡鸣”“布料摩擦”。悬疑短剧的秘诀是:画面安静处,音效要密集。 给每个镜头的转场处加一个 0.2 秒的“whoosh”声,高级感立刻提升。
  • 调色:不要用滤镜。手动调整参数:对比度 +15,高光 -10,阴影 +20,色温 -5(偏冷)。然后点击“自定义LUT”,导入你下载的“Kodak 2383 电影胶片”的.cube 文件(网上免费下载)。这是去除“AI 塑料感”最狠的一招。
  • 第三步:AI 配音与口型

    用剪映自带的“文本朗读”功能(选择“解说男声-质感”或“知性女声”),或者用 ElevenLabs 生成更自然的中文配音。注意:AI 配音的语速要控制在每分钟 220-240 字,比正常语速快 10%,符合短剧的紧凑感。

    如果角色有说话画面,用剪映的“数字人”功能(在“智能工具”栏),上传角色图,输入台词,它能生成简单的口型动画。虽然目前只能做到正面半身,但对于 60 秒短剧的 1-2 个说话镜头,完全够用。

    剪映调色与音效界面

    总结与进阶建议

    这套流程,我的学员从“一周更 3 条”提升到了“一天产 3 条”,且完播率平均提升 40%。核心逻辑是:用 AI 解决 80% 的重复劳动,把精力集中在 20% 的创意决策上(比如反转设计、镜头节奏)。

    如果你想更进一步,建议学习以下三个方向:

    1. 一致性控制:深入研究 Midjourney 的 `–cref`(角色参考)参数,这是 V6 版本推出的杀手锏,比垫图更精准,能锁定服装和面部特征,���合多角色短剧。
    2. 动态转场:学习 After Effects 的“Optical Compensation”和“CC Ball Action”效果,用于制作 AI 视频无法生成的复杂转场(如镜子碎裂、时间倒流)。
    3. 多语言分发:用 HeyGen 或 HeyWhisper 将你的短剧一键翻译成英语、西班牙语配音,并自动调整口型,一套素材赚多份收益。

    记住,AI 短剧的下半场,拼的不是“谁生成得快”,而是“谁更懂镜头语言”。工具只是笔,分镜和节奏才是灵魂。

    常见问题 FAQ

    Q1:Midjourney 生成的同一角色,为什么换个场景脸就变了?
    A:大概率是 `–seed` 值没固定,或者 `–iw` 值太低。确保每次生成都带上相同的 `–seed`,且 `–iw` 不低于 1.0。如果还不行,试试 V6 的 `–cref` 参数,直接粘贴基准图链接,它会强制锁定面部特征。

    Q2:Runway 生成视频时,人物总是“融化”或“扭曲”怎么办?
    A:这是运动幅度过大导致的。将提示词中的动作拆解为“微动作”,例如把“她转身”改为“她微微侧头,眼神从镜子移向镜头”。同时,在 Runway 的“Motion”选项中,选择“Subtle”或“Moderate”,不要选“High”。

    Q3:剪映的“数字人”口型对不上怎么办?
    A:检查你的文字稿是否包含标点符号。剪映的数字人需要完整的停顿标记,确保每句话以句号结束,逗号处它会自动换气。如果还是不对,手动在时间轴上把音频和视频轨道“分离”,然后微调视频轨道的偏移。

    Q4:如何让 AI 短剧看起来不那么“廉价”?
    A:三个捷径:一是用电影 LUT 调色(网上搜“FIlmConvert”或“DeLut”免费包);二是音效一定要丰富,尤其环境音(室内加空调嗡嗡声,室外加车流声);三是画幅比例务必 9:16,且上下加黑边(用剪映的“模糊背景”功能),模拟电影感。

    Q5:版权问题怎么处理?AI 生成的画面能商用吗?
    A:Midjourney 付费版(每月 10 美元以上)生成的图片可用于商业用途,但要注意避免生成“真人明星”或“知名 IP 角色”。Runway 生成的视频同样可商用。但 AI 配音建议用 ElevenLabs 的付费版,免费版的语音有“机器味”且商用有风险。最稳妥的做法是,在发布平台的后台声明“部分内容由 AI 辅助创作”。

    声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。