AI 短剧制作:从脚本生成到画面渲染的全链路
上周,一位在短视频平台拥有 30 万粉丝的学员找到我,她的痛点非常典型:“老师,我一周要更新 3 条短剧,但写剧本就要花掉两天,拍摄和剪辑又得两天,根本忙不过来。用 AI 写的脚本又太‘AI 味’,画面感全无。”
她不是个例。2024 年短剧市场规模突破 500 亿,但 90% 的创作者卡在“产能”与“质量”的矛盾上。今天,我不讲虚的,直接拆解一套我用 Midjourney + ChatGPT + 剪映 + After Effects 跑通的全链路工作流,从 0 到 1 产出一条 60 秒、具备电影质感的 AI 短剧。你会看到具体的提示词、参数设置,以及如何规避 AI 生成内容最常见的“塑料感”。
—
第一幕:脚本生成——用“角色卡”代替“写故事”
很多学员用 ChatGPT 写剧本,得到的永远是“在一个宁静的小镇,主人公小明发现了一个秘密……”这种流水账。问题出在:你没有给 AI 建立“导演思维”的上下文。
实操案例 1:从一句话到分镜脚本
假设我��要做一���悬疑反转短剧,核心梗是“闺蜜送了我一面镜子,镜子里的人比我慢半拍”。
第一步:构建角色卡(Character Sheet)
打开 ChatGPT 4o(或 Claude 3.5 Sonnet),不要直接说“写剧本”,而是输入以下结构化指令:
你是短剧导演。请为以下角色生成详细设定卡:
角色A:林薇,28岁,表面温柔实则心机,职业是画廊策展人。口头禅是“这世界需要一点假象”。
角色B:小雅,26岁,单纯善良,但观察力极强,职业是纹身师。
设定卡需包含:外貌特征(用于AI绘画)、核心欲望、内心恐惧、说话风格(带2句示例台词)。
这一步的关键在于“用于 AI 绘画”——你在为后续 Midjourney 生图埋下伏笔。生成的角色卡越具体,画面一致性越高。
第二步:生成分镜脚本
拿到角色卡后,输入:
基于以上角色卡,生成一个60秒的悬疑短剧脚本。要求:
1. 共8个镜头,每个镜头时长7-8秒。
2. 每个镜头必须包含:景别(特写/中景/全景)、画面描述(具体到光线和色彩)、台词、音效提示。
3. 最后必须有一个反转结局。
4. 画面描述中避免出现“美丽的”“巨大的”等抽象词,改用“冷白色顶光”“布满裂纹的洗手台镜面”等具象词。
ChatGPT 会给你一个表格化的脚本。此时,你需要做一件重要的事:用红笔划掉所有“对话推动剧情”的部分,改为“动作推动”。短剧的黄金法则是:前 3 秒没有视觉冲突,观众就划走了。
以我学员的实战为例,ChatGPT 生成的第一个镜头是“林薇在咖啡馆等小雅,内心忐忑”。我让她改成:“林薇的手指无意识地敲击着咖啡杯,杯中的拉花是一个倒置的人脸。”——这一个画面,比十句旁白都有力。
—
第二幕:画面生成——Midjourney 的“一致性”破局
这是全链路中最容易翻车的一环。直接输入“一个女孩在照镜子”,Midjourney 会给你画出 4 张完全不同的人脸。短剧需要的是“同一张脸”贯穿始终。
实操案例 2:用“种子值 + 垫图”锁定主角
第一步:生成主角基准图
在 Midjourney(V6 版本)中输入:
/imagine prompt: Chinese female, 26 years old, tattoo artist, short black hair with silver earrings, wearing a black apron, half-body portrait, cinematic lighting, 35mm lens, shot on ARRI Alexa --ar 9:16 --seed 20240607
注意三个关键参数:
- `–ar 9:16`:竖屏短剧专用比例,千万别用方形。
第二步:用垫图保持一致性
生成满意的基准图后,右键复制图片链接。后续所有镜头,都用这个格式:
/imagine prompt: [角色A图片链接] [角色B图片链接] 林薇站在昏暗的走廊尽头,手持一面复古铜镜,镜面反射出小雅扭曲的脸,冷蓝色调,惊悚氛围,广角镜头 --ar 9:16 --seed 20240607 --iw 1.5
这里的 `–iw`(Image Weight)参数至关重要。数值范围 0.5-2.0,建议设为 1.5。太高会完全复制原图动作,太低会失去人物特征。我测试过,1.5 是“服装、脸型、发型”与“新姿势、新场景”之间的最佳平衡点。
第三步:批量生成与筛选
一个 8 镜头的短剧,我建议每个镜头生成 2-3 个变体(用 `–v 1`、`–v 2` 或点击 U1/U2 放大)。不要贪多,否则后续剪辑时选择困难症会逼疯你。
避坑指南:
—
第三幕:动态化与剪辑——从“静帧”到“电影感”
这是把“连环画”变成“短剧”的核心环节。目前国内创作者最常用的组合是:剪映专业版(免费)+ Runway Gen-2 / Pika Labs(付费)。
实操步骤:让静态图“动起来”
第一步:Runway 动态化
将 Midjourney 生成的关键帧图上传至 Runway Gen-2,输入运动指令:
Motion: camera slowly pushes in, character's eyes flicker, hair moves slightly in wind, mirror reflection ripples like water
注意,Runway 对“物理运动”的理解有限。不要让它做“转身”“走路”等大动作,会扭曲变形。只做“镜头推拉摇移”和“微表情变化”,成功率能提升 80%。
第二步:剪映二次创作
将动态视频导入剪映专业版(版本 5.6 以上),进行关键操作:
第三步:AI 配音与口型
用剪映自带的“文本朗读”功能(选择“解说男声-质感”或“知性女声”),或者用 ElevenLabs 生成更自然的中文配音。注意:AI 配音的语速要控制在每分钟 220-240 字,比正常语速快 10%,符合短剧的紧凑感。
如果角色有说话画面,用剪映的“数字人”功能(在“智能工具”栏),上传角色图,输入台词,它能生成简单的口型动画。虽然目前只能做到正面半身,但对于 60 秒短剧的 1-2 个说话镜头,完全够用。
—
总结与进阶建议
这套流程,我的学员从“一周更 3 条”提升到了“一天产 3 条”,且完播率平均提升 40%。核心逻辑是:用 AI 解决 80% 的重复劳动,把精力集中在 20% 的创意决策上(比如反转设计、镜头节奏)。
如果你想更进一步,建议学习以下三个方向:
1. 一致性控制:深入研究 Midjourney 的 `–cref`(角色参考)参数,这是 V6 版本推出的杀手锏,比垫图更精准,能锁定服装和面部特征,���合多角色短剧。
2. 动态转场:学习 After Effects 的“Optical Compensation”和“CC Ball Action”效果,用于制作 AI 视频无法生成的复杂转场(如镜子碎裂、时间倒流)。
3. 多语言分发:用 HeyGen 或 HeyWhisper 将你的短剧一键翻译成英语、西班牙语配音,并自动调整口型,一套素材赚多份收益。
记住,AI 短剧的下半场,拼的不是“谁生成得快”,而是“谁更懂镜头语言”。工具只是笔,分镜和节奏才是灵魂。
—
常见问题 FAQ
Q1:Midjourney 生成的同一角色,为什么换个场景脸就变了?
A:大概率是 `–seed` 值没固定,或者 `–iw` 值太低。确保每次生成都带上相同的 `–seed`,且 `–iw` 不低于 1.0。如果还不行,试试 V6 的 `–cref` 参数,直接粘贴基准图链接,它会强制锁定面部特征。
Q2:Runway 生成视频时,人物总是“融化”或“扭曲”怎么办?
A:这是运动幅度过大导致的。将提示词中的动作拆解为“微动作”,例如把“她转身”改为“她微微侧头,眼神从镜子移向镜头”。同时,在 Runway 的“Motion”选项中,选择“Subtle”或“Moderate”,不要选“High”。
Q3:剪映的“数字人”口型对不上怎么办?
A:检查你的文字稿是否包含标点符号。剪映的数字人需要完整的停顿标记,确保每句话以句号结束,逗号处它会自动换气。如果还是不对,手动在时间轴上把音频和视频轨道“分离”,然后微调视频轨道的偏移。
Q4:如何让 AI 短剧看起来不那么“廉价”?
A:三个捷径:一是用电影 LUT 调色(网上搜“FIlmConvert”或“DeLut”免费包);二是音效一定要丰富,尤其环境音(室内加空调嗡嗡声,室外加车流声);三是画幅比例务必 9:16,且上下加黑边(用剪映的“模糊背景”功能),模拟电影感。
Q5:版权问题怎么处理?AI 生成的画面能商用吗?
A:Midjourney 付费版(每月 10 美元以上)生成的图片可用于商业用途,但要注意避免生成“真人明星”或“知名 IP 角色”。Runway 生成的视频同样可商用。但 AI 配音建议用 ElevenLabs 的付费版,免费版的语音有“机器味”且商用有风险。最稳妥的做法是,在发布平台的后台声明“部分内容由 AI 辅助创作”。

评论(0)