从古籍到AI短剧:我用WorkBuddy零成本做了一部恐怖反转片
去年我公司关门了。
做了二十年的煤矿监理,到头来行业萎缩、业务归零。47岁,学新东西比别人慢,但总得活下去。一个朋友说,不如试试AI视频?他写剧本,我来做。
就这样,我和WorkBuddy搭上了。
这篇文章记录我用AI做完第一部完整的短剧——改编自唐代传奇《集异记》里的《崔韬遇虎女》。7个镜头,60秒,两个角色,总花费0元。全程用免费工具,效果……比我想的好。
为什么选《崔韬遇虎女》
市面上AI短剧很多,但大部分一眼就能看出是AI做的。人物脸僵,口型对不上,动作跟机器人似的。
我不想做那样的。
我的策略是:AI生成人物形象,字幕和配音驱动剧情,人物动作尽量小。不追求花哨的动效,把力气花在角色一致性上。
《崔韬遇虎女》的原著很短,几百个字:书生崔韬夜宿凶馆,一只老虎进门,脱下虎皮变成美女,求他收留。崔韬带走虎女,扔掉虎皮。一年后故地重游,虎女捡回虎皮穿上,变回老虎,把崔韬吃了。
两个角色,三个场景,一个反转结尾。正好拿来试手。
故事本身就有钩子。"这间客栈,死了很多人"。前3秒就能把人抓住。结尾那个反转也不用额外设计,原著自带了。
第一步:改编剧本
原著是文言文,得先口语化。
我把原文拆成了7个镜头,每个镜头配一段台词或旁白。不追求角色大段对白——这是我做这条片子的核心取舍:用旁白推进叙事,只在关键情节给角色一句话。
剧本大概是这样:
镜头 | 时间 | 画面 | 旁白/台词 |
|---|---|---|---|
1 | 0-6秒 | 黑夜,古旧客栈外,牌匾"仁义馆" | 旁白:"这间客栈,死了很多人。" |
2 | 6-14秒 | 室内,门缝中虎爪伸入 | 旁白:"半夜,门自己开了。一只老虎走了进来。" |
3 | 14-24秒 | 老虎褪下皮毛,变成女人 | 旁白:"然后,它脱下了皮毛。" |
4 | 24-36秒 | 虎女面对崔韬,月光下表白 | 虎女:"我只能披着虎皮,夜里来寻你。别怕。" |
5 | 36-44秒 | 崔韬扔虎皮入枯井,二人赴任 | 旁白:"他把虎皮扔进了枯井,带着她赴任去了。" |
6 | 44-52秒 | 一年后重回客栈,崔韬调侃 | 崔韬:"你那件虎皮衣,还在井里呢。" |
7 | 52-60秒 | 虎女穿皮变虎,猛扑 | 旁白:"穿上了。这一去,再没人见过他们。" |
关键决策:除了镜头4的虎女表白和镜头6的崔韬调侃,其余全部用旁白。这意味着不需要给每个镜头做口型同步,省掉了最头疼的环节。
WorkBuddy帮我完成了剧本改编、分镜设计、配音脚本拆分、成本估算,整套方案在一个回合里就出来了。连edge-tts的配音命令都写好了,直接复制就能跑。
第二步:角色定妆照
这是全片最重要的一步。角色的脸定了,后面所有画面都得用这张脸。
我用的是即梦AI(jimeng.jianying.com),免费,每天有额度。每个角色生成5张候选,选最好的一张当定妆照。
崔韬的提示词:
中国古代书生,25岁,清秀鹅蛋脸,剑眉丹凤眼,高挺鼻梁,白净肤色,身穿青色圆领袍白色中衣,束发戴黑色幞头,温和而坚定,正面半身像,柔和月光,古风写实风格。
虎女的提示词:
中国古代美女,18岁,瓜子脸,柳叶眉杏眼,樱桃小口,白皙面若桃花,长发松松挽起,白色襦裙腰系淡黄丝带,眼神温柔中带一丝野性,月光下,古风写实风格。
生成5张,挑一张定妆。这张定妆照就是你后续所有画面的参考图。每个镜头生成时必须上传对应角色的定妆照,用即梦的"参考图"功能锁住脸型。这是保证角色一致性的命根子。
做完这一关,我手上的盘里有2个角色的定妆照,后面6个镜头全部基于这两张脸生。
第三步:分镜画面生成
按7个镜头逐个生成画面,每个镜头都上传对应角色的定妆照。
大部分镜头一版就过了。两个难点:
镜头3(虎变美女):老虎褪皮变人这个画面,即梦AI的静态图表现还可以。月光下,虎皮从背部裂开,女子从里面站起来。我做了三张图的过渡序列:老虎站月光下 → 虎皮半褪女子半露 → 女子站起虎皮落脚边。剪映里切图的时候加个淡入淡出,效果够用了。
镜头7(变虎反转):这个最难。虎女穿皮变虎,镜头要猛扑向观众。三段式处理:女子弯腰捞皮 → 披上开始变形 → 猛虎扑镜头。最后2秒黑屏出白字"这一去,再没人见过他们。"压迫感就出来了。
实际做出来的效果没有想象中完美,但作为第一部,跑通流程比追求细节重要。
第四步:配音
配音用了edge-tts,完全免费,本地跑。
三个音色:
WorkBuddy帮我写了完整的配音生成脚本,一个bash命令跑完全部。9段配音分轨导出,每条单独存mp3,方便后期剪辑的时候细调对齐。
这里有个经验:古风短剧的旁白慢一点反而更有味道。不要赶。给观众留出看画面的时间。
第五步:剪辑合成
剪辑用的是剪映,免费的。
步骤很简单:新建项目 → 9:16竖屏比例 → 按镜头顺序导入画面 → 拖入配音轨道 → 对齐时间线 → 加字幕 → 加转场 → 导出。
真正花时间的地方不是操作,是"对齐"。每句配音和对应画面的起止时间要对准,一错位就穿帮。
WorkBuddy在这里也帮了大忙。它根据edge-tts生成的音频实际时长,算出了每个镜头应该切的精确时间点,生成了一份配音时间线对照表。我按表切,一条过。
背景音乐用的剪映自带的免费古风BGM。镜头7变虎的时候叠了一层虎啸音效,也是剪映里搜到的。
片子的迭代做了6版。第1版是静态图+配音的粗剪,第3版开始加入动态视频片段,第5版重新调整了配音节奏,第6版解决了字幕和音轨的对齐问题。每一版都比上一版好一点。
六条真实经验
做完这部片子,几个心得:
1. 定妆照是第一关,也是最容易翻车的一关。 选好一张就别再换了。后面所有画面都基于这张脸生成,中途换参考图等于推倒重来。
2. 旁白比角色对话好控。 角色对话要做口型同步,AI目前的口型对齐效果还是不太稳定。要么对不上,要么对了但表情僵硬。旁白不存在这个问题。我的策略是:关键台词用角色原声,其余用旁白推进。
3. 动作越小,AI生成越稳。 人物跑跳打斗这类大幅动作,AI做出来常常手腿变形。我整部片子的角色基本是走、站、转头、抬手。小幅度动作,AI控制得住。
4. 虎变人是全片最难的一镜。 变形过程AI很难一次成,我的做法是拆成3张静态图,用剪映淡入淡出转场,效果反而比动态生成自然。
5. 配音语速要慢。 古风题材,旁白慢0.1-0.2倍,氛围感翻倍。女声也慢一点,温柔感更足。
6. 先出粗剪版,再迭代。 第一版丑没关系,能跑通全流程就是胜利。我的v1版粗糙得很,但v6版就明显能看了。迭代比一步到位靠谱。
成本
全部0元。
环节 | 工具 | 费用 |
|---|---|---|
剧本改编 | WorkBuddy | 0元 |
角色定妆照 | 即梦AI | 0元(每日免费额度) |
分镜画面 | 即梦AI | 0元 |
配音 | edge-tts | 0元(本地运行) |
剪辑合成 | 剪映 | 0元 |
合计 | 0元 |
如果把即梦的画面换成Seedance 2.0做动态视频,成本大概30-50元。但对第一部来说,先跑通流程、看效果,比花钱升级画质重要得多。
一个监理的转型
片子做完了,说实话,跟自己想要的还有点差距。虎变美女那一段的过渡还不够丝滑,变虎的压迫感也能再强化。但作为一个从来没碰过视频制作的人,能在几天内跑通从古籍到成片的完整流程,我觉得值。
WorkBuddy在这个过程中扮演的角色不止是一个问答工具。它帮我写剧本、拆分镜、调配音参数、算时间线、估成本。这些事情换我之前自己做,光查资料就得花好几天。
我的下一部在做《阳羡书生》。口中吐人的套娃故事,5个角色,视觉奇观更多。等做完了再写一篇。
如果你也在用AI工具做内容,不妨从一个小故事开始。古书里有很多没人碰过的题材,成本是零,竞争对手也不多。
先跑通一条片子,后面就顺了。
标签:#WorkBuddy #AI短剧 #古籍改编 #即梦AI #edge-tts
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。