画面生成完了,配音加上了,字幕也对齐了,背景音乐一铺,我就会忍不住从头播放一遍。
第一遍看,感觉还不错。
第二遍看,发现有几个镜头不太自然。
第三遍看,开始怀疑人物的脸是不是变了。
看到第五遍时,我已经分不清到底是作品真有问题,还是因为自己看得太多,产生了错觉。
这种状态我经历过很多次。
有一集我下班后连续做了几天,故事讲的是一个年轻人发现父亲偷偷卖掉老家的店铺,替他偿还创业欠款。
最后一场戏里,父亲把一张转账凭证放在桌上,儿子终于知道真相。
我当时觉得这段情绪特别完整。
人物沉默、手部特写、转账界面、父亲转身离开,背景音乐也铺得很满。
结果第二天早上重新看,我才发现几个非常明显的问题:
- 儿子前一个镜头穿深灰色外套,后一个镜头变成了黑色;
- 两个人前面隔着一张桌子,切到近景后却像面对面站在一起;
- 结尾镜头虽然很漂亮,却没有留下继续看下一集的理由。
那一刻我才真正意识到:
一集AI短剧“做完了”,和一集AI短剧“可以发布了”,中间还隔着一次完整检查。
而且检查不能只是从头到尾看一遍。
因为当画面、声音、字幕、音乐和剧情同时出现时,很多问题会互相遮挡。
音乐会掩盖台词问题。
台词会转移你对人物换脸的注意力。
剧情会让你暂时忽略道具位置变化。
反复播放整条成片,有时候反而更难发现问题。
后来我逐渐建立了一套自己的检查方式。
它不复杂,但让我少做了很多无效返工。
一、检查成片时,为什么不能只从头到尾正常播放?
正常播放当然要看。
但它只能回答一个大问题:
这集整体能不能看懂?
它很难帮我准确判断问题出在哪一层。
比如一场争吵戏看起来没有力量,原因可能有很多:
如果只正常播放,我通常只能感觉到“不够好”。
但不知道应该修改画面、声音、分镜还是剧本。
所以我现在会把一集短剧拆开检查。
主要分成下面几轮:
每一轮只看一类问题。
这样比一边看剧情,一边试图检查所有细节有效得多。
二、第一遍:关闭声音,只看画面
这是我现在最常用,也最容易发现问题的一步。
把声音完全关掉以后,画面会暴露很多之前被台词掩盖的问题。
我主要检查四件事。
1. 不听台词,能不能大致看懂人物在做什么?
AI短剧不能完全依赖对白解释剧情。
如果关闭声音后,只能看到两个人轮流站着说话,观众对人物的目标和关系没有任何判断,那这场戏的视觉叙事通常比较弱。
例如一场“经理发现账目异常”的戏。
关闭声音以后,至少应该能看到:
就算观众不知道具体金额,也应该知道“有人在质问,有人在隐瞒”。
如果没有声音以后,整场戏只剩人物嘴巴开合,我就会考虑补充:
声音负责说明细节,画面至少要负责建立关系和行动。
2. 镜头有没有明显跳动?
关闭声音后,我会更容易注意到:
有些镜头单独看没问题,连续播放就会非常明显。
比如前一个镜头人物坐在桌子右侧,视线向左。
下一个镜头还是同一个人物,却坐在画面左侧,视线也向左。
单看两条素材都能用,连起来却像人物瞬间换了位置。
3. 每个镜头是不是都停留得太久?
关闭声音以后,一个镜头是否拖沓会非常明显。
有些镜头原本配着台词,感觉还算正常。
关掉声音后,会发现人物四五秒都没有任何有效动作。
他只是站着、眨眼、轻微张嘴。
这种镜头不一定必须重做。
可以先尝试:
4. 人物动作有没有真正完成?
AI视频经常会生成“看起来要做,但没有真正做完”的动作。
例如:
正常播放时,台词可能会让人忽略。
关闭声音后,这些动作会显得特别别扭。
如果动作关系到剧情结果,一般需要重做或者重新设计切点。
如果动作只负责过渡,可以在动作进行中切掉,让观众自动补全。
三、第二遍:不看画面,只听声音
这一步一开始我觉得有点奇怪。
视频都看不到了,只听声音有什么用?
后来我才发现,只听声音能快速暴露台词和节奏问题。
我通常会把播放窗口缩小,或者直接把视线移开,只听:
1. 台词听起来像不像人在交流?
有些台词看文字没有问题,真正听起来却特别书面。
例如:
“关于你私自挪用公司周转资金这件事情,我希望你能够给我一个合理的解释。”
冲突场景里,这句话太完整、太礼貌,也太像汇报。
可以改成:
“公司的周转金,是不是你动的?”“给我一个解释。”
只听声音时,这种差别会非常明显。
第一种像在念材料,第二种更像人物正在对峙。
2. 人物情绪有没有突然变化?
同一个角色的两句配音,可能来自两次不同生成。
第一句声音压得很低。
第二句突然音量很大、语速很快。
画面配上以后,观众可能会暂时接受。
但只听声音,就会感觉人物像突然换了一个状态。
情绪变化不是不能大,而是必须有原因和过程。
例如:
如果中间没有信息变化,人物声音却突然升级,就会显得表演断裂。
3. 台词之间是不是完全没有呼吸?
AI配音很容易一句接一句,没有真实交流中的停顿。
甲刚说完最后一个字,乙立刻接话。
整个场景虽然很快,却没有人物思考和反应的空间。
我会重点检查:
并不是停顿越长越好。
大多数情况下,半秒左右就足以让一句话产生重量。
4. 音乐是不是一直在抢戏?
只听声音时,音乐问题特别明显。
有些音乐戴耳机听很有氛围。
用手机外放时,却把人物声音盖住了。
尤其是低沉男声、耳语、哭腔和快速对白,很容易被音乐吞掉。
我现在会用三种方式试听:
如果低音量时听不清关键台词,就要重新调整音乐和对白的关系。
5. 场景声音是否突然变化?
同一个办公室场景,前一个镜头有明显空调声,后一个镜头突然完全安静。
或者前一段环境声很宽,下一段变得像在小房间里。
这种变化会让观众潜意识里觉得空间发生了改变。
即使画面没有问题,声音断层也会破坏连续性。
四、第三遍:单独检查人物、服装和道具连续性
AI短剧和真人拍摄不同。
真人演员换一个机位,脸还是同一张脸。
AI人物每重新生成一次,都可能出现细微变化。
所以我会专门做一轮“连续性检查”。
1. 人物脸部
我会重点看:
有些变化单独看不大,但连续切换时会很明显。
特别是正面近景接正面近景,最容易暴露换脸。
如果只是轻微变化,可以尝试:
如果人物已经像另一个人,就不要硬救。
关键角色换脸属于必须重做的问题。
2. 服装
服装检查不只是颜色。
还包括:
有时候AI会把深蓝色变成黑色,单独看似乎差不多。
但如果这两个镜头直接相连,观众还是会察觉。
我现在做同一场戏时,会尽量锁定服装描述,并提前准备同角色的多个统一角度。
不要等剪辑时才发现,没有可以衔接的备用镜头。
3. 道具
剧情关键道具必须严格检查。
例如:
我曾经做过一个合同签字的镜头。
前一个画面合同是白色文件夹。
下一个特写却变成了牛皮纸档案袋。
虽然台词和表演都没有问题,但观众会怀疑这是不是两份不同文件。
如果道具承载剧情信息,形态、颜色和文字都要尽量统一。
普通水杯、装饰品等次要物品发生轻微变化,可以通过景别和切镜降低存在感。
但关键证据不能随便变化。
五、第四遍:检查视线、轴线和空间关系
这是我早期最容易忽略的一项。
我以前只要觉得人物脸没变、台词能接上,就认为两个镜头可以放在一起。
后来才发现,很多AI短剧之所以像“人物分别录制”,不是因为表情不够,而是因为视线和空间关系不成立。
1. 两个人到底站在哪里?
一场戏开始时,最好尽早让观众知道:
如果一开始没有建立空间,后面连续使用近景,观众很容易迷失方向。
我现在会尽量保留一个双人镜头或者场景中景,先交代站位。
后面的近景和特写才能建立在这个空间基础上。
2. 人物视线是否对得上?
如果甲在画面左边面对右侧,那么乙通常应该在画面右边面对左侧。
这样两个人才像在看彼此。
如果两个人都朝同一个方向看,就会像他们在共同看第三个人。
AI生成时,人物视线很容易偏。
不是完全对着对方,而是看向镜头、看向地面或者看向画面外。
如果偏差不大,可以缩短镜头。
如果是关键对峙近景,视线错误会明显破坏关系,通常需要重做。
3. 人物有没有跨轴?
简单理解,就是人物在连续镜头里突然交换了左右位置。
前一个镜头甲在左、乙在右。
切到下一个镜头后,甲突然到了右边、乙到了左边。
观众会感觉两个人瞬间换了位置。
解决方式不一定只能重做。
可以加入一个明确的移动镜头:
只要观众看见人物移动,位置变化就能被理解。
最怕的是没有任何动作,站位直接改变。
4. 景别变化有没有理由?
中景切近景,通常是为了强调情绪或者信息。
近景切特写,可能是为了突出眼神、关键道具或者情绪爆发。
如果镜头只是不断随机变化,观众会感觉剪辑很忙,却不知道重点在哪里。
景别变化应该配合剧情变化。
不是为了多一个角度而切。
六、第五遍:检查情绪有没有跳跃
AI人物的情绪很容易在单个镜头里成立,放到一整场戏里却不连贯。
例如:
第一个镜头,人物还在平静解释。
第二个镜头,突然怒吼。
第三个镜头,又恢复冷静。
第四个镜头,开始流泪。
每个镜头单独看都有表演。
连在一起却不知道人物为什么变化。
情绪检查不能只看“演得够不够大”。
要看情绪有没有因果。
我现在会把一场戏简单标成几个阶段:
例如:
这样检查时,我会看每个镜头是否处于正确阶段。
如果台词还没揭露转账,人物已经开始流泪,情绪就提前了。
如果真相已经出现,人物仍然毫无反应,情绪就迟到了。
如果人物刚刚爆发,下一秒又完全平静,中间就缺少过渡。
过渡不一定需要再生成一个复杂镜头。
有时只要加一个简单反应:
这些短镜头就能让情绪变化更可信。
七、第六遍:检查开头冲突和结尾钩子
一集内部镜头接得再顺,如果开头不抓人、结尾没有推动,传播效果还是会弱。
所以完成技术检查后,我还会重新看开头和结尾。
开头主要检查三件事
开头最好尽快出现:
如果前三秒只是人物走路、进入场景、坐下、喝水,观众很可能已经划走。
有时这些动作确实需要。
但可以把冲突声音提前放进来。
例如画面还在办公室门外,里面已经传来一句:
“那笔钱,你到底转给谁了?”
人物推门进入,冲突同时成立。
不一定要解释全部背景。
但至少要让观众知道:
如果前十秒观众还在猜两个人是谁,剧情很难真正进入。
我经常因为舍不得删漂亮镜头,在开头放办公室空镜、城市夜景和人物背影。
这些画面本身没问题。
但如果它们延迟了冲突,就应该缩短或者移到后面。
结尾主要检查三件事
好的结尾不一定要大反转。
但应该让观众产生一个明确问题:
有些结尾提前十秒就把答案全部说完,最后只是人物走远或者音乐渐弱。
画面很有氛围,却没有继续观看动力。
我会尽量让最后一句台词、最后一个道具或者最后一个人物反应承担钩子。
钩子出现以后,不要马上切走。
可以留半秒到一秒,让观众看清楚信息。
比如手机上突然出现一条消息:
“钱已经收到,别再联系我。”
如果画面只出现零点几秒,观众根本来不及读。
钩子不是出现就有效,而是必须被观众接收到。
八、哪些问题必须重做,哪些可以靠剪辑解决?
这是我返工时最纠结的问题。
每条素材都重新生成,时间和成本承受不了。
什么都靠剪辑硬救,成片又会越来越勉强。
后来我给自己定了一个简单标准:
影响剧情理解、角色身份和关键情绪的问题,优先重做。
只影响局部流畅度,而且能通过切镜自然隐藏的问题,优先剪辑解决。
一般必须重做的问题
这些问题即使通过剪辑缩短,也可能继续影响理解。
一般可以先靠剪辑解决的问题
常见修复方式包括:
但有一个前提:
修完以后,不能让观众明显感觉到你在躲问题。
如果为了遮一个错误,连续插入三四个无关特写,剧情会更加混乱。
九、我现在的返工顺序
以前发现问题后,我会立刻重新生成视频。
结果经常重做了一个镜头,又影响前后衔接。
现在我会按照影响程度安排返工。
第一优先级:剧情能不能看懂
先解决:
剧情理解有问题,其他细节做得再好也没有意义。
第二优先级:角色是否稳定
检查:
角色不稳定会直接破坏代入感。
第三优先级:镜头衔接是否自然
解决:
第四优先级:氛围和细节
最后再调整:
我以前经常一开始就调色、加音乐、做字幕动画。
后来画面返工,前面做的东西全部要重新调整。
现在我会先解决结构问题,再处理装饰细节。
十、我使用的一集AI短剧自检清单
每次准备导出前,我会快速过一遍下面这份清单。
画面检查
镜头检查
声音检查
字幕检查
剧情检查
十一、检查成片时,我现在最相信的一件事
以前我特别相信自己刚做完时的感觉。
刚完成一集,人物、剧情、镜头都是我自己一点点做出来的。
我知道每个镜头为什么放在这里,也知道每句台词想表达什么。
所以我会自动替作品补充很多观众并不知道的信息。
画面里没交代清楚的关系,我脑子里知道。
台词里没说完整的背景,我看过剧本。
一个动作没有做完,我知道人物原本想做什么。
但第一次刷到视频的观众,没有这些信息。
他只会根据屏幕上实际出现的内容判断。
所以我现在做完一集以后,会尽量让自己暂时忘掉剧本,只看成片本身。
我会问:
- 这个结尾真的有钩子,还是我因为知道后续剧情才觉得有悬念?
这些问题有时候比生成参数更重要。
写在最后
AI短剧返工最痛苦的地方,不是发现问题。
而是不知道哪些问题值得重做。
如果每一个小瑕疵都重新生成,一集可能永远做不完。
如果所有问题都想靠剪辑隐藏,作品又会越来越破碎。
我现在的做法不是追求绝对完美,而是先保证三件事:
剧情看得懂,人物认得出,情绪接得上。
这三件事成立以后,再去修复动作、口型、声音和画面细节。
有些AI瑕疵观众确实不会在意。
比如背景里一个不起眼的杯子换了位置,或者人物袖口出现轻微变化。
但有些问题必须认真处理。
主角换脸、关键证据错误、视线关系混乱、人物情绪没有原因,这些都会直接破坏故事。
做AI短剧越久,我越觉得检查和返工不是制作结束后的补救步骤。
它本身就是创作流程的一部分。
生成素材只是提供可能性。
真正决定哪些镜头留下、哪些问题重做、哪些瑕疵可以接受的人,仍然是创作者自己。
下一篇预告
下一篇,我准备聊一个很多普通人真正开始做以后都会关心的问题:
《一个普通上班族做AI短剧,时间和成本到底花在哪里?》
我会拆开聊剧本、人物、场景、分镜、视频生成和剪辑分别消耗多少精力,哪些环节最浪费生成次数,以及我是怎样利用下班时间拆分任务的。
也会分享为什么我现在不会再尝试一天之内,从剧本直接做到完整成片。