你好,我是西瓜,很多人做漫剧是不是会遇到这个问题:每个工具点我都会了,但真要做一部完整的短剧,第一步该干嘛?最后一步怎么收尾?中间怎么衔接?”
今天这篇,就是来回答这个问题的。我把整个流程拧成一条完整的流水线,从“只有一个想法”到“生成一段能看的成片”,一共六步。每一步都标注了输入、操作、输出,附上可以直接复制的提示词。照着走一遍,你就能产出一段完整的AI短剧。
一、六步总览
二、第一步:把想法变成剧本
输入:一个模糊的想法,比如“一个程序员在加班时发现电梯通往第0层”。
操作:把这个想法喂给DeepSeek或Claude,用下面的提示词,让它帮你生成一个包含分镜、对白、时长的剧本。
可直接复制的提示词:
请根据我提供的核心创意,生成一个完整的分镜剧本。剧本内容要包含“镜号 - 画面描述 - 角色对白(可选) - 时长(秒)”。核心创意:[粘贴你的想法,例如:一个程序员在加班时发现电梯通往第0层]输出要求:1. 剧本总时长控制在3-5分钟,分镜数量在20-30个。2. 清晰描述每个镜头的景别(远景/全景/中景/近景/特写)和角色动作。3. 如果有对白,请写在画面描述下方。4. 风格:悬疑+轻喜剧,参考《黑镜》但带有幽默感。输出:就是你接下来所有工作的蓝本——一份结构清晰的剧本,直接决定了后续每一步的成败。
三、第二步:从剧本生成角色形象
输入:上一步生成的剧本。
操作:把剧本喂给DeepSeek或Claude,用以下提示词,提取出角色形象的关键词,然后复制到Midjourney或DALL-E 3中生成定妆照。
可直接复制的提示词:
请根据以下剧本内容,提取主要角色的外貌特征、服装风格、气质神态,生成一份可直接用于AI生图的角色描述。剧本内容:[粘贴你的剧本]输出格式要求:1. 外貌特征:脸型、肤色、眼睛(颜色/形状)、鼻子、嘴唇、发型(颜色/长度/卷直/刘海)、身高、体型、标志性特征(痣/纹身/伤疤)。2. 服装风格:具体到款式、颜色、材质,例如“深灰色连帽卫衣,卡其色工装裤,白色运动鞋”。3. 气质神态:整体气质,常带表情(例如“疲惫但警觉,眉头微皱”)。4. 最终汇总成一段“角色描述汇总”,可直接复制用于AI生图。
关键步骤:把你得到的“角色描述汇总”粘贴到Midjourney,生成4-8张正面全身照,选出最像你想象中角色的那张,保存为“角色名_定妆照.png”。
四、第三步:生成角色16视图,锁定人设
输入:上一步选出的定妆照。
操作:把定妆照上传到DALL-E 3或Midjourney,用以下提示词,生成一张包含角色多个角度的16视图。
可直接复制的提示词(DALL-E 3,垫图模式):
基于我上传的参考图,生成同一角色的16视图角色设计图。所有视图中的面部特征、发型、服装必须与参考图100%一致。包含以下视图:正面全身、背面全身、左侧面全身、右侧面全身、左45°全身、右45°全身、正面半身、左侧面半身、右侧面半身、行走姿态、站姿、坐姿、抬手姿态、回头姿态、微笑表情、严肃表情。白色背景,网格布局,16宫格排列。不要水印,不要文字标注,不要边框。生成后检查清单:
所有格子的脸是同一个人的吗? → 不是就重生成,或者分批生成后用PS拼图
服装在所有格子中一致吗?(特别是有没有凭空多出或消失的图案、口袋)
五、第四步:生成分镜故事板,把剧本画面化

输入:剧本全文 + 角色16视图(作为角色参考)。
操作:把剧本和角色参考图上传到DALL-E 3,生成一张12格的分镜故事板,把文字变成画面。
可直接复制的提示词:
根据以下剧本和角色参考图,生成一张12格分镜故事板。剧本内容:[粘贴你的剧本,建议100-300字,包含场景、角色、对白]角色参考:见上传的16视图。场景设定:[一句话描述核心场景,如:深夜写字楼 / 废弃医院 / 太空飞船]输出要求:1.16:9画幅,12格网格排列。2. 每个分镜包含:镜号、景别(远景/全景/中景/近景/特写)、画面内容描述。3. 黑白草图风格,简洁清晰,重点突出角色位置、动作和场景元素。4. 景别说明:远景=大场景,全景=人物全身+环境,中景=膝盖以上,近景=胸部以上,特写=局部细节。
六、第五步:生成场景锚点卡,防止穿帮
输入:第四步生成的故事板。
操作:从故事板里提取核心场景信息,生成一份“场景锚点卡”。同时,把故事板里的12个分镜图拆成独立的图片文件。
5.1 生成场景锚点卡
可直接复制的提示词:
根据以下故事板,提取核心场景的“锚点卡”:场景名称: [给场景起名,例如:深夜办公室]空间结构: [描述空间布局,例如:大门(左后)→ 工位(中,靠窗)→ 茶水间角落(右前)]固定道具: [列出3-5个关键道具及其位置,例如:3号工位上的“Hello Kitty”马克杯、门上贴着的“加班费”文件、茶水间的饮水机]色板: [主色调+光源颜色,例如:冷白荧光灯为主,窗外是深蓝色夜空]标志性特征: [1-2个独特元素,例如:墙上挂钟的指针停在12点,永远不走]
5.2 拆分分镜图
把故事板中的12个格子,逐一截图或使用图片处理工具切开,保存为独立的图片文件。命名规则:场景名_镜号.png(例如:深夜办公室_镜01.png)。
拆完后检查:☐ 每个分镜的画面内容与故事板一致。☐ 角色形象与16视图一致(特别是服装和发型)。☐ 场景元素与锚点卡一致(道具位置要对)。
七、第六步:Runway Gen-3 / Pika 视频生成
输入:角色16视图 + 场景锚点卡 + 拆分好的分镜图。
操作:把以上材料上传到Runway Gen-3或Pika,用以下运镜提示词生成视频。
Runway Gen-3 / Pika 操作设置:
- 主参考图:按顺序上传分镜图(
深夜办公室_镜01.png, 深夜办公室_镜02.png …)。 - 角色参考:上传角色16视图中的正面图和侧面图(用于锁定人设)。
- 场景参考:上传场景锚点卡对应的概念图(用于锁定场景,可让AI生成一张)。
运镜提示词模板(可直接复制):
根据我上传的分镜序列,生成一段连续视频。逐镜运镜要求如下:镜1 (0-2秒):远景,缓慢推进。镜头从办公室全景开始,缓慢向主角工位推进。镜2 (2-4秒):中景,固定。镜头固定,主角从工位上抬头,看向门口。镜3 (4-6秒):近景,缓慢上摇。镜头从主角的手部特写(正在敲键盘)缓缓上摇到他的脸,捕捉他惊讶的表情。镜4 (6-8秒):全景,快速横移。镜头快速向左横移,展示空荡荡的茶水间和角落。镜5 (8-10秒):特写,固定。镜头固定,主角的瞳孔放大,倒映出电梯门打开的画面。镜6 (10-12秒):中景,环绕。镜头围绕主角做弧线运动,从侧面移动到正面,展示他犹豫不决的肢体语言。镜7 (12-14秒):远景,拉远。镜头从主角背后逐渐拉远,展现他站在明亮的电梯口与黑暗走廊的对比。镜8 (14-15秒):定格。镜头稳定,画面定格在主角迈步走进电梯的瞬间。核心约束:1. 所有镜头中,场景布局、道具位置、色调必须与上传的场景参考图一致。2. 角色外貌、服装必须与上传的角色参考图完全一致。3. 镜头之间要无缝过渡,不要生硬切镜。4. 一镜到底,保持画面的连续感。5. 不要添加任何文字、水印或LOGO。关键参数:画质选择高画质,分辨率1080p,帧率24fps。
八、六步流程图(简要版)
想法│▼第一步:生成剧本 → 带分镜的完整剧本│
▼第二步:生成角色定妆照 → 定妆照1张│
▼第三步:生成角色16视图 → 角色16视图1张│
▼第四步:生成分镜故事板 → 12格故事板1张│
▼第五步A:生成场景锚点卡第五步B:拆分分镜图│
▼第六步:Runway/Pika生成 → 15秒视频成片
九、总耗时估算(新手版)
十、常见问题排查指南
| | |
|---|
| | 重新生成16视图,确保所有视图一致;在视频工具中明确上传“角色参考”,并强调“保持角色外貌不变”。 |
| | 细化锚点卡,在运镜提示词中明确写出“场景布局、道具位置、色调保持不变”。 |
| | 在运镜提示词中增加“镜头之间无缝过渡”、“角色动作连贯”等指令。 |
| | 使用多段视频拼接,或者使用支持更长视频的版本(如有)。 |
| | 在提示词中写明“角色服装与参考图完全一致”,并上传包含服装细节的参考图。 |
| | 在提示词中增加“高分辨率,电影级质感,写实风格,无噪点,无变形”等指令。 |
六步走完,你从“一个想法”到了“一段能看的视频”。这条路我已经帮你踩过一遍了。每一步的坑、每一步的提示词、每一步的工具选择,都在这篇文章里了。
接下来就是动手做——做第一个15秒,然后第二个、第三个,慢慢把流程跑顺。你会发现,最难的不是技术,而是迈出第一步:把想法喂给AI,生成第一段剧本。
如果你在实操中遇到具体问题,欢迎在评论区或后台留言。比如:“我生成的16视图,右脸总是和左脸不一样,怎么办?”或者“我的场景锚点卡写得很详细,但视频里风扇还是凭空消失了,是怎么回事?”
👇 点个「在看」,让更多创作者跑通全流程。我是西瓜,下期见。