在实际做 AI 漫剧的现场,大部分人第一次使用 LibTV,遇到的瓶颈往往不是“不会点按钮”,而是“不知道下一个镜头该点什么”。剧本写好了,分镜不知道怎么拆;角色生成了,下一场戏脸型就变了;对话能出了,配音和口型又跟画面对不上。这套问题在 AI 视频制作里非常典型,因为漫剧不是单张图片的堆叠,而是一条“剧本 + 导演台 + 角色设计 + 场景 + 一致性 + 对话”的完整创作链路。
本文围绕 LibTV 的这套工作流,从零开始讲清楚 AI 漫剧是怎么制作的。内容包括:先理解 LibTV 的六个核心模块各自解决什么问题;再准备环境和项目;然后用手把手的方式跑通一条完整漫剧短片;接着拆解角色一致性、镜头参数、图像模型选择等关键细节;最后给出成片验证方法、常见故障排查链路和一组可以直接复用的实践清单。无论你是第一次接触 AI 视频制作的小白,还是已经能出片但总是被角色稳定性困扰的创作者,这套流程都值得从头顺一遍。
1. 先理解 LibTV 的创作链路:漫剧为什么需要“全套流水线”
1.1 漫剧制作的痛点和 LibTV 的定位
漫剧,简单说就是用漫画风格画面连续播放形成的短剧内容。它和传统动画的区别在于:漫剧不需要逐帧手绘,而是先由 AI 生成静态画面,再配合镜头运动、粒子效果、配音和字幕,形成接近“会动的漫画”的视频。
在 LibTV 出现之前,做一条漫剧短片的常见路径很繁琐:先用绘图工具生成主要角色立绘,再手工给每个场景写提示词,然后一张张生成背景,最后把图拖进剪辑软件里加运镜和配音。这套流程最大的问题不是“生成质量差”,而是“一致性失控”。同一角色在第一个镜头是圆脸,第二个镜头变成尖脸;同一个便利店,白天一个样,晚上又一个样。返工成本极高。
LibTV 的定位,是把这条链路整合成一个相对完整的创作闭环。它的核心不是替你做创意,而是替你把“剧本拆解、角色设定、场景控制、镜头编排、对话生成、出片合成”这些确定性较高的中间环节自动化。你用导演思维控制方向和节奏,工具负责把指令转成可用的镜头素材。
1.2 一条完整漫剧链路中的六个核心模块
LibTV 的工作流可以拆成六个模块,每个模块解决一类问题,也有对应的产出物。
| 模块 | 解决什么问题 | 核心产出物 | 常见的错误做法 |
|---|---|---|---|
| 剧本 | 故事内容和叙事结构 | 结构化剧本、台词、旁白 | 只写对话不写画面描述 |
| 导演台 | 分场分镜和节奏控制 | 分镜脚本、镜头顺序 | 一个场景一张图从头用到尾 |
| 角色设计 | 角色长什么样、穿什么、什么气质 | 角色参考图、角色设定卡 | 不给正面参考图直接生成 |
| 场景 | 每个镜头发生在什么空间 | 场景参考图、环境提示词 | 场景描述过于抽象 |
| 一致性 | 同一角色在不同镜头中不“换脸” | 参考图绑定、一致性权重配置 | 每张图单独写新提示词 |
| 对话与出片 | 台词配音、字幕、镜头合成 | 配音轨道、字幕、成片视频 | 画面做完了才发现没有配音轨 |
这六个模块不是六个独立功能,而是一条依赖链。剧本决定分镜,分镜决定需要哪些角色和场景,角色和场景绑定之后才谈得上一致性,一致性稳定之后,对话和出片才有意义。所以那篇 B 站教程标题里的“剧本 + 导演台 + 角色设计 + 场景 + 一致性 + 对话一键出片”,本质上是按这条依赖链排好的。
1.3 你拿到手的“镜头”到底是什么
在 LibTV 里,一个“镜头”通常不是一张静态图,而是一组结构化信息:画面描述、镜头类型、运镜方式、持续时间、角色位置、台词文本。理解这一点很重要,因为后续所有操作都是在填充这组信息。
一个典型镜头在数据层面可以表达成这样:
{ "shot_no": "S01-C01", "scene": "便利店内", "shot_type": "中景", "camera": "缓慢推近", "duration": 6, "characters": [ { "name": "林小麦", "position": "画面中央", "action": "拿起饭团,抬头看门口" } ], "dialogue": "今晚的晚饭,又是便利店饭团。", "tone": "疲惫中带一点自嘲" }在开始操作 LibTV 之前,先养成一个习惯:把“我要做一个镜头”替换成“我要填一份镜头信息卡”。这样后面无论界面怎么变,你都能知道自己的内容应该放到哪里。
2. 环境准备与项目起步
2.1 开始前要确认的几件事
LibTV 属于在线 AI 视频制作工具,绝大多数操作都在网页端完成。开始前不需要安装复杂软件,但要确认几项基础条件:
- 有一个可正常登录 LibTV 的账号,并确认当前账号是否包含视频生成或对话合成所需的额度。
- 准备稳定的网络环境。在线生成画面和语音对网络稳定性要求较高,尤其是导出长视频时,避免手动刷新页面。
- 确认浏览器版本。建议使用 Chromium 内核的现代浏览器,避免在老旧浏览器上出现预览控件异常。
- 准备一份属于自己的素材目录。把角色参考图、场景参考图、剧本文档按项目分目录存放,不要堆在桌面。
如果在学习阶段,建议先申请或使用免费额度完成一条 30 秒以内的测试短片。不要一上来就制作 5 分钟长篇,因为一致性、配音、字幕的问题会在长片中成倍放大,排错成本很高。
2.2 新建项目与页面入口
进入 LibTV 之后,第一步是新建项目。以常见项目式编辑器为例,新建项目时通常需要填写项目名称、选择视频比例和基础风格。
推荐初学设置:
- 视频比例:9:16,竖屏。漫剧主要在移动端播放,竖屏是默认场景。
- 风格标签:都市、写实漫剧或二次元,取决于你的题材。
- 项目模板:如果界面提供“从空白创建”和“从模板创建”,第一次建议从空白创建,先理解每个模块的用途,再决定是否使用模板。
新建项目后的主界面一般会分布着几个核心区域:左侧是素材和剧本栏,中间是导演台或分镜轨道,右侧是生成预览与参数面板。不同版本的界面布局可能有差异,但承担的职责基本一致。进入项目后,不要急着生成画面,先把左侧的剧本和角色素材填好,再去看中间轨道。
2.3 学会用“最小片段”先跑通流程
很多教程直接演示完整项目,结果读者跟到一半就断在某个参数上。更稳妥的做法是:先做一个“最小片段”,验证整条链路能通,再逐步扩展。
最小片段建议这样设计:
场景:一个房间 角色:一个角色 镜头:1 个中景镜头,时长 5 秒 台词:1 句话 目标:验证角色一致性、画面生成、配音、字幕、导出这五个环节是否都能正常完成这个最小片段如果能顺利导出成片,说明你的账号权限、素材格式、基本参数都正确。之后再把镜头数量增加到 5 个、10 个,问题会集中在“跨镜头一致性”和“叙事节奏”上,而不会混入账号或基础配置问题。
3. 手把手跑通一个漫剧短片:从剧本到成片
这一节用一个可复现的小案例,走完整条 LibTV 制作流程。案例设定很简单:一个便利店夜班店员,在凌晨两点的便利店,自言自语说了一句台词。
3.1 第一步:把剧本结构化,分场分镜
剧本不能只是一段文字,而是要先拆成“场”,再把“场”拆成“镜头”。以案例剧本为例:
场次:S01 地点:24 小时便利店 时间:凌晨 2:00 事件:夜班店员林小麦在收银台整理货架,突然听到门口铃声响起。 关键情绪:疲惫、紧张、好奇。拆成镜头后:
S01-C01:远景,街道空无一人,便利店灯箱亮着,脚步声接近。 S01-C02:中景,林小麦抬头看向门口,神情疲惫。 S01-C03:近景,门被推开,铃铛声响起,林小麦手里的饭团掉在桌上。分镜阶段不需要写太长描述,关键是给每个镜头确定三件事:拍什么主体、用什么景别、画面里发生了什么动作。这些信息在 LibTV 里会成为提示词的主要来源。
3.2 第二步:角色设计,先确定“谁在演”
角色设计的目标不是生成一张好看的单图,而是生成一个“能跨镜头保持稳定”的参考角色。因此角色设计要包含外观、服装、气质、禁止项四类信息。
以案例角色为例:
角色名:林小麦 身份:24 小时便利店夜班店员 年龄外貌:22 岁,齐肩短发,眼下有一点黑眼圈 服装:白色衬衫,深色围裙,胸口有便利店 logo 常用表情:疲惫、抿嘴、微微皱眉 禁止项:不要戴眼镜,不要穿红色外套在 LibTV 中,角色设计通常有两种做法:
- 直接上传自己准备的角色参考图,让后续镜头以该图为基准。
- 先用文字描述生成角色立绘,再把这版立绘保存为角色参考图。
推荐第二种。原因是自己准备参考图时,画风可能和 LibTV 默认生成风格不一致,导致后续镜头画风漂移。让工具先生成一版,再把它固化为参考图,风格一致性更高。
生成角色立绘时,建议使用正面全身或半身图,画面干净、背景简单。不要把复杂的场景提示词混进角色设计里,否则后续每个镜头都会把背景也复制出来,反而难控制。
3.3 第三步:场景设置,给镜头一个确定的空间
场景设置要回答的问题很简单:这个镜头发生在哪里?环境是什么气氛?
案例场景可以设置成:
场景名:S01 便利店内部 整体风格:都市写实漫剧 空间描述:狭窄的便利店货架过道,白色日光灯,冷藏柜发出淡淡蓝光 时间感:凌晨,窗外漆黑 氛围关键词:冷清、安静、略带压抑场景设置最关键的一点是“稳定”。同一个场景在不同镜头中,家具位置、灯光方向、货架密度都要尽量一致。具体做法是:把第一个镜头生成的场景画面保存为场景参考图,后续镜头带上这张参考图,并只修改角色位置和镜头角度,不修改空间描述。
3.4 第四步:导演台编排,控制叙事节奏
导演台是 LibTV 里决定“镜头顺序和节奏”的区域。在这里把前面拆好的镜头按顺序排到时间轴上,并给每个镜头设置时长、转场方式和运镜方向。
案例镜头可以这样编排:
S01-C01 远景:时长 5 秒,运镜:缓慢推进,转场:淡入 S01-C02 中景:时长 6 秒,运镜:轻微左右摇,转场:硬切 S01-C03 近景:时长 4 秒,运镜:快速推近,转场:硬切要注意,导演台不是简单排列图片,它决定了观众的信息接收顺序。远景交代环境,中景展示人物状态,近景放大情绪变化。如果三个镜头都是同一个景别,叙事会非常平。
在 LibTV 中,镜头之间还需要关注“视频衔接”问题。如果两个镜头是同一个场景的连续动作,建议让角色在画面中的位置保持基本一致,避免观众感觉角色瞬移。
3.5 第五步:对话生成与一键出片
对话模块负责把台词转成配音,并生成对应字幕。以案例台词为例:
台词:今晚的晚饭,又是便利店饭团。 说话人:林小麦 情绪:疲惫、无奈 语气:轻声自言自语设置好说话人和情绪后,LibTV 会生成对应的语音轨道。生成后先试听,确认语速和情绪是否符合画面。如果在导演台里已经设置了 6 秒镜头时长,而配音只有 5 秒,建议调整画面时长或增加画面内动作,而不是单纯拉长结尾黑屏。
最后一步就是“一键出片”。在出片前,确认以下内容:
- 所有镜头都已生成画面,没有遗留空白帧。
- 所有对话都有配音轨道。
- 字幕内容与台词一致,无错别字。
- 视频比例与发布平台要求一致。
确认后提交渲染,等待成片生成。长视频渲染时间较长,不要反复刷新页面。
4. 关键参数与功能点详解
4.1 角色一致性的三个核心参数
角色一致性是漫剧制作中最容易出问题的环节。在 LibTV 中,控制一致性的手段通常包括参考图、一致性权重和画面种子三类。
| 参数 | 作用 | 推荐初值 | 调大影响 | 调小影响 |
|---|---|---|---|---|
| 参考图强度 | 画面向角色参考图靠拢的程度 | 0.7 - 0.8 | 角色更像参考图,但姿势变化受限 | 姿势更自由,但五官容易漂移 |
| 一致性权重 | 与提示词的权衡比例 | 0.6 - 0.7 | 跨镜头更稳定,但可能忽略动作描述 | 动作更准确,但同一角色多个镜头会换脸 |
| 随机种子 | 控制生成随机性 | 固定不变 | 不同镜头风格跳跃 | 固定时可减少同镜头重试差异 |
很多人在镜头 1 生成时用的是“系统随机种子”,镜头 2 生成时又用了一个新种子,导致同一个角色在不同镜头里像两个人。建议在确认角色参考图稳定后,将随机种子固定下来,只调整其它描述性提示词。
如果 LibTV 的界面允许保存“角色模板”,那么每次新建项目时直接复用模板,而不是重新生成角色。这样系列内容的一致性会好很多。
4.2 镜头与运镜参数
镜头参数影响的是画面的运动感和节奏感,主要有这几类:
- 景别:远景、全景、中景、近景、特写。景别越近,情绪越强,信息越少。
- 运镜方向:推进、拉远、左摇、右摇、上摇、跟随。运镜要和人物动作匹配。
- 镜头时长:单镜头时长越短,节奏越紧张;越长,越有沉浸感。
- 转场方式:硬切、淡入淡出、叠化、闪白。不同转场对应不同的叙事情绪。
漫剧中常见的节奏方式是“远景交代环境,中景展开对话,近景释放情绪”。对话镜头建议用中景或近景,远景对话会让观众看不清嘴型和表情。
4.3 关于 General Image Pro 和图像模型的关系
这是一个在社区里经常被问到的问题:LibTV 里的 General Image Pro 是不是就是某个外部图像模型的替代版?在官方没有明确说明底层模型关系的情况下,不建议直接下结论,也不建议把“General Image Pro”等同于任何已知模型。
从使用角度,只需要确认三件事:
- General Image Pro 是 LibTV 界面中图像生成模型的一个选项,不同项目阶段可以切换模型。
- 判断一个模型是否适合自己,不看名字,而要看同一组提示词在不同模型下的输出对比。
- 模型选项会影响出图风格、细节质量和生成速度。正式开拍前,用同一个角色参考图和场景提示词分别跑几张图做对比,选风格最稳定的那一个。
如果你在设置界面看到了多个图像模型选项,建议固定一个模型跑完整个项目,不要中途随意切换。中途切换模型是漫剧画风突变的最常见原因之一。
4.4 常用参数速查表
以下表格汇总了漫剧制作中最常用的参数,方便在配置时快速对照。
| 参数类别 | 具体参数 | 适用场景 | 推荐值 |
|---|---|---|---|
| 画布 | 视频比例 | 移动端发布 | 9:16 |
| 画布 | 分辨率 | 平台允许的最大值 | 1080x1920 或工具上限 |
| 角色 | 参考图强度 | 保证脸型一致 | 0.7 - 0.8 |
| 一致性 | 随机种子 | 跨镜头复用 | 固定 |
| 镜头 | 单镜头时长 | 对话镜头 | 4 - 6 秒 |
| 镜头 | 单镜头时长 | 环境交代镜头 | 3 - 5 秒 |
| 镜头 | 运镜速度 | 情绪平缓 | 慢速推近 |
| 对话 | 语速 | 日常对话 | 正常语速或 0.95 倍 |
| 生成 | 图像模型 | 全项目统一 | 固定一个 |
5. 成片验证与常见故障排查
5.1 成片质量从哪些维度验证
成片渲染完成后,不要只盯着“有没有生成成功”,要从以下维度逐条检查:
- 角色稳定性:同一角色在不同镜头中五官、发型、服装是否一致。
- 场景一致性:同一场景在不同镜头中空间结构是否一致。
- 叙事流畅度:镜头顺序是否表达了剧本意图,是否存在跳切。
- 音画同步:配音内容是否和字幕一致,口型是否大致吻合。
- 视频节奏:是否有长时间无变化的静止画面。
- 技术质量:有无花屏、闪烁、横纹、音轨缺失。
如果只是个人学习,检查前三条就够了。如果是准备发布的商业内容或接单交付,六条都要过一遍。
5.2 高频问题与处理方式
以下是漫剧制作中高频出现的几类问题以及排查建议。
| 问题现象 | 常见原因 | 检查方式 | 处理建议 |
|---|---|---|---|
| 角色每换一个镜头就变脸 | 参考图未绑定,或一致性权重过低 | 检查每个镜头是否都关联了角色参考图 | 重新绑定参考图,调高参考图强度 |
| 画面风格突然变化 | 中途切换了图像模型或提示词风格词 | 检查镜头设置里模型和风格标签 | 全项目统一模型,固定风格关键词 |
| 同一场景不同镜头空间对不上 | 只写场景描述,未保存场景参考图 | 对比两个镜头的货架、灯光位置 | 保存第一个镜头为场景参考图 |
| 配音和字幕不一致 | 修改台词后未重新生成字幕 | 检查对话轨道与字幕轨道 | 重新生成字幕,或手动修正 |
| 导出时间很长或卡住 | 镜头数量过多或分辨率过高 | 查看渲染队列和日志 | 降低分辨率,拆分成多段导出 |
| 视频有闪烁花屏 | 生成帧之间的种子不稳定 | 检查每个镜头的随机种子 | 固定种子并重生成问题镜头 |
5.3 从镜头到项目的排查链路
当整条片子出现问题时,建议按下面的顺序排查,而不是盲目重做。
第一步,先定位问题出现在哪一层。如果所有镜头都有问题,优先检查项目设置和模型选择;如果只有某个镜头有问题,只需要处理该镜头。
第二步,检查输入是否完整。该镜头是否缺少角色参考图?场景描述是否为空?台词是否为空?很多“画面崩坏”实际上是输入缺失导致工具用默认值补全。
第三步,检查参数是否一致。与前后镜头相比,该镜头的随机种子是否被重置,图像模型是否被切换,参考图强度是否有明显差异。
第四步,重新生成单镜头做对比。固定其它参数不变,只修改一个变量,比如把参考图强度从 0.5 调到 0.8,看画面变化,判断是哪个参数引起的。
第五步,确认不是工具版本或缓存问题。在线工具的界面和功能会不断更新,如果某个功能突然不可用,先刷新页面并查看版本更新说明。
注意:不要只验证程序能生成画面,还要验证角色、场景、字幕、配音、时长是否都符合预期。漫剧出片不是“生成了就等于完成了”。
6. 实践经验与扩展方向
6.1 剧本阶段的高质量输入清单
剧本质量直接决定成片上限。在把剧本交给 LibTV 之前,建议先过一遍这份清单:
- 每个场次都有明确地点、时间、事件。
- 每个镜头至少包含景别、动作、情绪三个信息。
- 对话不超过两句话,过长的台词需要拆分成多个镜头。
- 画面描述里避免使用“漂亮”“好看”等主观词,改用“暖黄色灯光”“白色衬衫”等可观察的词。
- 角色之间不要出现视觉歧义,比如两个角色都穿黑外套时,要明确区分。
6.2 角色与场景管理的长期维护建议
如果准备做系列漫剧,建议给每个角色和场景建立独立的素材档案,命名规范要统一。
示例目录结构:
project_name/ ├── script/ │ └── episode_01.md ├── characters/ │ ├── lin_xiaomai/ │ │ ├── reference_front.png │ │ ├── reference_full.png │ │ └── prompt_template.txt │ └── zhang_cheng/ │ ├── reference_front.png │ └── prompt_template.txt ├── scenes/ │ ├── convenience_store/ │ │ ├── reference_01.png │ │ └── prompt_template.txt │ └── street_night/ │ └── reference_01.png └── output/ └── episode_01_final.mp4素材命名建议采用“项目_类型_版本”的规则,例如lin_xiaomai_character_v3.0.png。版本号很重要,否则一次修改后旧版本被覆盖,后续发现新版不如旧版时无法回退。
6.3 发布前的最后检查清单
每次准备发布或交付之前,按这份清单逐项确认:
- 片头片尾是否完整,是否需要加频道 logo。
- 字幕是否有错别字,标点是否统一。
- 音量是否稳定,是否有突然的音量跳变。
- 是否输出两种分辨率版本,例如 1080x1920 用于移动端,1920x1080 用于图文预览。
- 是否保留了工程文件和原始素材,方便后续修改。
- 导出的视频文件是否存在绿屏、黑帧、音画不同步等问题。
6.4 从“能出片”到“能稳定出片”
LibTV 这类工具真正考验的不是“会不会用”,而是“能不能稳定复现一套自己的流程”。很多人在第一次生成效果不错后,第二次完全复制操作却得不到同样结果,往往是因为没有固定随机种子、没有保存角色模板、没有记录参数。
建议新手在完成第一条完整漫剧后,立刻做一次复盘:把这一条视频中用到的角色模板、场景模板、参数组合、提示词模板保存成自己的项目模板。以后每做一条新片,都以这套模板为起点,再根据新剧本调整。这样你会从“每次从零开始”变成“每次在已有基础上迭代”,效率和稳定性都会有明显提升。
漫剧制作的经验积累速度,取决于你记录了多少“可复用的输入”。不要只保存成片,要把成片背后的脚本、参考图、参数一起保存。这些才是你真正能带走的东西。