
在实际做 AI 漫剧的现场大部分人第一次使用 LibTV遇到的瓶颈往往不是“不会点按钮”而是“不知道下一个镜头该点什么”。剧本写好了分镜不知道怎么拆角色生成了下一场戏脸型就变了对话能出了配音和口型又跟画面对不上。这套问题在 AI 视频制作里非常典型因为漫剧不是单张图片的堆叠而是一条“剧本 导演台 角色设计 场景 一致性 对话”的完整创作链路。本文围绕 LibTV 的这套工作流从零开始讲清楚 AI 漫剧是怎么制作的。内容包括先理解 LibTV 的六个核心模块各自解决什么问题再准备环境和项目然后用手把手的方式跑通一条完整漫剧短片接着拆解角色一致性、镜头参数、图像模型选择等关键细节最后给出成片验证方法、常见故障排查链路和一组可以直接复用的实践清单。无论你是第一次接触 AI 视频制作的小白还是已经能出片但总是被角色稳定性困扰的创作者这套流程都值得从头顺一遍。1. 先理解 LibTV 的创作链路漫剧为什么需要“全套流水线”1.1 漫剧制作的痛点和 LibTV 的定位漫剧简单说就是用漫画风格画面连续播放形成的短剧内容。它和传统动画的区别在于漫剧不需要逐帧手绘而是先由 AI 生成静态画面再配合镜头运动、粒子效果、配音和字幕形成接近“会动的漫画”的视频。在 LibTV 出现之前做一条漫剧短片的常见路径很繁琐先用绘图工具生成主要角色立绘再手工给每个场景写提示词然后一张张生成背景最后把图拖进剪辑软件里加运镜和配音。这套流程最大的问题不是“生成质量差”而是“一致性失控”。同一角色在第一个镜头是圆脸第二个镜头变成尖脸同一个便利店白天一个样晚上又一个样。返工成本极高。LibTV 的定位是把这条链路整合成一个相对完整的创作闭环。它的核心不是替你做创意而是替你把“剧本拆解、角色设定、场景控制、镜头编排、对话生成、出片合成”这些确定性较高的中间环节自动化。你用导演思维控制方向和节奏工具负责把指令转成可用的镜头素材。1.2 一条完整漫剧链路中的六个核心模块LibTV 的工作流可以拆成六个模块每个模块解决一类问题也有对应的产出物。模块解决什么问题核心产出物常见的错误做法剧本故事内容和叙事结构结构化剧本、台词、旁白只写对话不写画面描述导演台分场分镜和节奏控制分镜脚本、镜头顺序一个场景一张图从头用到尾角色设计角色长什么样、穿什么、什么气质角色参考图、角色设定卡不给正面参考图直接生成场景每个镜头发生在什么空间场景参考图、环境提示词场景描述过于抽象一致性同一角色在不同镜头中不“换脸”参考图绑定、一致性权重配置每张图单独写新提示词对话与出片台词配音、字幕、镜头合成配音轨道、字幕、成片视频画面做完了才发现没有配音轨这六个模块不是六个独立功能而是一条依赖链。剧本决定分镜分镜决定需要哪些角色和场景角色和场景绑定之后才谈得上一致性一致性稳定之后对话和出片才有意义。所以那篇 B 站教程标题里的“剧本 导演台 角色设计 场景 一致性 对话一键出片”本质上是按这条依赖链排好的。1.3 你拿到手的“镜头”到底是什么在 LibTV 里一个“镜头”通常不是一张静态图而是一组结构化信息画面描述、镜头类型、运镜方式、持续时间、角色位置、台词文本。理解这一点很重要因为后续所有操作都是在填充这组信息。一个典型镜头在数据层面可以表达成这样{ shot_no: S01-C01, scene: 便利店内, shot_type: 中景, camera: 缓慢推近, duration: 6, characters: [ { name: 林小麦, position: 画面中央, action: 拿起饭团抬头看门口 } ], dialogue: 今晚的晚饭又是便利店饭团。, tone: 疲惫中带一点自嘲 }在开始操作 LibTV 之前先养成一个习惯把“我要做一个镜头”替换成“我要填一份镜头信息卡”。这样后面无论界面怎么变你都能知道自己的内容应该放到哪里。2. 环境准备与项目起步2.1 开始前要确认的几件事LibTV 属于在线 AI 视频制作工具绝大多数操作都在网页端完成。开始前不需要安装复杂软件但要确认几项基础条件有一个可正常登录 LibTV 的账号并确认当前账号是否包含视频生成或对话合成所需的额度。准备稳定的网络环境。在线生成画面和语音对网络稳定性要求较高尤其是导出长视频时避免手动刷新页面。确认浏览器版本。建议使用 Chromium 内核的现代浏览器避免在老旧浏览器上出现预览控件异常。准备一份属于自己的素材目录。把角色参考图、场景参考图、剧本文档按项目分目录存放不要堆在桌面。如果在学习阶段建议先申请或使用免费额度完成一条 30 秒以内的测试短片。不要一上来就制作 5 分钟长篇因为一致性、配音、字幕的问题会在长片中成倍放大排错成本很高。2.2 新建项目与页面入口进入 LibTV 之后第一步是新建项目。以常见项目式编辑器为例新建项目时通常需要填写项目名称、选择视频比例和基础风格。推荐初学设置视频比例9:16竖屏。漫剧主要在移动端播放竖屏是默认场景。风格标签都市、写实漫剧或二次元取决于你的题材。项目模板如果界面提供“从空白创建”和“从模板创建”第一次建议从空白创建先理解每个模块的用途再决定是否使用模板。新建项目后的主界面一般会分布着几个核心区域左侧是素材和剧本栏中间是导演台或分镜轨道右侧是生成预览与参数面板。不同版本的界面布局可能有差异但承担的职责基本一致。进入项目后不要急着生成画面先把左侧的剧本和角色素材填好再去看中间轨道。2.3 学会用“最小片段”先跑通流程很多教程直接演示完整项目结果读者跟到一半就断在某个参数上。更稳妥的做法是先做一个“最小片段”验证整条链路能通再逐步扩展。最小片段建议这样设计场景一个房间 角色一个角色 镜头1 个中景镜头时长 5 秒 台词1 句话 目标验证角色一致性、画面生成、配音、字幕、导出这五个环节是否都能正常完成这个最小片段如果能顺利导出成片说明你的账号权限、素材格式、基本参数都正确。之后再把镜头数量增加到 5 个、10 个问题会集中在“跨镜头一致性”和“叙事节奏”上而不会混入账号或基础配置问题。3. 手把手跑通一个漫剧短片从剧本到成片这一节用一个可复现的小案例走完整条 LibTV 制作流程。案例设定很简单一个便利店夜班店员在凌晨两点的便利店自言自语说了一句台词。3.1 第一步把剧本结构化分场分镜剧本不能只是一段文字而是要先拆成“场”再把“场”拆成“镜头”。以案例剧本为例场次S01 地点24 小时便利店 时间凌晨 2:00 事件夜班店员林小麦在收银台整理货架突然听到门口铃声响起。 关键情绪疲惫、紧张、好奇。拆成镜头后S01-C01远景街道空无一人便利店灯箱亮着脚步声接近。 S01-C02中景林小麦抬头看向门口神情疲惫。 S01-C03近景门被推开铃铛声响起林小麦手里的饭团掉在桌上。分镜阶段不需要写太长描述关键是给每个镜头确定三件事拍什么主体、用什么景别、画面里发生了什么动作。这些信息在 LibTV 里会成为提示词的主要来源。3.2 第二步角色设计先确定“谁在演”角色设计的目标不是生成一张好看的单图而是生成一个“能跨镜头保持稳定”的参考角色。因此角色设计要包含外观、服装、气质、禁止项四类信息。以案例角色为例角色名林小麦 身份24 小时便利店夜班店员 年龄外貌22 岁齐肩短发眼下有一点黑眼圈 服装白色衬衫深色围裙胸口有便利店 logo 常用表情疲惫、抿嘴、微微皱眉 禁止项不要戴眼镜不要穿红色外套在 LibTV 中角色设计通常有两种做法直接上传自己准备的角色参考图让后续镜头以该图为基准。先用文字描述生成角色立绘再把这版立绘保存为角色参考图。推荐第二种。原因是自己准备参考图时画风可能和 LibTV 默认生成风格不一致导致后续镜头画风漂移。让工具先生成一版再把它固化为参考图风格一致性更高。生成角色立绘时建议使用正面全身或半身图画面干净、背景简单。不要把复杂的场景提示词混进角色设计里否则后续每个镜头都会把背景也复制出来反而难控制。3.3 第三步场景设置给镜头一个确定的空间场景设置要回答的问题很简单这个镜头发生在哪里环境是什么气氛案例场景可以设置成场景名S01 便利店内部 整体风格都市写实漫剧 空间描述狭窄的便利店货架过道白色日光灯冷藏柜发出淡淡蓝光 时间感凌晨窗外漆黑 氛围关键词冷清、安静、略带压抑场景设置最关键的一点是“稳定”。同一个场景在不同镜头中家具位置、灯光方向、货架密度都要尽量一致。具体做法是把第一个镜头生成的场景画面保存为场景参考图后续镜头带上这张参考图并只修改角色位置和镜头角度不修改空间描述。3.4 第四步导演台编排控制叙事节奏导演台是 LibTV 里决定“镜头顺序和节奏”的区域。在这里把前面拆好的镜头按顺序排到时间轴上并给每个镜头设置时长、转场方式和运镜方向。案例镜头可以这样编排S01-C01 远景时长 5 秒运镜缓慢推进转场淡入 S01-C02 中景时长 6 秒运镜轻微左右摇转场硬切 S01-C03 近景时长 4 秒运镜快速推近转场硬切要注意导演台不是简单排列图片它决定了观众的信息接收顺序。远景交代环境中景展示人物状态近景放大情绪变化。如果三个镜头都是同一个景别叙事会非常平。在 LibTV 中镜头之间还需要关注“视频衔接”问题。如果两个镜头是同一个场景的连续动作建议让角色在画面中的位置保持基本一致避免观众感觉角色瞬移。3.5 第五步对话生成与一键出片对话模块负责把台词转成配音并生成对应字幕。以案例台词为例台词今晚的晚饭又是便利店饭团。 说话人林小麦 情绪疲惫、无奈 语气轻声自言自语设置好说话人和情绪后LibTV 会生成对应的语音轨道。生成后先试听确认语速和情绪是否符合画面。如果在导演台里已经设置了 6 秒镜头时长而配音只有 5 秒建议调整画面时长或增加画面内动作而不是单纯拉长结尾黑屏。最后一步就是“一键出片”。在出片前确认以下内容所有镜头都已生成画面没有遗留空白帧。所有对话都有配音轨道。字幕内容与台词一致无错别字。视频比例与发布平台要求一致。确认后提交渲染等待成片生成。长视频渲染时间较长不要反复刷新页面。4. 关键参数与功能点详解4.1 角色一致性的三个核心参数角色一致性是漫剧制作中最容易出问题的环节。在 LibTV 中控制一致性的手段通常包括参考图、一致性权重和画面种子三类。参数作用推荐初值调大影响调小影响参考图强度画面向角色参考图靠拢的程度0.7 - 0.8角色更像参考图但姿势变化受限姿势更自由但五官容易漂移一致性权重与提示词的权衡比例0.6 - 0.7跨镜头更稳定但可能忽略动作描述动作更准确但同一角色多个镜头会换脸随机种子控制生成随机性固定不变不同镜头风格跳跃固定时可减少同镜头重试差异很多人在镜头 1 生成时用的是“系统随机种子”镜头 2 生成时又用了一个新种子导致同一个角色在不同镜头里像两个人。建议在确认角色参考图稳定后将随机种子固定下来只调整其它描述性提示词。如果 LibTV 的界面允许保存“角色模板”那么每次新建项目时直接复用模板而不是重新生成角色。这样系列内容的一致性会好很多。4.2 镜头与运镜参数镜头参数影响的是画面的运动感和节奏感主要有这几类景别远景、全景、中景、近景、特写。景别越近情绪越强信息越少。运镜方向推进、拉远、左摇、右摇、上摇、跟随。运镜要和人物动作匹配。镜头时长单镜头时长越短节奏越紧张越长越有沉浸感。转场方式硬切、淡入淡出、叠化、闪白。不同转场对应不同的叙事情绪。漫剧中常见的节奏方式是“远景交代环境中景展开对话近景释放情绪”。对话镜头建议用中景或近景远景对话会让观众看不清嘴型和表情。4.3 关于 General Image Pro 和图像模型的关系这是一个在社区里经常被问到的问题LibTV 里的 General Image Pro 是不是就是某个外部图像模型的替代版在官方没有明确说明底层模型关系的情况下不建议直接下结论也不建议把“General Image Pro”等同于任何已知模型。从使用角度只需要确认三件事General Image Pro 是 LibTV 界面中图像生成模型的一个选项不同项目阶段可以切换模型。判断一个模型是否适合自己不看名字而要看同一组提示词在不同模型下的输出对比。模型选项会影响出图风格、细节质量和生成速度。正式开拍前用同一个角色参考图和场景提示词分别跑几张图做对比选风格最稳定的那一个。如果你在设置界面看到了多个图像模型选项建议固定一个模型跑完整个项目不要中途随意切换。中途切换模型是漫剧画风突变的最常见原因之一。4.4 常用参数速查表以下表格汇总了漫剧制作中最常用的参数方便在配置时快速对照。参数类别具体参数适用场景推荐值画布视频比例移动端发布9:16画布分辨率平台允许的最大值1080x1920 或工具上限角色参考图强度保证脸型一致0.7 - 0.8一致性随机种子跨镜头复用固定镜头单镜头时长对话镜头4 - 6 秒镜头单镜头时长环境交代镜头3 - 5 秒镜头运镜速度情绪平缓慢速推近对话语速日常对话正常语速或 0.95 倍生成图像模型全项目统一固定一个5. 成片验证与常见故障排查5.1 成片质量从哪些维度验证成片渲染完成后不要只盯着“有没有生成成功”要从以下维度逐条检查角色稳定性同一角色在不同镜头中五官、发型、服装是否一致。场景一致性同一场景在不同镜头中空间结构是否一致。叙事流畅度镜头顺序是否表达了剧本意图是否存在跳切。音画同步配音内容是否和字幕一致口型是否大致吻合。视频节奏是否有长时间无变化的静止画面。技术质量有无花屏、闪烁、横纹、音轨缺失。如果只是个人学习检查前三条就够了。如果是准备发布的商业内容或接单交付六条都要过一遍。5.2 高频问题与处理方式以下是漫剧制作中高频出现的几类问题以及排查建议。问题现象常见原因检查方式处理建议角色每换一个镜头就变脸参考图未绑定或一致性权重过低检查每个镜头是否都关联了角色参考图重新绑定参考图调高参考图强度画面风格突然变化中途切换了图像模型或提示词风格词检查镜头设置里模型和风格标签全项目统一模型固定风格关键词同一场景不同镜头空间对不上只写场景描述未保存场景参考图对比两个镜头的货架、灯光位置保存第一个镜头为场景参考图配音和字幕不一致修改台词后未重新生成字幕检查对话轨道与字幕轨道重新生成字幕或手动修正导出时间很长或卡住镜头数量过多或分辨率过高查看渲染队列和日志降低分辨率拆分成多段导出视频有闪烁花屏生成帧之间的种子不稳定检查每个镜头的随机种子固定种子并重生成问题镜头5.3 从镜头到项目的排查链路当整条片子出现问题时建议按下面的顺序排查而不是盲目重做。第一步先定位问题出现在哪一层。如果所有镜头都有问题优先检查项目设置和模型选择如果只有某个镜头有问题只需要处理该镜头。第二步检查输入是否完整。该镜头是否缺少角色参考图场景描述是否为空台词是否为空很多“画面崩坏”实际上是输入缺失导致工具用默认值补全。第三步检查参数是否一致。与前后镜头相比该镜头的随机种子是否被重置图像模型是否被切换参考图强度是否有明显差异。第四步重新生成单镜头做对比。固定其它参数不变只修改一个变量比如把参考图强度从 0.5 调到 0.8看画面变化判断是哪个参数引起的。第五步确认不是工具版本或缓存问题。在线工具的界面和功能会不断更新如果某个功能突然不可用先刷新页面并查看版本更新说明。注意不要只验证程序能生成画面还要验证角色、场景、字幕、配音、时长是否都符合预期。漫剧出片不是“生成了就等于完成了”。6. 实践经验与扩展方向6.1 剧本阶段的高质量输入清单剧本质量直接决定成片上限。在把剧本交给 LibTV 之前建议先过一遍这份清单每个场次都有明确地点、时间、事件。每个镜头至少包含景别、动作、情绪三个信息。对话不超过两句话过长的台词需要拆分成多个镜头。画面描述里避免使用“漂亮”“好看”等主观词改用“暖黄色灯光”“白色衬衫”等可观察的词。角色之间不要出现视觉歧义比如两个角色都穿黑外套时要明确区分。6.2 角色与场景管理的长期维护建议如果准备做系列漫剧建议给每个角色和场景建立独立的素材档案命名规范要统一。示例目录结构project_name/ ├── script/ │ └── episode_01.md ├── characters/ │ ├── lin_xiaomai/ │ │ ├── reference_front.png │ │ ├── reference_full.png │ │ └── prompt_template.txt │ └── zhang_cheng/ │ ├── reference_front.png │ └── prompt_template.txt ├── scenes/ │ ├── convenience_store/ │ │ ├── reference_01.png │ │ └── prompt_template.txt │ └── street_night/ │ └── reference_01.png └── output/ └── episode_01_final.mp4素材命名建议采用“项目_类型_版本”的规则例如lin_xiaomai_character_v3.0.png。版本号很重要否则一次修改后旧版本被覆盖后续发现新版不如旧版时无法回退。6.3 发布前的最后检查清单每次准备发布或交付之前按这份清单逐项确认片头片尾是否完整是否需要加频道 logo。字幕是否有错别字标点是否统一。音量是否稳定是否有突然的音量跳变。是否输出两种分辨率版本例如 1080x1920 用于移动端1920x1080 用于图文预览。是否保留了工程文件和原始素材方便后续修改。导出的视频文件是否存在绿屏、黑帧、音画不同步等问题。6.4 从“能出片”到“能稳定出片”LibTV 这类工具真正考验的不是“会不会用”而是“能不能稳定复现一套自己的流程”。很多人在第一次生成效果不错后第二次完全复制操作却得不到同样结果往往是因为没有固定随机种子、没有保存角色模板、没有记录参数。建议新手在完成第一条完整漫剧后立刻做一次复盘把这一条视频中用到的角色模板、场景模板、参数组合、提示词模板保存成自己的项目模板。以后每做一条新片都以这套模板为起点再根据新剧本调整。这样你会从“每次从零开始”变成“每次在已有基础上迭代”效率和稳定性都会有明显提升。漫剧制作的经验积累速度取决于你记录了多少“可复用的输入”。不要只保存成片要把成片背后的脚本、参考图、参数一起保存。这些才是你真正能带走的东西。