本文回答:AI 动漫短剧从剧本到成片要过哪 8 个环节,每个环节产出什么、按什么验收,Seedance 2.0 与 2.5 两版提示词规范怎么分开写,以及自己用工具做、调接口、用 AI 视频产线、外包几种做法怎么选。
ai动漫短剧教程的核心是一条从剧本到成片的流水线:分场剧本→锁画风→出设定图→切段→画分镜→写提示词→出片审片→合成配音加标识,共 8 个环节,每个环节先验收再往下交。做法有四条:在即梦里自己写提示词逐镜生成;在 LibTV 上自己连节点搭流程;有研发团队的直接调 Seedance 接口;或用猫斯卡(AI 视频生产系统)这类产线按环节出中间产物,人在关键节点确认、审片。
AI 动漫短剧是用 2D 或 3D 动画画风、由视频模型按剧本逐段生成画面的微短剧。按《微短剧发展管理办法》(国家广播电视总局令第16号)第二条,微短剧是指单集时长少于二十分钟,主题主线明确、故事情节连续完整、人物角色突出的剧集。
下文模型规范以火山方舟公开的 Seedance 提示词指南与规范原文为准,标「实操上」的是经验做法。
ai动漫短剧怎么做出来的?8 个环节的产出与验收
实操上的交接单,每一格验收过了才往下交:
| 环节 | 这一步产出 | 验收看什么 |
|---|---|---|
| 1 分场剧本 | 按场写的剧本,每场有地点、出场人物、一个主要事件 | 同一角色全剧只用一个称呼 |
| 2 锁画风 | 一段固定的风格描述 + 几张风格样图 | 人物样图和场景样图是同一种画法 |
| 3 设定图 | 人物图、场景空镜图、道具图 | 一张人物图只有一个角色;场景图里没有人 |
| 4 切段 | 段落清单,每段一个主要事件 | 同框人数;文戏、武戏分开 |
| 5 分镜 | 每场一张宫格分镜 + 镜头清单 | 读取顺序写清 |
| 6 提示词 | 每段一份提示词 | 每张参考图的用途写清;没把整场剧本贴进去 |
| 7 出片审片 | 每段若干版本,选定一版 | 按审片清单逐项过 |
| 8 合成与发布 | 一集成片 | 拼接处不跳、标识到位 |
环节 1 剧本:ai动漫短剧怎么制作剧本才能直接开拍?
火山方舟《Doubao Seedance 2.0 系列提示词指南》写明:请勿直接将完整剧本作为提示词使用,文案内容过度冗余易造成模型理解混乱。所以剧本要写成「能被拆」的,实操上按三条验收:
- 称呼统一:指南要求已定义主体后,每次提到主体时都应使用同一标签。「林夏」「班长」混着叫,就对不上设定图。
- 每场一个主要事件:Seedance 2.5 规范(sd25-pe)要求一次生成内的长视频优先使用「阶段」,每阶段只安排一个主要状态变化并写清结束状态。
- 位置写实物:同一规范要求围绕门、桌子、车辆、柜台等稳定物体描述内外、前后、朝向、距离,不要只写屏幕左侧或右侧。
环节 2~3 锁画风、出设定图:先定画法,再定人物、场景和道具
Seedance 2.0 指南写到:参考图偏写实、提示词未强调风格时,期望的 2D/3D 动漫风格有概率漂移成真人写实,建议将参考图先变为目标风格再生视频;Seedance 2.0 提示词优化规范(sd2-pe)也把动漫 / 非写实场景的视觉风格升为必填,必须显式锚定。
- 写一段固定风格描述(如「2D 日系动画,赛璐璐上色,非写实」),每张设定图、每段提示词原样带上。
- 人物图:按 Seedance 2.0 指南,人物参考使用大头照 + 全身照即可,不建议使用人物多视图,多视图易被识别为多个不同主体。Seedance 2.5 不同:sd25-pe 允许同一主体的多视角参考,但要逐图写职责、声明共同定义同一个实体,并明确成片中的实体数量。
- 场景图:画空镜。sd25-pe 的示例写法是场景参考「只采用空间布局、建筑和光线,不采用图中人物」。
- 道具图:只给剧情里要被看到的东西出图。2.0 指南推荐素材配置总计 4~5 个,不建议用满素材上限。
环节 4 切段:一集剧本怎么切成能出片的段?
- 时长上限:Seed 官网 Seedance 2.5 页写明单段视频时长提升至 30 秒,并支持两次视频延长。
- 同框人数:Seedance 2.0 指南写到,参考人物数量超过 4 人时,模型输出稳定性下降,可能出现少人、多人或人物重复。群戏实操上拆小。
- 文戏和武戏分开切:同一指南建议单一场景的文戏用视频延长做连贯长镜头,追逐、打斗、蒙太奇等武戏独立生成片段再剪辑组合。
验收:每段写一行「开始画面 → 结束画面」,写不出结束画面的,重切。
环节 5 分镜:宫格分镜图怎么用来控镜头?
sd25-pe 的说法:宫格分镜用于定义整体故事、镜头顺序和大致构图;优先使用 15 格以内、画面干净且文字标注较少的故事板;必须说明读取顺序、采用的镜头结构,以及不采用的线稿画风、标注或占位人物。
动漫题材尤其要写上「不采用线稿画风」。即梦首页技能里有「创作分镜」,LibTV 有「多机位九宫格」和分镜图组,自己画也行。
环节 6 提示词:动漫镜头提示词按哪一版规范写?
Seedance 2.5(sd25-pe):带参考素材的模板是【生成目标】【参考素材职责】【事件脚本】【保持一致】;画幅、总时长、分辨率、帧率和声音开关不写进 Prompt,由页面或接口设置。示意片段:
【生成目标】动漫短剧一场:林夏在教室门口拦住转学生。 【参考素材职责】 <林夏>对应@图片1,只采用五官、发型和服装。 <转学生>对应@图片2,只采用五官、发型和服装。 <教室走廊>参考@图片3,只采用空间布局、建筑和光线,不采用图中人物。 【事件脚本】 阶段1:转学生从走廊尽头走近,停在门框外一步远。结束状态:两人隔着门框对视。 阶段2:林夏抬手扶住门框挡住去路,说{你昨天去哪了}。结束状态:转学生低头看她的手。 阶段3:转学生侧身从她手臂下钻进教室。结束状态:林夏回头望向教室里。 【保持一致】两人发型、服装与参考图一致;画面保持 2D 日系动画、赛璐璐上色。Seedance 2.0(sd2-pe):顺序使用镜头1、镜头2,禁止写绝对秒数;单镜头只指定 1 种运镜方式;最终输出要挂画质包、稳定包、水印 / Logo 兜底,多人场景必挂双胞胎兜底。
两版差在三处:兜底约束(2.0 默认挂;2.5 不得自动添加用户未要求的画质包、稳定包、水印等约束)、时间组织(2.0 用镜头序号,2.5 长视频优先用阶段)、多视图参考(2.0 不建议、2.5 可以但要声明同一实体)。混着用是常见返工原因。
环节 7 出片与审片:抽卡怎么记、哪些问题直接重拍?
真实成本 = 单价 × 抽卡次数 × 片长,看单价先看清模型档位、分辨率、样片还是正片。即梦官网提供样片模式,先生成样片、选中满意版本再直出高分辨率版本。
实操上每段记下生成几次、没选中的原因,回查是哪个环节没验收好。审片清单(出自 Seedance 2.0 指南):
| 看到的问题 | 对策 |
|---|---|
| 同一画面出现两个一样的人 | 提示词末尾加双胞胎固定约束,人物参考图优先单人独立照片 |
| 未要求却出字幕 | 加「保持无字幕」;业务允许时优先横屏再裁成竖屏,横屏出字幕的概率明显低于竖屏 |
| 动漫变写实 | 加明确风格约束词,或先把参考图变为目标风格 |
| 人数不对 | 参考人物超过 4 人时分组生成图片再生视频 |
指南也说明字幕与双胞胎问题目前无法 100% 避免,审片不能省。
环节 8 合成、配音与标识:成片发出去前还差什么?
- 拼接:延长接起来的段,拼接处跳变的修法是前一段末尾删减 6 帧、后一段开头删减 1 帧,建议续写时以转场切镜的时刻结尾(Seedance 2.0 指南)。
- 标识:《人工智能生成合成内容标识办法》第十条,用户使用网络信息内容传播服务发布生成合成内容的,应当主动声明并使用服务提供者提供的标识功能进行标识;《微短剧发展管理办法》第三十四条,使用人工智能技术生成、制作的微短剧,制作机构和播出单位应当遵守国家有关规定,并依据有关规定在每集明显位置添加提示标识。具体做法以发布平台的提示为准。
- 声音:Seedance 2.0 指南「常见问题」给了两条:中文发音不准时,替换为发音一致的常用同音字;视频结尾有噪音时,片尾音频淡出。
ai制作动漫短剧用什么软件?四条路和外包对比
| 做法 | 要不要写提示词 | 要不要学连线 | 抽卡 | 出来的是 | 出片靠什么 | 适合谁 |
|---|---|---|---|---|---|---|
| Seedance(直接调接口) | 要 | 不用连线,但要写代码接入 | 逐镜生成,通常要反复试 | 单段片段 | 研发团队与提示词水平 | 有研发团队的公司 |
| 即梦 | 要 | 不用 | 通常要反复抽,官网提供样片模式降低抽卡成本 | 单段片段,分集连贯要自己管 | 操作人员的提示词与剪辑水平 | 做少量镜头、会写提示词的人 |
| LibTV | 要 | 要,自己连节点、搭工作流 | 通常要反复试 | 取决于你搭的流程 | 操作人员搭流程的水平 | 想逐环节精细控制的团队 |
| 猫斯卡 | 不用(懂行的可以自己编辑提示词) | 不用 | 实测 874 场,平均每场 1.46 次 | 剧本、设定图、分镜到每场成片 | 18 位数字专家流水线 | 要做多集、成体系出片的编剧、工作室和企业 |
| 外包制作团队 | 不用 | 不用 | 不涉及 | 成片 | 团队水平与预算 | 预算充足、不想自己管过程的项目 |
- 即梦或 LibTV:8 个环节都自己做、自己验收。即梦调用的是 Seedance;LibTV 的新手引导是「拖拽一个或多个节点 + 进行连接」,流程要自己搭。
- 直接调 Seedance 接口:把这些环节写成自己的程序,适合有研发、要批量的公司。
- 猫斯卡这类 AI 视频产线:猫斯卡:18 位数字专家分工,从一句话想法到剧本、设定图、分镜、成片,不用写提示词、不用学习。对应上面的环节:剧本按约 10 秒一段切成场块去拍;选 2D / 3D 动画画风就是漫剧,选定后设定图与视频提示词走同一风格;每场自动按「场景图 → 本场道具图 → 人物定妆图」顺序挂参考图;出片调用 Seedance 或 MiniMax H3 Max。实测 874 场视频,平均每场生成 1.46 次,约四分之三第一次生成就用上。边界:没有成片自动打分,质量终审仍在创作者手里;角色一致性依赖定妆资产链路,不是人脸比对校验。
常见问题
动漫短剧里的打斗戏老是崩,是模型不行还是写法不对?
多半是写法。Seedance 2.0 指南建议追逐、打斗这类武戏独立生成片段再剪辑组合;sd2-pe 要求优先低缓连续小动作,规避狂奔、大跳、剧烈翻滚等高爆发动态。实操上一段只写一个动作回合。
同一个角色有两套造型,比如闪回里的少年版,设定图怎么出?
实操上每套造型单独出一张人物图,当作两个主体、各起一个固定标签(如「林夏」「少年林夏」),每段只挂当场那一套。sd25-pe 规定单人设定图不得同时定义两个会同时出场的命名人物,一行只定义一个主体及其主参考素材。