AI漫剧制作教程:用豆包Skill从脚本到成片全流程 📅 发布时间:2026/9/7 9:32:03 👁 浏览次数: 最近做短视频内容的朋友群里越来越多人在聊“AI漫剧”一条几分钟的剧情动画脚本、分镜、画面、配音、剪辑全用AI完成成本可以压得很低更新速度却快得惊人。我自己试着跑了一轮流程后发现工具链的核心完全可以用豆包AI来承担尤其是配合近期讨论度很高的“豆包Skill”机制可以把一套漫剧生产流程固化下来让新手也能按步骤出片。这篇教程就从完整实操角度拆解从脚本到成片的全流程重点会放在豆包Skill运用、新海诚风格的画面提示词写法、角色一致性和剪辑避坑这几个环节。1. 为什么推荐用豆包做AI漫剧1.1 AI漫剧到底是什么AI漫剧并不是一个新物种简单说就是用AI工具辅助生产“漫画动态剧”“短剧漫画”“动态漫”等内容。它和传统动画的区别在于传统动画需要原画师逐帧绘制AI漫剧则主要靠文本生成分镜、图像生成画面、语音合成配台词再把静态画面通过剪辑和少量动态效果串成一条视频。目前常见的AI漫剧形式有三种形式画面风格制作难度更新速度静态漫剧漫画分镜字幕配音较低最快动态漫剧静态画面加轻微运镜、人物口型、粒子效果中等较快AI动画短剧连续图生视频接近动画效果较高较慢对零基础或者刚开始尝试的人来说建议从第一种和第二种入手。本文的实操流程也以这两种为落点既能快速出片又能在后续过渡到更复杂的图生视频流程。1.2 豆包AI在漫剧生产中的定位豆包AI本身是综合型AI助手覆盖文本生成、图像理解、对话、翻译等能力。做漫剧时它最大的价值不是某一个单点功能而是能把“创意发散—脚本撰写—分镜拆解—提示词生成—内容审校”这条创作链全部承接住。换句话说传统流程里你需要来回切换好几个AI工具在豆包里可以集中完成前期创作。再加上豆包App支持语音输入和语音合成导演口述想法、生成台词、配音试听这些动作都能在一个工具里闭环。这并不意味着所有步骤都必须在豆包一个产品里完成。漫剧生产一定会涉及专业剪辑、画面精修、批量素材管理但作为核心创作引擎豆包承担的是最重脑力劳动这也是题目所说的“一个豆包搞定”的真正含义。1.3 本文的实操路线本文不是只讲概念而是按照真实生产顺序推进先把豆包Skill和提示词环境准备好。用豆包写故事脚本。用豆包把脚本拆成分镜表格。用豆包生成每个镜头的画面提示词重点调出新海诚风格。用豆包或配套工具生成画面、配音。进入剪辑合成输出完整漫剧。最后补充常见报错排查和接单前的合规建议。这条路线可以完整照做也可以只摘取其中某一部分用于自己的项目。2. 开工前需要准备什么2.1 账号与基础工具豆包AI目前最常见的入口是网页版和手机App使用前先准备好以下基础条件豆包AI账号手机号注册即可。电脑端优先推荐使用网页版或PC客户端因为写长提示词、复制分镜表格时电脑效率更高。剪辑软件剪映、必剪、PR均可新手优先推荐剪映原因后续会解释。配音工具优先使用豆包自带的语音合成能力或者剪映的“文本朗读”功能。素材管理文件夹按“01_脚本”“02_分镜”“03_画面”“04_配音”“05_成片”建好目录避免后期素材混乱。这里不写死具体版本因为豆包客户端迭代很快。你在搜索栏看更新日志即可。多数情况下保持默认版本就能完成本文流程。2.2 理解豆包Skill是什么豆包近期引入了Skill的概念很多用户第一次看到时容易和“智能体”混淆。为了方便理解可以把Skill理解成“内置到对话流程里的专用工作流插件”。默认情况下豆包是一个通用AI你问什么它答什么。但漫剧创作这种任务往往需要多个步骤比如先生成脚本、再拆分镜、再写画面描述、再检查风格参数。这时如果每一轮都手动输入一堆重复指令效率很低。Skill的作用就是把“我接下要做漫剧请按固定流程处理”这套规则预先定义好豆包会按照你写好的流程自动执行。举一个通俗例子你请一个助理帮忙做菜普通对话模式是你一步一步告诉他“洗菜、切菜、热锅、倒油”。Skill模式则是你给他一份完整菜谱他会自己按顺序执行还在每个环节主动汇报结果。当前豆包对Skill的开放形态可能随版本调整有的入口叫“智能体”有的已经开放“Skill”管理有的可能放在实验室模块内。所以下面会提供两条路如果你界面里已经有Skill入口可以直接创建如果暂时没看到也提供手动把提示词粘贴进对话的兜底办法。2.3 Skill和Agent的区别这轮热词里很多人同时搜“skill”“agent”“skill和agent的区别”。简单区分一下维度SkillAgent本质带固定步骤和输出格式的能力包能自主决策、多轮调用工具的执行体交互方式你调用它它按流程处理当前任务你给它目标它自己规划并推进功能边界相对固定相对开放适合场景重复性创作流程比如漫剧分镜需要多工具联动、自动决策的复杂任务做漫剧时两者可以结合起来用Skill固定“分镜生成模板”再用Agent在多轮对话里自动处理角色设定、风格校准、批量提示词生成。但对零基础用户建议先从Skill入手因为它输出更可控不容易跑偏。3. 用豆包Skill搭建漫剧工作流3.1 怎么创建一个漫剧Skill如果你使用的豆包版本已经开放Skill创建入口通常流程是这样的进入Skill管理页面。点击“新建Skill”或“创建技能”。输入Skill名称比如“AI漫剧分镜大师”。在描述里写明用途方便后续检索。把核心提示词粘贴进对应的提示词编辑区。保存后在对话框选择对应Skill再开始对话。如果没有Skill入口就把同样的提示词直接粘贴到豆包对话框顶部形成“长期对话设定”效果类似。创建Skill时要注意一点提示词不要只写“你是一个漫剧导演”这种假大空的设定要写清楚输出格式、字段含义、步骤顺序、禁止事项。3.2 一个可复用的漫剧Skill提示词下面给出一份可以直接复制使用的漫剧Skill提示词。它的设计目标是当你输入一段剧情概要后豆包能自动输出“故事梗概人物设定分镜表格画面提示词建议”。你是一位资深AI漫剧导演和分镜师。你的工作内容如下 一、接到剧情概要后按下面的步骤处理 第一步提炼故事梗概。不超过150字说明主角、目标、冲突、结局。 第二步设计主要人物。每个角色输出 - 角色名 - 性别/年龄段 - 性格关键词 - 外貌特征 - 典型服装 - 声音风格建议 第三步生成完整分镜表格。表格必须包含这些列 - 镜头序号 - 画面内容 - 景别远景/全景/中景/近景/特写 - 运镜描述 - 台词 - 音效/音乐建议 - 画面提示词英文为佳 二、画面提示词的固定结构 [主体角色描述][动作/表情][环境场景][构图/景别][光影氛围][画风关键词][质量词] 三、画风约束 当用户提到“新海诚风格”时在画面提示词中加入以下关键词 Makoto Shinkai style, anime background art, detailed sky, volumetric light, cinematic composition, vivid color grading, bokeh, clean linework, high detail 同时加入中文说明画面强调大景深、天空云层层次、光影氛围、通透感。 四、禁止事项 - 不要输出与分镜无关的解说。 - 不要使用水印词、logo词、真实品牌词。 - 分镜数量默认8到12个用户要求时再增减。使用方式很简单把这段提示词粘贴进Skill或直接粘贴到新对话中。然后在对话里输入你的剧本创意豆包就会按照固定结构输出。3.3 新海诚风格画面关键词库新海诚风格是AI漫剧里很受欢迎的一种画风特点是光影细腻、云层表现夸张、画面通透感强、色彩明亮中带层次。为了让豆包生成稳定的新海诚风格提示词除了上面Skill里的默认词你还可以准备一份关键词库在需要时手动补充。常用英文关键词参考Makoto Shinkai style anime background glowing clouds dramatic sky sunset afterglow soft bokeh lens flare high-saturation color detailed weather scene beautiful composition cinematic lighting clean line art high detail anime illustration常用中文关键词参考新海诚风格、动画背景、云层层次丰富、光影通透、色彩浓郁、电影感构图、景深虚化、逆光、空气感、细腻笔触、高细节动画插画这些词不建议一次性全部堆进去而是根据画面内容选择5到8个组合。比如表现天空时强调“glowing clouds”“dramatic sky”表现室内时强调“soft bokeh”“lens flare”“cinematic lighting”。4. 实战第一步从剧情脚本到分镜4.1 用豆包生成故事脚本假设我们要做一个2分钟左右、偏治愈系的新海诚风格漫剧。直接在对话里输入需求比如请帮我写一个2分钟左右的AI漫剧故事主题是“夏日重逢”治愈系新海诚画风。主角是一个离开小镇多年的男生回到故乡寻找儿时玩伴。不要对话太多重点在画面情绪。豆包返回的内容会包含分集或短片梗概。如果你觉得故事太平淡可以继续追问故事要有转折高潮部分加入一场夏日暴雨后的彩虹场景让观众情绪被推到高点。这里有一个重要经验AI生成的故事容易套路化例如开头“清晨阳光洒下”、结尾“两人相视一笑”。作为创作者你必须建立标准主动干预。要敢于给AI限定“不要出现什么”比只告诉它“要什么”更容易出彩。4.2 把脚本拆成交互式分镜获得故事梗概后不需要手动拆分镜头直接在对话里调用Skill或者粘贴以下指令请把上面这个“夏日重逢”故事拆成12个镜头分镜按你预设的表格格式输出。每个镜头保持80-120字的画面提示词台词要口语化能配合情绪。豆包会返回一份较完整的分镜表。这里建议你要求它导出成“Markdown表格”或“CSV格式”方便粘贴到Excel进行二次整理。例如把分镜表格用Markdown格式输出我后续复制到表格软件里整理。4.3 分镜表整理标准拿到豆包输出的分镜后不要直接拿去生成图片你需要先做一遍“人类导演”的校验。重点检查以下内容逻辑是否连贯镜头切换是否跳戏。情绪是否递进高潮有没有给足持续时间。角色是否稳定每个镜头里的服装、发型、外貌描述是否一致。台词是否适合配音太长的台词要拆分或删减。如果出现角色设定前后矛盾直接在对话里要求豆包修正第5镜和第8镜的女主角服装描述不一致请统一为“浅蓝色连衣裙白色帆布鞋短发”。调整完成后把分镜表复制到Excel或飞书表格中作为后续制片的唯一依据。5. 实战第二步画面生成与角色一致性5.1 为什么同一角色在不同镜里会变样用AI生成漫剧画面时最容易出现的困扰是“同一个角色上一张图一个样子下一张图又变了”。这是因为AI文生图模型不具备默认的“角色身份记忆”能力它每次生成都是独立的。解决思路有几种锁定角色描述词每个镜头的画面提示词里人物外貌和服装必须保持一致。先生成角色三视图在正式画分镜前先生成角色设定图再把设定图作为参考图。依赖豆包的多模态理解能力上传一张角色参考图让豆包基于这张图生成后续画面描述。如果你的工具支持“图生图”或“垫图”方法2会更稳定。5.2 每个镜头画面提示词的写法模板在豆包里填写画面提示词时样式如下一个穿浅蓝色连衣裙的短发女生站在夏日的车站前风吹起裙角她抬头看天空表情带着期待和紧张。场景是小镇旧车站站台边有绿色邮筒远处有山和积雨云。中景轻微仰拍画面通透阳光从云层间隙洒下。 Keyword: Makoto Shinkai style, anime background, dramatic sky, glowing clouds, lens flare, cinematic lighting, high detail如果豆包能直接生成画面就把这段文字交给豆包文生图功能。如果豆包只负责文本你需要先复制这段提示词到专门的AI绘图工具里使用同样也能出效果。5.3 批量生成的效率技巧AI漫剧镜头多如果一帧一帧手动描述会非常累。你可以让豆包一次性输出所有镜头的提示词形成“提示词批量包”。在对话里输入把上面的12个分镜全部扩展为完整画面提示词不要遗漏按“镜头01、镜头02”的编号输出每个提示词独立成段。人物外观描述必须完全一致只允许环境、景别和情绪变化。得到批量提示词后可以复制到表格里逐行执行生成。有些工具支持批量导入你可以直接使用。如果工具不支持批量建议从情绪点最饱满的高潮镜头开始生成再补齐前后镜头这样即便有偏差后期调整成本也较低。6. 实战第三步配音、动态化和剪辑6.1 用豆包生成配音漫剧配音有两类做法一是真人配音适合需要强烈情绪表现力的作品二是AI语音合成适合快速出片和低成本项目。如果是零基础小白建议先用AI配音练手。在豆包对话里你可以这样要求请为以下台词生成配音脚本文案语气要符合漫剧情绪。我用语音合成工具朗读所以请把每句台词控制在20字以内并标注情绪关键词。 台词我回来了。这么多年我还是记得那个夏天。得到文案后再用豆包的语音功能朗读或者复制到剪映“文本朗读”中选择合适音色。注意不同语音合成工具的连读、停顿、重音处理不一样生成后一定要听三遍以上发现AI味太重就换成自然音色或手动加上断句。6.2 画面动态化思路如果只把静态图配上配音视觉张力会偏弱。想要让漫剧更像“剧”可以给画面加动态效果常见手段有三种轻微运镜在剪辑软件中用关键帧让静态图缓慢放大、平移模拟推镜头和摇镜头。环境动态给画面加雨丝、光线变化、云层流动等效果。剪映有氛围动画效果可套用。AI图生视频如果你使用的豆包版本或配套工具支持图生视频可选择部分高潮镜头生成动态片段注意力集中到关键场景不需要全部动态化。不建议一开始就把所有镜头都做成图生视频一是耗时二是容易破坏风格统一性。先用“静态图关键帧运镜”把全片串起来再用视频生成工具处理一两个高潮镜头效果会更好。6.3 漫画感剪辑时间线、转场与节奏剪辑时我最推荐新手用剪映原因是它内置大量适合剧情片的转场、字幕样式和音乐卡点功能不必额外找素材。导入素材后按照分镜表顺序排入时间线然后统一完成以下设置每张画面默认停留3到5秒配音长的镜头可延长。转场优先选“淡入淡出”“叠化”“轻微模糊”不要用PPT感强烈的花式转场。配音轨和字幕轨对齐字幕可以整段粘贴后在时间线上手动拆分。BGM音量控制在人声之下一般在20%到35%左右避免掩盖台词。全片节奏参考“开场平缓—中段推进—高潮爆发—结尾释然”的结构高潮部分可以加快剪辑频率。6.4 字幕、封面和导出设置漫剧的字幕一般分两类对话字幕和氛围字幕。对话字幕使用简体中文字体即可建议字号大一点放在画面下方三分之一处。氛围字幕用于表现角色内心独白或时间地点可以配合新海诚风格使用带一点日系感的字体但要注意版权。导出的参数建议如下具体可依据平台调整分辨率1920x1080 或 1080x1920 帧率30fps 格式MP4 码率较高保证画面清晰 音频48kHz立体声如果发布到B站、抖音横屏选1920x1080。如果发布到抖音、快手竖屏选1080x1920分镜构图也需要相应调整建议在前期生成画面时就明确用横屏还是竖屏避免后期裁坏构图。7. 常见问题与排查思路问题现象常见原因解决思路豆包输出的分镜太抽象没法直接生成画面提示词里没有景别和画面结构要求豆包按“主体动作环境景别光影画风”格式重写同一角色每张图都不一样人物描述没有锁定固定关键词建立角色卡统一外貌、服装、发型词新海诚风格不明显风格关键词数量不足或和画面内容冲突增加天空、光照、云层关键词减少复杂场景元素生成画面有文字乱码提示词里包含了品牌词或logo干扰删除品牌相关词补上“no text, no logo”配音AI味太重单句太短或标点不完整手动拆分长句补充逗号和省略号以控制停顿剪辑后画面和配音不同步没有按照分镜表逐帧对齐以配音轨为基准逐镜头对齐画面和字幕发布到竖屏平台画面被裁前期没确认横竖屏方向前期锁定画幅比例必要时对画面重新构图如果你在操作中遇到同类报错建议先排查提示词再排查工具设置因为多数问题都出在前期描述不够结构化。8. 给打算接单的新手的建议8.1 版权与合规红线标题提到“学完即可接单”这话有一定吸引力但作为创作者接单前必须先弄清楚版权边界你生成的AI漫剧如果商用要确认所用AI工具服务条款是否明确允许商用。配音音色如果用他人克隆音色必须获得本人授权无法确定来源就不要商用。音乐、音效优先使用素材库内已授权内容不要随便下载网络音乐。剧本原创性要留底尤其是客户定制单建议清晰约定创作与授权范围。若涉及真人形象、地标、品牌要向客户确认素材授权。合规不是阻碍而是保护自己。一次版权纠纷足以抵消好几单收入。8.2 接单前先做样片测试我的建议是在正式接单之前先独自完成1到2条10分钟以内的完整漫剧作品不一定要发布但要跑完全流程。通过样片你才能知道自己完整做一个漫剧需要多少小时。哪些环节最耗时。豆包Skill能不能扛住长时间连续创作。剪辑和配音的熟练度有没有达标。只有跑过完整流程报价才靠谱不会出现“单子接了但交不了货”的问题。8.3 持续优化的方向AI工具更新很快豆包Skill也在持续演进。想在这一行有长期竞争力不要只依赖“会按按钮”而是要逐渐建立以下能力提示词能力能根据画面反馈快速调整风格。脚本能力能判断故事节奏、情绪转折是否成立。审美能力能区分“AI一眼假”和“有电影感”的差别。项目管理能力能并行处理多个订单管理素材和时间节点。把豆包当成你的创作搭档而不是替代你思考的机器这样才能做出有辨识度的作品。工具的差距会越来越小真正拉开差距的是对故事、画面和情绪的理解。做漫剧这件事最大的门槛从来不是工具。只要你认真跑一遍流程把分镜模板、角色卡、风格关键词、剪辑节奏都整理成自己的素材库后续每一部作品都会比上一部快很多。这篇教程里的方法和提示词都可以直接拿去用也建议你边做边调整把它变成真正适合自己创作习惯的流程。