今天给大家演示一个自动化短视频合成 Coze 工作流。该流程通过大模型生成文案与标题,再结合语音合成、音频分析和视频剪辑插件,自动完成从文字到成品短视频的全过程。它能够高效整合字幕、配音、背景音乐以及随机视频片段,最终生成一份可直接用于发布的剪映草稿,极大地提升了创作者的生产效率。文章目录工作流介绍核心模型Node节点工作流程大模型应用文案与标题生成节点使用方法应用场景开发与应用工作流介绍这个工作流整体逻辑清晰:大模型负责生成标题和文案,语音合成节点将文字转化为配音,音频分析节点计算时长并驱动视频片段的切分,多个代码节点完成字幕、视频和音频的重组,最后通过剪映插件节点批量添加视频、字幕和音频,合成完整的短视频草稿。整体形成了一条从输入文本到视频成品的闭环生产线。核心模型在本流程中,大语言模型负责生成视频文案和标题,它的推理能力保证了输出的内容连贯、自然,并支持长上下文的深度思考。结合语音合成模型,可以将文案转为拟人化的声音,从而实现图文到音视频的跨模态转换。模型名称说明豆包·1.5·Pro·深度思考·128K用于生成视频标题与文案,具备长文本处理与高质量输出能力speech_synthesis(语音合成)将生成的文本转换为音频配音,支持多音色与语速调整Node节点工作流由大模型节点、插件节点以及代码节点组成,各节点在处理链路中各司其职:大模型负责文本生成,代码节