Pixelle-Video 本地部署完整指南:一句话生成短视频成片

Pixelle-Video 本地部署完整指南:一句话生成短视频成片 Pixelle-Video 本地部署完整指南一句话生成短视频成片【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video想发一条知识类短视频但你不想碰剪辑软件。Pixelle-Video 是一个开源 AI 短视频引擎输入一个主题它自动完成文案、AI 配图、语音合成与视频合成一句话出片。5 个分镜的视频约 2-5 分钟产出全本地跑通可以做到 0 元 API 费用。 项目速写它替你自动化了哪些事它解决一个很具体的问题写脚本、画图、配音、拼视频这四个环节都不用手做。你只负责提供主题或现成文案系统自动拆分分镜、为每个分镜生成配图、合成解说语音再把画面、语音和 BGM 合成成片。成片保存在output/目录支持竖屏 1080x1920、方形 1080x1080 和横屏 1920x1080 三种规格。它适合不会剪辑的内容创作者、有显卡想省钱的个人开发者以及想批量产出短视频的运营。环节它做什么你要做什么文案LLM 把主题写成解说词并拆分镜选模型、填主题图像/视频每个分镜生成一张图或一段视频选工作流和模板语音TTS 合成解说可克隆你的声音选音色可传参考音频成片自动合成 BGM 与画面点「生成视频」 最短上手路径拿到第一个成片目标只有一个尽快让一个成片出现在你的屏幕上。装环境。Windows 直接解压官方整合包双击start.bat浏览器自动打开http://localhost:8501macOS/Linux 先装好 uv 和 ffmpeg然后克隆并启动git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py填系统配置。展开「⚙️ 系统配置」选 LLM 预设如通义千问并填 API Key图像填本地 ComfyUI 地址默认127.0.0.1:8188或 RunningHub 密钥。没有本地显卡时也可以选直连 API 模型这条路。输主题点生成。左侧选「AI 生成内容」填一个主题比如「为什么要养成阅读习惯」TTS 和模板保持默认点「生成视频」。收片。页面自动播放成片文件在output/里5 个分镜通常等 2-5 分钟。 生产线拆解文案、图像、语音、成片各在做什么成片出来之后你会想知道每一步到底在干什么。文案。LLM 把你的主题写成解说词并拆成 3-5 个分镜也支持「固定文案」模式直接跳过创作。所有 OpenAI 兼容接口都能接方案特点适合谁通义千问中文表现好单条视频约 0.01-0.05 元日常量产、在意成本GPT-4o文案逻辑与创意上限高专业内容、追求文案质量DeepSeek开源接口价格便宜批量任务、预算有限Ollama本地运行0 元隐私敏感、不想走外网图像。每个分镜生成一张配图默认工作流是image_flux.json共三条路线本地 ComfyUI、RunningHub 云端、直连模型 API。workflows/selfhost/和workflows/runninghub/里分别有现成的 image_qwen、image_flux、image_sd3.5 等可选方案特点适合谁本地 ComfyUI按次 0 元模型自己管有显卡、成本敏感RunningHub按量付费无需本地显卡无 GPU、省事优先直连 APIDashScope、OpenAI、Seedream 等不想维护 ComfyUI语音。TTS 工作流从workflows/目录自动扫描默认 Edge-TTS 开箱即用Index-TTS 支持声音克隆上传一段 MP3/WAV 参考音频即可复刻你的音色。方案特点适合谁Edge-TTS免配置音色自然默认选择Index-TTS上传参考音频克隆自己的声音个人账号、固定人设Spark-TTS中文音色偏播音腔正式解说场景成片。模板决定最终观感按命名分三族static_*.html纯文字、不生成 AI 媒体、出片最快image_*.html用 AI 图做背景video_*.html用 AI 视频做背景动感最强但耗时和费用最高。尺寸按竖屏、方形、横屏分组BGM 支持无、内置音乐、或把音频文件放进bgm/目录自定义。方案特点适合谁static_*无 AI 媒体生成最快金句卡、公告类内容image_*AI 配图做背景常规短视频解说video_*AI 视频做背景追求动态感、预算充足 换 3 个场景实战科普、推广与克隆音色不同内容配不同组合下面是三个可以直接照抄的搭法。知识科普你的诉求快速出一条「如何养成阅读习惯」的竖屏科普。 推荐组合通义千问 image_qwen 工作流 Edge-TTS image_book.html1080x1920。 成片效果5 分镜竖屏科普视频2-5 分钟出片成本约 0.01-0.05 元。产品推广你的诉求给新品做一条横屏宣传片画面要干净现代。 推荐组合GPT-4o image_flux 工作流 横屏 1920x1080 的 film 或 full 模板。 成片效果风格统一的横屏宣传片段适合放在官网和社媒频道。个人口播你的诉求旅行日记要用自己的声音不想听起来像机器。 推荐组合固定文案模式 Index-TTS上传自己的参考音频 image_fashion_vintage.html。 成片效果成品像你在亲自讲述同一音色可复用到后续所有视频。️ 踩坑速查表卡住了先查这张表大多数卡点集中在三类连不上、效果不对、资源不够。现象可能原因处理办法ComfyUI 连接失败服务未启动、URL 写错、防火墙拦截确认服务在跑核对默认地址127.0.0.1:8188点「测试连接」Docker 里连不上本机 ComfyUI容器与宿主机网络隔离地址改为host.docker.internal:8188LLM 调用失败API Key 错误、余额不足、网络异常看报错信息核对 Key 与网络图像/视频生成中断工作流文件缺失、模型未下载、内存不足确认工作流与模型就位检查磁盘空间出片明显变慢分镜过多或云端排队分镜压到 3-5 个优先本地 ComfyUITTS 没有声音工作流选错或参考音频格式不对换回默认 tts 工作流确认音频是 MP3/WAV 进阶与资源跑通之后往哪走能出第一片之后剩下的是这些扩展能力和资料入口。数字人口播生成虚拟形象对着镜头播报的流水线。图生视频上传一张静态图走 i2v 工作流变成动态片段。动作迁移上传参考视频加图片做动作迁移。自定义素材上传自己的照片和视频AI 分析内容并生成脚本。历史页与批量任务回看历史产出一次提交多个生成任务。按你的硬件条件选路线你的条件推荐组合成本/速度没有本地显卡通义千问 RunningHub 或直连 API按量付费无本地依赖有显卡、能跑 ComfyUI本地 selfhost 工作流约 0.01-0.05 元/条想把成本压到最低Ollama 本地 ComfyUI0 元资料入口各给一个不用全看文档快速开始模板templates/工作流workflows/常见问题docs/zh/faq.mdPixelle-Video 把文案、图像、语音、合成四道工序压缩成一次配置加一个主题。如果你是新手先用通义千问加默认图像工作流出一条片再逐个换模板和音色试如果你已有 ComfyUI直接走本地工作流单条成本能压到几分钱如果你是开发者templates/和workflows/两个目录就是定制化的入口。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考