输入一个主题就拿到成片:Pixelle-Video 全自动短视频生成实践

输入一个主题就拿到成片:Pixelle-Video 全自动短视频生成实践 输入一个主题就拿到成片Pixelle-Video 全自动短视频生成实践【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一个 AI 全自动短视频引擎输入一个主题它自动完成文案撰写、AI 配图、TTS 语音合成、背景音乐和成片拼接不用打开剪辑软件就能拿到可发布的短视频。最快上手3 条命令打开本地 Web 界面视频拼接依赖 ffmpeg先装一下macOS 执行brew install ffmpegUbuntu 执行sudo apt install ffmpeg。然后git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开 http://localhost:8501是一个三栏界面左侧输入内容中间配置语音和视觉右侧是生成按钮和视频预览区。Windows 用户也可以直接下载官方整合包双击start.bat即可不需要装 Python 和 uv。首次使用要展开「⚙️ 系统配置」面板填一个 LLM 的 API Key通义千问、GPT、DeepSeek 等预设会自动填好 base_url再配置图像生成服务本地 ComfyUI 或 RunningHub 云端保存后才能开始生成。核心功能每条流水线都能单独替换从主题到成片文案、配图、语音一条链跑完它能做什么输入主题后LLM 自动写解说词并拆成 5 个分镜可改每个分镜配一张 AI 生成插图再经 TTS 合成语音最后拼成视频。适合不想写脚本、只想快速出内容的人。实现上是一条「文案生成 → 配图规划 → 逐帧处理 → 视频合成」的模块化流水线代码在pixelle_video/pipelines/每个环节都可以单独换。30 多种 HTML 模板三种尺寸各取所需它能做什么用模板决定画面版式。templates/目录按尺寸分三组1080x1920 竖屏、1920x1080 横屏、1080x1080 方形文件名分三类static_纯文字、不需要 AI 生图、image_AI 图做背景、video_AI 视频做背景。适合按投放平台选版式竖屏给短视频平台横屏给 B 站方形给社交分发。界面里点「预览模板」可以先看效果再选用会写 HTML 的人也能往templates/里加自己的模板。语音可试听可克隆从 Edge-TTS 到 Index-TTS它能做什么下拉选择 TTS 工作流系统自动扫描workflows/目录内置 Edge-TTS、Index-TTS 等再选音色——中文有晓晓、云希英文有 Aria、Jenny 等音色列表定义在pixelle_video/tts_voices.py。上传一段参考音频还能做声音克隆先试听再用。适合做固定人设的系列号或想用本人声音口播的人。ComfyUI、RunningHub、直连 API 三条路任选它能做什么图像生成、视频生成、素材分析这几项能力都是可插拔的。可以走本地 ComfyUI 工作流workflows/selfhost/可以走 RunningHub 云端工作流workflows/runninghub/也可以直连厂商 APIDashScope、OpenAI、Kling 等客户端代码在pixelle_video/services/api_services/在界面下拉框里切换即可。适合硬件条件和预算不同的人本地显卡走自部署是零成本云端则完全不用搭环境。扩展流水线数字人口播、图生视频、动作迁移它能做什么除了标准「主题到成片」界面还提供几条专用流水线web/pipelines/上传人物照片做数字人口播上传图片做图生视频上传参考视频做动作迁移上传自己的照片和视频让 AI 分析后生成脚本自定义素材。适合已经有素材、只缺「素材到成片」这一步的创作者。完整用例一个主题生成 5 分镜竖屏视频以官方文档里的默认示例主题走一遍完整流程输入内容左侧「内容输入」选「AI 生成内容」模式输入「为什么要养成阅读习惯」场景数保持默认 5 个分镜。系统配置LLM 预设里选一个模型并填 Key图像生成选工作流云端选 RunningHub本地选 ComfyUI。语音保持默认 Edge-TTS选一个中文女声点「预览语音」先试听不满意就换音色。视觉选竖屏 1080x1920 的 AI 配图模板如image_default图像尺寸默认 1024x1024。点「 生成视频」右侧实时显示进度——生成文案、逐分镜生成插图会显示「分镜 3/5 - 生成插图」这类提示、合成语音、合成视频。2~5 分钟后成片自动在右侧播放附带时长、文件大小、分镜数信息视频文件保存在output/文件夹界面上的「历史」页会记录过往生成任务。效果不满意时有四个明确的调优点换 LLM 改文案风格、改提示词前缀改配图风格、换 TTS 工作流或参考音频改语音、换模板改版式。新手最容易卡住的 4 个问题必须装 ComfyUI 吗不一定。选static_纯文本模板时只需要 LLM 和 TTS本地零生图环境也能出片想要 AI 配图又不想自建就选 RunningHub 云端工作流填个 API Key 即可。一次生成多少钱、多久3~5 个分镜的视频通常 2~5 分钟。费用上有明确梯度Ollama 本地 LLM 本地 ComfyUI 是 0 元通义千问 本地 ComfyUI 约 0.01~0.05 元/条全云端方案最贵但完全不用本地环境。报错了从哪查高频卡点只有两个LLM API 调用失败检查 Key 和网络和 ComfyUI 连不上在配置面板点「测试连接」。完整排查步骤在docs/zh/troubleshooting.md。配置文件放哪把根目录的config.example.yaml复制为config.yaml再填里面有 LLM 的 base_url 和 api_key、ComfyUI 地址、默认模板等文件含密钥仓库里明确提醒不要提交。这些配置也可以在 Web 界面里全部完成。它适合谁自媒体和个人创作者用「主题 模板 固定音色」批量产出口播类短视频把写稿和剪辑时间省下来。企业内容团队通过直连 API 和 FastAPI 服务api/目录接入内部系统做批量生产所有语言版本共用同一套视觉模板。本地 GPU 用户Ollama ComfyUI 全本地部署整条链路零成本适合先跑通流程再谈规模化。一句话总结Pixelle-Video 把「文案、生图、配音、配乐、剪辑」五步收进一个按钮你只负责选主题和风格。下一步打开docs/zh/getting-started/quick-start.md看完整配置流程用上面的示例主题生成你的第一条视频。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考