Pixelle-Video AI 全自动短视频引擎:5 分钟从零跑通你的第一条 AI 视频

Pixelle-Video AI 全自动短视频引擎:5 分钟从零跑通你的第一条 AI 视频 Pixelle-Video AI 全自动短视频引擎5 分钟从零跑通你的第一条 AI 视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video先说结论这是什么值不值得试Pixelle-Video 是一个开源的 AI 短视频引擎你只输入一个主题它就把文案、AI 配图、语音解说、背景音乐、视频合成全包了全程不用碰剪辑软件。它解决的核心痛点是「内容很多、时间很少」的人做视频的三座大山不会写、不会剪、没时间剪。适合零基础新手和想批量出号的运营者。按最省的云端方案算一条 1 分钟视频的 API 成本约 1~5 分钱而你手动做一条要 5 个小时左右。接下来我会带你 5 分钟跑通第一条视频再讲怎么避坑。跑通它只需做这几件事零基础生成 AI 视频 5 步走完拿到能跑的东西。Windows 用户下载官方一键整合包并解压Python、ffmpeg 等依赖都内置了其他系统从源码运行也一样克隆项目后执行uv run streamlit run web/app.py。启动 Web 界面。双击start_web.bat或等上面的命令跑起来浏览器会自动打开 http://localhost:8501。配一次 LLM。展开「⚙️ 系统配置」在下拉里选通义千问等预设填入 API Key点保存。选预设时 base_url 和模型名会自动带出来不用手写。输入主题。在左侧输入框敲一句你想讲的内容比如「为什么要养成阅读习惯」右侧模板、音色保持默认就行。点「 生成视频」然后验证结果。你会看到进度条依次走过「生成文案 → 生成配图 → 合成语音 → 合成视频」一个 5 分镜的视频约 2~5 分钟出炉。成片自动存在output/目录界面里可直接播放带 1080x1920 竖屏参数。它替你干的四件事从写稿到批量出片写稿输主题出分镜脚本一个字都不用你敲它做的事把主题拆成带画面感的分镜脚本每句话对应一帧再配上解说词。你不用做的事打开文档憋文案也不用担心结构松散。怎么调支持通义千问、GPT、DeepSeek、本地 Ollama 等预设换个模型文案风格就变已有现成稿子时切到「固定文案内容」模式直接粘贴按段落、行或句子自动切分。配图每个分镜自动挂一张 AI 插图它做的事每个分镜生成一张 AI 插图再套进 HTML 模板合成画面风格由你选。你不用做的事找图、抠图、调色。怎么调templates/里按竖屏、横屏、方形分了 30 多套模板界面里可以逐个预览在「提示词前缀」里填一句英文风格描述比如黑白简笔画风全片画风就锁死了。配音解说和 BGM 一起就位它做的事把解说词合成人声再垫上背景音乐音量自动混好。你不用做的事自己录干声、剪杂音、调音量。怎么调内置 Edge-TTS 免费音色开箱即用也支持 Index-TTS 声音克隆——上传一段自己的录音就能克隆音色把 MP3 丢进bgm/文件夹界面里直接选作背景乐。成片与批量一晚上排队产出 20 条不是梦它做的事按模板把画面、语音、BGM 按时间轴合成完整视频文件直接可发。你不用做的事导入剪辑软件、对齐音画、导出参数。怎么调历史记录页支持批量创建任务把一批主题一次性提交按队列慢慢出片图像、视频、TTS 还能在 ComfyUI 工作流、RunningHub 云端、直连 API 三种通道间随便切。跟你对比一下免费短视频工具差出多少时间环节手动做用它做写脚本憋 1 小时输主题1 分钟内出分镜文案找素材翻 2 小时图库每个分镜自动配 AI 插图配音录 30 分钟 修 1 小时自动合成可选克隆自己的声音剪辑合成剪 2 小时5~10 分钟自动出片一条总耗时约 5 小时约 5~10 分钟API 成本 1~5 分一条视频省 4 个多小时一周更新 3 条就是 12 小时以上。这些时间拿去陪娃、刷手机、甚至早点睡都比坐在剪辑软件前强。配置避坑三个最容易卡住的地方填了 API Key 但 LLM 一直报错→ 多半是config.example.yaml复制成config.yaml后只填了 api_key忘了 base_url → 直接在「⚙️ 系统配置」里选预设让 base_url 和模型名自动带出来别手填。卡在「生成配图」这一步不动→ 选的工作流和密钥不匹配带runninghub/前缀的要 RunningHub API Key带selfhost/前缀的要本地跑着 ComfyUI → 在配置页点「测试连接」确认通了再生成混着用必卡死。我第一晚就是在这上面耗了半小时。TTS 工作流选了但没声→ 克隆音色只部分工作流支持如 Index-TTSEdge-TTS 不需要参考音频 → 用哪个工作流就看它要什么不确定的先在「预览语音」里试一段再正式生成。进阶玩法开源视频自动化的三条延伸路线声音克隆上传一段参考音频视频开口就是你的声音做个人 IP 号时用得上。图生视频与动作迁移静态照片变动态镜头、老照片「开口说话」拍产品图和历史素材时用得上。批量排队生产历史记录页一次提交多个主题配合队列限制过夜跑运营号定时更新时用得上。想深入就翻这几个入口教程在 docs/zh/模板在 templates/云端工作流在 workflows/runninghub/音色清单在 pixelle_video/tts_voices.py。现在就去跑一条git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video进目录运行uv run streamlit run web/app.py输一个你早想讲的主题——5 分钟后那条 1~5 分钱的成片就在output/里等你了。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考