
Pixelle-Video 使用指南从一句主题到完整短视频的完整流程【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一款 AI 全自动短视频生成工具输入一个主题它自动生成视频文案、AI 配图、语音合成并完成视频合成直接产出可发布的成片。适合想批量产出短视频的内容创作者、教育工作者以及没有剪辑经验的新手。第一次跑起来启动与首次配置拿到代码后有三件事启动、配置、输入第一个主题。Windows下载官方整合包内置 Python 环境与 FFmpeg解压后双击start.bat浏览器会自动打开 Web 界面。Linux / macOSgit clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv sync ./start_web.sh界面地址是http://localhost:8501。首次进入时展开「系统配置」面板LLM 部分选一个模型预设并填入 API Key图像部分填本地 ComfyUI 地址或 RunningHub 云密钥点「保存配置」即可开始生成。输入一个主题之后文案、画面、配音到合成把「如何提升工作效率」填入内容输入区选择「AI 生成内容」模式剩下的流程是固定的四步文案LLM 围绕主题生成完整脚本并拆成 5 个分镜分镜数可调整每段文字对应一个画面。画面按分镜逐张生成配图画面风格由所选工作流和提示词决定。配音TTS 把每段文案合成为语音默认使用免费的 Edge TTS。合成画面、语音按所选模板拼成完整视频输出到output/文件夹页面右侧可直接预览播放。一个 5 分镜的视频大约需要 2–5 分钟取决于模型响应速度、图像生成速度和网络状况页面会实时显示当前进行到哪一步。影响成片效果的四个设置配置里真正决定成片质量的只有四处其余都是默认值就能跑。LLM 配置决定文案质量选通义千问、GPT 或本地 Ollama 模型文案的完整度和口语化程度随之确定。视觉工作流决定画面质量runninghub/目录下的工作流走云端不需要显卡selfhost/目录下的工作流走本地 ComfyUI。工作流基于 FLUX、SDXL、Qwen 等图像模型视频生成可选 WAN 2.1 / WAN 2.2 动态背景。配置文件是 config.yaml改前可对照官方示例。模板决定版式与比例模板全部是 templates/ 目录下的 HTML 文件按分辨率分三类——1080×1920 竖屏适合抖音、快手、Reels1920×1080 横屏适合 B 站、YouTube1080×1080 方形适合 Instagram。改模板里 HTML 的 CSS 就能换字体、配色和布局。语音与音色决定听感Edge TTS 免费且多语言Index TTS 支持上传参考音频做声音克隆。生成前可以试听音色所有可选音色都在 tts_voices.py 里能看到。成本怎么算本地 Ollama 本地 ComfyUI 是零成本路线通义千问 本地画面是低成本路线LLM 和画面全走云端则费用最高但完全不需要本地显卡。常见问题快速自查生成失败或卡住→ 多为网络不通或密钥填错。检查能访问 AI 服务 API再核对config.yaml里的 API Key 与服务器地址最后看运行日志定位具体报错。语音听感不自然→ 换一个音色或把语速调到 0.8–1.2 区间想要更贴合的内容可以上传参考音频走声音克隆。批量产出时→ 先单跑一个主题确认模板和配置无误再启用批量模式每行填一个主题保持模板一致系列片的风格才统一。图片质量不满意→ 换更高规格的工作流并在提示词里加质量描述词例如 4k, high detail, professional photography。开始使用Pixelle-Video 把写脚本、找素材、剪辑、配音这几件事压缩成了填主题、等成片两步。从下面这行命令开始配置好密钥输入第一个主题即可git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv sync ./start_web.sh【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考