3分钟跑通AI全自动短视频生成器Pixelle-Video从启动到调参完整实测【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video跑通一次生成你会拿到一条带旁白、BGM 和排版的完整短视频文件落在项目根目录的output/文件夹里界面右侧直接播放同时显示时长、文件大小和分镜数。这就是 Pixelle-Video——输入一个主题AI 全自动写文案、配图、配音、合成产出可发布的 AI 短视频。首次启动macOS、Linux 和 Windows 的最快启动方法macOS / Linux 用户需要两样东西Python 包管理器uv用uv --version验证和ffmpegmacOS 用brew install ffmpegUbuntu/Debian 用sudo apt install ffmpeg。然后git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.pyuv run会自动装好 Python 依赖浏览器自动打开 http://localhost:8501 。Windows 用户更省事直接下官方整合包解压双击start.bat打包脚本在 packaging/windows/ 里不用装 Python 和 ffmpeg。打开浏览器第一眼看到的是三栏布局左侧内容输入、中间语音与视觉设置、右侧 生成视频按钮。第一次要用先展开「⚙️ 系统配置」面板LLM 下拉里选一个预设通义千问、GPT-4o、DeepSeek、Ollama 都在填 API Key点「保存配置」界面才能开始干活。能力盘点一个引擎能产出什么主题解说视频主流程 ⚡入口 web/pipelines/standard.py。给一句主题LLM 拆成分镜脚本分镜数默认 5 个滑杆范围 3–30也可以切「固定文案」模式贴现成稿子支持按段落/行/句子三种方式切分。每个分镜走「TTS 配音 → AI 配图 → HTML 模板排版 → ffmpeg 拼接」最后叠上 BGM。知识号日更、小说解说这类批量场景就是为它设计的。数字人口播入口 web/pipelines/digital_human.py。上传一张人像照片加一段讲稿配合 workflows/runninghub/digital_combination.json 工作流人物图会开口说话产出竖屏口播视频。培训机构做课程切片、企业内训最对口不用真人出镜也不用录棚。图生视频与动作迁移入口 web/pipelines/i2v.py 和 web/pipelines/action_transfer.py。前者上传静态图jpg/png/webp 均可交给 WAN 2.1/2.2 这类模型生成动态片段后者更特殊传一段参考视频 一张目标图参考视频里的动作会迁到图片主体上官方示例是跳舞小猫。手里有一堆旧图旧视频想盘活的时候这两条管道就是二次创作的起点。自定义素材成片入口 web/pipelines/asset_based.py。上传自己的照片或视频AI 先分析素材再反向写脚本等于以素材定文案和主流程以主题定素材正好互补。三个值得深看的设计模板即换皮器。入口在 templates/ 目录按1080x1920竖屏、1920x1080横屏、1080x1080方形三个尺寸文件夹组织文件名前缀即类型static_*.html纯文字不烧生图、image_*.html套 AI 配图、video_*.html套 AI 动态视频。界面里选模板时可以点「预览模板」先试效果会 HTML 的话自己往目录里扔一个新文件下拉菜单会自动识别——这基本是个现成的插件机制。同一段文案配image_film黑底电影感和image_wide_darktech深色科技卡出来就是两条完全不同的片子。音色克隆藏在 TTS 下拉里。中间栏的 TTS 工作流菜单会自动扫描 workflows/ 目录tts_前缀的 JSON 都会被收进来内置 Edge-TTS 免费零配置Index-TTS 支持克隆。选到支持克隆的工作流后上传一段参考音频MP3/WAV/FLAC 均可点「预览语音」试听满意了再正式生成旁白就会用你自己的声音。模型供应商可以整块替换。除了 ComfyUI / RunningHub 两条工作流链路配置样例 里的api_providers段支持直连 OpenAI、DashScope、字节 ARKSeedream/Seedance、可灵等API Key、Base URL 和代理开关都能在 ⚙️ 系统配置面板里填不用改代码。有显卡走本地没显卡走云端链路切换只动配置。调参4 个最常改的字段加 2 个隐藏的把 config.example.yaml 复制为config.yaml即可文件头专门警告了别把它提交进 Git。实测跑通后最常动的就这几个字段作用推荐取值llm.modelllm.base_url写文案的大脑性价比qwen-max完全免费选 Ollamabase_url填http://localhost:11434/v1样例里给的本地模型是llama3.2comfyui.image.default_workflow配图走哪条生成链路无本地显卡runninghub/image_flux.json有本地 ComfyUI默认http://127.0.0.1:8188选selfhost/image_flux.jsoncomfyui.runninghub_concurrent_limit云端 RunningHub 并发上限普通成员保持1允许范围 1–10超套餐会排队报错template.default_template默认排版模板发抖音/视频号1080x1920/image_default.html发 B 站横屏1920x1080/image_film.html还有两个容易忽略的comfyui.image.prompt_prefix是配图风格前缀写英文样例默认是火柴人简笔画风改这一个字段就能统一整条视频的画面风格自定义 BGM 把 MP3/WAV 扔进bgm/文件夹就会被扫描到配好可在左侧试听。报错排查顺序TTS 随机失败→ 原因默认的 Edge-TTS 走微软免费接口网络一波动就挂FAQ_CN.md 里官方也承认了这点 → 解法TTS 下拉切到 ComfyUI 链路的tts_工作流如 Index-TTS稳定性好得多。提示 Could not find a Chrome executable→ 原因系统缺 Chrome 内核模板渲染环节要靠它把 HTML 截成画面 → 解法装一个 Google Chrome 即可。LLM 配了但生成文案直接报错→ 原因通常三选一base_url多了空格或多余后缀、API Key 无效或没余额、模型名拼错 → 解法按这个顺序逐项核对选预设能自动填对前两项手填最容易在 URL 上翻车。配置改完不生效→ 原因界面里改完忘点「保存配置」或者config.yaml和 WebUI 两处写了同一个字段的不同值 → 解法确认点过保存同一个配置项只在一处维护别两边各写一个。收尾它适合谁起步怎么走适合内容量大、单条复杂度不高的创作者——科普号、知识卡、课程口播、产品短视频也适合想拆AI 短视频全链路的开发者管道在 pixelle_video/pipelines/、服务在pixelle_video/services/模块边界清晰好读好改。不适合追求逐帧精剪、电影级叙事的片子它是量产工具不是剪辑台另外重度用 RunningHub 要盯着 API Key 费用和并发上限纯本地免费组合Ollama 本地 ComfyUI对显卡有硬要求。我推荐的路径先git clone后装 Ollama 加本地 ComfyUI零成本跑通第一条竖屏视频确认流程和模板合口味再按画质需求升级到通义千问、RunningHub 或 DashScope 这些云服务。完整文档在 docs/ 下中英文齐全快速上手看 docs/zh/getting-started/quick-start.md 就行。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
