ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

一句话 AI 日更短视频:Pixelle-Video 全自动短视频生成引擎上手与避坑指南

一句话 AI 日更短视频:Pixelle-Video 全自动短视频生成引擎上手与避坑指南 一句话 AI 日更短视频Pixelle-Video 全自动短视频生成引擎上手与避坑指南【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video一条科普短视频从写脚本到合成成片通常要折腾半天。而在 Pixelle-Video 里输入为什么要养成阅读习惯几分钟后就能拿到带旁白、BGM 和封面的成片——这是一个本地部署的开源 AI 全自动短视频生成引擎。它是什么一条全自动的 AI 短视频生产线一句话定义本地跑起来的开源工具输入一句话主题输出一条能直接发布的完整视频。输入一个主题如为什么要养成阅读习惯或你自己写好的完整文案经过LLM 写分镜脚本 → AI 逐镜生成配图/动态视频 → TTS 合成旁白 → 套 HTML 模板排版 → ffmpeg 合成产出落在output/目录的成片文件界面里直接预览能看到时长、文件大小和分镜数整条主流程写在 pixelle_video/pipelines/standard.py代码注释把每个环节拆得很直白对照界面基本不会迷路。三条命令启动Windows 有整合包macOS / Linux 用户装好uv和ffmpeg后克隆仓库即可启动git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py浏览器会自动打开http://localhost:8501。Windows 用户不用碰 Python 环境直接下载项目自带的一键整合包解压后双击start.bat浏览器自己会弹出来。从主题到成片中间发生了什么界面上是内容输入 — 语音视觉设置 — 输出预览的三栏布局完整走一遍就是这 5 个阶段配 LLM展开 ⚙️ 系统配置面板从下拉里选一个预设通义千问、GPT-4o、DeepSeek、Ollama 等预设定义在 pixelle_video/llm_presets.py选好只需补 API Key。选 Ollama 走本地模型base_url为http://localhost:11434/v1一分钱不花。产出后续所有文案、分镜、配图提示词的大脑。选内容模式左侧栏两种玩法——AI 生成内容只给主题让它写稿固定文案粘贴现成讲稿跳过创作支持按段落/行/句子分割。分镜数默认 5 个。产出一份可预览的解说脚本。挑 TTS 工作流默认走 workflows/selfhost/tts_edge.json调微软免费接口零配置想克隆自己的声音选 Index-TTSworkflows/runninghub/tts_index2.json上传一段参考音频先试听再生成。产出每个分镜的旁白音频。选图像工作流和模板生成配图有三条路——本地 ComfyUI默认http://127.0.0.1:8188、云端 RunningHub、直连模型 APIDashScope、OpenAI、可灵、Seedream 等默认走 workflows/runninghub/image_flux.json无需本地显卡。模板决定排版static_*.html纯文字、image_*.html套 AI 配图、video_*.html套 AI 动态视频。产出每个分镜的画面素材。点生成看进度右侧 生成视频 按钮会实时显示分镜 3/5 - 生成插图这种粒度底层由 comfy_base_service.py 这类服务基类异步驱动。5 分镜的视频大约 2-5 分钟完成后自动播放文件落在output/。三个超出一句话出片的功能数字人口播一张人像照片就能开口说话入口在 web/pipelines/digital_human.py界面是三栏左上传角色图像中选工作流和参数右看预览。底层配合 workflows/runninghub/digital_combination.json 这类工作流把人物图 文案 TTS 串成口播视频。适合知识讲解、课程切片不用真人出镜也不用录棚。图生视频与动作迁移静态素材也能动起来图生视频在 web/pipelines/i2v.py把一张静态图交给 WAN 2.1 / 2.2 这类视频模型生成动态片段工作流在 workflows/runninghub/video_wan2.2.json 等文件里。动作迁移web/pipelines/action_transfer.py更野上传一段参考视频 一张目标图片参考视频里的动作会迁到图片主体上官方示例是一只跳舞的小猫。做舞蹈教学、产品展示素材很实用。HTML 模板换一个文件换一条视频的皮这是最被低估的设计。模板就是 templates/ 目录下的 HTML 文件按1080x1920竖屏、1920x1080横屏、1080x1080方形分了三个文件夹。同一段文案换个模板就是三种完全不同的成片横屏的image_film.html是黑底电影感——会点 HTML 的话自己往目录里扔模板界面下拉菜单会自动识别模板系统本身就是半个插件机制。config.yaml 速查最常动的 6 个字段把 config.example.yaml 复制成config.yaml即可用文件头特别提醒别提交到 Git。下面这几个是 80% 场景你要动的字段作用推荐值comfyui.image.default_workflow配图走哪条生成链路没本地显卡选runninghub/image_flux.json有本地 ComfyUI 选selfhost/image_flux.jsoncomfyui.runninghub_concurrent_limit云端 RunningHub 并发上限1-10普通成员保持1超了会排队报错llm.modelllm.base_url写文案的大脑性价比qwen-max完全免费走 Ollamabase_url填http://localhost:11434/v1template.default_template默认排版模板发抖音/视频号1080x1920/image_default.htmlB 站横屏1920x1080/image_film.htmlcomfyui.image.prompt_prefix配图风格前缀统一整条视频画面要写英文默认是火柴人简笔画风comfyui.tts.default_workflow默认 TTS 工作流默认selfhost/tts_edge.json免费零配置哪类人最划算哪类人趁早放弃适合你如果内容量大、单条复杂度不高的创作者——科普号、知识卡、课程口播、产品短视频日更是刚需手里有一堆静态图和旧素材想用图生视频 动作迁移把它们盘活成动态内容想研究AI 短视频全链路怎么串的开发者模块化程度高管道在 pixelle_video/pipelines/服务在 pixelle_video/services/各是各的好读好改不适合你如果追求电影级叙事和精细剪辑——它是自动出活路线不是精修路线想纯本地白嫖但没有显卡本地 ComfyUI 建议 NVIDIA 显卡且 6GB 以上显存重度依赖 RunningHub 云端却对费用不敏感API Key 有成本并发还受套餐限制最容易卡住的 4 个问题更完整的排查清单在 docs/FAQ_CN.md这里挑最容易翻车的。TTS 总是失败、报错不稳定现象是语音合成随机挂掉。原因是默认 Edge-TTS 调微软免费接口网络波动时失败率偏高官方 FAQ 也承认了。解法下拉菜单切到 ComfyUI 链路的tts_工作流如 Index-TTS稳定性明显更好。报错 Could not find a Chrome executable现象是模板渲染环节直接报错。原因是系统缺 Chrome 内核模板渲染依赖它把 HTML 截成画面。解法装一个 Google Chrome 即可。LLM 配好了生成文案却直接报错按顺序查三样——base_url是否多了空格或多余后缀、API Key 是否有效且有余额、模型名拼写是否正确。选预设会自动填对前两项手填最容易在 URL 上翻车。配置改完不生效界面里改完要记得点保存配置另外别在config.yaml和 WebUI 两处各改一遍同一个字段只认一处省得互相打架。一句话结论如果你的目标是最低成本先出一条能发的视频Pixelle-Video 目前是最省心的开源选择之一。下一步就从 docs/zh/getting-started/quick-start.md 看起用 Ollama 本地 ComfyUI 的免费组合跑通第一条再逐步升级到云端模型提画质。【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表