AI短视频生成完整教程:用 Pixelle-Video 输入一个主题,几分钟出一条成片
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
Pixelle-Video 是一个开源的 AI短视频生成引擎:你输入一个主题,它自动完成文案撰写、AI 配图、语音合成、背景音乐和成片合成。不用剪辑经验、不用写代码,适合做知识分享、运营自媒体账号,或想快速验证创意的个人与团队。
🎬 它到底能做什么:AI短视频生成的 4 项核心能力
- 输入主题,输出完整文案:把"健康饮食的重要性"这样的主题交给 LLM(大语言模型,负责写稿的 AI),自动拆成分镜并写好评解词
- 输入分镜,输出配图或动态视频:每个分镜调用图像或视频生成工作流,静态插图和动态视频片段都支持
- 输入文案,输出配音:TTS(文本转语音)把解说词读成语音,内置 Edge-TTS、Index-TTS 等方案,也可上传参考音频做声音克隆
- 输入素材,输出成片:画面、配音、BGM 按 HTML 模板排版合成,竖屏、横屏、方形都支持,视频文件保存在
output/目录
🚀 从安装到出片的完整流程:Pixelle-Video 一键上手
第一步:一键安装与启动
Windows 用户下载项目提供的整合包,解压后双击start.bat,依赖全部内置;Mac / Linux 用户从源码启动:
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video ./start_web.sh浏览器会自动打开http://localhost:8501,进入三栏式的 Web 界面。
第二步:首次配置 AI 服务
展开「⚙️ 系统配置」面板,只需填两组信息:
- LLM 配置:选一个写文案的模型(通义千问、GPT-4o、DeepSeek 均可),填入 API Key
- 图像生成服务:有本地显卡就填 ComfyUI 地址(默认 http://127.0.0.1:8188),否则填 RunningHub 云端 API Key
也可以直接改配置文件,参考 config.example.yaml 复制一份为config.yaml:
llm: api_key: "你的密钥" base_url: "https://dashscope.aliyuncs.com/compatible-mode/v1" model: "qwen-max"第三步:生成第一个作品
在「📝 内容输入」区输入主题,选好视频模板和 TTS 工作流(默认 Edge-TTS 即可),点击「🎬 生成视频」。整条 AI短视频生成 流水线会自动跑完:生成文案 → 逐分镜配图 → 合成语音 → 合成视频,5 个分镜的样片大约 2~5 分钟。
📚 适合哪些使用场景:3 类典型用法
知识科普与读书分享:输入"黑洞的形成原理"这类主题,AI 会写结构清晰的解说词并逐句配图,选竖屏 1080x1920 模板可以直接发抖音、快手。这是 AI短视频生成 最高频的用法,templates/ 里的image_book、image_default等模板都是按知识类内容设计的。
个人素材二次创作:项目支持「自定义素材」,上传自己的照片和视频,AI 分析内容后生成配套解说,适合旅行日记、美食分享这类 Vlog 的再加工。
周更内容的批量生产:批量模式下每行一个主题,一次排 7 个选题,系统逐个生成独立成片,适合需要稳定更新节奏的账号运营者。
🛠️ 进阶定制:模板、参数与工作流
模板选择与改造:模板按分辨率放在 templates/ 的子目录里,命名前缀有固定含义——static_是纯文字静态模板,image_是 AI 配图模板,video_是动态视频模板。会点 HTML 的话,改 CSS 里的颜色、字号和布局,就能做出品牌专属风格。
调整生成参数:LLM 的 temperature 降到 0.5 左右,文案风格更稳定;max_tokens 控制文案长度;图像提示词前缀用英文描述画面风格,能明显改变配图质感。
替换工作流引擎:workflows/ 目录里是 ComfyUI 工作流的 JSON 文件。在 ComfyUI 中设计好工作流、导出 API 格式,按image_、video_、tts_前缀命名放进去,下拉菜单里就会多出自定义选项,集成规范见 docs/FAQ_CN.md。
💰 成本与性能:AI视频免费方案怎么选
Pixelle-Video 可以零成本运行,也可以按需付费,两种路线对比如下:
| 方案 | 组成 | 成本 | 适合人群 |
|---|---|---|---|
| 完全本地 | Ollama 本地 LLM + 本地 ComfyUI + Edge-TTS | 0 元 | 有独立显卡 |
| 云端组合 | 通义千问写文案 + RunningHub 生成图像 | 按量付费 | 没有显卡、不想装环境 |
有显卡就选完全本地方案,长期开销最低;没显卡时用通义千问写文案,成本极低,图像生成走 RunningHub 按需付费。混合搭配也可以:日常内容用经济配置,重要内容换高质量模型。
❓ 常见问题:3 个高频问题的排查路径
LLM 调用报错:依次检查三处——Base URL 有无多余空格或错误后缀、API Key 是否有效且有余额、模型名拼写是否正确。
语音合成失败:默认 Edge-TTS 走微软免费接口,容易受网络波动影响;切换到tts_前缀的 ComfyUI 工作流,稳定性更高。
成片效果不满意:先换 LLM 模型对比文案风格,再调图像提示词前缀和尺寸,最后换模板或 TTS 工作流,逐项排除。更多细节见官方文档 docs/zh/。
Pixelle-Video 把 AI短视频生成 的写文案、找素材、配音、剪辑四道工序合并成"输入一个主题",你的时间可以花在选题和发布上。下一步:打开 Web 界面,选一个你本周就想发的主题,先出一条 5 分镜的竖屏样片看看效果。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考