开源AI短视频生成工具Pixelle-Video:一句话主题,三步跑通,零显卡要求
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
某个知识科普账号的首页,每天多一条 60 秒口播视频:白底、水墨山、冷静的女声。但账号背后是一个人——没有相机、没有麦克风、没有剪辑软件。他只在输入框里敲下一句主题,点一下生成,几分钟后output/目录里就多了一条成片 MP4。用的就是开源项目Pixelle-Video:一个 AI 短视频生成引擎,输入一个主题,自动完成文案撰写、分镜配图、TTS 配音与 BGM 合成,全程不碰剪辑软件。
一句话到成片:AI短视频生成的具体产物是什么
你拿到的虽然是 MP4,但一个"主题"里其实装着五份中间产物。
- 解说词:LLM 根据主题输出结构化完整口播稿,并顺手切好分镜——后续所有画面和配音都由这份脚本驱动;
- 分镜插图:每个分镜自动生成一张 AI 插画,风格跟着所选模板走;
- 配音:内置 Edge-TTS、Index-TTS 等方案,选音色即可;
- BGM:从
bgm/内置曲库挑选,或上传自己的音乐文件; - 成片:最终合成一条带字幕画面的竖屏/横屏视频,落到
output/目录。
不想让 AI 写稿?把成稿直接粘贴进「固定文案」模式即可,系统按句子分割,一句一图,画面切换更密,节奏感更强。
以主题「如何增加被动收入」为例,配合下方这种电影感横版模板,产物就是一条黑底留白、水墨山居中、标题压顶的 16:9 口播视频:
模板切换与模型搭配:短视频画风怎么换
templates/目录下的模板全部是 HTML 文件,按成片尺寸分成1080x1920(竖屏)、1920x1080(横屏)、1080x1080(方形)三组,命名即行为:static_*不生成任何媒体、image_*由 AI 生成插图、video_*由 AI 生成动态画面。
界面内置模板画廊,支持输入测试提示词「生成预览」,先出图再决定,不用凭文件名盲猜。几个可以直接抄的搭配:
- 知识科普:
image_book(书卷白底)+ 通义千问文案,语速默认即可; - 情感治愈:
image_healing+ 温柔女声,语速调慢半档; - 科技资讯:
image_wide_darktech宽屏深色风,适合 B 站横屏。
模型侧同样可换:LLM 在[pixelle_video/llm_presets.py](https://link.gitcode.com/i/bbe028b21a6ec4a5713fb9c1f11b665c)中预置了通义千问、GPT、DeepSeek、Ollama 等一键预设;图像/视频生成可选 RunningHub 云端工作流或 DashScope、Kling 等直连 API。觉得静态画面不够带感,把模板切到video_*,同一份脚本就能产出会动的分镜。
批量出片怎么省钱:无显卡与零 API 成本路线
先说结论:显卡不是这个项目的必需项。
批量模式是效率大头:勾选后输入框变成每行一个主题,所有视频共享同一套模板、音色与工作流配置,单次上限100 条。更实用的是容错——单条失败不会中断整批,系统记录错误后自动跑下一条,结束时给成功/失败清单,失败的单独重跑即可。
成本上有两条路线:
- 云端路线(无显卡):图像/视频走 RunningHub 按量付费或 DashScope 等直连 API,文案走 LLM 接口(国产模型普遍比 GPT 便宜一个量级),TTS 用 Edge-TTS。一晚跑十条系列内容完全可行;
- 本地路线(有 NVIDIA 显卡):LLM 切 Ollama、工作流指向本地 ComfyUI、语音用 Edge-TTS,整套API 费用为零,数据全部留在本机。
一句话划清边界:它服务图文口播类账号(科普、治愈、读书、理财),如果你拍真人出镜短剧或需要逐帧手动精修,这不是对的工具——它和剪映类手动剪辑器不是替代关系,前者解决"从 0 到成片",后者解决"从素材到成片"。
零基础起步:三步跑通AI短视频生成
跑通它只需要三件事:装依赖、起 Web 页面、填一组密钥。
git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video && uv sync uv run streamlit run web/app.py(需先安装uv与ffmpeg;Windows 用户可直接下载一键整合包,双击start.bat,浏览器自动打开http://localhost:8501。)
剩下你只需做三步:
- 在「⚙️ 系统配置」里填 LLM 密钥——通义千问、DeepSeek、Ollama 任选其一,
config.example.yaml里有各家 base_url 注释可抄; - 在「📝 内容输入」敲一个主题,选模板;
- 点「🎬 生成视频」,等进度条走完,去
output/取片。
更多细节见 docs/ 下的安装与配置教程,或 web/app.py 对应的 Web 界面引导。
高频疑问
一次批量最多能跑多少条?100 条,每行一个主题,全部共享同一套模板与音色配置,按顺序依次生成。
批量里某一条失败了会中断吗?不会。系统记录错误后自动继续下一条,结束时输出成功/失败清单,失败的可以单独重跑。
没有独立显卡能跑吗?能。图像与视频生成走 RunningHub、DashScope 等云端服务,TTS 用 Edge-TTS,全程不依赖本地显卡。
能用我自己的声音做旁白吗?可以。上传一段 10 秒以上的清晰人声即可克隆音色,整个系列内容共用同一副"个人声音";也可以从内置 Edge-TTS 音色里挑,支持先试听再确认。
模板的尺寸会影响成片吗?会。模板所在目录决定画面宽高比:1080x1920出竖屏、1920x1080出横屏、1080x1080出方形,按发布平台选对尺寸即可。
output/目录还空着——你的第一个主题,想好了吗?
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考