Pixelle-Video 如何配置直连 API 媒体模型调用图像与视频生成服务?
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
Pixelle-Video 生成配图和视频的默认路径是 ComfyUI / RunningHub 工作流。如果你不想维护本地 ComfyUI 环境,也不想依赖 RunningHub,可以让它绕过工作流,直接调用模型供应商的图像、视频生成 API(README 中称为「直连模型 API」)。这篇文章说明如何在 Web 界面或config.yaml中配置直连 API 媒体模型、选择对应工作流,以及生成时如何核对调用参数。适用前提是:项目已按 快速开始 启动 Web 界面(uv run streamlit run web/app.py或 Windows 整合包),并且 LLM 配置项已填好——「保存配置」按钮只有在 LLM 的 API Key、Base URL、Model 都完整时才会写盘。
支持的供应商与鉴权字段
直连 API 媒体模型支持四类供应商,鉴权方式不完全一样(来源:README、web/components/settings.py):
| 供应商 | 用途 | 鉴权字段 | WebUI 默认 Base URL |
|---|---|---|---|
| OpenAI / GPT Image | GPT 图像生成模型 | api_key | https://api.openai.com/v1 |
| DashScope / Wan / HappyHorse | 通义万象图像、视频生成 | api_key | https://dashscope.aliyuncs.com/api/v1 |
| Volcengine ARK / Seedream / Seedance | 字节 Seedream 图像、Seedance 视频生成 | api_key | https://ark.cn-beijing.volces.com/api/v3 |
| Kling AI / 可灵 | 可灵视频生成 | access_key+secret_key | https://api-beijing.klingai.com |
Base URL 在 WebUI 中会预填官方默认地址,可按需修改;只需要实际用到的供应商,其余供应商留空即可。
在 Web 界面配置(主路径)
- 打开 http://localhost:8501,展开「⚙️ 系统配置」面板(未完成配置时该面板默认展开)。
- 先完成 LLM 配置(选择预设后填入 API Key),否则后面点「保存配置」不会生效。
- 在下方的「🧩 API 媒体模型」区域填写:
- 公共项:「本地代理(可选)」留空表示不用代理,需要时填形如
http://127.0.0.1:9090的地址;「打印模型请求参数」是调试开关,开启后终端会打印发送给图像/视频模型的 prompt、模型名和输入文件路径。 - 各供应商项:按上表填入 API Key(或 Kling 的 Access Key / Secret Key),Base URL 保留默认值或改为自己的服务地址。
- 启用代理:每个供应商有单独的「启用代理」勾选框,只有开启该供应商的勾选框,它的请求才会走公共本地代理;未开启的供应商不受代理影响。
- 公共项:「本地代理(可选)」留空表示不用代理,需要时填形如
- 点击「保存配置」。配置会写入
config.yaml的api_providers段;页面出现保存成功提示后刷新,重新打开「系统配置」可确认各输入框已回填。
注意:该区域与上方 LLM、ComfyUI / RunningHub 配置相互独立,填了直连 API 配置不代表工作流会自动切换,仍需要在生成参数里选对api/...工作流。
通过 config.yaml 配置(替代路径)
也可以直接编辑配置文件。项目根目录的 config.example.yaml 给出了模板,其中直连 API 段为:
api_providers: common: print_model_input: false local_proxy: "" openai: api_key: "" base_url: "https://api.openai.com/v1" use_proxy: false dashscope: api_key: "" base_url: "https://dashscope.aliyuncs.com/api/v1" use_proxy: false ark: api_key: "" base_url: "https://ark.cn-beijing.volces.com/api/v3" use_proxy: false kling: base_url: "https://api-beijing.klingai.com" access_key: "" secret_key: "" use_proxy: false字段含义与 WebUI 一一对应:common.print_model_input对应「打印模型请求参数」,common.local_proxy是公共代理地址,各供应商的use_proxy控制该供应商是否走这个代理。config.example.yaml顶部注明该文件要复制为config.yaml后使用,且config.yaml不应提交到 Git。首次运行程序时也会自动创建配置文件(见 配置文件详解)。
选择工作流并生成视频
配置只是提供鉴权,真正让生成走直连 API 的关键是选对工作流:
- 图像生成:在「视觉设置 → 图像生成」的工作流下拉菜单中,除
selfhost/...、runninghub/...外,还可以选择api/...开头的直连图像模型工作流;README 明确提示,选择api/...工作流前需要先在系统配置中填写对应供应商的密钥。 - 视频生成:模板按命名区分类型,
video_*.html模板使用 AI 生成的视频作为背景。选中支持动态视频的模板或扩展工作流后,即可使用 DashScope Wan / HappyHorse、Kling、Seedance 等直连视频模型生成片段,并支持按模型能力显示分辨率、画幅比例、时长、水印、原生音频等参数。 - 图像尺寸在「图像尺寸」中设置(默认 1024x1024),README 提示不同模型对尺寸有不同限制,按所选供应商模型的约束调整。
如何验证配置生效
- 核对请求参数:开启「打印模型请求参数」后点击「🎬 生成视频」,观察启动 Web 界面的终端是否打印出实际发送给模型的 prompt、模型名和输入文件路径。这是确认请求确实发往直连 API 模型的直接依据。
- 观察生成进度与产物:生成过程中界面显示实时进度(生成文案 → 生成配图 → 合成语音 → 合成视频),完成后自动播放视频预览,视频文件保存在
output/文件夹。 - 失败时的重试行为:选择直连视频模型时,README 说明支持网络下载重试,以及内容审核失败后的提示词中性化重试;出现审核类失败时可先确认是否触发了该重试流程,而不是直接判定密钥错误。
边界与限制
- 如果你只使用 ComfyUI 或 RunningHub,
api_providers段可以完全留空;反之,选api/...工作流却没填对应供应商密钥,生成会缺少该能力的凭据,需要回到「API 媒体模型」区域补填并重新「保存配置」。 - 代理只对勾选了「启用代理」的供应商生效,且 README 说明代理仅被部分提供商(例如 OpenAI 图像模型)使用;未开勾选的供应商请求不经过代理。
- 供应商鉴权与 LLM 鉴权是两套独立的配置,LLM 的预设选择、API Key 不影响
api_providers段,也不反之。
【免费下载链接】Pixelle-Video🚀 AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考