news 2026/9/6 16:08:21

Deep-Live-Cam 实时换脸上手指南:1 张照片、3 次点击,约 10 分钟看到第一帧

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Deep-Live-Cam 实时换脸上手指南:1 张照片、3 次点击,约 10 分钟看到第一帧

Deep-Live-Cam 实时换脸上手指南:1 张照片、3 次点击,约 10 分钟看到第一帧

【免费下载链接】Deep-Live-Camreal time face swap and one-click video deepfake with only a single image项目地址: https://gitcode.com/GitHub_Trending/de/Deep-Live-Cam

逐帧换脸要等半天、导出再等半天?Deep-Live-Cam 主打的就是实时换脸:只需 1 张照片,把视频、电影甚至摄像头画面里的人脸当场替换掉。普通电脑约 10 分钟装完,摄像头模式下 10–30 秒出预览画面,你敲完安装命令的时间还没到它跑起来的时间。

30 秒搞懂:它凭什么能"实时"

Deep-Live-Cam 对每一帧只做三件事:先用人脸检测模型找到画面里的脸,再用一张源脸照片把身份替换上去(表情、姿态、光照都跟原画走),最后把结果混合回画面。摄像头模式下这套流程在后台循环跑,前面给你开一个实时窗口,所以"换"发生在显示之前,而不是导出之后。

开工前 60 秒自检:我的机器跑得动吗

对照下表 6 项,1 分钟出结论:

项目最低(能跑)推荐(流畅)
操作系统Windows 10 / macOS 11 / 主流 LinuxWindows 11 / macOS 12+
Python3.113.14(3.11–3.14 均可)
内存8GB16GB
显卡无,CPU 模式可跑NVIDIA RTX 3060+ / Apple M 系
磁盘空闲10GB(依赖 + 约 300MB 模型)20GB
FFmpeg已安装且在 PATH 中最新稳定版

"最低"与"推荐"的差距基本都体现在帧率上:CPU 模式跑得动但偏慢,GPU 模式才是真·实时。项目自带一段普通 PC 的性能演示,先有个心理预期再动手:

跟着做:从零到第一个换脸结果

4 个里程碑,每个 1 条核心命令 + 1 个验收点。

里程碑 1:克隆仓库并建虚拟环境

用意是隔离依赖,避免这个项目的包污染系统 Python。

git clone https://gitcode.com/GitHub_Trending/de/Deep-Live-Cam cd Deep-Live-Cam python -m venv venv

Windows 激活用venv\Scripts\activate,macOS / Linux 用source venv/bin/activate

验收点:终端提示符前出现(venv)

里程碑 2:一条命令装完依赖

pip install -r requirements.txt

这条命令会把 OpenCV、ONNX Runtime、insightface 人脸库、GUI 框架一次装齐(见 requirements.txt)。首次运行时程序还会自动下载约 300MB 的换脸与增强模型,也可以提前把inswapper_128_fp16.onnxGFPGANv1.4放进 models/ 文件夹,说明在 models/instructions.txt。

验收点:执行pip show onnxruntime能打印出版本号。

里程碑 3:GUI 三次点击,出第一支换脸视频

python run.py

在弹出的窗口里:① 选源脸照片(谁的清晰正脸照就换谁,对应-s);② 选目标图片或视频(对应-t);③ 点 Start。验收点:输出保存在以目标文件命名的文件夹里,打开就能看到换好的脸。

想直接试实时效果:选源脸 → 选摄像头 → 点 Live,等 10–30 秒预览画面就会出现,想换人随时重选一张源脸。

里程碑 4:命令行一键出片

习惯终端的话,一条命令等价于上面的点击流程:

python run.py -s face.jpg -t clip.mp4

验收点:终端进度条走完后,目标同名文件夹里生成换脸成片。

常用能力开关:你想要什么效果,就开哪个

按"想要的效果"分组,每行一句话,够抄即用(完整定义见 命令行参数解析)。

想更自然(说话口型不穿帮)

开关说明典型值
--mouth-mask遮罩嘴部,保留原口型,说话类视频效果最明显开关

想一次换多张脸 / 不同人换不同的脸

开关说明典型值
--many-faces处理画面里每一张脸(默认只换 1 张)开关
--map-faces把不同主体分别映射到不同源脸--many-faces配合

想画质更好、文件更对味

开关说明典型值
--frame-processor按书写顺序执行处理管线,默认只有face_swapper追加face_enhancer/face_enhancer_gpen256/face_enhancer_gpen512
--video-encoder输出编码器,默认libx264libx265(更小)/libvpx-vp9
--video-quality编码质量 0–51,越小越清晰18(默认)
--keep-fps保留原始帧率,播放更顺开关
--keep-audio保留原音轨默认开启

想稳住内存与内容安全

开关说明典型值
--max-memory内存上限,单位 GB8
--nsfw-filter不当内容过滤,公开发布前建议开着开关

把效果调到位:按硬件直接抄

不用懂原理,照抄你那一档:

档位照抄命令预期
够用档(纯 CPU)python run.py --execution-provider cpu --execution-threads 8 --max-memory 8片段控制在 1 分钟内,720P 足够
进阶档(NVIDIA 显卡)python run.py --execution-provider cuda1080P 舒适区;依赖里已含 CUDA 版 ONNX Runtime
进阶档(Apple Silicon)python run.py --execution-provider coreml官方 onnxruntime 已内置 CoreML,零额外安装
拉满档(Intel / AMD 核显)pip install onnxruntime-openvino==1.21.0(Intel)或pip install onnxruntime-directml==1.21.0(AMD/Windows),再分别用--execution-provider openvino/directml启动比纯 CPU 明显更快,分辨率可再往上抬

前两档目标"跑得动不卡",后两档追求"更高分辨率 + 人脸增强",高端显卡可顺手加--frame-processor face_swapper face_enhancer

卡住了?按症状对号入座

  1. 看到什么:一启动就提示找不到 FFmpeg,直接退出。通常是:FFmpeg 没装,或它的 bin 目录不在 PATH 里。一句话解:装好 FFmpeg 并把 bin 目录加入 PATH,重开终端后用ffmpeg -version验证。

  2. 看到什么:加了--execution-provider cuda却报 cuDNN / cuBLAS 错误,退回 CPU。通常是:CUDA 运行时缺失或版本不配套(官方验证组合为 CUDA 12.8 + cuDNN 8.9.7)。一句话解:按该组合安装两者,把 cuDNN 的 bin 目录加进 PATH 后重启程序。

  3. 看到什么:处理长视频到一半,内存飙高、程序卡死。通常是:帧与中间结果一直驻留内存。一句话解:启动时加--max-memory 8(或更小值),仍爆就先降分辨率。

  4. 看到什么:点了 Live,预览半天不出现。通常是:首次要加载并预热约 300MB 模型,10–30 秒属正常;超过 30 秒还不动,查摄像头权限或换一个摄像头索引。一句话解:再等等;不行就检查系统相机权限设置。

下一步:往哪里深挖

  • 想看参数默认值怎么算(线程数、内存上限、后端探测):modules/core.py 里的suggest_*系列函数
  • 想改画质:整条帧处理管线都在 modules/processors/frame/,face_swapper.py是换脸本体,face_enhancer.py系列是增强器
  • 想搞懂"脸是怎么被找到的":modules/face_analyser.py
  • 想手动管理模型下载与校验逻辑:modules/model_downloader.py
  • 想自己压测管线性能:benchmark_pipeline.py

【免费下载链接】Deep-Live-Camreal time face swap and one-click video deepfake with only a single image项目地址: https://gitcode.com/GitHub_Trending/de/Deep-Live-Cam

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/6 16:07:40

从EBOM到MBOM:制造企业BOM转换的落地指南

简介:围绕制造业信息化中EBOM向MBOM转换的专题方案文档,面向企业IT规划、ERP/PDM实施顾问及工艺管理人员。文档系统梳理了PDM与ERP系统集成的四种接口方式:内部函数调用、直接数据库访问、中间文件交换、中间数据库,并指出直接数据…

作者头像 李华
网站建设 2026/9/6 16:07:02

近红外光热治疗纳米机器人:从光热转换到穿透深度优化的技术解析

简介:《光热治疗纳米机器人设计方案详解》以PDF形式呈现,共672页、50个大章节,聚焦近红外响应结构拓扑优化与组织穿透深度增强算法,面向机器人、纳米医学与光热治疗领域的研究者。内容从近红外光在生物组织中的传输特性与“治疗窗…

作者头像 李华
网站建设 2026/9/6 16:04:56

drawio-desktop 免费5分钟画流程图:Visio 文件桌面转换完整指南

drawio-desktop 免费5分钟画流程图:Visio 文件桌面转换完整指南 【免费下载链接】drawio-desktop Official electron build of draw.io 项目地址: https://gitcode.com/GitHub_Trending/dr/drawio-desktop 如果你是常画流程图的人,多半遇到过这些…

作者头像 李华
网站建设 2026/9/6 15:51:52

三相桥式全控整流电路Simulink仿真:从建模到波形调试全解析

简介:这份基于Matlab/Simulink的三相桥式全控整流电路仿真研究文档,适合电力电子、自动化及相关专业的本科生、研究生和工程技术人员阅读。资源以图文(精)形式系统讲解了三相桥式全控整流电路的电路结构、晶闸管导通顺序、共阴极与…

作者头像 李华