Real-Time Face Swap, Rebuilt & Faster

更快、更稳、更好看的实时换脸

基于 DeepFaceLive 全面重构:TensorRT 自动加速、直调 OBS 虚拟摄像头直播、兼容 RTX 50 系新显卡、一键合成带声音的换脸视频。同样的电脑,更高的帧率、更低的延迟、更自然的画面。

Deepfacelive_ZHA
TRT
推理自动加速
直调OBS
虚拟摄像头直播
50系
新显卡完美兼容
帧率
大幅提升
一键
合成带声视频
Speed · Quality · Compatibility

用户真正在乎的,我们全押对了

不堆参数、不玩概念。同样的硬件,把每一帧做得更快、每一张脸做得更好看、出片出直播都更省事——这才是换脸软件该有的样子。

⚡

TensorRT 自动加速

RTX 20/30/40/50 系显卡自动走 TensorRT 高性能路径,推理实测提速最高 1.5-3 倍。首次自动转换后结果可复用,二次启动秒级就绪。

🚀

同样硬件,帧率更高

固定显存缓冲、GPU 连续合成、异步输出等全链路优化,砍掉每一帧里的无谓开销。同样的电脑,帧率显著提升,画面更流畅。

🎥

直调 OBS 直播

内置 OBS Virtual Camera,一键直连 OBS 等直播软件,即开即用。虚拟摄像头不再拖慢换脸主流程,直录直播两不误。

🎬

一键合成视频

视频文件做源,点一下自动出片——原声直接带入,标准 MP4 成品。不用录屏、不用剪辑软件,直播用的设置原样出片。

🎯

兼容 RTX 50 系

针对 RTX 50 系新显卡与 CUDA 12 新环境专项适配,自动检测驱动并选择最佳执行路径,新卡开箱即用,性能火力全开。

🎨

9 维美颜 + 动态保留

美白、瘦脸、大眼、瘦下颌等 9 个维度实时美颜,眨眼、说话、牙齿细节动态保留,换脸更像"本来就是你"。

🪶

遮罩羽化零负担

边缘羽化分离计算,运算量降到约十分之一。羽化开到最大档,帧率纹丝不动,边缘过渡照样柔和自然。

🎤

声画同步

声音延迟毫秒级精细调节,画面延迟变化时自动对齐,直播口型不再对不上。麦克风、扬声器随时切换,无需重启。

Deep Optimizations

每一处优化,都是为了让你用得更爽

速度、画质、成片、兼容性——我们把用户看得见摸得着的环节逐个打磨到位。

推理加速
Faster Inference

更快的推理,更高的帧率

原版只有 CUDA 和 DirectML 两种执行方式,且每帧都存在大量重复的显存分配与数据搬运。Deepfacelive_ZHA 在推理和合成热路径上做了成体系的优化。

  • RTX 显卡自动启用 TensorRT,推理提速最高 1.5-3 倍
  • 固定 I/O 显存缓冲复用,告别每帧重复分配
  • 合成结果在 GPU 端直接整理输出,减少整帧回传
  • 多人同框连续合成后统一回传,多脸帧率更稳
  • 遮罩羽化分离计算,羽化开到最大也不拖帧率
直播输出
Live Output

为直播而生的输出系统

原版没有虚拟摄像头,推流还是同步阻塞写入——网络一慢就拖垮整条流水线。Deepfacelive_ZHA 重写了整个输出环节。

  • 内置 OBS Virtual Camera,直调 OBS 等直播软件,即选即用
  • 输出完全异步,推流慢也不卡换脸主流程
  • 只保留最新帧,直播延迟更低
  • 30 种分辨率档位含 13 种竖屏,手机竖屏直播直接选
  • 摄像头黑屏自动检测重连,USB 掉线自动恢复
一键合成视频
One-Click Export

一键合成,成品视频直出

原版对视频文件只能逐帧保存 PNG 序列,配音、合成全靠剪辑软件。Deepfacelive_ZHA 选择视频文件、点击开始,整段视频自动按当前全部设置渲染成片——原声音轨直接带入,无需录屏、无需后期。

  • 直播用的模型、检测、遮罩、美颜设置原样出片,效果一致
  • 原声音轨直接复制进成品,不重新编码、零失真
  • 标准 MP4(H.264 高画质),手机电脑任何设备直接播放
  • 进度实时可见,随时可以取消
  • 输出帧数自动校验,跳过的帧自动补齐
画质与自然度
Better Quality

更自然的换脸效果

原版只有基础的面具融合。Deepfacelive_ZHA 在换脸主流程周围加了一套完整的画质增强能力,效果可逐项开关,不用为用不上的效果付出性能。

  • 9 维实时美颜:美白 / 瘦脸 / 大眼 / 瘦下颌 / 下巴形状 / 颧骨 / 额头等
  • 动态保留眨眼、说话、牙齿细节,表情不僵硬
  • FaceXSeg 外部遮罩后台预热、无缝切换,失败自动回退内置遮罩
  • 模型加载后分辨率自动同步,避免错位和画质损失
  • 关闭的效果不占用任何处理资源,性能按需分配
硬件兼容
Broad Compatibility

新显卡,开箱即用

原版对新显卡的驱动环境适配滞后,新卡未必能发挥全部性能。Deepfacelive_ZHA 自动检测显卡型号与驱动版本,让每一张卡都跑在最佳路径上。

  • RTX 50 系 / CUDA 12 新驱动环境专项适配
  • 自动检测显卡与驱动版本,选择最佳执行路径
  • RTX 20/30/40/50 系满足条件时自动走 TensorRT 高性能路径
  • 多显卡按算力、显存、负载综合评分,自动选最强的卡
  • 手动指定的显卡优先于自动策略,你的选择不被覆盖
Comparison

为什么 Deepfacelive_ZHA 比原版更好用

保留原版优秀工作流的同时,把用户每天会遇到的性能和体验痛点逐个修掉。

你关心的
原版 DeepFaceLive
Deepfacelive_ZHA
推理加速
仅 CUDA / DirectML,无 TensorRT
TensorRT 自动启用,提速最高 1.5-3 倍
显卡兼容
新显卡驱动环境适配滞后
兼容 RTX 50 系 / CUDA 12,自动选最佳路径
虚拟摄像头
无,仅推流 / 窗口预览
内置 OBS Virtual Camera,直调直播软件
视频导出
只能逐帧存 PNG 序列,合成配音全靠自己
一键输出成品 MP4,原声音轨直接带入
整体帧率
每帧重复分配显存,数据反复搬运
热路径全面优化,同样硬件帧率显著提升
遮罩羽化
羽化调大,运算量暴涨,帧率骤降
分离计算,开启大羽化帧率不受影响
推流延迟
同步阻塞写入,网络一慢就积压
异步写入 + 只保留最新帧,低延迟不卡流水线
多脸场景
每张脸单独处理回传,帧率骤降
GPU 连续合成统一回传,多人同框更稳
画质自然度
基础面具融合
9 维美颜 + 眼/嘴/牙动态保留 + 外部遮罩
声画同步
无
声音延迟毫秒级调节 + 自动对齐
摄像头分辨率
7 种横屏档位
30 种档位含 13 种竖屏,适配手机直播
长时间运行
内核反复重编译,周期性卡顿
内核保持热状态 + 流水线超时保护
启动体验
多模块同时抢显卡,容易卡死
按顺序恢复,数秒进入就绪
Optimization Details

优化详解

以下每一项都能在使用中直接感受到:更快的帧率、更低的延迟、更自然的画面、更省事的成片。用的是什么显卡、什么模型、开多少效果,最终帧率会有差异,所以我们只讲优化本身,不承诺脱离实际的固定数字。

10+
推理与合成热路径优化
1/10
遮罩羽化运算量
9 维
实时美颜调节
1 键
合成带原声视频
30 档
分辨率含 13 种竖屏
⚡

一、推理与热路径优化

同样的硬件,更高的帧率
新增 性能

TensorRT 自动加速

原版仅支持 CUDA 和 DirectML 两种执行方式。Deepfacelive_ZHA 新增 TensorRT 路径,RTX 20 系及以上显卡自动启用,推理实测提速最高 1.5-3 倍。

你能感受到的
  • 全自动:检测到支持的显卡自动启用,不需要理解任何参数
  • 首次有提示:第一次加载模型会提示"需要转换 1-3 分钟",不会误以为卡死
  • 转换结果可复用:同一模型和环境下二次启动秒级就绪
  • 按显存分档:8GB/12GB/16GB/24GB 显卡使用不同工作区上限,不会一次占满显存
  • 失败自动回退:TensorRT 不可用时自动回退 CUDA,永远不会因此无法启动
性能

每帧开销全面削减

原版每一帧都在重复做大量无谓工作:反复分配显存、整帧数据在 GPU 和 CPU 之间来回搬运。Deepfacelive_ZHA 把这些开销逐项砍掉。

优化项
  • 固定显存缓冲复用:输入输出缓冲一次分配、每帧复用,不再反复申请释放
  • GPU 端直接整理输出:合成结果在显卡上直接完成格式转换,回传数据量降到约四分之一
  • 合成缓冲复用:整帧、遮罩、变形、混合的工作缓冲全部复用,避免每帧创建大数组
  • 颜色匹配收敛:多段颜色空间转换合并计算,减少大量琐碎提交
  • 关闭的效果零开销:没开启的动态遮罩、美颜不再预先分配资源
性能

多脸场景不再掉帧

原版对同框的每张脸单独处理后逐一回传整帧。Deepfacelive_ZHA 让多张脸在 GPU 中连续处理完后统一回传,多人连麦、群播场景帧率明显更稳。检测和标记模型也支持多脸批量推理,处理异常时自动降级逐张,直播全程无感。

优化 性能

遮罩羽化零负担

边缘羽化是换脸过渡自然的关键,但原版对羽化使用二维卷积,羽化值一大运算量就平方级暴涨,合成器瞬间沦为瓶颈、帧率骤降。Deepfacelive_ZHA 改为水平 + 垂直两次一维卷积的分离计算,效果完全一致,运算量降至约十分之一。

你能感受到的
  • 羽化随便开:把羽化调大到让边缘最柔和的档位,帧率也不受影响
  • 画质不打折:分离计算数学上与原算法等价,过渡效果完全一致
  • 叠加其他效果更稳:羽化 + 美颜 + 动态保留同时开启仍有充足性能余量
🎥

二、输出与成片

更低延迟,更稳输出,一键成片
新增

虚拟摄像头输出

原版没有虚拟摄像头,直播平台无法直接采集画面。Deepfacelive_ZHA 内置 OBS Virtual Camera,直播软件里直接选择即可。

你能感受到的
  • 即选即用:OBS 等直播软件里直接选 Deepfacelive_ZHA 摄像头
  • 不拖慢主流程:虚拟摄像头按自己的节拍取画面,不再把换脸流水线拖到低速
  • FPS 可选:AUTO / 25 / 30 / 45 / 60,自动模式跟随实际处理帧率
  • 失败自动重试:推送失败自动退避重试,不中断直播
新增

一键合成带声音的换脸视频

原版对视频文件只能逐帧保存 PNG 序列,配音和合成要靠剪辑软件自己完成。Deepfacelive_ZHA 新增一键成片:以视频文件为源,按当前全部设置自动渲染整段视频,与源视频同名输出成品 MP4。

你能感受到的
  • 原声直接带入:源视频有音轨就复制进成品,不重新编码、零失真
  • 设置全保留:模型、检测、标记、遮罩、美颜、动态保留全部照搬,出片效果和直播一致
  • 高画质标准格式:H.264 高画质编码,手机电脑直接播放,方便二次剪辑
  • 全程可控:进度实时显示,随时取消;帧数自动校验,跳帧自动补齐
优化 稳定

直播输出不卡主流程

原版推流是同步阻塞写入,网络一慢整个合成线程都被拖住。Deepfacelive_ZHA 重写为完全异步的输出系统:直播软件从虚拟摄像头取画面,推流快慢都不影响换脸主流程。

改进项
  • 推流慢不卡换脸:网络再慢也不会拖住换脸主流程和画面预览
  • 只保留最新帧:网络慢时丢弃过期旧帧,观众看到的始终接近实时
  • 失败自动重试:推送中断自动退避重试,不中断直播
🎨

三、画质与自然度

换脸更像"本来就是你"
新增

9 维实时美颜

原版没有任何美颜能力。Deepfacelive_ZHA 新增完整实时美颜面板,相当于把直播软件的美颜面板直接嫁接到换脸流程里。

9 个调节维度
  • 美白:在 LAB 颜色空间提亮,比简单加亮度更自然
  • 瘦脸 / 大眼 / 瘦下颌 / 下巴形状 / 颧骨宽度 / 额头高度 / 下巴长度 / 脸部长度:各维度独立调节
  • CUDA 加速:美颜变形在 GPU 上运行,多脸场景共享处理、减少重复复制
  • 五官自动保护:瘦脸不扭曲眼睛嘴巴,临时显卡故障后自动恢复
新增

动态保留 + 外部遮罩

换脸结果保留原始的眨眼、说话、笑容等动态细节,表情不再僵硬。同时新增 FaceXSeg 外部遮罩:边缘切割比内置遮罩更精准。

你能感受到的
  • 动态保留眼睛 / 嘴巴 / 牙齿:独立开关 + 缩放 + 边缘羽化精细控制
  • 外部遮罩后台预热:准备期间继续用内置遮罩,不会停住画面等待
  • 无缝切换:预热成功后自动接管,失败自动回退内置遮罩,画面不中断
  • 独立开关:关闭时不创建会话、不占显存,随时对比效果和性能
🔧

四、硬件兼容与自动选择

新显卡开箱即用,跑在最佳状态
新增 兼容

RTX 50 系新显卡兼容

原版对新显卡的驱动环境适配滞后,新卡到手未必能直接发挥全部性能。Deepfacelive_ZHA 针对 RTX 50 系与 CUDA 12 新环境专项适配,自动检测显卡型号和驱动版本,选好正确的执行路径。

选择策略
  • RTX 20/30/40/50 系:条件满足时自动走 TensorRT 高性能路径
  • 50 系专项检测:新驱动环境识别与版本校验,开箱即用
  • 失败自动回退:TensorRT 不可用时自动回退 CUDA,永远跑在最佳可用路径
  • CUDA 运行库随软件提供:不与其他软件自带的 CUDA 组件冲突
新增

多显卡智能选卡

原版只按设备序号排列。Deepfacelive_ZHA 综合计算能力、显存带宽和当前负载自动评分选卡:同时插着 3080 和 4070Ti 会自动选 4070Ti;高端卡被其他程序占满时会让位给更可用的卡。你手动指定的显卡永远优先,不会被后台策略擅自改掉。

🛡️

五、长时间稳定运行

更少卡顿,更少中断
稳定

全方位防卡死

原版长时间运行容易出现周期性卡顿,启动时多个模块同时抢占显卡也容易长时间无响应。Deepfacelive_ZHA 系统性解决了这些问题。

保护机制
  • 内核保持热状态:不再周期性重编译计算内核,消除规律性卡顿
  • 流水线超时保护:下游停止时上游自动退出阻塞,界面不卡死
  • 模块按顺序恢复:启动时逐个模块就绪,避免同时抢显卡导致卡死或爆显存
  • 关窗有上限:即使后台正在转换模型,关窗也在数秒内完成
  • 摄像头多重后备:多 API 逐个尝试 + 分辨率逐档降级 + 黑屏自动检测重连,USB 掉线自动恢复
Ready to Try

现在就体验帧率的差距

Deepfacelive_ZHA 把 DeepFaceLive 从"发烧友工具"进化成"拿来就能直播、就能出片的生产力工具"。