LiveTalking
实时交互式流式数字人项目,支持 ER-NeRF 等多种神经渲染方案,实现高质量的唇形同步和面部表情驱动,适用于虚拟主播和数字客服场景
🎯适用场景:虚拟主播、数字人客服、在线教育互动角色、直播带货场景
📥 收录于 2026/6/4
📊 仓库数据
📈 Stars 变化 ↑1 天 +6· 统计区间 7/17 20:11 → 7/18 23:22(1 天)
✅ 优点
- •实时流式渲染延迟低,交互体验流畅
- •支持多种神经渲染方案可灵活选择
⚠️ 限制
- •高质量渲染对 GPU 算力要求较高
- •自定义角色建模需要额外的 3D 建模工作
🔗 相关工具
Deep Live Cam
github.com/hacksider/Deep-Live-Cam
实时人脸替换工具,91,252+ stars。仅需一张照片即可实现实时视频换脸和一键视频 Deepfake,基于 AI 视觉模型实现高精度面部替换。支持摄像头实时预览和离线视频处理,是 AI 换脸领域最受欢迎的开源项目。
🎯多模态内容理解与生成
openpilot
github.com/commaai/openpilot
自动驾驶操作系统,60,671+ stars。comma.ai 开源的高级驾驶辅助系统(ADAS),支持 275+ 款车型的自适应巡航、车道保持等自动驾驶辅助功能
🎯多模态内容理解与生成
FFmpeg
github.com/FFmpeg/FFmpeg
FFmpeg 多媒体处理框架的增强版本,60K+ stars。支持音视频转码、剪辑、滤镜、流媒体等全功能,是视频 AI 处理和多媒体应用的底层基础设施
🎯AI 视频预处理、音视频转码剪辑、多媒体流处理
Face Recognition
github.com/ageitgey/face_recognition
人脸识别 API,56,311+ stars。世界最简单的人脸识别 Python 库,基于 dlib 深度学习模型,提供命令行和编程接口,支持人脸识别、比对、定位等功能
🎯多模态内容理解与生成
FaceSwap
github.com/deepfakes/faceswap
开源 Deepfake 换脸工具,55,193+ stars。基于深度学习的视频换脸工具,支持从图片提取人脸特征并替换到目标视频中,提供训练和推理完整流程
🎯多模态内容理解与生成
Upscayl
github.com/upscayl/upscayl
AI 图片超分辨率工具,44,717+ stars。免费开源的 AI 图片放大器,支持 Linux、macOS、Windows。使用 Real-ESRGAN 等模型实现 4x 无损放大,是设计、摄影、AI 图像后处理的必备工具。
🎯多模态内容理解与生成
