免费!推荐1个中科大开源的数字人工具,一张照片就能生成全身动态说话头像


我是李邦华,AI社工通主理人。

大家有没有遇到过这种情况——社区要做一个线上服务宣传视频,但社工站就那么几个人,大家都有本职工作,根本抽不出时间去录视频。特别是一些专业的内容讲解,每次都要来回NG,录一个3分钟的视频可能折腾一整天。

我懂这种痛苦。特别是现在很多社区都在推"智慧化服务",要求线上线下结合,但实际执行起来,拍摄剪辑都要外包,成本高、周期长,根本不现实。

今天给大家安利一个中科大联合香港理工大学开源的数字人工具——OneShotOneTalk。怎么说呢,它说白了就是把你手里的一张照片,变成一个会说话、会做手势、会做表情的虚拟人,而且是全身都能动的那种,不是那种只有脸在动的"半截"数字人。

这个工具有几个功能特别适合我们社工场景:

1. 一张照片就能生成全身数字人

不需要复杂的拍摄,也不需要专业的绿幕。你只需要上传一张照片——可以是社工站工作人员的正面照,也可以是精心设计的卡通形象——系统就能生成一个完整的全身说话头像。生成的人物会自然地点头、摆手、做手势,表情也会随着说话内容变化。

2. 精准控制动作和表情

很多数字人工具生成的动作都很"假",像是木偶在念台词。OneShotOneTalk支持对手势、表情、姿势进行精确控制。你可以指定"让她在说到重点时点头",或者"在做自我介绍时挥手",生成的结果会比较自然。

3. 支持中文语音驱动

虽然项目是学术研究导向,但对中文的支持在持续优化。配合TTS(文字转语音)工具,可以实现中文内容的自动驱动。

我知道大家可能担心:这个听起来很专业,是不是需要很高配置的电脑?

其实分两种情况:

方案一:用云端演示(推荐小白)

目前项目主页有在线demo可以直接体验,不需要本地部署,输入照片就能生成。虽然生成速度取决于服务器负载,但完全免费、不需要任何技术基础。

方案二:本地部署(完全免费,有一定门槛)

如果你有一定技术基础,或者单位有GPU服务器,可以下载代码本地部署。本地部署的好处是完全免费、可以批量生成、不限制使用次数。配置要求取决于你的使用量,一般来说RTX 3060以上的显卡就能跑起来。

给大家举个例子:某社区社工站要做一个"老年人防诈骗"系列科普视频。以前需要专人录制,现在只需要:

  • 准备几张工作人员的正面照片
  • 写好文案,用TTS转成语音
  • 上传到OneShotOneTalk生成视频
  • 简单剪辑配上字幕

一个人一下午能搞定一周的量,而且视频风格统一、形象专业。

产品信息表

表格

项目 信息
开源地址 https://ustc3dv.github.io/OneShotOneTalk/
GitHub https://xiangjun-xj.github.io/OneShotOneTalk/
费用 完全免费
技术门槛 云端demo可直接使用;本地部署需一定技术基础
推荐指数 ⭐⭐⭐⭐

我的碎碎念:

说实话,这个工具目前还比较"学术",上手需要一点时间。但它的技术方向很有意思——用一张照片生成全身动态数字人,这在目前开源领域是领先的。

对于我们社工来说,它特别适合做这几件事:

  • 标准化内容的批量生产(比如政策解读、活动预告)
  • 保护隐私的宣传视频(用卡通形象代替真人出镜)
  • 应急内容的快速产出(来不及录真人视频时的备选方案)

当然,它还不能完全替代真人录制,视频质量也取决于输入照片的质量。但作为一个免费、开源、有技术含量的工具,值得关注一下。

本文由AI社工通原创,欢迎关注


免费!推荐1个开源客服系统,社工站终于不用一个人同时盯十几个群了 **Chatwoot**,全渠道客服系统

社工站还在用纸质表格走审批? 试试这个开源OA 开源OA系统——O2OA

评 论
评论已关闭