我是李邦华,AI社工通主理人。
大家有没有遇到过这种情况——社区要做一个线上服务宣传视频,但社工站就那么几个人,大家都有本职工作,根本抽不出时间去录视频。特别是一些专业的内容讲解,每次都要来回NG,录一个3分钟的视频可能折腾一整天。
我懂这种痛苦。特别是现在很多社区都在推"智慧化服务",要求线上线下结合,但实际执行起来,拍摄剪辑都要外包,成本高、周期长,根本不现实。
今天给大家安利一个中科大联合香港理工大学开源的数字人工具——OneShotOneTalk。怎么说呢,它说白了就是把你手里的一张照片,变成一个会说话、会做手势、会做表情的虚拟人,而且是全身都能动的那种,不是那种只有脸在动的"半截"数字人。
这个工具有几个功能特别适合我们社工场景:
1. 一张照片就能生成全身数字人
不需要复杂的拍摄,也不需要专业的绿幕。你只需要上传一张照片——可以是社工站工作人员的正面照,也可以是精心设计的卡通形象——系统就能生成一个完整的全身说话头像。生成的人物会自然地点头、摆手、做手势,表情也会随着说话内容变化。
2. 精准控制动作和表情
很多数字人工具生成的动作都很"假",像是木偶在念台词。OneShotOneTalk支持对手势、表情、姿势进行精确控制。你可以指定"让她在说到重点时点头",或者"在做自我介绍时挥手",生成的结果会比较自然。
3. 支持中文语音驱动
虽然项目是学术研究导向,但对中文的支持在持续优化。配合TTS(文字转语音)工具,可以实现中文内容的自动驱动。
我知道大家可能担心:这个听起来很专业,是不是需要很高配置的电脑?
其实分两种情况:
方案一:用云端演示(推荐小白)
目前项目主页有在线demo可以直接体验,不需要本地部署,输入照片就能生成。虽然生成速度取决于服务器负载,但完全免费、不需要任何技术基础。
方案二:本地部署(完全免费,有一定门槛)
如果你有一定技术基础,或者单位有GPU服务器,可以下载代码本地部署。本地部署的好处是完全免费、可以批量生成、不限制使用次数。配置要求取决于你的使用量,一般来说RTX 3060以上的显卡就能跑起来。
给大家举个例子:某社区社工站要做一个"老年人防诈骗"系列科普视频。以前需要专人录制,现在只需要:
- 准备几张工作人员的正面照片
- 写好文案,用TTS转成语音
- 上传到OneShotOneTalk生成视频
- 简单剪辑配上字幕
一个人一下午能搞定一周的量,而且视频风格统一、形象专业。
产品信息表
表格
| 项目 | 信息 |
|---|---|
| 开源地址 | https://ustc3dv.github.io/OneShotOneTalk/ |
| GitHub | https://xiangjun-xj.github.io/OneShotOneTalk/ |
| 费用 | 完全免费 |
| 技术门槛 | 云端demo可直接使用;本地部署需一定技术基础 |
| 推荐指数 | ⭐⭐⭐⭐ |
我的碎碎念:
说实话,这个工具目前还比较"学术",上手需要一点时间。但它的技术方向很有意思——用一张照片生成全身动态数字人,这在目前开源领域是领先的。
对于我们社工来说,它特别适合做这几件事:
- 标准化内容的批量生产(比如政策解读、活动预告)
- 保护隐私的宣传视频(用卡通形象代替真人出镜)
- 应急内容的快速产出(来不及录真人视频时的备选方案)
当然,它还不能完全替代真人录制,视频质量也取决于输入照片的质量。但作为一个免费、开源、有技术含量的工具,值得关注一下。
本文由AI社工通原创,欢迎关注
