首页 > Ai工具箱 > Ai开源项目内容详情
Audio2Photoreal

Audio2Photoreal

所属分类:Ai开源项目

访问人数:              收录日期:2024-03-23 22:20:36

相关标签: Ai工具箱 Ai开源项目

官方网址:https://github.com/facebookresearch/audio2photoreal/

SEO查询: 爱站网 站长工具

进入网站

网站简介

Meta ai最近发布了一项炸裂的技术:Audio2PhotoReal,从音频生成全身逼真的虚拟人物形象。它可以从多人对话中语音中生成与对话相对应的逼真面部表情、完整身体和手势动作。

这些生成的虚拟人物不仅在视觉上很逼真,而且能够准确地反映出对话中的手势和表情细节,如指点、手腕抖动、耸肩、微笑、嘲笑等。

Audio2Photoreal.gif

Audio2PhotoReal工作原理:

Audio2PhotoReal结合了向量量化的样本多样性和通过扩散获得的高频细节的优势,以生成更具动态性和表现力的动作。

1、数据集捕获:首先捕获了一组丰富的双人对话数据集,这些数据集允许进行逼真的重建。

2、运动模型构建:项目构建了一个包括面部运动模型、引导姿势预测器和身体运动模型的复合运动模型。

3、面部运动生成:使用预训练的唇部回归器处理音频,提取面部运动相关的特征。

利用条件扩散模型根据这些特征生成面部运动。

4、身体运动生成:以音频为输入,自回归地输出每秒1帧的向量量化(VQ)引导姿势。将音频和引导姿势一起输入到扩散模型中,以30帧/秒的速度生成高频身体运动。

5、虚拟人物渲染:将生成的面部和身体运动传入训练好的虚拟人物渲染器,生成逼真的虚拟人物。

6、结果展示:最终展示的是根据音频生成的全身逼真虚拟人物,这些虚拟人物能够表现出对话中的细微表情和手势动作。

Audio2Photoreal.gif

Audio2Photoreal项目地址:https://github.com/facebookresearch/audio2photoreal/

Audio2Photoreal论文地址:https://arxiv.org/pdf/2401.01885.pdf

网站评估

      Audio2Photoreal收录在cd解析,点击人数实时更新,并归类Ai开源项目分类中,所以这是一个Ai开源项目类型的网站,本站只是简单分析 "Audio2Photoreal" 的价值、可信度、类型、更新速度等,包括Audio2Photoreal百度权重、Audio2Photoreal搜狗权重等。

      Audio2Photoreal真正的价值在于它是否为社会的发展带来积极促进作用。另外还取决于各种因素的综合分析,以Audio2Photoreal的流量或权重多少来衡量站点价值当然不够准确。唯一的办法是自己笔算网站的价值,这个估算不需要你雇佣任何人,掌握 "Audio2Photoreal" 的所有数据资料将成为你估算的基础。

      声明:

      本站cd解析提供的Audio2Photoreal来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由cd解析实际控制,在2024-03-23 22:20:36收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,cd解析不承担任何责任。

标签列表

发布评论