字节跳动X-Portrait2技术尝鲜:我感觉动捕要升级到next level了

发布日期:2024-11-13 20:13

来源类型:澎湃热榜 | 作者:Supakorn

阅读提醒: 平时喜欢玩游戏、看 3D 动画片的朋友,肯定对“动作捕捉”这个词不陌生。 无论是游戏人物还是动画片角色,他们能够做出各种生动的表情,其实都离不开动作捕捉技术的加持。 不过,动作捕捉技术...
【新澳免费资料大全】 【新澳2024年精准正版资料】 【2024天天彩正版资料大全】 【2024年资料免费大全】 【新澳门资料免费资料】 【新澳精准资料免费提供最新版】 【新澳开奖结果查询今天】 【新澳门彩历史开奖结果走势图表】 【澳门2024正版免费资】 【新澳门彩王中王免费】 【新澳门彩历史开奖记录走势图】 【7777788888新澳门开奖2023年】 【777788888新澳门开奖】

平时喜欢玩游戏、看 3D 动画片的朋友,肯定对“动作捕捉”这个词不陌生。

无论是游戏人物还是动画片角色,他们能够做出各种生动的表情,其实都离不开动作捕捉技术的加持。

不过,动作捕捉技术应用了这么多年,也不是没有缺点,比如动捕的工作流和需要的设备非常复杂,以 200 分钟左右的动画来看,从演员表演到最终完成往往需要不止一个月的时间。而且动捕的设备也非常昂贵,动辄就是几十万美金。

而除了动作捕捉,要想实现动画中的表情控制,可能就只有传统动画师手动去肝了,这条路不用说,更加费时费力。

那么,上面这两种途径之外,还有什么方法能更高效且低成本地完成表情、动作的捕捉和控制呢?

在如今这个智能化的时代,要回答这个问题,肯定绕不开一个词:AI。

刚好,最近字节跳动智能创作团队提出了一项 X- Portrait2 单图视频驱动技术,就让我们看到了新的可能。

X- Portrait2 单图视频驱动技术,仅需要一张静态照片和一段驱动视频即可生成高质量、电影级的视频。

该模型不仅能保留原图的 ID,还能准确捕捉并逼真迁移从细微到夸张的表情和情绪,呈现高度真实的效果。这无疑是为创作富有表现力、逼真的角色动画和视频片段提供了一种成本极低且高效的方法。

听起来似乎是很不错,那么它的实际表现又怎么样呢?IT之家最近获得了内部测试的机会,下面我们不妨先通过 X- Portrait2 的生成的视频表现来看一下。

X- Portrait2 实测:看到这逼真的效果,感觉我起猛了……

实际使用时,我们只需要给模型提供一段带有显著人物表情的视频,以及另一张静态的人物照片,X- Portrait2 就可以让照片中的人物做出和视频上人物相同的表情、动作。

比如IT之家首先想到影视经典乌蝇哥的名场面,然后让《黑神话:悟空》里的天命人来复刻乌蝇哥的表情(视频测试素材仅用于技术演示):

X- Portrait2 技术下天命人模仿乌蝇哥的表情整体还是比较自然的,和原视频也比较像。而且可以看到测试图片中天命人和视频中的乌蝇哥头部视角是有差别的,但这并没有影响到 X- Portrait2 对表情的复刻。

接下来IT之家想到让游戏《生化危机 4:重制版》中的里昂和艾什莉演绎电视剧《回家的诱惑》中的名场面,X- Portrait2 同样生成了对应的视频,小编将结果专为 gif 格式,供大家参考:

视频测试素材仅用于技术演示

视频测试素材仅用于技术演示

由于是将真实人物的表情模拟到 3D 角色建模上,看起来难免会有一种怪怪的感觉,但能看到 X- Portrait2 已经是尽可能让生成的视频角色表情和画面整体看起来自然了。仔细观察会发现生成后的视频在原来静态图片的基础上加入了不少控制表情时面部阴影细节的变化,这都是为了让最终生成的效果更加协调和真实。

接下来再测试一个例子,让《荒野大镖客 2:救赎》中的亚瑟・摩根做出《三国演义》电视剧里诸葛亮骂王朗的表情:

视频测试素材仅用于技术演示

可以看到,这次生成的结果就更加逼真了,亚瑟做表情时,面部皮肤纹理、阴影细节的变化都非常真实,如果不仔细看或者不了解游戏剧情,真可能会以为这就是游戏里原来的 CG 动画。

前面都是用游戏中的人物做测试,接下来IT之家使用 AI 生成的人物照片来进行测试,这样就相当于真人照片来模仿原视频真人的表情,理论上结果应该会更加“难辨真假”。

小编首先用 AI 生成一张成年男性的照片,让其模仿电视剧《大宅门》里于和伟吐口水的名梗:

视频测试素材仅用于技术演示

换用 AI 生成的真人照片后,效果确实是更加逼真了,除了人物大笑时面部褶皱的阴影稍微有点过,其他看起来都很自然,如果不仔细观察,确实很难发现这是 AI 生成的表情复刻视频。

然后小编又让 AI 生成一张女性的照片,让它模仿电视剧《甄嬛传》结局里甄嬛与皇后最后对峙里的一个小片段:

视频测试素材仅用于技术演示

可以看到,X- Portrait2 技术让照片中的女生对甄嬛说话时表情模仿地惟妙惟肖,可以看到电视剧里甄嬛说这句话时的表情还是比较克制的,面部微表情的变化也很细腻,对于复刻来说其实是比较有挑战的。但实际呈现的结果显然可以让人满意,将甄嬛此刻的威严很好地展现了出来。

除了这些,小编在体验过程中还测试了一些其他的案例,比如让《黑神话:悟空》中的二郎神说“在坐的各位都是垃圾”,这表情还是很魔性的:

视频测试素材仅用于技术演示

还有 AI 生成的男生模仿金馆长的大笑,也很逼真,以后要想模仿这种一般人做不出来的大笑表情,自拍个照片就行了……

视频测试素材仅用于技术演示

总体来说,字节跳动的 X- Portrait2 单图视频驱动技术着实给小编带来了一些震撼,仅从目前测试的效果来看,已经很强了,各种细微的表情都能复刻和拿捏,同时通过增加新的阴影和细节变化让视频画面整体达到协调自然的效果,很难想象随着这项技术进一步成熟和进化,会达到怎样的效果,或许以后真的会改变动捕乃至动画、特效行业吧。

出色效果背后,这些领先性的创新值得关注

看到 X- Portrait2 技术让人震撼的表情和动作控制能力,相信大家也会好奇字节跳动究竟是怎么做到的,这背后有哪些技术上的创新?

X-Portrait 2 是字节跳动基于前一代的 X-Portrait 创新条件扩散模型研究成果上进化而来的,将人像驱动的表现力提升到了一个全新的高度。

不同于以往依赖人脸关键点检测的单图驱动方法,X-Portrait 2 构建了一个当前最先进的表情编码器模型,通过一种创新的端到端自监督训练框架,能够从大量人像视频中自学习 ID 无关的运动隐式表征。进一步将这个编码器与强大的生成式扩散模型相结合,即可生成流畅且富有表现力的视频。

经过在大规模高质量表情视频上的训练,X-Portrait 2 在运动表现力和 ID 保持性方面显著优于先前技术。算法能够从驱动视频中提取不同颗粒度的表情特征(如挑眉、咬唇、吐舌、皱眉),并有效迁移到扩散模型,实现精准的表情动作控制,进而能实现驱动视频中人物情感的高保真迁移。

在训练表情编码器时,为了让编码器关注驱动视频中与表情相关的信息,X-Portrait 2 较好地实现了外观和运动的解耦。

具体来说,通过为模型设计过滤层,编码器能有效过滤运动表征中的 ID 相关信号,使得即使 ID 图片与驱动视频中的形象和风格差异较大,模型仍可实现跨 ID、跨风格的动作迁移,涵盖写实人像和卡通图像。这使得 X-Portrait 2 能高度适应各种各样的应用场景,包括现实世界中的叙事创作、角色动画、虚拟形象以及视觉特效等。

正因如此,前面IT之家测试时即使驱动视频是真人影视剧片段,而 ID 图像是 3D 游戏建模人物,也能很好的视线表情动作的控制。

再比如下面这几个例子,驱动视频是真人视频,而 ID 图像有真人照片、卡通漫画,甚至是油画作品,X-Portrait 2 也输出了足以乱真的结果。

视频测试素材仅用于技术演示

看到 X-Portrait 2 的表现,可能有小伙伴会想到不久前由谷歌等公司支持的人工智能初创公司 Runway 推出的“Act-One”功能,集成在 Runway 的视频生成模型 Gen-3 Alpha 中,这个功能也和 X-Portrait 2 有类似,让用户可以使用手机或相机轻松录制自己或他人的视频,之后利用 Act-One 功能将录制对象的面部表情转移到 AI 生成的角色上。

而与 Runyway Act-One 等最先进的方法相比,X-Portrait 2 更加出色,能够如实表现快速的头部动作、细微的表情变化以及强烈的个人情感,这些方面对于高质量的内容创作(比如动画和电影制作)至关重要。

例如下面这组效果对比中,X-Portrait 2 相比 X-Portrait 对人物面部表情的刻画明显更加丰富和生动,而 Runyway Act-One 生成的人物面部缺少很多细节,看起来表情相对生硬,明显没有前两者有冲击力。

视频测试素材仅用于技术演示

再比如下面这个案例中,驱动视频中的人物动作幅度较大,而且表情比较夸张,X-Portrait 2 很好地还原了原视频的特点,X-Portrait 丢失了一些面部细节,而且头部运动的过程有些跳脱,但整体也不错。Runyway Act-One 这边,则直接因为驱动视频头部运动幅度较大而无法生成。

视频测试素材仅用于技术演示

由此可见,字节跳动 X- Portrait2 单图视频驱动技术在确实还是很猛的,包含很多创新点,而且无论是在动态目标捕捉能力,还是在生成结果的逼真度,协调度等方面,相比目前行业里其他类似的 AIGC 模型和方案都有明显的优势。

结语

体验并了解完字节跳动的 X- Portrait2 单图视频驱动技术,IT之家不得不感叹 AIGC 技术进步速度之快,以及字节跳动在 AI 模型创新方面强大的技术实力。

同时还要提醒大家,上面小编体验的还只是 X- Portrait2 内部测试的版本,而随着未来其模型技术的成熟完善,其应用前景无疑是不可限量的。

比如创作者们可以用它来大大加速自己的创作,过去需要投入大量人力物力的动捕设备,可能就不需要了,拍一段视频 + 1 张照片,就能解决表情动作采集的问题,这种效率的提升简直不敢想象。

再比如这项技术未来也可以应用到数字人、XR 等领域,让我们的数字分身或者各种 AI 智能体能够更像真人,甚至能够通过表情变化传达情绪,和我们进行更加自然的交流,进一步打破虚拟和现实的边界……

可以说,生成式 AI 的每一次进步,都是我们生产效率的巨大提升,更是对我们当前工作、生活和娱乐的变革。

而字节跳动们正在通过持续创新的技术和解决方案,一步一步让这样的理想变成现实。

生成式 AI 的未来,真的充满无限可能。

【管家婆一句话玄机资料大全】 【澳门最精准免费资料】 【2024澳门六开彩开】 【澳门资料大全夭天免费】 【澳门内部正版资料免费公开】 【7777788888精准马会传真图】 【新奥天天免费资料的注意事项】 【曾夫人论坛免费资料大全】 【新奥六开彩资料2024】 【2024新奥天天免费资料】 【7777788888新澳门正版】 【正版资料免费大全】 【新澳资料免费精准期期准】 【新澳资彩长期免费资料】
【新澳天天彩正版免费资料观看】 【新澳门彩历史开奖结果走势图】 【2024澳门正版资料大全】 【新澳资料免费大全】 【2024澳门天天六开彩免费图】 【澳门一码一肖一待一中四不像】 【新澳资料免费最新正版】 【澳门天天彩免费资料大全免费查询,】 【澳门六开彩天天正版免费】 【新奥天天免费资料大全正版优势】 【新澳门历史记录查询最近十期】 【新澳论坛免费资料】 【二四六天天好(944cc)246天彩香港挂牌全篇】 【新澳门精准全年资料免费】

下载中心

视频封面

视频名称:特朗普要对华加税?澳大利亚先警觉

大小: 1.6GB 下载:(501323) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:闹大了!女孩坐轮椅独飞遭南航拒载,短信证明申请成功竟成空谈?

大小: 9.4GB 下载:(357331) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:大安区召开全区政法系统党风廉政建设联席会议

大小: 2.1GB 下载:(271190) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:重磅!澳门要建交易所,打造人民币“离岸纳斯达克”,广期所也要来,大湾区概念股再火一把?

大小: 8.3GB 下载:(382815) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:中国年轻人不再喜新厌旧,成就了一个百亿大生意

大小: 1.1GB 下载:(763945) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:邓超孙俪夫妇低调做公益被曝光,12年捐赠超900万《孤舟》叛徒的身份暴露无遗,是顾易中的女朋友肖若彤

大小: 2.6GB 下载:(303712) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:美国大选后,埃隆·马斯克加入了特朗普与乌克兰泽伦斯基的通话

大小: 4.7GB 下载:(355996) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:人工智能及其创造力

大小: 6.2GB 下载:(523641) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:和你“债”一起 美国大选落定,有时候选择比努力更重要11年,内蒙一女子每晚打麻将,从来没输过钱,丈夫在地窖找到原由

大小: 9.7GB 下载:(405797) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:一夜冻雨,气温骤降20多度,赶紧给流浪猫咪们升级一下保

大小: 9.7GB 下载:(2242) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:原来王楚钦,发烧了!为什么鸡蛋不能放冰箱?了解这“3大原因”,让鸡蛋既新鲜又实用

大小: 5.9GB 下载:(340290) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:分手后仍纠缠,男子深夜闯入前女友家中讨说法将对方打伤

大小: 1.6GB 下载:(69072) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:学前教育法、能源法、新修订的文物保护法来了!施行时间→邓颖超读书时的一张罕见照片,戴着眼镜,气质不凡

大小: 4.4GB 下载:(140840) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:每经专访中国区域科学协会理事长肖金成:区域基本公共服务均等化需要“真金白银” 成渝城市群应着力向西向南开放

大小: 6.5GB 下载:(855450) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:市值超10000亿美元!台积电,狂飙!

大小: 3.5GB 下载:(68648) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:陷入全城热恋的尔滨,3天赚59亿,豆腐脑怎么就不能是甜的呢?

大小: 5.1GB 下载:(210510) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:财政部:支持房地产市场健康发展相关税收政策近期推出《前途无量》为了一句话,祝丰山尽全力帮助林强,董事长甘拜下风

大小: 5.6GB 下载:(786776) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:当古诗词照进现实,古人真的诚不欺我!

大小: 3.8GB 下载:(732529) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:用于大规模量子计算机系统量子比特控制的超导电路成功完成演示

大小: 2.9GB 下载:(358280) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:21集催泪炸弹:姐妹情深引发观众泪崩,苏州美景再度圈粉无数3年前,宁夏7岁小女孩一笑走红,后拒百万签约,如今怎么样了?

大小: 3.8GB 下载:(600763) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:马克思主义中国化与中共党史党建知识体系的系统构建

大小: 4.5GB 下载:(664919) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:江西万年县上坊乡党委原书记李佩霞受贿案一审开庭:当庭认罪

大小: 4.9GB 下载:(844682) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:WTA年终总决赛 郑钦文再现ACE雨 首次参赛即打进四强臭豆腐定价营销学(上)

大小: 3.4GB 下载:(970978) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:古典学的由来,以及希腊文化的发展

大小: 8.8GB 下载:(771219) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:新使命 新机制 新变革

大小: 1.2GB 下载:(14153) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:WTA总决赛:郑钦文2-0大满贯得主晋级决赛,超莱巴金娜成亚洲一姐买食用盐,到底挑“海盐”还是“精盐”?早知早受益,了解再买不吃亏

大小: 5.3GB 下载:(283149) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:游戏语音这块毒蛋糕何时等来自己的解药?3年前,宁夏7岁小女孩一笑走红,后拒百万签约,如今怎么样了?

大小: 8.2GB 下载:(419479) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:宝可梦旅途小智v丹帝大战即将开始,朱紫最新消息放出

大小: 1.3GB 下载:(232313) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:避免特朗普加税,欧盟想……

大小: 7.5GB 下载:(225200) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:汉堡狂热粉特朗普,撑不起麦当劳们

大小: 7.6GB 下载:(248889) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)
视频封面

视频名称:BC电池布局提速 光伏行业技术路线之争或加剧

大小: 9.1GB 下载:(933400) 语言: 中文字幕 最后更新: 2024年11月14日

下载视频 (注:防盗链已开启)

评论

打开APP查看72条评论

赵晓诗

4秒前

这无疑是为创作富有表现力、逼真的角色动画和视频片段提供了一种成本极低且高效的方法。

邬立朋

7分钟前

这使得 X-Portrait 2 能高度适应各种各样的应用场景,包括现实世界中的叙事创作、角色动画、虚拟形象以及视觉特效等。

/絵沢萠子

2天前

X- Portrait2 技术下天命人模仿乌蝇哥的表情整体还是比较自然的,和原视频也比较像。

发表您的评论: