服务热线:

+86 6402 79856

超市货架、各种展架、仓储展柜 等生产销售商

可根据客户不同的需要,进行个性化设计制造

行业新闻

微软开源StableAnimator 首个端到端ID一致性人类视频生雷竞技raybet成

作者:小编 点击: 发布时间:2025-03-23 06:45

  第一作者、第二作者分别为复旦大学研究生涂树源、邢桢,通讯作者为复旦大学吴祖煊副教授。

  近年来,扩散模型在图像与视频合成领域展现出强大能力,为图像动画技术的发展带来了新的契机。特别是在人物图像动画方面,该技术能够基于一系列预设姿态驱动参考图像,使其动态化,从而生成高度可控的人体动画视频。此类技术在多个应用场景中展现出巨大潜力,包括:(1)影视行业:为动画制作提供高效解决方案,使虚拟角色的动画生成更加精细与便捷。(2)游戏行业:赋予游戏角色和虚拟人物自然流畅的动作表现,增强交互体验,使虚拟世界更加线)自媒体内容创作:助力短视频创作者与数字艺术家拓展创意边界,实现高度定制化的动态形象设计。

微软开源StableAnimator 首个端到端ID一致性人类视频生雷竞技raybet成(图1)

  人像动画生成的关键在于:基于参考图像和输入的动作序列合成动态视频,同时确保人物身份特征(尤其是面部信息)的一致性。然而,现有方法在处理复杂动作变化时仍然面临诸多挑战:(1)身份一致性受损,面部区域在剧烈动作下易产生形变和失真,难以保持稳定的个体特征。(2)视频质量下降,当前最先进的人像动画生成模型(如 MimicMotion 和 ControlneXt)依赖外部换脸工具(FaceFusion)进行后处理,这种方式虽能改善局部细节,但往往降低整体视频的视觉质量。(3)空间与时间建模的矛盾,即便已有众多专注于身份一致性的图像生成模型,直接将其嵌入视频扩散模型却常导致建模冲突。其根本原因在于,视频扩散模型引入时间建模层后,原本稳定的空间特征分布被扰动,而基于图像 的 ID 保护方法通常依赖于静态的空间特征分布,这种失衡导致身份保持能力下降,并在 ID 还原与视频流时序畅度之间产生难以调和的矛盾。

  为了解决上述问题,我们提出了 StableAnimator 框架,以实现高质量和高保真的 ID 一致性人类视频生成,目前代码已开源,包括推理代码和训练代码。

  如图所示,StableAnimator 在 Stable Video Diffusion (SVD) 这一常用骨干模型的基础上进行构建,以高效处理用户输入的参考图像,生成符合输入姿态序列的视频。其关键流程包括三条并行的特征提取与融合路径:(1)参考图像首先通过冻结的 VAE 编码器转换为潜变量特征,这些特征被复制以匹配视频帧数,并与主要潜变量拼接,以确保时序一致性。(2)图像同时经过 CLIP 图像编码器,提取全局外观嵌入,这些嵌入分别输入至去噪 U-Net 的每个交叉注意力层以及 StableAnimator 专门设计的面部编码器,以增强生成图像的外观一致性。(3)此外,图像还经过 ArcFace 进行面部特征提取,生成的面部嵌入进一步由 StableAnimator 的面部编码器优化,以提升面部对齐度和身份一致性,优化后的嵌入最终输入至去噪 U-Net 以指导生成过程。同时,PoseNet 结构(类似于 AnimateAnyone)负责提取输入姿态序列的运动特征,并将其添加至噪声潜变量特征中,雷竞技raybet官网以确保生成视频的姿态精准匹配输入序列。

  在推理阶段,StableAnimator 采用去噪生成策略,将原始输入视频帧替换为随机噪声,同时保持其他输入信息不变,以确保生成过程的灵活性和泛化能力。其核心创新在于引入了一种基于 Hamilton-Jacobi-Bellman(HJB)方程的面部优化方法,以提升身份一致性并彻底摆脱对外部换脸工具的依赖。具体而言,该方法将 HJB 方程的求解过程嵌入到去噪步骤中,通过计算 HJB 方程的最优解,引导 U-Net 在潜变量特征的分布调整上朝向更高的身份一致性方向收敛。这样一来,去噪过程不仅仅是对随机噪声的纯粹去除,更是一个动态优化过程,使生成的视频在保持高质量的同时,实现面部特征的精准保留,从而在身份一致性与视频保真度之间达到更优的平衡。

  (1)全局内容感知面部编码器(Global Content-aware Face Encoder):该编码器创新性地将面部特征与全局图像布局深度融合,利用多层交叉注意力机制,使面部嵌入特征精准对齐参考图像的整体上下文。通过这种方式,它有效过滤掉与身份无关的背景噪声,确保面部建模更加稳定,从而提高面部特征的一致性和清晰度。

  (2)分布感知的身份适配器(Distribution-aware ID Adapter):针对扩散模型中时序层对空间特征分布的干扰问题,该适配器引入了一种分布对齐策略。具体而言,它通过计算面部特征和全局图像特征的均值与方差,确保二者在整个去噪过程中保持一致性,避免特征偏移和失真。该适配器的设计使得面部特征能够无缝适配时序建模层,同时维持视频整体的空间一致性和视觉质量。

  (3)基于 Hamilton-Jacobi-Bellman (HJB) 方程的面部优化:此优化过程仅在推理阶段激活,并不会影响 U-Net 的参数更新。StableAnimator 通过在扩散推理过程中引入 HJB 方程优化,使面部特征的调整遵循最优路径选择原则。HJB 优化过程与去噪步骤并行进行,使优化后的变量对去噪路径施加约束,从而促使模型在生成过程中保留更高的身份一致性,同时显著减少面部区域的细节损失,确保视频的高质量输出。

  现有方法在处理面部和身体变形以及服装变化方面存在明显局限。例如,Disco、MagicAnimate、AnimateAnyone 和 Champ 在姿态转换过程中容易导致面部特征扭曲或服装结构丢失,而 Unianimate 在动作匹配方面表现良好,雷竞技raybet官网能够精准调整参考图像的姿态,但仍难以保证身份一致性。同时,MimicMotion 和 ControlNeXt 在保留服装细节方面具有优势,但在身份特征一致性上仍然存在缺陷。相比之下,StableAnimator 通过精确建模姿势序列驱动图像动画化,在动态生成过程中不仅保持了参考图像的身份特征完整性,而且确保了生成结果的细节准确性和生动性,充分展现了在身份一致性和高质量动画生成方面的显著优势。

  StableAnimator 在 TikTok 数据集和 Unseen100 数据集上与当前最先进(SOTA)的人像图像动画模型进行了定量对比。其中,Unseen100 数据集从主流视频网站额外收集的 100 个视频组成,相较于 TikTok 数据集,Unseen100 具有更复杂的动作信息和更精细的主体外观,尤其是包含位置变化和面部表情动态变化(如摇头动作),使得保持身份一致性更具挑战性。为了确保公平性,所有模型均在 StableAnimator 的训练集上进行训练后,再在 Unseen100 上进行评估。对比实验结果表明,StableAnimator 在面部质量(CSIM)和视频保真度(FVD)方面均超越所有对比模型,同时保持了较高的单帧质量。特别是,相较于当前最优的 Unianimate,StableAnimator 在 TikTok 和 Unseen100 数据集上的 CSIM 分别提升了 36.9% 和 45.8%,而这一显著的身份一致性提升并未以牺牲视频保真度和单帧质量为代价,充分验证了其在高质量人像动画生成中的卓越性能。

  03月13日,“促进各民族像石榴籽一样紧紧抱在一起”,快三购彩计划,金沙游戏娱乐,马经内幕B(新图推荐),华体汇体育app下载官网

  03月13日,31省份GDP出炉:广东连续35年居首,西藏增速最快,皇冠苹果版app下载,aoa体育平台提不了款,新宝gg体育下载,AG亚洲游戏平台

  03月13日,上半年北京“疏整促”优化资源布局 提升居民生活品质,真钱网投入口,最新传密绝杀6肖,行会2威尼斯,ROR在线日探访浙江宁波湖礁湾岛 荒废渔村变身网红打卡地天博官方网站入口正规的十大网赌微球体育澳门宝博会开户

  03月13日往来港澳“说走就走”,大湾区融合加力提速万博手机登陆页面九洲天下现金网b0b体育官网登录亿博体育下载地址

  03月13日山东“扩容”创新发展联合基金 吸引优势力量共促基础研究888真人app官方欧宝体育登录入口糖果派对电子游艺太阳城贵宾会……

  03月13日,“小东北虎”勇闯山西感受“晋味中国年”,ag8登陆,ya博官网,火狐体育手机版下载,美高梅手机版

  03月13日,暑热贯穿全天,小时候夏夜没现在这样热是错觉吗?,足球买滚球软件,打牛牛的软件,千赢国际官网登陆入口手机版,世界杯怎么买球投注

  03月13日改善经营主体预期 增强发展内生动力(评论员观察)爱博免费试玩澳门人巴黎人网站大发在线日,基层女工成长记:做好“排头兵” 她在岗位上发光发热,银河国际bb,新2官网总网址,赢真钱牛牛下载,lol世界赛外围

  03月13日,探访北京数字人产业基地 看看数字人都应用在哪些场景?,麻将棋牌娱乐,奥讯比分,尊龙app链接,在哪里能赌欧洲杯

  03月13日,青海海东:多条政策措施落地 助房产市场持续“升温”,福星送特,立博直播视讯,AOA在线买球,缅甸锦利国际网投

  精神病房也会迎来清晨,紫金矿业遭贩毒集团掠夺3.2吨黄金中国和巴西加强可持续农业合作新宝gg下载地址皇冠游戏大全最新版真钱炸三张银河娱乐娱乐场下载

  素媛案犯擅自外出,韩国博主看黑猴满是遗憾江西广昌山乡之中金色油菜花盛开 民众踏春赏花正当时365体育游戏欢迎您申博注册送18ag平台真钱马会双烧图

  我才不要和你做朋友呢,鸟吧吧友的想象力宁夏银川:萌娃乐享书香假期188bet金宝搏体育线路威尼斯电子游戏网址AG真人线路检测鸿博平台登录网址查询

  不会带团队就只能自己帮别人写作业《求是》发表习重要文章,哪些表现可能是热射病中美青年热情点亮音乐之夜 携手共架友谊合作青春之桥金蟾捕鱼olleyu乐鱼娱乐电竞乐鱼官网入口下载mgm线路检测

  胖猫姐姐称一切已交给律师,EDG胜决对阵LEV财政部:今年农业生产相关资金已经下达华球足球百乐棋牌官网下载无限娱乐博必胜娱乐

标签:
相关新闻
最新产品
在线客服
联系方式

热线电话

+86 9844 72266

上班时间

周一到周五

公司电话

15800988039

二维码
线