手机版
搜索
帮助
微博
微信

互联网快讯

首页科技快讯 B 站神曲 damedane：精髓在于换脸，五分钟就能学会

B 站神曲 damedane：精髓在于换脸，五分钟就能学会

来源：晰数塔互联网快讯时间：2020年09月08日 17:13

编者按：本文来自微信公众号“HyperAI超神经”（ID:HyperAI），作者：神经小兮，36氪经授权发布。

内容提要：AI 换脸技术层出不穷，但一代更比一代强。最近，一个发表在 NeurIPs 2019 的 AI 换脸模型 first order motion model 火了起来，其表情迁移效果胜过同领域其它方法。最近，这项技术在 B 站引起一波新潮流……

关键词：图像动画表情迁移

最近，B 站上涌现出一波画风过于「生草」（B 站黑话，意为魔性搞笑）的视频，播放量动辄上百万，相当火爆。

技能满分的 Up 主们，利用「first order motion 一阶运动模型」的 AI 换脸项目，生成了各种各样画风清奇的视频。

比如，竟然让张学友、杜甫、唐僧、熊猫头表情包声情并茂地演唱《damedane》、《unravel》……画面是这个样子的：

唐僧版《Unravel‍‍》，来源：B 站 Up 主：粗犷毛线君

杜甫版《Unravel》，来源 B 站 Up 主：cold_joke

不得不说，有点上头……大家可以自行到小破站搜索更多作品观赏。

这些视频引得无数网友摩拳擦掌跃跃欲试，纷纷留言求教程。接下来，我们就来了解一下，实现这些换脸效果的技术（万恶之源）：一阶运动模型（first order motion model）。

学习园地 B 站，多个教程教你对口型

迄今为止，类似的换脸、对口型的技术层出不穷，每提出一个，就会引起一波换脸热潮。

而 First order motion 模型由于在五官、口型优化上效果比较好，且容易上手、实现效率高，于是大受欢迎。

B 站上的 up 主们，已经积极上传了不少教程

比如要文章开头的《damedane》换脸，只需几十秒就能实现，五分钟就可以学会。

B 站上的多数 up 主选用 Google 的云端硬盘和 Colab 来进行教程。考虑到翻墙门槛，我们选取了其中一位 up 主的教程，使用国内的机器学习算力容器服务（https://openbayes.com），现在还能薅羊毛，每周都赠送 vGPU 的使用时长，轻松完成该教程。

这个教学视频逐步讲解，即使是小白，也能轻松学会这招换脸大法。up 主还将 notebook 上传到了平台，只要一键 clone 就可以直接使用。

不过，很多技术 Up 主表示，娱乐之余，制作视频是为了进行技术交流，所以希望大家不要恶意滥用。

上图视频教程地址：

https://openbayes.com/console/openbayes/public/containers/BwZQj5wr3Jp

原项目 Github 地址：

https://github.com/AliaksandrSiarohin/first-order-model

又一个换脸神器，好用在哪里？

First order motion 模型来自顶会 NeurlPS 2019 上的一篇论文，《First Order Motion Model for Image Animation》（《用于图像动画的一阶运动模型》），作者来自意大利的特伦托大学以及 snap 公司。

论文地址：https://arxiv.org/pdf/2003.00196.pdf

由标题就可知，该论文要实现的目标是让静态图片动起来。在给定一张源图片和一个驱动视频的情况下，让源图片中的形象，跟着驱动视频中的动作动起来。也就是，让万物皆可动起来。

效果如下图所示，左上角为驱动视频，其余为源静态图：

模型框架构成

总的来说，该一阶运动模型的框架主要由两个模块组成：运动估计模块（motion estimation module）和图像生成模块（image generation module）。

运动估计模块：通过自监督学习将目标物体的外观和运动信息进行分离，并进行特征表示。

图像生成模块：模型会对目标运动期间出现的遮挡进行建模，然后从给定的名人图片中提取外观信息，结合先前获得的特征表示，进行视频合成。

方法概述

比传统模型强在哪里？

有人可能会有疑问，这和之前的 AI 换脸方法有什么不同？作者给出了解释。

此前的换脸视频操作，需要以下操作：

通常需要针对换脸的双方人脸图像数据，进行事先训练；

需要对源图像进行关键点标注、再进行相应的模型训练。

但现实中个人的人脸数据较少，也没有大量的时间进行训练。因此，传统的模型通常用在特定形象上效果较好，但用在普通大众身上，质量就很难保证，容易翻车。

之前的方法会出现表情迁移不准的情况

因此，该论文提出的方法，解决了对数据的依赖问题，大大提高了生成效率。想实现表情、动作迁移，只需要在同类别的图像数据集上训练即可。

比如想实现表情迁移，则不管是换谁的脸，只要在人脸数据集训练即可；想实现太极动作迁移，就用太极视频数据集进行训练。

训练完成之后，使用对应的预训练模型，就可以实现让源图像跟着驱动视频动起来的结果。

该方法与其它方法在同一数据集训练效果对比

第二、三列的方法对于人体动作迁移会出现偏差

作者将其方法与目前该方向最先进的方法 X2Face 和 Monkey-Net 进行了对比，结果在相同的数据集中，本方法各个指标都有所提高，在两个人脸数据集（VoxCeleb 和 Nemo）上，本方法也明显优于最初提出用于人脸生成的 X2Face。

damedane 换脸视频原型的倾情演绎

相关推荐

B 站神曲 damedane：精髓在于换脸，五分钟就能学会
 45位女明星的换脸视频卖49元，AI换脸产业链的隐患令人担忧
 国内首个监管“AI换脸术”规定出台，防得住技术作恶的人吗？
AI换脸产业链调查：女星定制换脸视频1分钟20元起
 AI换脸一时爽，小心赔到家底光
 AI换脸一时爽，侵权违法小心赔到家底空
 国内网剧AI换脸术首秀：“五毛特效”引吐槽，大型“车祸”的锅谁来背？
AI换脸调查：淫秽视频可定制女星，700部百元打包卖
 鹿晗都有AI粉了，为什么AI换脸剧的效果还这么渣？
3天登顶苹果免费榜换脸软件ZAO是怎么造出来的

网址: B 站神曲 damedane：精髓在于换脸，五分钟就能学会 http://www.xishuta.com/newsview30574.html

所属分类：互联网创业

推荐科技快讯

移动办公如何高效？谷歌研究了两年，发现了这七个秘密

移动办公如何高效？谷歌研究了两年，发现了这七个秘密

人类唯一的出路：变成人工智能（三）

人类唯一的出路：变成人工智能（三）

饿了么口碑：今年计划招5000名员工、增80万骑手

饿了么口碑：今年计划招5000名员工、增80万骑手

盖茨力劝美国用核技术解决气候变化愿掏数十亿腰包

盖茨力劝美国用核技术解决气候变化愿掏数十亿腰包

最新科技快讯

在家也能现场看球！马卡：老佛爷的“无限伯纳乌”幻想已变为现实

在家也能现场看球！马卡：老佛爷的“无限伯

挖人是“小偷”行为？董明珠再引争议，造车新势力很受伤！

挖人是“小偷”行为？董明珠再引争议，造车

马云回归后，阿里做出了“两大决定”，势要集团动态丨MWC 2025系列：烽火通信高通发布多款连接产品和AI创新成果｜M AI大模型出现“幻觉”该怎么办？科技界代化危为机：企业应对不实负面舆情的6大策略马斯克称AI毁灭人类概率为20%重磅曝光！机器人产业爆发！这6家黑马公司严为民：别怀疑，就是瞄准它！

科技快讯热点排名

科技快讯热点

人类唯一的出路: 变成人工智能（五）

人类唯一的出路: 变

报告：抖音海外版下载量突破10亿大关挑战Facebook

报告：抖音海外版下载

苏宁易购2018年报:营收破2453亿线下门店超万家

苏宁易购2018年报

阿里巴巴钉钉宣布1月30日上线企业拜年红包

阿里巴巴钉钉宣布1月

即时专业知识