快手可灵团队最新开源项目火了:大叔实时变身少女,GitHub狂揽7.5K星
一水 发自 凹非寺
量子位 | 公众号 QbitAI
离大谱!!不看视频完整版谁知道里面的美少女竟是一位大叔。
还引来HuggingFace首席战略官Thomas Wolf亲自体验:
所以,为啥LivePortrait能够疯狂引人关注?
还得从它让人眼前一亮的表现说起……
让表情“移花接木”
LivePortrait由快手可灵大模型团队开源,只需 1张原图 就能生成动态视频。
先来看一组官方输出。
从 最简单 的 开始,丢一张静态图像,LivePortrait可以让肖像眨眼、微笑或转头。 还可以施展 “移花接木” ,也就是将表情、动态等复制到其他人身上,还是不限风格(写实、油画、雕塑、3D渲染)和尺寸那种~
比如提供一段宝宝没有表情的视频(最右侧),我们可以让宝宝按照参照视频wink或微笑。
对了,不仅限于人物肖像,小猫小狗也能开始撒娇卖萌了。
看来小说里的“三分凉薄,三分讥笑,四分漫不经心”也不是不能实现。[doge]
看完这些不知道你有没有心动,反正网友们整活儿的心是挡不住了。
比如配个灯光花式扮鬼脸,有恐怖片那味儿了:
再比如实时化身二刺猿:
看完这些例子,接下来我们挖一挖背后的技术原理。
爆火开源框架
和当前主流基于扩散模型的方法不同,LivePortrait探索和扩展了 基于隐式关键点的框架 的潜力。具体而言,LivePortrait不依赖于图像中明确可见的标记或特征点,而是通过学习数据集中的模式来隐式地推断出关键点的位置。
在此基础上,LivePortrait通过 两个阶段 从头开始训练模型。先说第一阶段,LivePortrait对基于隐式点的框架(如Face Vid2vid),做了一系列改进。
有了这些,模型的泛化能力、表达能力和纹理质量都能进一步提升。
再说第二阶段,通过贴合模块和重定向模块的训练,模型能够更精确地处理面部表情的细节。
那么,LivePortrait具体表现如何呢?
研究显示,在 同身份驱动对比结果中 ,与已有方法相比,LivePortrait具有较好的生成质量和驱动精确度,可以捕捉驱动帧的眼部和嘴部细微表情,同时保有参考图片的纹理和身份。
One More Thing
补一条官方最新预告:可灵AI即将在 全球范围内 推出其服务。Sora还没来,可灵这回倒是先走出去了~
https://huggingface.co/spaces/KwaiVGI/LivePortrait
项目主页:
https://liveportrait.github.io
论文:
https://arxiv.org/abs/2407.03168
参考链接:
[1] https://x.com/Yokohara_h/status/1815440947976794574
[2] https://weibo.com/1727858283/5059185991221724
[3] https://x.com/Kling_ai/status/1815332322599973289
[4] https://x.com/toyxyz3/status/1811300657158320450
[5] https://x.com/thione/status/1815114364581748861 — 完 — 量子位年度AI主题策划 正在征集中! 欢迎投稿专题 一千零一个AI应 用 , 365行AI落地方案 或与我们分享你在 寻找的AI产品 ,或发现的 AI新动向
点这里 👇 关注我,记得标星哦~ 一键三连「分享」、「点赞」和「在看」 科技前沿进展日日相见 ~