生成式 AI 试妆和 AR 滤镜,区别在哪?
最后更新:
AR 滤镜是在实时视频上给你的脸实时上色,生成式试妆则是重新生成一整张静态照片,两者回答的其实是不同的问题。
AR 滤镜的做法,是在手机上实时锁定摄像头画面里的脸,每秒三十次甚至更快地往视频上画颜色。生成式试妆的做法,是把一张静态照片发给一个模型,由模型重新画出整张图,再把新图返还给你。这两者之间几乎所有其他的差别,都是从这一个根本区别延伸出来的。
两者各自怎么运作
AR 滤镜先要追踪你的脸。软件给脸套上一层网格,并逐帧跟踪这层网格。以苹果的 ARKit 为例,它把被追踪的脸描述为ARFaceGeometry,一个拓扑结构在不同实例之间保持不变的三维网格,苹果自己的文档也把叠加虚拟妆容列为可以在这层网格上做的事情之一。软件接着把颜色混合到这层网格对应的区域上,再合成回视频画面。每秒三十帧,留给这一整套动作的时间只有约三十三毫秒,这也是为什么这项运算必须足够“轻”:本质上是在已有的像素上做一次颜色混合,边缘做羽化处理以避免看起来像贴上去的。你在品牌官网上体验到的试妆,用的是同一套思路,只是换成了那家公司自己的追踪引擎,跑在浏览器里。
生成式试妆不逐帧跟着你走。它接收一张照片,发送给运行在服务器上的模型,模型生成同一张照片的新版本,把妆容画进去。这个模型不做任何叠加,它重新生成的是像素本身,所以妆容成了图像的一部分,而不是浮在图像上方的一层。
两者并排对照
下表里的生成式试妆例子是 Looksmith,它即将登陆 iOS,目前还不能使用。
| 差异点 | AR 滤镜 | 生成式试妆 |
|---|---|---|
| 运算发生在哪 | 手机本地 | 服务器 |
| 输入 | 实时摄像头视频 | 一张静态照片 |
| 出结果要多久 | 实时,每帧约三十三毫秒 | 在 Looksmith 里大约一分钟 |
| 可交互 | 是,随你的动作实时变化 | 否 |
| 最终得到什么 | 一层实时叠加画面 | 一份图像文件 |
| 覆盖范围 | 通常一次一件产品 | 一整套完整妆容 |
| 展示的产品 | 开发方自己的产品目录 | 不绑定某一个品牌 |
| 光线 | 由摄像头逐帧自行判断 | 拍摄那一刻的光线被固定下来 |
| 一般花费 | 品牌自家页面上免费 | Looksmith 前六次免费,之后用点数 |
可以自己验证的几个后果
为什么同一支口红,在 AR 滤镜里每次看起来都不一样?
因为它下面的视频画面本身在变。你的手机在跑自动白平衡和自动曝光,每秒判断很多次房间里什么算白色,再把整个画面往这个判断拉过去。站在暖光灯下,摄像头会把这份暖意加重;站到窗边,它又会反过来。滤镜画的是同一个颜色数值,你看到的却是两支不同的口红。
这个可以用任意一个品牌的试妆页面在两分钟内验证:先在钨丝灯下打开同一个色号,再拿着手机走到窗边,滤镜继续开着。产品本身什么都没变,滤镜画的那个数值也没变。
哪一种显示的颜色更准?
两者都没资格说自己更准。任何一个宣传“颜色准确度百分比”的试妆功能,在它公开背后的测算方法之前,都应该当成广告词看待。一张静态照片确实只有一种白平衡,不会像实时画面那样一直漂移,所以一张生成的图至少在你端详它的时候是稳定的。但你的摄像头是在某一种特定条件下拍下这张照片,再经过同一套处理流程,返回的是一张说得过去的图,不是对颜料本身的测量。Looksmith 不公布颜色准确度的百分比,因为 Looksmith 没有测量过这个数字。
如果要确定具体色号,答案是拿实物色号在日光下试在自己下颌线上。这两种数字方式都只是帮你在到那一步之前先缩小范围。
为什么一个品牌的 AR 滤镜永远只能试那个品牌的产品?
因为这个滤镜就是围着那个品牌的产品目录搭建的。你用过的大多数品牌试妆,背后其实是两套引擎中的一套,只是换了个名字。欧莱雅在二〇一八年三月收购了 ModiFace,而做 YouCam Makeup 的玩美移动(Perfect Corp)在二〇二二年于纽约证券交易所上市。品牌提供色号列表,引擎提供追踪技术,而色号列表才是这整件事真正的目的。
一个品牌自己的滤镜没法给你展示由三个不同品牌拼出来的一整套妆容,也永远不会得出“最适合你的答案是一件它自己不卖的产品”这种结论。丝芙兰 Virtual Artist 或丝芙兰旗下以外像 Ulta GlamLab 这类零售商试妆能覆盖多个品牌,但也只限于那家零售商有货的品牌。这些引擎到底是谁在背后搭建的,拆解在什么是虚拟试妆里。
生成式试妆要花多长时间?
在 Looksmith 里大约一分钟。模型生成的是一整张全新图像,而不是给现有图像上色,这个运算跑在服务器上,不在你手里,整个过程完全不是实时交互的。你是在拿实时预览换一张成品图,如果你要的就是实时预览,生成式试妆就不是对的工具。
试妆的结果能保存下来吗?
这是大多数人第一时间就注意到的差别。AR 滤镜是一层实时叠加,关掉之后什么都不会留下,除非你想着截了图。生成式试妆会生成一份文件。Looksmith 返回一张 9:16 的海报图,也就是画上了妆容的你自己的照片,还可以选配一段无声的四秒循环短片,用到的产品会列在旁边。四张这样的图可以并排摆在一个屏幕上。你可以把其中一张发给朋友问问意见,也可以先放在手机里,等到明天再看自己怎么想。
两种方式会改变我的脸吗?
AR 美妆滤镜理论上只是画颜色,所以你的脸本身不受影响。但实际情况是,承载这些滤镜的应用往往还捆绑了瘦脸、大眼一类的调整工具,一次会话里忘了关的设置,很容易带进下一次会话。与其假设滤镜只在处理颜色,不如直接去看这款应用自己列出的功能清单。
生成式试妆的风险方向正相反。模型重新生成的是整张图,如果开发方没有对它加以约束,它是可能跑偏的。就设计而言,Looksmith 不会改变任何面部结构:单眼皮还是单眼皮,你的年龄、姿势、表情和构图都保持原样,因为返回给你的是你自己被重新上妆的照片,而不是一张新的肖像。Looksmith 完整保留眼镜,也从不主动添加眼镜,并且不做任何美颜磨皮。锁定不变的完整清单在AI 试妆会改变我的脸吗里。
该用哪一种,取决于你想解决什么问题
这是大多数对比文章都不愿意写清楚的部分。
| 你想弄清楚什么 | 该用哪个 | 为什么 |
|---|---|---|
| 这个眼线形状适不适合我的眼型 | AR 滤镜 | 你需要眨眼、转头、低头看它 |
| 这个色系大致适不适合我 | AR 滤镜 | 十秒钟,在专柜过道里,免费 |
| 这是不是最准确的粉底色号 | 都不是 | 拿实物在日光下试在下颌线上,十分钟后再看一次 |
| 眼影、腮红、唇妆整套放在一起适不适合我 | 生成式 | 大多数 AR 滤镜一次只处理一件产品 |
| 我想同时比较四个方案 | 生成式 | 你没法把两层实时叠加画面并排摆在一起 |
| 我想在公开场合穿戴之前先看一眼 | 生成式 | 图片会留下来,你可以再回来看 |
| 我正站在专柜,产品就在手里 | 都不是 | 实物就在眼前,直接试在下颌线上,再走到室外看看 |
一条简单的判断标准:问题关于形状和位置、而且你需要动起来的时候,用 AR 滤镜。问题是一整套妆容合不合适、而且你想留一张明天还能再看的图的时候,用生成式试妆。
Looksmith 站在哪一边
Looksmith 是 Mirable Labs, Inc. 出品的一款生成式试妆应用,即将登陆 iOS。在 Looksmith 里,你先保存一次“形象”(Likeness),也就是一组自拍照,之后成为可反复使用的脸。接着用三种方式之一挑一个妆容:Style Me 一次性把你放进多个妆容里,Create Look 用一段文字描述来生成,Mirror a Look 把一张参考照片上的妆容转移过来。Looksmith 会在十二个部位上构建这个妆容,从唇妆、唇线到眼影、腮红、眉毛,最终返回一张画着你自己的脸的海报图,用到的产品列在旁边。
Looksmith 的前六个妆容在完成引导流程后免费赠送,之后用购买的点数包运行,没有订阅制。隐私政策说明了你发送的照片会经历什么。
两者都没解决的问题
两种工具都碰不到质地、持妆或气味。AR 滤镜没法告诉你一款粉底到了中午会不会卡进细纹里,生成的图也不能,因为两者靠的都是单一瞬间,产品本身不在现场。生成出来的一张图也不是在承诺某一支具体的产品,就一定能画出一模一样的效果。
两种工具做的其实是同一件事:缩小值得实际去试的选项范围,只是从不同的方向去缩。滤镜在你动起来的过程中先排除掉不合适的色系,生成的图则告诉你整套组合是不是属于你。选错工具,正是很多人得出“虚拟试妆没用”这个结论的原因。这两种方式之后要走的实体步骤,写在不买也能试妆的方法里。