我在浏览器里打开了实时 AI 换脸,然后重新想了一遍“真实”

yhc2073
·
·
IPFS
当屏幕里的另一张脸跟着我眨眼、说话和做手势,我第一次清楚地感到:视频里的动作可以是真的,身份却可以是生成的。面对越来越自然的实时画面,我们还能怎样确认对面是谁?

我在浏览器里打开 Vivify平台 进行实时 AI 换脸时,摄像头和 AI 输出被放在同一个界面里。左边是坐在镜头前的我,右边是AI根据我上传的参考图生成的实时画面。原本绑在一起的动作和面孔,就这样被拆成了两部分。

实时换脸效果对比

屏幕里的“她”,会跟着我一起动

我眨眼,她也眨眼;我开口说话,她的嘴唇跟着移动;我抬手做了一个动作,屏幕里的画面也作出相同的回应。表情、眼神、嘴部动作和手势,几乎都跟着镜头里的我变化。

奇怪的是,我很清楚右边的人不是我,动作却又确实来自我。她看起来像一个正在和我同时说话的人,而不是一张贴在视频上的静态照片。

这次体验让我第一次非常直观地感到:一段视频可以保留我的即时反应,却不再保留我的可见身份。

动作是真的,不代表身份也是真的

过去我们判断视频真假,常常会观察嘴形、眼神和动作是否自然。可当这些细节都能跟着真人实时变化时,“看起来会动”本身就不再足以证明身份。

这并不意味着画面里的每个细节都完美,也不意味着任何光线、角度和网络条件下都会稳定。但在普通的视频交流里,人通常不会逐帧寻找破绽。只要表情、语气和动作足够连贯,我们就很容易把“画面自然”进一步理解成“对面是本人”。

真正需要重新考虑的,可能不是 AI 能不能生成一张逼真的脸,而是我们过去为什么那么容易相信视频。

如果视频通话也不能证明身份

当视频里的脸和动作都很自然,普通人还能怎么分辨真假?我现在能想到的答案,不是训练自己成为图像鉴定专家,而是减少对单一画面的信任。

如果一次视频通话突然涉及转账、验证码、账户权限或重要决定,看到熟悉的脸、听到熟悉的说话方式,都不应该成为唯一依据。更稳妥的做法,是通过自己保存的号码重新联系,换一个沟通渠道,或者询问只有双方知道、而且没有公开在社交网络上的信息。

对创作者来说,另一条边界同样重要:只使用本人或已经获得明确授权的参考身份,并在公开分享时说明画面经过 AI 生成。技术可以把动作和身份拆开,使用者仍然需要把它们的来源交代清楚。

现在它还只是浏览器预览

当前的 Vivify 实时 AI 换脸页面 只能在浏览器中进行短时预览,还没有客户端或手机 App,也不提供录制、下载、虚拟摄像头或生产直播输出。这张页面不能直接替换手机视频通话的画面。

但它让我看见了一种已经可以被体验的能力:真人的即时动作与另一张可见身份,能够在同一个实时画面里结合。至于它什么时候、会不会进入普通视频通话,我不能从这次体验下结论。

我只能确定,打开页面之前,我关心的是换得像不像;关掉页面之后,我开始怀疑另一件事:以后当一张脸隔着屏幕看着我、回应我、跟我说话时,我还会不会像现在这样自然地相信,对面就是本人?

CC BY-NC-ND 4.0 授权
已推荐到频道:时事・趋势

喜欢我的作品吗?别忘了给予支持与赞赏,让我知道在创作的路上有你陪伴,一起延续这份热忱!

yhc2073Indie hacker, working on https://vivify.video
  • 来自作者

不用下載,也不用 GPU:現在即時 AI 換臉已經這麼簡單了