我在浏览器里打开了实时 AI 换脸,然后重新想了一遍“真实”
我在浏览器里打开 Vivify平台 进行实时 AI 换脸时,摄像头和 AI 输出被放在同一个界面里。左边是坐在镜头前的我,右边是AI根据我上传的参考图生成的实时画面。原本绑在一起的动作和面孔,就这样被拆成了两部分。
屏幕里的“她”,会跟着我一起动
我眨眼,她也眨眼;我开口说话,她的嘴唇跟着移动;我抬手做了一个动作,屏幕里的画面也作出相同的回应。表情、眼神、嘴部动作和手势,几乎都跟着镜头里的我变化。
奇怪的是,我很清楚右边的人不是我,动作却又确实来自我。她看起来像一个正在和我同时说话的人,而不是一张贴在视频上的静态照片。
这次体验让我第一次非常直观地感到:一段视频可以保留我的即时反应,却不再保留我的可见身份。
动作是真的,不代表身份也是真的
过去我们判断视频真假,常常会观察嘴形、眼神和动作是否自然。可当这些细节都能跟着真人实时变化时,“看起来会动”本身就不再足以证明身份。
这并不意味着画面里的每个细节都完美,也不意味着任何光线、角度和网络条件下都会稳定。但在普通的视频交流里,人通常不会逐帧寻找破绽。只要表情、语气和动作足够连贯,我们就很容易把“画面自然”进一步理解成“对面是本人”。
真正需要重新考虑的,可能不是 AI 能不能生成一张逼真的脸,而是我们过去为什么那么容易相信视频。
如果视频通话也不能证明身份
当视频里的脸和动作都很自然,普通人还能怎么分辨真假?我现在能想到的答案,不是训练自己成为图像鉴定专家,而是减少对单一画面的信任。
如果一次视频通话突然涉及转账、验证码、账户权限或重要决定,看到熟悉的脸、听到熟悉的说话方式,都不应该成为唯一依据。更稳妥的做法,是通过自己保存的号码重新联系,换一个沟通渠道,或者询问只有双方知道、而且没有公开在社交网络上的信息。
对创作者来说,另一条边界同样重要:只使用本人或已经获得明确授权的参考身份,并在公开分享时说明画面经过 AI 生成。技术可以把动作和身份拆开,使用者仍然需要把它们的来源交代清楚。
现在它还只是浏览器预览
当前的 Vivify 实时 AI 换脸页面 只能在浏览器中进行短时预览,还没有客户端或手机 App,也不提供录制、下载、虚拟摄像头或生产直播输出。这张页面不能直接替换手机视频通话的画面。
但它让我看见了一种已经可以被体验的能力:真人的即时动作与另一张可见身份,能够在同一个实时画面里结合。至于它什么时候、会不会进入普通视频通话,我不能从这次体验下结论。
我只能确定,打开页面之前,我关心的是换得像不像;关掉页面之后,我开始怀疑另一件事:以后当一张脸隔着屏幕看着我、回应我、跟我说话时,我还会不会像现在这样自然地相信,对面就是本人?
喜欢我的作品吗?别忘了给予支持与赞赏,让我知道在创作的路上有你陪伴,一起延续这份热忱!
