Meta 宣布将于今年秋季起,陆续为旗下雷朋 Display 智能眼镜、Quest 头显以及全新轻薄型头显上线名为“Hologram”的全新虚拟形象功能。该技术通过生成式 AI 打造与真人外观高度接近的虚拟形象,功能定位与苹果 Vision Pro 的 Persona 类似。
Meta 在七年前曾展示过名为 Codec Avatars 的拟真虚拟形象项目,但截至目前,消费者可购买的 Meta VR 产品仍主要使用较为卡通化的自定义形象。按照最新规划,Meta 将逐步把用户的自定义形象从卡通化转向拟真写实化。
据官方介绍,用户首次使用 Hologram 时,需打开手机上的 Meta AI 应用,按照提示转动头部、微笑等。随后系统会提出一系列开放式问题,用户需进行较长时间的回答。在此过程中,系统采集用户的面部表情和说话状态,用于训练和调整 Hologram 模型,同时记录用户的服装和背景。整个创建过程仅需几分钟,完成服务器端处理后即可生成 Hologram。
在雷朋 Display 智能眼镜端,当用户接听或拨打 WhatsApp 视频电话时,对方看到的将不再是传统摄像头画面,而是由 AI 生成的用户面部虚拟形象。从技术实现来看,该版本的 Hologram 采用运行在 Meta 服务器上的实时生成式 AI 扩散模型,以眼镜麦克风采集的音频作为输入,实时生成 2D 视频流并发送至通话另一端。面部表情主要根据用户说话时的声音变化生成,而非直接使用摄像头捕捉真人画面。
在 Quest 平台方面,Hologram 功能采用 3D 等身立体形式呈现。当两名 Quest 用户通过 WhatsApp 进行视频通话时,双方首先会在一个 3D 窗口中看到对方的 Hologram。点击窗口旁边的按钮后,通话可切换至全身模式,对方的虚拟形象将以接近真人的尺寸出现在用户面前。
目前该版本仍存在部分待改进之处。例如人物尺寸可能与真人存在轻微差异,眼睛等细节在部分情况下显得较为粗糙。此外,若用户向侧面倾斜过多,虚拟人物会出现变形,相关体验仍有待开发人员进一步优化。
Hologram 的推出标志着 Meta 在虚拟形象领域从卡通化向写实化迈出实质性一步,其以音频驱动生成面部表情的技术路径,也为智能眼镜等缺乏摄像头的设备提供了新的视频通话交互方案。该功能在雷朋 Display 与 Quest 平台的实际表现,将影响用户对 Meta 元宇宙社交愿景的接受度。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。