眼镜如果一直在看、一直在听,它就不再是相机配件。7月8日,Meta正在测试一款具备“超级感知”能力的AI眼镜原型。
Meta做社交平台,也做Ray-Ban Meta智能眼镜。这副原型集成摄像头、麦克风和传感器,配合Llama系列以及新一代Watermelon模型的端侧能力。端侧,白话就是计算尽量在眼镜本地完成,而不是每帧都上传。公开功能包括全天候环境感知、实时翻译、视觉问答、人物识别和信息提醒:使用者看见、听见的,AI也可以看见、听见,并做增强。
和2024年发布的Ray-Ban Meta比,这是代际差别。前者销量超过百万副,能力是拍照加语音助手。原型直接瞄准持续陪伴,而不是等用户按下快门。
隐私争议同步出现。持续摄像和录音,意味着在公共场所可能录下旁人的对话和画面。原文把历史对照放在谷歌眼镜:2013年至2015年,Google Glass因隐私争议退出消费市场。Meta要处理的是同一条法律边界:公共场所的拍摄和录音,谁同意,谁负责。
战略上,眼镜被写成最自然的可穿戴设备。如果跑通,它会被当作智能手机之后的计算入口候选,与苹果Vision Pro的空间计算、传出的OpenAI与Jony Ive硬件合作、以及xAI和Tesla Optimus的机器人路线并列。后一条里,Jony Ive仍是“传”,不是已发布的产品。
扎克伯格公开承认,AI智能体开发没有按预期加速。硬件这边没有减速,反而用这副眼镜加码。原文的解释是:硬件渗透比软件Agent的迭代更可控,AI原生硬件成为新的押注点。
端侧决定这副眼镜能不能长时间戴。Llama系列和Watermelon被写成本地模型,用来做感知、翻译、视觉问答、人物识别和提醒。若每一帧都上传,功耗和隐私都会更差。Ray-Ban Meta已经卖过百万副,说明可拍照的眼镜有人买;原型要证明的是持续开着摄像头和麦克风,也有人愿意戴,并且旁人的权利有设计可以交代。
原型不是开售日期。人物识别放到公共场所,监管阻力会比翻译功能更大。下一步看Meta是否公布指示灯、本地存储和旁人知情的设计,而不是只演示“它认识你”。