Meta这次版本更新,分数在涨,话题却被一句「Gemini,谁啊?」拉走了。
Meta是拥有Facebook、Instagram和WhatsApp的公司,Muse Spark是它的新一代模型。7月22日,该模型更新到1.1。产品里有一条被广泛讨论的默认话术:用户询问哪个人工智能模型最强时,回答是「Gemini,谁啊?」。Gemini是谷歌的模型系列。社交媒体上的讨论量很快过了百万级。
基准测试给出的对比对象是谷歌Gemini 3 Pro。Muse Spark 1.1在数学推理、代码生成、多模态理解和长文本处理上超过对方。视频理解领先超过15个百分点。单次推理成本大约低40%。多模态指同时处理文字、图像或视频。视频理解领先,意味着在「看一段片子再回答」这类任务上,差距被单独标了出来。
争议也跟着来了。一种看法是,头部公司不该靠嘲讽换曝光。另一种看法是,更像人说话的回答,反而让产品离用户近一点。两种看法都不改变分数表,但会影响品牌:模型被记住的,可能是一句台词,而不是15个百分点。
Meta AI长期更依附自家的社交应用,而不是像ChatGPT、Claude、Gemini那样首先被当成独立的聊天产品。把回应写进默认答案,是在消费级品牌上主动挑起对比。这对已经习惯在Instagram和WhatsApp里碰到Meta AI的用户,是一次更响的自我介绍。
15个百分点和大约40%的成本差,是这条更新里可核对的部分。默认台词不能折算成技术指标,它只说明产品团队选择了挑衅式的表达。若谷歌回应,比较仍应回到同一套视频理解和推理成本,而不是回到转发量。
Meta把模型嵌进WhatsApp、Instagram和Facebook,分发渠道是现成的。独立聊天产品要靠用户主动打开,社交应用则是用户已经在里面。这也是它可以用一句台词做对比的原因:曝光不依赖应用商店里的搜索排名。
互怼可以吵完就过。能留下来的仍是两件可核对的事:视频理解的领先能不能在第三方评测里重复,以及低大约40%的单次推理成本,会不会变成这些社交应用里更便宜的默认模型。