匿名模型上线,开发者第一反应往往不是测智商,而是测Tokenizer——词表与视频编码留下的「数字指纹」,有时比公关稿更接近真相。
Ox Alpha是2026年8月20日以匿名身份出现在OpenRouter上的大模型,OpenRouter仅称来自暂时匿名的第三方提供商。因「Ox」与「牛」谐音,叠加网络梗,国内开发者称之为「牛来大模型」。公开规格显示:上下文约104.86万token,单次最大输出约13.1万token,支持文本、图片与视频输入,强调代码工程、长周期Agent与复杂推理;OpenCode随后接入OpenCode Go,曾连续数日近乎不限量免费使用且不计入用户原有Go额度,吸引大量开发者用代码库与终端任务实测,累计使用量达数百B token级、数万独立用户。
身份溯源目前集中在两家候选:智谱与谷歌。支持智谱血缘的社区证据包括:Tokenizer测试显示Ox Alpha与GLM-5.3对同一混合中英文、代码与emoji文本的token计数存在稳定偏移(例如同样内容GLM-5.3为68 token、Ox Alpha为143 token,差额或可由隐藏System Prompt解释);25组Prompt验证观察到类似固定关系。多模态侧,受控测试视频显示Ox Alpha与GLM-5V-Turbo在帧率变化、时长增长(约每秒147 token)与分辨率缩放上的token预算高度相似,四项控制视频额外预算可逐项对齐;MiMo、Qwen、GLM-4.6V等呈现不同特征。API层有人为传入异常参数捕获到类似「temperature parameter is illegal」的错误信息,风格与智谱服务相近。背景上,OpenRouter 2026年2月匿名模型Pony Alpha最终被揭晓为GLM-5早期测试版,强化了「智谱又来」的第一反应。
支持谷歌的论据主要来自产品画像与社媒:1M级上下文、原生图像视频、长期Agent与复杂代码工程与Gemini路线相似;Gemini 3.5 Pro发布节奏一拖再拖,Google DeepMind员工在相关讨论中的发言被社区解读为暗示。尚无公开铁证定论。
能力评测的分歧:
产业观察上,Ox Alpha热闹反映了两件事:一是代码Agent场景仍缺「够长上下文+够狠输出+够便宜」的组合;二是模型身份越来越难解——蒸馏、后训练与第三方推理层让「谁训练的」与「谁部署的」成为两道题。另有调侃称或为Cursor等工具拿开源GLM再训一层,尚无证实。可以把它想成:匿名期是免费众测窗口,Tokenizer是众包亲子鉴定——哞声再大,也得等OpenRouter或厂商牵牛回家。
需要把边界读清楚。Tokenizer与视频token测试来自社区,非官方鉴定;「trained by Z.ai」等截图证据等级更低。下一观察点是匿名期结束后的官方归属与定价策略。