Ox Alpha|匿名「牛来」模型溯源:Tokenizer与视频编码指向智谱或谷歌

PromptTree|阅读 0
2026/08/23 20:23
Ox AlphaOpenRouter智谱超长上下文
8月20日上线的匿名模型Ox Alpha(网友称「牛来大模型」)在OpenRouter与OpenCode等平台引发身份溯源讨论:社区测试显示其Tokenizer计数与GLM-5.3存在固定偏移关系,视频输入token预算与GLM-5V-Turbo高度相似;亦有线索指向谷歌Gemini下一代。模型支持约104.86万token上下文、约13.1万token最大输出,面向代码、长周期Agent与复杂推理,OpenCode曾长期近乎不限量免费开放。

匿名模型上线,开发者第一反应往往不是测智商,而是测Tokenizer——词表与视频编码留下的「数字指纹」,有时比公关稿更接近真相。

Ox Alpha是2026年8月20日以匿名身份出现在OpenRouter上的大模型,OpenRouter仅称来自暂时匿名的第三方提供商。因「Ox」与「牛」谐音,叠加网络梗,国内开发者称之为「牛来大模型」。公开规格显示:上下文约104.86万token,单次最大输出约13.1万token,支持文本、图片与视频输入,强调代码工程、长周期Agent与复杂推理;OpenCode随后接入OpenCode Go,曾连续数日近乎不限量免费使用且不计入用户原有Go额度,吸引大量开发者用代码库与终端任务实测,累计使用量达数百B token级、数万独立用户。

身份溯源目前集中在两家候选:智谱与谷歌。支持智谱血缘的社区证据包括:Tokenizer测试显示Ox Alpha与GLM-5.3对同一混合中英文、代码与emoji文本的token计数存在稳定偏移(例如同样内容GLM-5.3为68 token、Ox Alpha为143 token,差额或可由隐藏System Prompt解释);25组Prompt验证观察到类似固定关系。多模态侧,受控测试视频显示Ox Alpha与GLM-5V-Turbo在帧率变化、时长增长(约每秒147 token)与分辨率缩放上的token预算高度相似,四项控制视频额外预算可逐项对齐;MiMo、Qwen、GLM-4.6V等呈现不同特征。API层有人为传入异常参数捕获到类似「temperature parameter is illegal」的错误信息,风格与智谱服务相近。背景上,OpenRouter 2026年2月匿名模型Pony Alpha最终被揭晓为GLM-5早期测试版,强化了「智谱又来」的第一反应。

支持谷歌的论据主要来自产品画像与社媒:1M级上下文、原生图像视频、长期Agent与复杂代码工程与Gemini路线相似;Gemini 3.5 Pro发布节奏一拖再拖,Google DeepMind员工在相关讨论中的发言被社区解读为暗示。尚无公开铁证定论。

能力评测的分歧:

  1. 社区10项真实软件工程小样本测试中,Ox Alpha完成8项(80%),高于部分对比模型,但样本极小,非官方基准。
  2. Stripe CEO Patrick Collison公开称表现「非常惊艳」;Abacus.AI CEO Bindu Reddy称实测低于预期;沃顿商学院Ethan Mollick称惊艳程度一般;亦有开发者认为低推理强度下一般、视觉弱于Gemini。

产业观察上,Ox Alpha热闹反映了两件事:一是代码Agent场景仍缺「够长上下文+够狠输出+够便宜」的组合;二是模型身份越来越难解——蒸馏、后训练与第三方推理层让「谁训练的」与「谁部署的」成为两道题。另有调侃称或为Cursor等工具拿开源GLM再训一层,尚无证实。可以把它想成:匿名期是免费众测窗口,Tokenizer是众包亲子鉴定——哞声再大,也得等OpenRouter或厂商牵牛回家。

需要把边界读清楚。Tokenizer与视频token测试来自社区,非官方鉴定;「trained by Z.ai」等截图证据等级更低。下一观察点是匿名期结束后的官方归属与定价策略。