开源大模型竞争已不只比榜单分数,还比激活参数、上下文长度与API单价能不能对齐头部闭源口径。腾讯公开Hy4 preview:总参数约770B、激活约49B、上下文约1M,并自述在编程、智能体与科研相关榜单上进入开源第一梯队。权重与体验入口覆盖Hugging Face、GitHub、魔搭、TokenHub与WorkBuddy等渠道,方便开发者直接试用。
腾讯在大模型与云开发者工具链上持续投入,Hy4 preview可看作其面向开源社区与API调用方的新一轮产品化动作:一边放出可下载或可体验的权重入口,一边给出透明价目,试图进入开发者默认工具栈的候选名单。
规格层面,公开材料给出的关键数字是总参约770B、激活约49B、上下文约1M。厂商自述其在编程、智能体与科研相关榜单处于开源第一梯队;体验与分发渠道包括Hugging Face、GitHub、魔搭、TokenHub与WorkBuddy。API定价约按每百万Token计:输入约6元、输出约18元,缓存命中约0.3元,公开材料称该口径对齐DeepSeek V4 Pro。
规格与定价要点:
所谓激活参数,白话是MoE(混合专家)结构里每次推理真正点亮的那部分专家,而不是把全部约770B都算一遍——这直接关系到推理成本与吞吐。百万级上下文则面向长文档、长会话与复杂Agent轨迹;是否真正开箱即用,仍取决于注意力实现、截断策略与账单上限。缓存命中价则鼓励重复上下文场景复用前缀,降低长对话账单。
国产开源赛道近期的常见打法,是用「高总参、相对可控激活、长上下文、透明价目」组合抢开发者心智。Hy4 preview把这几项写进同一份材料,并主动把API价与DeepSeek V4 Pro对齐叙述,说明价格战与规格战已经绑在一起。对智能体开发者,长上下文承诺很诱人,但真正决定留存的是同题编程与工具调用任务上的失败重试成本。
产业影响上,更多团队会把Hy4放进候选评测池:一边比私有化与开源许可是否友好,一边比同预算下的编程与Agent工单完成率。preview阶段也意味着权重、许可与速率限制仍可能调整,企业采购不宜只看首发海报。
需要把边界读清楚:「开源第一梯队」属厂商自述,独立基准与污染排查仍必要。下一观察点是正式版定价是否维持、企业私有化部署方案,以及长上下文在真实Agent工单上的有效利用率。