陈大年|创立StartLux押注本地大模型,27B预览在信通院MCP测试居次

PromptTree|阅读 0
2026/09/04 09:23
StartLux陈大年本地大模型Agent
盛大系连续创业者陈大年创立StartLux(上海原点星辉),主打本地模型商业化。StartLux-V1.0-27B-Preview以Qwen3.6-27B为基座,信通院MCP-Universe综合约39.25%居第二,接近万亿级DeepSeek-V4-Pro;目前仅受控测试,备案完成后拟开源。

云端大模型再强,若数据必须持续上传、按Token长年付费,对隐私敏感与内网场景仍是一道门槛。近窗,盛大系连续创业者陈大年带着StartLux(上海原点星辉科学技术有限公司)重新入场,公开叙事只有一句:做全球首家主打本地模型商业化的AI公司——把能力、数据与控制权留在个人设备与本地工作站。

StartLux由陈大年任CEO、郭权玮博士任CTO。陈大年是中国初代程序员,曾参与创立盛大网络、连尚网络,并孵化过国民级产品「WiFi万能钥匙」;淡出公众视野约十年后,他把赌注押在「小而美的本地模型」而非再追一张云端旗舰榜。公司官网强调:本地不只是部署方式,更意味着隐私、长期成本与自主控制权。

产品与训练要点:

  1. 型号:StartLux-V1.0-27B-Preview,约27B稠密模型,面向工具调用与通用Agent
  2. 基座:以Qwen3.6-27B做后训练定向增强
  3. 方法:采用「AI训练AI」(Auto Research)——模型在真实工具环境中自主执行任务,按环境反馈持续迭代;公司称此为国内首个以此方案完成后训练的本地Agent模型
  4. 硬件门槛公开口径:约16GB及以上显存消费级显卡(如RTX 4060 Ti 16G、4090、5090等),或高内存版Apple芯片;更低显存适配仍在推进
  5. 商业计划:完成审核后拟开源,现阶段暂无收费计划

评测页给出可核对数字。中国信通院MCP-Universe专项测试中,Overall Micro Pass@1约39.25%(272/693),Overall Macro Pass@1约38.89%,六款参测模型中居第二:超过约284B的DeepSeek-V4-Flash与约198B–201B量级的Step系Flash对照,与约1.6万亿参数的DeepSeek-V4-Pro综合差距约1个百分点。分项上,位置导航排名第一,浏览器自动化、金融分析等任务出现并列第一或独占第一的口径。公司注明测试自8月3日起按当日市场最新版本取样,并由信通院三轮完整测试取平均。

所谓本地大模型,白话是模型装在自己的电脑或工作站上跑,问题与文件不必默认送进第三方云端;所谓Auto Research,白话是让模型在真实工具闭环里自己练「办事」,而不是只刷静态题库。对开发者,这意味着验收要从「聊天好不好」换成「离线/内网能不能稳定完成多步任务」。

放在行业上下文里,DeepSeek、Kimi、千问等把云端旗舰与开源权重卷得极深,本地侧长期缺一张「官方评测可核对、消费级机能跑」的成绩单。StartLux用信通院MCP专项把讨论钉在Agent任务通过率上,等于主动邀请对照:27B本地能不能逼近万亿云端。竞品若只有量化体积与聊天演示,会显得证据链偏软。

产业影响上,若备案与开源兑现,会抬高「本地Agent可采购」的叙事权重;若长期停在受控测试,市场仍会回到「能不能装、能不能稳、谁来售后」。需要把边界读清楚:榜单为信通院专项与公司官网口径,不等于全场景通用;面向公众服务须按生成式AI管理办法完成备案,当前仅对少量受邀人员开放限量测试。下一观察点是备案节点、开源节奏与真实消费级机型上的长时稳定性。