云端大模型再强,若数据必须持续上传、按Token长年付费,对隐私敏感与内网场景仍是一道门槛。近窗,盛大系连续创业者陈大年带着StartLux(上海原点星辉科学技术有限公司)重新入场,公开叙事只有一句:做全球首家主打本地模型商业化的AI公司——把能力、数据与控制权留在个人设备与本地工作站。
StartLux由陈大年任CEO、郭权玮博士任CTO。陈大年是中国初代程序员,曾参与创立盛大网络、连尚网络,并孵化过国民级产品「WiFi万能钥匙」;淡出公众视野约十年后,他把赌注押在「小而美的本地模型」而非再追一张云端旗舰榜。公司官网强调:本地不只是部署方式,更意味着隐私、长期成本与自主控制权。
产品与训练要点:
评测页给出可核对数字。中国信通院MCP-Universe专项测试中,Overall Micro Pass@1约39.25%(272/693),Overall Macro Pass@1约38.89%,六款参测模型中居第二:超过约284B的DeepSeek-V4-Flash与约198B–201B量级的Step系Flash对照,与约1.6万亿参数的DeepSeek-V4-Pro综合差距约1个百分点。分项上,位置导航排名第一,浏览器自动化、金融分析等任务出现并列第一或独占第一的口径。公司注明测试自8月3日起按当日市场最新版本取样,并由信通院三轮完整测试取平均。
所谓本地大模型,白话是模型装在自己的电脑或工作站上跑,问题与文件不必默认送进第三方云端;所谓Auto Research,白话是让模型在真实工具闭环里自己练「办事」,而不是只刷静态题库。对开发者,这意味着验收要从「聊天好不好」换成「离线/内网能不能稳定完成多步任务」。
放在行业上下文里,DeepSeek、Kimi、千问等把云端旗舰与开源权重卷得极深,本地侧长期缺一张「官方评测可核对、消费级机能跑」的成绩单。StartLux用信通院MCP专项把讨论钉在Agent任务通过率上,等于主动邀请对照:27B本地能不能逼近万亿云端。竞品若只有量化体积与聊天演示,会显得证据链偏软。
产业影响上,若备案与开源兑现,会抬高「本地Agent可采购」的叙事权重;若长期停在受控测试,市场仍会回到「能不能装、能不能稳、谁来售后」。需要把边界读清楚:榜单为信通院专项与公司官网口径,不等于全场景通用;面向公众服务须按生成式AI管理办法完成备案,当前仅对少量受邀人员开放限量测试。下一观察点是备案节点、开源节奏与真实消费级机型上的长时稳定性。