欧洲开源阵营终于拿出「重量级」旗舰:名字叫Le Chonk,戏谑之外是认真的主权叙事。
10月6日,Mistral正式宣布Mistral Large 4公开预览,内部昵称「Le Chonk」。官方口径:约1万亿总参数、约490亿每token激活参数的原生多模态模型,目前可通过Mistral Studio预览API试用,完整权重计划在10月底发布。公司称其在编码、Agent工作流与多模态理解上表现突出,并宣称显著优于美国或欧洲其他开放权重模型;在网络安全、金融、法律等企业关键负载上处于开源模型前列,视觉定位等个别任务甚至超过部分闭源前沿模型。
训练与主权: ML4在Mistral位于欧洲的自有数据中心、用约3800块NVIDIA Grace Blackwell GPU从零训练约两个月,预览推理也跑在同一基础设施上。训练数据覆盖160多种语言,含欧盟全部官方语言。公司把开放权重与可自托管,明确绑到「AI主权」与网络安全场景:闭源模型常因安全策略拒绝漏洞复现与补丁类任务,而防守方又需要同等能力;开放权重允许组织在自有策略下部署。
评测摘录: 官方称在Artificial Analysis Cyber Index上跻身全球前五,并大幅领先中国以外开源模型;某漏洞复现并修补测试得分82%,高于部分因拒答接近零分的闭源模型;Cybench 40题解决率约93%。编码侧DeepSWE v1.1约61.7%、SWE-Atlas-QnA约59.4%、Terminal-Bench 4约28.3%;AutomationBench商业工作流约59.9%。视觉定位Dense 200上官方称超过GPT-6 Astra(42%对41%)。权重发布前,公司还在与网络安全机构、合作伙伴与政府侧做红队测试。
边界说明: 预览期仍在继续强化学习,最终checkpoint可能继续提升;完整基准复现需等权重落地。对产业,这是欧洲在「开放权重+自建算力」路线上的一次加码,也与同周Reflection Beam等开源发布形成对照。
事实以Mistral官方博客为准。