前沿实验室的负责人开始写规则,而同一周的安全评分没有一家拿到A。
7月14日,Google DeepMind首席执行官Demis Hassabis发表《A Framework for Frontier AI and the Dawning of a New Age》,呼吁美国建立由联邦监督的AI标准机构,在前沿模型公开发布前做国家安全风险测试。方案参考美国金融业监管局FINRA的公私合作:行业出钱运转,政府保留监督。DeepMind是Google的AI研究机构,Hassabis是其负责人。
达到能力门槛的开发者会被指定为「前沿实验室」,需要发布模型卡片、维持网络安全标准,并审查接触高级系统的人员资质。机构先自愿运行,要求发布前最多30天提交独立审查,评估网络安全、生物研究、欺骗行为等危险能力。协议生效后转为强制,过于危险的模型可以触发实验室之间协调减速。Hassabis与Anthropic首席执行官Dario Amodei据称在6月七国集团峰会上,向包括特朗普总统在内的国家元首提过类似方案。Hassabis把通用人工智能说成「可能只有几年」,称当下是「奇点山脚」,潜在影响是「工业革命的10倍、10倍速」。这些是他的判断,不是已经发生的时间表。
同周,生命未来研究所FLI发布《夏2026 AI安全指数》,评估9家头部公司的37项指标。Anthropic整体C+,OpenAI为C,Google DeepMind为C,Meta为D+,xAI为F,DeepSeek与Mistral亦为F,没有一家拿到A或A-。更尖锐的一点是:Anthropic、OpenAI、Google DeepMind和Meta都已削弱或废除此前「若系统接近危险门槛就暂停开发」的承诺。加州大学伯克利分校教授Stuart Russell指出,能力竞赛更极端,企业甚至在明显不安全时仍计划发布。
欧洲在加自己的一层。欧盟委员会7月7日发布《网络安全与AI行动计划》,把先进AI模型上市前评估定为政策,目标2027年具备运行能力。8月2日,AI法案下的通用AI透明度义务生效。美国方案倾向行业出资、政府监督;欧盟走的是国家运行评估设施再加上立法。两套体系仍不一样,但都在把「发布前要被看一眼」写成制度。
FLI的字母等级是这家研究所的指数,不是政府处罚。30天预审也还是提议。下一观察点是美国会不会把自愿审查写成机构,以及那些撤回暂停承诺的实验室,会不会在下一次发布说明里重新写上停止条件。