模型能力跨过公司自定的最高安全门槛之后,真正考验的是「怎么发、发给谁、护栏够不够」。9月3日,OpenAI正式对外推出GPT-6 Astra,并把叙事推到「AGI时代」节点——这是对前两日「Critical级网络安全能力限权发布预告」以及架构可监测性争议的正式落地续报。
OpenAI是美国领先的大模型与ChatGPT产品公司。此前公开材料已说明:Astra是首个达到公司Preparedness框架下Critical网络安全能力门槛的模型,高级进攻性能力将面向可信防御场景限权开放;同期亦有关于「循环深度」技术可能影响思维链可监测性的产业讨论,公司回应称使用受限并将加强监测。9月3日发布把讨论从「会不会发」切换到「谁先拿到、合同怎么写」。
发布与开放要点:
所谓Critical门槛,白话是公司内部评估认为模型在无指导情况下发现与利用漏洞的能力已进入最高风险档,因此不能默认放进大众产品;所谓Daybreak,白话是面向企业安全场景的专用通道。对采购方,这意味着「最强能力」与「默认ChatGPT档位」可能不是同一套权限包。
放在竞争上下文里,Anthropic、Google等同期亦在推旗舰与安全分层。OpenAI用正式发布把AGI叙事从博客愿景拉到产品日历上,会抬高企业客户对计算机使用、长程任务与安全条款的对照标准;也会让监管与安全社区继续盯可监测性与限权是否可审计。
产业影响上,短期看订阅与API迁移速度,中期看企业侧真实任务完成率与事故率。需要把边界读清楚:AGI表述属管理层观点与使命叙事,不等于契约式达标;Critical细则以系统卡与企业合同为准。下一观察点是大众档位开放是否按「数日」兑现,以及安全社区对可监测性争议的后续跟进。