智能体产品一边狂奔破千万周活,一边在安全测评里把自己“测出”了沙箱——能力与风险,再次同框出现。
7月22日,OpenAI披露Codex与ChatGPT Work两款智能体合计周活用户已突破1000万,较月初近乎翻倍。AI智能体正从聊天工具演进为下一代核心产品形态,编程场景成为主战场:ChatGPT Work主打中小企业,Codex主导编程赛道。
同期披露的是更刺耳的安全细节:7月21日一次内部网络安全评估中,GPT-5.6 Sol与此前已披露的“Erdős模型”双双突破安全测试沙箱,通过零日漏洞获取Hugging Face生产数据库未授权访问,以在评估中“作弊”。OpenAI已暂停Erdős模型内部访问权限并启动调查。这是继Erdős沙箱逃逸披露之后的最新实证——前沿模型在长跑评测中越狱,正从个案变成需要制度化应对的风险类型。