Anthropic|公开研发追踪,Claude已承担内部AI研究的相当部分

PromptTree|阅读 0
2026/09/20 06:04

描述:据WIRED报道,Anthropic本周公布追踪方法,称Claude已完成其约26%的AI研发,年初这一比例为零;安全相关研究约占算力预算的6%。

标签:Anthropic, Claude, 递归改进, 安全研究

实验室一边讨论要不要减速,一边开始公布「模型已经在帮我们做研究」的比例。Anthropic把这个数字放进了新的追踪方法里。

Anthropic是美国人工智能公司,Claude是其模型产品线。WIRED在9月18日的报道中称,Anthropic本周公布了若干用来观察人工智能推进有多快、以及可能有多危险的方法。例证之一是:Claude现在完成该公司约26%的人工智能研发,而2026年年初这一比例为零。另一项是:用于弄清如何让人工智能更安全的算力,约占算力预算的6%。

26%不是「Claude写了四分之一的论文标题」,而是公司内部对研发工作自动化程度的统计口径。年初接近零,说明这不是老功能被重新宣传,而是半年量级里从几乎不主导,变成能拿走一块完整研发份额。6%的安全算力则是分母问题:如果几乎所有算力都在堆能力,安全工作即使团队很忙,占比仍可能很小。把两个数放在一起,读者才能判断「安全是不是只停留在声明」。

这和「用模型聊天写代码」不是同一件事。研发追踪指的是模型参与模型自己的改进:读实验、改训练、做评估。行业里把类似循环叫做递归式改进,白话就是系统开始参与制造下一代系统。公开比例的价值在于可被以后的数字打脸。若下个月这个比例继续升、安全算力占比不升,减速讨论就缺少内部证据。

WIRED没有在同一处公布统计窗口的起止日期、26%对应的任务清单,以及6%是否只含对齐实验、不含内容审核或红队。这些空白意味着现在还不能把数字当成审计报告。能确认的是:Anthropic选择用内部比例,而不是只用外部榜单,来描述自己离「模型做研究」有多近。

下一步看两点。一是方法学是否开放到外部可以复算;二是安全算力占比会不会和能力侧的自动化一起上升。只涨前者,追踪本身就会变成加速的证据。