Anthropic|Claude Code将Auto mode设为Pro/Max/Team默认(8月14日起)

PromptTree|阅读 1
2026/08/10 11:36
AnthropicClaude CodeAuto modeCoding Agent安全分类器
Anthropic于8月7日宣布,自8月14日起Pro/Max/Team新会话默认启用Claude Code Auto mode;用分类器拦截不可逆/破坏性/越界动作,1053人对照实验中拦危险命令约89%对人工约13.6%;Enterprise等通道暂可选,计划约一个月内推动默认化。

编程智能体最烦人的不是不会写代码,而是每一条命令都要你点「允许」——Anthropic决定把默认改成「自动跑,危险再拦」。

Anthropic是美国前沿模型实验室,以Claude系列模型与企业安全叙事著称。Claude Code是其面向软件工程的编程Agent(coding harness):模型负责理解与规划,Harness负责调终端、改仓库、跑测试、留下可审计轨迹。所谓Auto mode,白话就是减少逐步人工审批,把「要不要执行这条工具调用」交给分类器先判一判,只在高风险时打断你。

公司于8月7日在官方博客宣布:自8月14日起,Pro、Max与Team套餐的新会话将默认启用Auto mode;若用户此前已自行设定其他默认模式,可能收到一次性切换提示;已锁定(pinned)默认的用户不受影响。Enterprise、Claude API以及AWS/Bedrock、Google Cloud Agent Platform、Microsoft Foundry等通道暂仍为可选开启;公司计划在约一个月内与云伙伴推动默认化,并提前通知企业管理员。分类器额外token开销对Pro/Max/Team用户即日起不再计费。

机制与安全口径(公司披露):

  1. 拦截目标:优先阻断不可逆、破坏性或越出当前环境的动作;被拦后模型通常自行找更安全路径,或直接向用户确认。
  2. 回退阈值:连续拦截或会话内累计拦截达到设定次数,回退到人工审批。
  3. 对照实验:1053名付费测试者中,人工审查仅拦住约13.6%的危险命令,Auto mode拦住约89%;会话越长,人类拦截率从约17%降到约5%,分类器则更平稳。
  4. 权限疲劳:用户对权限弹窗批准率约达97%;约半数活跃CLI用户手写过宽泛Bash允许规则,部分会话直接进入bypass权限模式。
  5. 生产叙事:Teams与Enterprise采纳者中,Auto mode用户PR产出约高25%;Adobe、Nuro、Gusto、Garner Health等已在生产环境使用。

权限疲劳,白话就是弹窗太多,人会变成「同意机器」。Anthropic的论点很锋利:与其假装每个人都会认真审每一条命令,不如承认习惯性点击,并把安全预算花在分类器、硬拒绝规则、提示注入探针和git状态感知上。官方亦强调:Auto mode降低风险,并不消灭风险;高利害生产变更仍建议人工复核。

把这件事放进编程Agent竞赛看:赛道已从「能不能补全函数」走到「能不能通宵跑完、早上交出可合并PR」。少打扰用户,才能让长程任务成立;但少打扰必须配得上拦截率,否则只是把事故从「点错同意」换成「没人看着」。下一观察点是Enterprise默认化时间表,以及真实生产事故率能否对得上红队与对照实验——默认开关一拨,整个行业的安全基线也会被重新定价。