编程智能体最烦人的不是不会写代码,而是每一条命令都要你点「允许」——Anthropic决定把默认改成「自动跑,危险再拦」。
Anthropic是美国前沿模型实验室,以Claude系列模型与企业安全叙事著称。Claude Code是其面向软件工程的编程Agent(coding harness):模型负责理解与规划,Harness负责调终端、改仓库、跑测试、留下可审计轨迹。所谓Auto mode,白话就是减少逐步人工审批,把「要不要执行这条工具调用」交给分类器先判一判,只在高风险时打断你。
公司于8月7日在官方博客宣布:自8月14日起,Pro、Max与Team套餐的新会话将默认启用Auto mode;若用户此前已自行设定其他默认模式,可能收到一次性切换提示;已锁定(pinned)默认的用户不受影响。Enterprise、Claude API以及AWS/Bedrock、Google Cloud Agent Platform、Microsoft Foundry等通道暂仍为可选开启;公司计划在约一个月内与云伙伴推动默认化,并提前通知企业管理员。分类器额外token开销对Pro/Max/Team用户即日起不再计费。
机制与安全口径(公司披露):
权限疲劳,白话就是弹窗太多,人会变成「同意机器」。Anthropic的论点很锋利:与其假装每个人都会认真审每一条命令,不如承认习惯性点击,并把安全预算花在分类器、硬拒绝规则、提示注入探针和git状态感知上。官方亦强调:Auto mode降低风险,并不消灭风险;高利害生产变更仍建议人工复核。
把这件事放进编程Agent竞赛看:赛道已从「能不能补全函数」走到「能不能通宵跑完、早上交出可合并PR」。少打扰用户,才能让长程任务成立;但少打扰必须配得上拦截率,否则只是把事故从「点错同意」换成「没人看着」。下一观察点是Enterprise默认化时间表,以及真实生产事故率能否对得上红队与对照实验——默认开关一拨,整个行业的安全基线也会被重新定价。