Opus 负责「难而重」的活,Sonnet 负责「又快又够用」——Anthropic 用 5.5 把这条分工又拧紧了一圈。
Anthropic 官方博客宣布推出 Claude Sonnet 5.5,为 Claude 5.5 家族第二款模型(接在 Opus 5.5 之后)。公司称其较 Sonnet 5 生成速度提升逾 30%,因 Token 更省,多数工作单任务成本可降约 30%;标价仍为每百万输入 token 2 美元、输出 10 美元。定位是日常编码、修 bug、制作文档幻灯片与表格等界定清晰的任务,并强调设计与协作体验;更小的 Haiku 5.5 预计数周内加入同一家族。
评测口径(公司公布): Terminal-Bench 4.0 智能体编码 70.6%(Sonnet 5 为 10.3%);CursorBench 4.0 约 55.5%;GDPval-AA 等知识工作指标接近 Opus 5.5;OSWorld 2.1 计算机使用部分分约 80.1%。Epic、Slack、Zendesk、Cursor/SpaceXAI、Unity、Lovable、Atlassian 等早期测试方给出速度、工具调用次数与完成质量方面的正面反馈。安全侧称自动化行为审计多数指标优于或持平 Sonnet 5;因网络安全能力接近 Opus 5,Sonnet 5.5 成为首个配备同类 cyber 护栏与回退机制的 Sonnet,并加强对蒸馏攻击与思考轨迹保护。
模型已在 Anthropic 平台及 AWS、Google Cloud、Azure 等提供,API 标识 claude-sonnet-5-5,并支持零数据保留选项。对开发者,这是把「高性价比 Agent 编码」默认档再抬一档;复杂开放式任务公司仍推荐 Opus。事实以 Anthropic 官方博文与系统卡为准。