↑

Anthropic|发布Claude Haiku 5.5,小模型降价再提速

PromptTree|阅读 0
2026/10/08 08:35
AnthropicClaude Haiku 5.5小模型推理成本API定价
Anthropic于10月7日发布Claude Haiku 5.5,宣称是迄今最快、最便宜、能力最强的Haiku模型:短请求API价格较Haiku 4.5降约90%,输入与输出分别为每百万token 0.10与0.50美元,并首次在Haiku档位加入可调effort。

当大模型都在卷「更聪明」,Anthropic这次把子弹压在了「更便宜的高频小模型」上。

10月7日,Anthropic发布Claude Haiku 5.5,补齐了Claude 5.5家族的最后一块拼图——此前Opus 5.5与Sonnet 5.5已相继上线。Haiku系列定位是高吞吐、成本敏感型任务,例如摘要、压缩、数据库查询、分类与轻量Agent子任务。官方称,这是迄今最快、成本最低、能力最强的Haiku模型。

定价: 对提示词不超过10万token的请求,API价格较前代Haiku 4.5下降约90%,输入与输出分别为每百万token 0.10美元与0.50美元;超过10万token的请求则下降约50%。综合口径下,平均运行成本较Haiku 4.5下降约75%。这一输入价格与OpenAI的GPT-6 Luna完全持平,直接把小模型价格战打到同一水位。

能力与档位: 官方基准上,Haiku 5.5在编码、computer use与知识工作上均大幅领先Haiku 4.5;在Artificial Analysis智能指数上得43分,较上一代提升26分。更关键的是,Haiku档位首次引入可调effort——调用方可自行在「省钱」与「求准」之间选择,把推理成本控制权下放给业务方。同日,Sonnet 5.5的缓存读取价也砍半。

产业含义: 小模型是Agent系统里调用量最大的「基础设施层」,单次价格微小差异会放大成可观的月度账单。Haiku 5.5用「降价+可调档位」直击高频场景的ROI痛点,也反映出模型厂商竞争重心正从「旗舰跑分」转向「单位任务成本」。观察点在于:大幅降价是否以牺牲长上下文与复杂任务稳定性为代价,以及真实业务侧的成本收益比。

事实以Anthropic官方博客与定价页面为准。