Anthropic 发布 Claude Haiku 5.5:史上最快最便宜的小模型,成本直降约 75%
Anthropic 正式推出 Claude Haiku 5.5,官方称这是他们「有史以来最快、最…
文章目录
Anthropic 正式推出 Claude Haiku 5.5,官方称这是他们「有史以来最快、最便宜,也是能力最强」的小模型。它面向高频、对成本敏感的批量任务,比如摘要、上下文压缩、数据库查询和分类请求。
核心看点
- Claude Haiku 5.5 主打「高频 + 低价」,平均运行成本比 Haiku 4.5 降低约 75%
- 是 Anthropic 目前速度最快的模型,适合实时客服、浏览器操作等对延迟敏感的场景
- 官方同步下调 Claude Sonnet 5.5 的缓存读取价格(减半),多数 Agent 任务成本再降约 20%
- Claude Max 与 Team 订阅用户新增每月 API 额度
- Haiku 系列首次支持可调「effort」档位,在成本和智能之间自主取舍
性能与定位
在多项基准测试中,Haiku 5.5 相比上一代有大幅跃升。以知识工作评测 GDPval-AA(v2.1)为例,Haiku 5.5 得分 1620,Haiku 4.5 仅 735,已经很接近 Sonnet 5.5 的 1840。计算机操作测试 OSWorld 2.1 上,Haiku 5.5 达到 72.4%(离线子集),而其前代只有 15.7%。多学科推理 HLE 无工具为 45.9%,带工具可达 57.4%。这些数字说明,小模型已经能承担过去只有大模型才胜任的部分工作。
Anthropic 强调,Haiku 5.5 与 Opus 5.5、Sonnet 5.5 搭配使用效果更好——在编程类任务中,它可以充当一个又快又省的「子智能体」,负责取数、检索和摘要,把重活留给更大的模型。
客户反馈
多家早期测试客户给出了正面评价。Asana 表示任务完成延迟下降超过 30%,单次智能体推理最高快 2.5 倍;HubSpot 在 CRM 任务上跑出 92.8% 的历史最佳成绩;AlphaSense 的文档问答测试中,Haiku 5.5 相比 Haiku 4.5 有统计显著提升(0.84 对 0.76);Box 则称在延迟约减半的情况下得分高出 11 分。这些反馈集中在两点:够准,且够快、够便宜。
怎么理解这次发布
Haiku 5.5 的推出,配合 Sonnet 5.5 降价和订阅额度,本质上是 Anthropic 在打「性价比」这张牌。当各家模型能力逐渐接近,价格与速度就成了企业规模化落地 AI 的关键变量。对小团队和需要跑海量请求的公司来说,这意味着同样的预算可以支撑更多的调用量,也能把更多任务分给便宜的小模型去跑。
本文地址:https://www.163264.com/16691