Anthropic 在 2026 年 10 月 7 日发布了新一代小模型 Claude Haiku 5.5,官方定位是「有史以来最快、最便宜、最能打的小模型」。相比上一代 Haiku 4.5,它在平均成本上直降约 75%,同时在多个基准测试上实现了数倍甚至十几倍的性能跃升。对于要做高并发、低成本任务的开发者和企业来说,这是一次真正意义上的质变,而不只是小幅迭代。
核心能力
Claude Haiku 5.5 延续了 Haiku 系列的定位——小参数、快响应、低价格,专门用来扛高吞吐、成本敏感的工作负载。Anthropic 官方明确列出的典型场景包括:
- 摘要与压缩:长文本摘要、上下文压缩,适合批量处理
- 数据库查询与分类:结构化的分类、打标、路由类请求
- 编码子代理:配合 Claude Opus 5.5 或 Claude Sonnet 5.5 当 subagent,把琐碎的小任务甩给它
- 速度敏感任务:实时客服、浏览器自动化(browser use)等对延迟有硬要求的场景
最值得注意的升级有两点:第一,Haiku 5.5 是 Haiku 系列第一个支持「可调努力程度」(effort setting) 的模型,用户可以在 Low / Med / High / Xhigh / Max 五档之间选择,按需在「省钱」和「更聪明」之间做取舍;第二,它的绝对性能已经追平甚至反超不少中端模型,摆脱了过去小模型「够快但不够聪明」的刻板印象。
性能提升:不止是便宜
降价的前提是性能没有缩水——事实上是大幅反超。根据 Anthropic 官方 System Card 里的基准数据,Haiku 5.5 相比 Haiku 4.5 的提升堪称夸张:
| 基准测试 | Haiku 5.5 | Haiku 4.5 | 提升幅度 |
|---|---|---|---|
| 知识工作 GDPval-AA v2.1 | 1620 | 735 | 约 2.2 倍 |
| 电脑操作 OSWorld 2.1 | 72.4% | 15.7% | 约 4.6 倍 |
| 多学科推理 HLE(无工具) | 45.9% | 10.2% | 约 4.5 倍 |
| Agent 编码 Terminal-Bench 4.0 | 39.2% | 0.0% | 从 0 到可用 |
| 视觉推理 Chartography | 46.4% | 6.4% | 约 7 倍 |
最刺眼的是 OSWorld(真实电脑操作)从 15.7% 跳到 72.4%,以及 Terminal-Bench 编码从 0 直接干到 39.2%。这意味着上一代 Haiku 几乎无法胜任的 agentic 任务,这一代已经「能用」了。不过要客观说一句:这些数字仍明显低于 Sonnet 5.5(Terminal-Bench 70.6%、OSWorld 83.9%),所以 Haiku 5.5 的定位依旧是「性价比打手」,而不是旗舰。
定价:便宜到什么程度
按每百万 token 计价,Claude Haiku 5.5 的官方定价如下:
| 项目 | Haiku 5.5(≤100K) | Haiku 5.5(>100K) | Haiku 4.5 |
|---|---|---|---|
| 输入 token | $0.10 | $0.50 | $1.00 |
| 输出 token | $0.50 | $2.50 | $5.00 |
| 缓存读取 | $0.01 | $0.05 | $0.10 |
也就是说,在绝大多数(约 90%)不超过 10 万 token 的请求里,Haiku 5.5 的输入价格只有上一代的 十分之一。官方还顺带把 Sonnet 5.5 的缓存读取价格砍半,让 agentic 任务整体再省约 20%。这一波降价,摆明了是冲着高并发场景里的成本优势去的。
使用体验 / 局限
优点:速度极快(官方称是史上最快),价格极低,且第一次支持 effort 调节,能按预算灵活升降智能程度。作为编码 subagent 或客服后端,性价比突出,几乎找不到同价位更强的对手。
局限:作为小模型,绝对智能上限仍低于 Sonnet / Opus,复杂多步推理、深度创作类任务不要指望它一骑绝尘;中文场景下虽然可用,但它的调校重心偏向「高吞吐的英文结构化任务」,纯中文长文创作不如旗舰模型细腻。
Claude Haiku 5.5 与其他同类模型横向对比
| 模型 | 定位 | 输入价格 | 本站评分 |
|---|---|---|---|
| Claude Haiku 5.5 | 小模型 / 高并发 | $0.10 / M | 8.7 |
| Claude Sonnet 5.5 | 中端主力 | $2.00 / M | 9.1 |
| Claude Opus 5.5 | 旗舰 | 更高 | 9.3 |
| GPT-6 Luna | OpenAI 小模型 | 约 $0.04 | 8.4 |
| GPT-6.1 Sol | OpenAI 效率模型 | 较低 | 8.9 |
| GLM-5.3 | 国产开源旗舰 | 较低 | 8.8 |
从上表能看出,Haiku 5.5 在小模型这个细分坐标系里几乎站到了顶点:它比 GPT-6 Luna 略贵,但性能(尤其 OSWorld 72.4% 对 48.9%)明显更强,性价比的「甜点」位置卡得很准。如果你需要一个既快又便宜、还能干点正经活的模型,它目前是首选;如果追求顶级推理质量,还是得上 Sonnet 或 Opus。
综合评分
| 维度 | 评分 | 评价 |
|---|---|---|
| 功能完整度 | 8.5 / 10 | 首次支持 effort 调节,能力覆盖摘要/编码/agent,小模型里很全 |
| 易用性 | 9.0 / 10 | 全平台上线,API 模型名 claude-haiku-5-5,接入零门槛 |
| 性价比 | 9.5 / 10 | 输入 $0.10/M,比上代便宜 75%,同档无敌 |
| 中文支持 | 8.0 / 10 | 中文可用但非调优重点,长文创作不如旗舰细腻 |
| 输出质量 | 8.5 / 10 | 数倍于上代,但仍低于 Sonnet/Opus 的天花板 |
综合评分:8.7 / 10
总结
Claude Haiku 5.5 是一次「降价 + 提质」同步到位的迭代,把「小模型」这三个字的天花板又抬高了一截。对需要高并发、强成本控制、且任务相对标准化的团队,它几乎是当前的最优解;对普通个人用户,它则是一个「够快、够用、不心疼」的高性价比选择。想看看它和其他模型的完整对比数据,可以到 AI 工具对比引擎 里直接拉一张五维对照表。
常见问题(FAQ)
Claude Haiku 5.5 免费吗?
不免费,但价格极低。API 输入 token 约 $0.10 / 百万(100K 以内),比上一代便宜约 75%。Anthropic 的 Claude 订阅用户(Pro/Max/Team)也可在聊天界面使用,Team 和 Max 订阅还新增了月度 API 额度。
Claude Haiku 5.5 和 Sonnet 5.5 该选哪个?
看任务复杂度。Haiku 5.5 适合摘要、分类、客服、编码 subagent 这类高并发标准化任务,便宜且快;Sonnet 5.5 适合需要更强推理和多步 agent 的工作,性能更高但价格也更贵。预算敏感选 Haiku,追求质量选 Sonnet。
怎么接入 Claude Haiku 5.5?
在 Claude Platform 上把模型名设为 claude-haiku-5-5 即可,AWS Bedrock、Google Cloud、Microsoft Azure 也都已同步上线,官方提供迁移指南。
Claude Haiku 5.5 支持中文吗?效果如何?
支持中文,日常对话、翻译、摘要都能正常使用。不过它的调校重心是英文高吞吐任务,纯中文的深度长文创作质量不如 Claude Opus 等旗舰模型。
想发现更多好用的 AI 模型?查看我们的 AI 模型库 与 工具对比引擎,或继续阅读:Claude Sonnet 5.5 评测 · Claude Opus 5.5 评测 · Qwen 3.7 Plus 评测。
