type
Post
status
Published
date
Oct 8, 2026
slug
hn-49996437
summary
Anthropic推出了迄今为止速度最快、成本最低的小型模型Claude Haiku 5.5,旨在处理高吞吐量和对成本敏感的任务。该模型运行成本大幅降低,并支持可调节的努力设置,同时官方还下调了Sonnet 5.5的缓存读取价格。
tags
科技
category
新闻
icon
password
推出 Claude Haiku 5.5:我们迄今发布的最便宜、最快、功能最强的小型模型。
Claude Haiku 5.5 专为高吞吐量、对成本敏感的任务而设计。它能够可靠地处理快速且重复的工作负载(如摘要、精简、数据库查询和分类请求)。它非常适合与 Opus 5.5 和 Sonnet 5.5 搭配作为编码工作的子代理。此外,由于它也是我们迄今为止速度最快的模型,因此它特别适合实时客户支持和浏览器使用等对速度敏感的任务。¹
Haiku 5.5 的价格远低于 Haiku 4.5。平均而言,现在的运行成本降低了约 75%。²
伴随此次发布,我们正在提升整个模型产品组合的性价比。我们将 Claude Sonnet 5.5 的缓存读取价格减半,这意味着 Sonnet 5.5 在大多数智能体工作负载下的运行成本降低了约 20%。此外,我们为 Claude Max 和 Team 订阅者推出了全新的每月 API 额度,旨在支持用户构建在 Claude 平台上运行的新智能体和应用程序。

性能

以下是 Claude Haiku 5.5 在一系列基准测试中的表现:
有关我们如何进行评估的详细信息,请参阅 Haiku 5.5 系统卡片。
Haiku 5.5 是我们首款配备可调节工作量设置的 Haiku 级模型。这意味着,与我们的其他模型一样,用户可以决定是优化成本还是优化智能。以下图表展示了 Haiku 5.5 在各项工作量设置下三个基准测试中的表现:
OSWorld 2.1 (离线子集)准确率与成本对比
在早期测试中,我们的客户反馈的结果与上述性能和成本的提升相一致。以下是他们对新模型的评价:
引言
“我们对 Claude Haiku 5.5 印象深刻,尤其是它的速度。我们将它运行在我们的 AI 队友评估套件中,该套件是我们的 AI 智能体产品,涵盖了诸如错误分类、项目设置以及搜索大型投资组合以找出高风险或逾期工作等用例。与我们今天使用的模型相比,任务完成的延迟减少了 30% 以上,每个智能体轮次的推理速度最高提升了 2.5 倍。这是一种明显更轻快流畅的体验。”
公司Asana
作者Aaron Vinh,资深软件工程师

定价

下表展示了 Claude Haiku 5.5 的定价与我们其他模型的对比。当用于提示词长度不超过 100,000 个 token(占我们以往 Haiku 模型请求的大约 90%)的任务时,Haiku 5.5 尤其具有超高性价比。
每 100 万个 token 的价格 | Haiku 5.5 提示词不超过 / 超过 100k | Haiku 4.5 | Sonnet 5.5
缓存读取 | $0.01 / $0.05 | $0.10 | $0.10
缓存写入 | $0.125 / $0.625 | $1.25 | $2.50
输入 token | $0.10 / $0.50 | $1.00 | $2.00
输出 token | $0.50 / $2.50 | $5.00 | $10.00

安全

对齐。与 Haiku 4.5 相比,Claude Haiku 5.5 在几乎所有的对齐评估中都表现出重大改进。特别是,我们发现未对齐行为的实例要少得多,并且配合滥用的意愿也有所降低。该模型的 系统卡片更详细地描述了我们的评估过程和结果。
安全防护。与其能力相一致,Haiku 5.5 的网络安全防护比 Haiku 4.5 更严格,但比我们应用于其他最新模型的防护措施稍微宽松一些。在网络安全方面,它们比 Sonnet 5.5 的防护措施允许更广泛的防御任务,但它们仍然会阻止渗透测试以及攻击者更有可能使用的其他技术。
Haiku 5.5 的生物学防护与 Sonnet 5、Sonnet 5.5 和 Opus 5 相同。它们允许生物学研究问题,但限制访问我们判定可能造成危害的请求。致力于更广泛生物学和网络活动的组织可以申请我们的 生命科学验证计划和 网络验证计划。

可用性

Claude Haiku 5.5 现已在所有平台上线,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。在 Claude 平台上,开发者可以开始使用 claude-haiku-5-5。
有关详细信息,请参阅我们的 迁移指南。

更多更新

在推出 Claude Haiku 5.5 新定价的同时,我们也在进一步提升模型和产品的价值。
首先,从今天开始,我们将降低 Claude Sonnet 5.5 缓存读取的价格。缓存读取现在成本降低 50%:每百万 token 0.10 美元,而非 0.20 美元。由于缓存读取占模型 token 消耗很大一部分,这使 Sonnet 5.5 在大多数智能体任务上的成本降低了约 20%。
例如,此次降价意味着 Sonnet 5.5 在 Terminal-Bench 4.0 上的性价比表现发生了以下变化:
Terminal-Bench 4.0 准确率与成本对比
这张图表展示了 Haiku 5.5 与我们更大模型之间的一个重要区别。对于 Terminal-Bench 4.0 所测量的复杂智能体编码任务,Sonnet 5.5 和 Opus 5.5 仍然是更好的选择。相比之下,Haiku 5.5 最适合范围较窄的任务,使用旧版本的 Claude 可能会使这些任务的成本过高——例如精简、摘要或子代理工作。
其次,本周我们将向所有 Max 和 Team 订阅者推出一项新的每月 API 额度,供他们在 Claude 平台上使用。Max 5x 用户每月将获得 100 美元的额度,Max 20x 用户将获得 200 美元,Team 订阅者将获得高达 500 美元的额度(在用户之间共享)。这些额度旨在让用户尝试构建调用我们 API 的工具、应用程序和智能体。它们可用于我们的任何模型。有关更多信息,请 参阅我们的帮助中心文章。
对于开发者,我们还在测试阶段更新了 Claude Python 和 TypeScript SDK,以增加对计算机使用和浏览器使用的支持。鉴于其速度、能力和价格的结合,Haiku 5.5 非常适合这些任务。您可以阅读 我们的 Claude 平台文档了解更多信息。
申请 eu.org 免费域名Mistral发布开源大模型Mistral Large 4
Loading...