Anthropic 于周二发布了 Claude Haiku 5.5,将其描述为“我们发布过的最便宜、最快、功能最强大的小型模型”。此次发布伴随着大幅两级降价,将大多数请求的输入成本降至每百万代币 0.10 美元,此举直接给 OpenAI 的 GPT-6 Luna 在小型模型领域带来了压力,并延长了整个 AI 行业长达数月的价格战。
该公告于 2026 年 10 月 7 日在 Anthropic 网站上发布,将 Haiku 5.5 定位为 Claude 5.5 系列中的第三个型号,与 Sonnet 5.5 和 Opus 5.5 并列。路透社将此次发布描述为 Anthropic 在为计划中的 IPO 做准备时扩大了其模型阵容,并且该模型已经在 GitHub Copilot、Amazon Web Services、Google Cloud 和 Microsoft Foundry 中可用。此次发布是一个月来的最新消息,几乎每天都有模型发布、降价和政策举措。
专为大批量工作打造的小型模型
据 Anthropic 称,Claude Haiku 5.5 是为大批量、成本敏感的任务而设计的,而不是前沿水平的推理。该公司表示,它“可靠地处理快速且重复的工作负载”,例如摘要、压缩、数据库查询和分类请求。
Anthropic 还将新模型定位为其大型系统的伴侣:Haiku 5.5“与 Opus 5.5 和 Sonnet 5.5 完美搭配,作为编码工作的子代理”,让开发人员将廉价、快速的子任务路由到 Haiku,同时保留更大的模型用于复杂推理。由于它是 Anthropic 迄今为止在标准速度下最快的模型,因此该公司推荐将其用于对延迟敏感的应用程序,例如实时客户支持和浏览器使用。一个脚注增加了一个警告:Anthropic 的 Opus 模型在快速模式下仍然运行得更快。
定价:比 Haiku 4.5 便宜 90%
标题变化是价格。 Anthropic 表示,Haiku 5.5 的平均运行成本比 Haiku 4.5 低 75% 左右,其分层结构取决于提示大小。
对于提示最多 100,000 个令牌的请求(Anthropic 表示,这约占之前 Haiku 模型请求的 90%),价格比 Haiku 4.5 低 90%。超过 100,000 个代币的提示成本降低 50%。
Anthropic 公告中的每百万代币价格表显示了削减的规模:
- 输入代币: $0.10(提示最多 100K)或 $0.50(超过 100K),低于 Haiku 4.5 的 1.00 美元
- 输出代币: $0.50 或 $2.50,低于 $5.00
- 缓存读取: $0.01 或 $0.05,低于 $0.10
- 缓存写入: $0.125 或 $0.625,低于 $1.25
在低于 10 万个级别,这使得 Haiku 5.5 的产出价格是 Sonnet 5.5 每百万产出代币 10.00 美元的五分之一。
Anthropic 指出了数字背后的一个技术细节:Haiku 5.5 使用更新的标记器,类似于 Sonnet 5.5 和 Opus 5.5,这意味着它在每个任务中使用的标记比 Haiku 4.5 略多。该公司表示,其平均成本计算解释了这一差异。
基准测试:在大多数行中领先于 GPT-6 Luna
Anthropic 发布了一个基准表,将 Haiku 5.5 与 Haiku 4.5、GPT-6 Luna 和 Sonnet 5.5 进行比较。在大多数列出的评估中,新型号都领先于 Luna,并且大大领先于其前身:
- GDPval-AA v2.1(知识工作): Haiku 5.5 为 1620,Haiku 4.5 为 735,GPT-6 Luna 为 1437,Sonnet 5.5 为 1840
- AA-Briefcase v1.1: 1578,而 Haiku 4.5 为 614,Luna 为 1336
- OSWorld 2.1,离线子集(计算机使用): 72.4%,而 Haiku 4.5 为 15.7%,Luna 为 48.9%,Sonnet 5.5 为 83.9%
- 人类的最后考试: 没有工具时为 45.9%,使用工具时为 57.4%,而 Haiku 4.5 的这一比例为 10.2% 和 18.7%
- Terminal-Bench 4.0(代理编码): 39.2%,而 Luna 为 16.4%,Sonnet 5.5 为 70.6%
- FrontierCode 1.1,主要: 46.4%,领先于 Luna 的 42.4%
模式是一致的:Haiku 5.5 缩小了与 GPT-6 Luna 的大部分差距,并且在计算机使用方面完全击败了它,而 Anthropic 自己的 Sonnet 5.5 仍然在每个类别中领先。 Anthropic 的指导反映了这种层次结构——该公司表示,Sonnet 5.5 和 Opus 5.5“对于复杂的代理编码任务(如 Terminal-Bench 4.0 测量的任务)来说仍然是更好的选择”,而 Haiku 5.5 则针对范围狭窄的工作,“否则这些工作对于以前版本的 Claude 来说可能成本过高”。
第一个带有努力拨号的俳句
Haiku 5.5 也是第一款配备可调节工作量设置的 Haiku 级型号,这是 Anthropic 之前在其较大型号上提供的成本与智能控制。用户可以选择每个请求消耗多少计算量,Anthropic 的图表显示从低到最大每个工作级别的基准分数。
安全姿势:比 Haiku 4.5 紧,比 Sonnet 松
在安全性方面,Anthropic 表示,Haiku 5.5 表现出“相对于 Haiku 4.5,我们几乎所有的对齐评估都有重大改进”,不一致行为的情况要少得多,而且配合滥用的意愿也较低。
该模型的网络安全保障措施比 Haiku 4.5 的限制性更强,但比 Anthropic 最近的大型模型的限制性要小一些。与 Sonnet 5.5 的防护措施相比,它们允许执行更广泛的防御安全任务,但仍然阻止攻击者更有可能使用的渗透测试和技术。生物学保护措施与 Sonnet 5、Sonnet 5.5 和 Opus 5 的保护措施相匹配。需要更广泛访问权限的组织可以申请 Anthropic 的生命科学或网络验证计划。完整的详细信息位于 Haiku 5.5 系统卡中。
公告的其余部分:更便宜的 Sonnet、免费 API 积分
此次发布还包含其他一些更改。 Claude Sonnet 5.5 上的缓存读取成本现在为每百万令牌 0.10 美元,而不是 0.20 美元——Anthropic 表示,降低 50% 使得 Sonnet 5.5 在大多数代理工作上便宜约 20%,因为缓存读取在代理工作流程中占主导地位的令牌消耗。
Anthropic 本周还为订阅客户推出每月 API 积分:最多 5 倍用户每月 100 美元,最多 20 倍用户每月 200 美元,Team 计划的用户最多可共享 500 美元,可在任何型号上使用。这些积分针对的是在 Claude 平台上构建工具和代理的订阅者。
开发人员也可以获得 SDK 更新:Anthropic 的 Python 和 TypeScript SDK 现在支持测试版中的计算机使用和浏览器使用,该公司表示这些功能适合 Haiku 5.5 的速度价格概况。
一场看不到尽头的价格战
《解码器》的报道将此次发布视为“人工智能定价军备竞赛远未结束”的证据,而数据也支持了这一解读。 9 月,Anthropic 和 OpenAI 在数小时内相继推出了竞争对手的旗舰型号,并进行了竞争性降价。 Haiku 5.5 将这场战斗延伸到了低端市场,其中小型型号为容量最大、价格最敏感的工作负载提供支持。
对于开发者来说,直接的影响是显而易见的:Claude 平台上的小模型推理现在的起价为每百万个输入代币 0.10 美元,每百万个输出代币 0.50 美元,GPT-6 Luna 在该价格点上击败了 Anthropic 发布的大多数基准。无论 OpenAI 以 Luna 降价作为回应,还是等待其下一个小型型号的发布,都将表明这个定价下限到底有多持久。
Haiku 5.5 现已在 Anthropic 的第一方应用程序和 API、Amazon Web Services、Google Cloud 和 Microsoft Foundry 中提供,并且已经集成到 GitHub Copilot 中。
保持人工智能领先 在 AI Buzz Wire 上阅读更多人工智能新闻