Claude Haiku 5.5

厂商 / 系列
AnthropicClaude
上下文
1M
输入价
$0.10 / 百万 tokens
输出价
$0.50 / 百万 tokens
许可
闭源

快速对比

选择一个模型,与 Claude Haiku 5.5 并排比较关键规格。

查看 Claude 系列对比

COMPARE MATRIX · 横向比较

模型比较

并列查看 0 项模型的关键规格

当前不足 2 项,可关闭面板后继续选择。

已选模型规格比较矩阵
比较项
规格暂无可比较规格
提示:左右滚动可查看全部项目

概览

Anthropic 目前最便宜、最快的小模型:100 万 token 上下文,10 万 token 以内的请求输入 $0.10 / 输出 $0.50 每百万 token(比 Haiku 4.5 便宜 90%),适合分类、抽取、路由、摘要和给 Opus / Sonnet 当子智能体,也是首个支持 effort 调节的 Haiku。 能力要点:自适应思考(adaptive thinking)+ effort 参数(low / medium / high / xhigh / max,默认 medium):首个可按任务在成本和智能之间调节的 Haiku 级模型;100 万 token 上下文,同步接口最大输出 12.8 万 token;Message Batches API 加 output-300k-2026-03-24 测试头可输出 30 万 token;计算机使用 / 浏览器操作:OSWorld 2.1(离线子集)72.4%,Haiku 4.5 为 15.7%;Python / TypeScript SDK 同步加入计算机使用和浏览器使用测试版支持;知识型工作:GDPval-AA v2.1 Elo 1620(Haiku 4.5 为 735,Sonnet 5.5 为 1840);智能体编程:Terminal-Bench 4.0 39.2%、FrontierCode 1.1 46.4%;官方建议复杂编程仍用 Sonnet 5.5 / Opus 5.5,Haiku 5.5 做压缩、摘要、子任务;推理与视觉:Humanity's Last Exam 无工具 45.9%、有工具 57.4%;Chartography 46.4%;文本与图像输入、文本输出,多语言,支持工具调用。 Claude Haiku 5.5 是 Anthropic 于 2026 年 10 月 7 日发布的小模型,官方称它是「迄今最便宜、最快、能力最强的小模型」,面向高并发、对成本和延迟敏感的工作:摘要、上下文压缩、数据库查询、分类、信息抽取、路由,以及在 Opus 5.5 / Sonnet 5.5 主导的编程任务里当子智能体;因为速度是全系最快(Opus 的 Fast 模式除外),也适合实时客服和浏览器操作。它采用与 Claude Opus 4.7 之后各模型相同的新分词器,同样的文本比 Haiku 4.5 多约 30% 的 token;思考块只能在生成它的账户(或其关联账户)中使用。 价格按单次请求的输入长度分两档(每百万 token):10 万 token 以内输入 $0.10、输出 $0.50、缓存读取 $0.01、缓存写入 $0.125;超过 10 万 token 输入 $0.50、输出 $2.50、缓存读取 $0.05、缓存写入 $0.625;Batch API 再减半。对比 Haiku 4.5(输入 $1 / 输出 $5),10 万 token 以内便宜 90%、以上便宜 50%;官方说 Haiku 4.5 约 90% 的请求都在 10 万 token 以内,算上新分词器多出的 token,平均运行成本约低 75%。同日 Anthropic 还把 Sonnet 5.5 的缓存读取价从 $0.20 降到 $0.10(官方称多数智能体任务约便宜 20%),并宣布本周起给 Max 和 Team 订阅用户每月发放 Claude Platform API 额度(Max 5x $100、Max 20x $200、Team 最高 $500 共享)。 客户反馈(官方发布页):HubSpot 的 CRM 模拟评测得分 92.8%,为其测过的小模型最高;AlphaSense 文档问答 0.84 对比 Haiku 4.5 的 0.76;Box 比 Haiku 4.5 高 11 分、延迟约减半;Asana 任务完成延迟降低 30% 以上。安全方面,网络安全防护比 Haiku 4.5 更严,但比 Sonnet 5.5 宽松,允许更多防御性任务、仍拦截渗透测试类请求。已在 Claude API、Amazon Bedrock(anthropic.claude-haiku-5-5)、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 全平台上线;Anthropic 承诺在自营平台上不早于 2027 年 10 月 7 日退役。 上手方式:Claude API 请求里把 model 设为 claude-haiku-5-5;从 Haiku 4.5 迁移时,按官方迁移指南检查 token 预算(新分词器多约 30%),需要更省钱就把 effort 设为 low,需要更好效果再调高。来源:anthropic.com/claude-haiku-5-5 发布页、platform.claude.com 模型总览与 Haiku 5.5 模型页(2026-10-08 核对)。 API ID:claude-haiku-5-5(Amazon Bedrock:anthropic.claude-haiku-5-5);最大输出 128,000 token;知识截止 2026 年 6 月。

模态
多模态

能力

  • 自适应思考(adaptive thinking)+ effort 参数(low / medium / high / xhigh / max,默认 medium):首个可按任务在成本和智能之间调节的 Haiku 级模型
  • 100 万 token 上下文,同步接口最大输出 12.8 万 token;Message Batches API 加 output-300k-2026-03-24 测试头可输出 30 万 token
  • 计算机使用 / 浏览器操作:OSWorld 2.1(离线子集)72.4%,Haiku 4.5 为 15.7%;Python / TypeScript SDK 同步加入计算机使用和浏览器使用测试版支持
  • 知识型工作:GDPval-AA v2.1 Elo 1620(Haiku 4.5 为 735,Sonnet 5.5 为 1840)
  • 智能体编程:Terminal-Bench 4.0 39.2%、FrontierCode 1.1 46.4%;官方建议复杂编程仍用 Sonnet 5.5 / Opus 5.5,Haiku 5.5 做压缩、摘要、子任务
  • 推理与视觉:Humanity's Last Exam 无工具 45.9%、有工具 57.4%;Chartography 46.4%
  • 文本与图像输入、文本输出,多语言,支持工具调用