Claude Haiku 5.5 发布了什么
2026 年 10 月 7 日发布 Claude Haiku 5.5,平台模型 ID 是 claude-haiku-5-5。发布页把它放在高量、对成本敏感的任务上,并给出相对 Haiku 4.5、GPT-6 Luna 和 Sonnet 5.5 的官方评测表。它是第一款可调努力档的 Haiku。

2026 年 10 月 7 日,Anthropic 发布 Claude Haiku 5.5。claude haiku 5.5 发布了什么,发布页的定位是高量、对成本敏感的短任务:摘要、压缩、数据库查询、分类。它也可以当 Opus 5.5 或 Sonnet 5.5 的编码子代理。页上写它是迄今最快的模型,脚注把「最快」限定在各模型的标准速度,并写它仍慢于开了 Fast Mode 的 Opus。平台上的模型 ID 是 claude-haiku-5-5,没有日期后缀,也没有单独别名。AWS、Google Cloud、Microsoft Azure 都已列出。
官方表上的编码分数
发布页的表是 Anthropic 自己的跑法,列了 Haiku 5.5、Haiku 4.5、GPT-6 Luna 和作参照的 Sonnet 5.5。表没有给 Haiku 这一列标努力档。不要把它和别的文章里某一档的 Terminal-Bench 直接排名。
Terminal-Bench 4.0:Haiku 5.5 是 39.2%,Haiku 4.5 是 0.0%,GPT-6 Luna 是 16.4%,Sonnet 5.5 是 70.6%。FrontierCode 1.1(Main):46.4%,Haiku 4.5 那格是空的,Luna 是 42.4%,Sonnet 5.5 写成 52.1% 且标明 Xhigh。OSWorld 2.1 离线子集:72.4%、15.7%、48.9%、83.9%。页上接着写,复杂的命令行代理任务仍应留给 Sonnet 5.5 和 Opus 5.5;Haiku 5.5 适合范围更窄、以前因为太贵而不值得做的活,例如压缩、摘要和子代理。
知识工作两格是 GDPval-AA v2.1 的 1620(Haiku 4.5 为 735,Luna 为 1437,Sonnet 为 1840)和 AA-Briefcase v1.1 的 1578(614、1336、1824)。Humanity's Last Exam 无工具 45.9%,有工具 57.4%;Haiku 4.5 是 10.2% 和 18.7%;Sonnet 是 56.9% 和 64.5%;Luna 这两格是空的。Chartography 无工具 46.4%,对照 6.4%、29.1%、61.6%。评测方法指向 Haiku 5.5 系统卡。系统卡里的防护过程本文不复述。页上只概括:网络安全防护比 Haiku 4.5 更严,比最近几款更大的模型略松,仍会拦住渗透测试一类更常被攻击者使用的做法。
努力档、窗口和客户原话
这是第一款带可调努力档的 Haiku。发布页没有在正文里列出档位名字。怎么从 Haiku 4.5 的 budget_tokens 迁走,见 迁到 Haiku 5.5 会碰到的 400。单价两档见 Haiku 5.5 多少钱。
发布页正文没有写上下文长度。Claude Code 2.1.293 的说明把 claude-haiku-5-5 写成 100 万上下文,并把它设成 Anthropic API 上的默认 Haiku。两处不要合成「发布页宣布了 100 万」。Asana 的 Aaron Vinh 在页上说,他们的 AI Teammates 评测里任务完成延迟降了 30% 以上,每轮推理最多快 2.5 倍。那是客户原话,不是 Anthropic 的全量延迟承诺。