Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%

机智流 2026-10-08 04:53
Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%图1

封面图来源:Anthropic 官方发布页配图

北京时间 10 月 8 日凌晨 2 点 01 分,Anthropic 发布 Claude Haiku 5.5。官方说法是:它是自家发布过的最便宜、最快、也最能打的小模型。平均下来,跑同样的活比 Haiku 4.5 省约 75%。

短请求更夸张。10 万 token 以内的请求,价格直接是 Haiku 4.5 的十分之一。

能力也没缩水。官方测的操作电脑任务,Haiku 4.5 只有 15.7%,Haiku 5.5 到了 72.4%。

官方发布页

https://www.anthropic.com/claude-haiku-5-5

Claude 官方账号的原话:

Introducing Claude Haiku 5.5: the cheapest, fastest, and most capable small model we've ever released. On average, it costs around 75% less to run than Claude Haiku 4.5.

推出 Claude Haiku 5.5:我们发布过的最便宜、最快、能力最强的小模型。平均来看,它的运行成本比 Claude Haiku 4.5 低约 75%。

Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%图2

@claudeai 官方帖,北京时间 10 月 8 日 2:01

Haiku 是什么

Claude 的模型一直分大中小几档。Opus 最强,Sonnet 居中,Haiku 最小、最快、最便宜。

上一代 Haiku 4.5 是 2025 年 10 月发的,到现在整整一年。这次 Haiku 5.5 一出,Claude 5.5 这一代的 Opus、Sonnet、Haiku 就凑齐了。

官方给它的定位很清楚:量大、对成本敏感的活。

比如写摘要、压缩长对话、查数据库、给请求分类。也适合当「小弟」:让 Opus 5.5 或 Sonnet 5.5 负责规划,Haiku 5.5 作为子智能体去跑腿。

它还是 Anthropic 目前最快的模型,所以实时客服、浏览器操作这种要求反应快的场景,官方也点名推荐。

有个小注脚:说它最快,是按各模型的标准速度比的。Opus 开了 Fast Mode 之后,还是比它快。

规格一览

这些来自 Claude 开发文档的模型总览页:

• 模型 ID:claude-haiku-5-5,没有日期后缀,也没有单独的别名

• 上下文窗口:100 万 token,Haiku 4.5 是 20 万

• 最大输出:12.8 万 token,Haiku 4.5 是 6.4 万

• 知识截止:2026 年 6 月

• 输入输出:能看文字和图片,输出文字,支持工具调用和多语言

• 思考方式:自适应思考,默认力度是 medium

• 下线时间:不早于 2027 年 10 月 7 日

价格:按提示长度分两档

这是 Haiku 5.5 最特别的地方。

Anthropic 其他新模型,100 万 token 上下文都是一个价。Haiku 5.5 不一样,以 10 万 token 为界,超过了就按高价算。

每百万 token 的价格如下。

提示在 10 万 token 以内:

• 输入:0.10 美元

• 输出:0.50 美元

• 缓存写入(5 分钟):0.125 美元

• 缓存写入(1 小时):0.20 美元

• 缓存读取:0.01 美元

提示超过 10 万 token:

• 输入:0.50 美元

• 输出:2.50 美元

• 缓存写入(5 分钟):0.625 美元

• 缓存写入(1 小时):1 美元

• 缓存读取:0.05 美元

批处理(Batch API)再打 5 折:

• 10 万以内:输入 0.05 美元,输出 0.25 美元

• 超过 10 万:输入 0.25 美元,输出 1.25 美元

对比一下 Haiku 4.5,每百万 token:

• 输入:1 美元

• 输出:5 美元

• 缓存写入:1.25 美元

• 缓存读取:0.10 美元

Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%图3

官方发布页的价格表:Haiku 5.5(10 万以内 / 超过 10 万)、Haiku 4.5、Sonnet 5.5,单位为每百万 token

所以 10 万以内便宜 90%,超过 10 万便宜 50%。

为什么按 10 万划线?官方给的理由是:Haiku 4.5 收到的请求里,大约 90% 都在 10 万 token 以内。

那「平均省 75%」怎么来的?官方脚注说,这个数已经把一件事算进去了:Haiku 5.5 换了新的分词器,同一件活要用的 token 会多一点。

多多少?发布页说「略多」,迁移文档写得更具体:同样一段文字,在 Haiku 5.5 上大约多出 30% 的 token,具体看内容。原来按 token 做的预算,最好重新算一遍。

成绩:跟 Haiku 4.5 不是一个量级

官方拿 Haiku 5.5 对比了 Haiku 4.5、OpenAI 的 GPT-6 Luna,还把 Sonnet 5.5 放在旁边做参考:

Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%图4

官方发布页的基准测试表。高亮列为 Haiku 5.5,最右为 Sonnet 5.5 参考值

逐项看,顺序是 Haiku 5.5 / Haiku 4.5 / GPT-6 Luna / Sonnet 5.5:

• GDPval-AA v2.1(44 种职业的真实工作,Elo 分):1620 / 735 / 1437 / 1840

• AA-Briefcase v1.1(知识工作):1578 / 614 / 1336 / 1824

• OSWorld 2.1(操作真电脑完成多步任务,离线子集):72.4% / 15.7% / 48.9% / 83.9%

• Humanity's Last Exam 不用工具:45.9% / 10.2% / 未列 / 56.9%

• Humanity's Last Exam 用工具:57.4% / 18.7% / 未列 / 64.5%

• Terminal-Bench 4.0(命令行里的复杂任务):39.2% / 0.0% / 16.4% / 70.6%

• FrontierCode 1.1(Main):46.4% / 未列 / 42.4% / 52.1%

• Chartography(看图表推理,不用工具):46.4% / 6.4% / 29.1% / 61.6%

几个看点。

第一,对 Haiku 4.5 是碾压。Terminal-Bench 4.0 上 Haiku 4.5 一分没拿,Haiku 5.5 有 39.2%。

第二,表里有分的几项,Haiku 5.5 都比 GPT-6 Luna 高。电脑操作差得最多,72.4% 对 48.9%。

第三,离 Sonnet 5.5 还有距离,尤其是 Terminal-Bench,39.2% 对 70.6%。官方自己也说了,复杂的写代码类智能体任务,还是交给 Sonnet 5.5 和 Opus 5.5。

第一次能调「思考力度」

这是 Haiku 系列第一次支持调节 effort,也就是让模型想多想少。

一共 5 档:Low、Med、High、Xhigh、Max。想得越多越准,也越贵。

官方给了一张 OSWorld 的成本曲线,横轴是每次尝试花多少钱,纵轴是得分:

Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%图5

官方发布页配图:OSWorld 2.1 离线子集上,各模型不同力度下的得分与每次尝试成本(横轴为对数刻度)

红线是 Haiku 5.5。最低档每次不到 0.1 美元,就有 40 分出头;开到 Max,每次约 0.6 美元,72 分左右。

右下角那个孤零零的浅色点是 Haiku 4.5:花得比 Haiku 5.5 Max 还多,分数只有 15.7%。

早期客户怎么说

官方放了几家公司的早期测试反馈,挑几条有数字的:

• Asana:用在自家 AI 智能体产品上,跟现在用的模型比,完成任务的延迟降了 30% 以上,每轮推理最快快 2.5 倍

• HubSpot:在 CRM 模拟测试里拿到 92.8%(三次平均),是他们测过的小模型里最高的

• AlphaSense:文档问答功能每周约 800 万次调用。400 条测试里,Haiku 5.5 得 0.84,Haiku 4.5 是 0.76

• Box:比 Haiku 4.5 高 11 分,延迟大约减半

• Cognition:Devin Fusion 用 Opus 5.5 当主力、Haiku 5.5 当助手,FrontierCode 保持 66.2 分,同时降低了成本和延迟

在哪能用

今天起全面上线:

• Claude 应用:Free、Pro、Max、Team、Enterprise 都能选,网页、iOS、Android 都有

• Claude Code:已经可以用

• Claude Platform API:模型名 claude-haiku-5-5

• 亚马逊云:Amazon Bedrock 上的 ID 是 anthropic.claude-haiku-5-5

• 谷歌云:claude-haiku-5-5

• 微软 Foundry:claude-haiku-5-5

第三方也跟得很快。Vercel 的 AI Gateway 上线了,Cursor 也在 13 分钟后宣布支持。

Cursor:短请求便宜 10 倍

Cursor 官方账号凌晨 2 点 14 分发帖:

Claude Haiku 5.5 is now available in Cursor! On shorter requests, it costs 10x less than Claude Haiku 4.5. Turn it on in Cursor Settings > Models.

Claude Haiku 5.5 已在 Cursor 上线!较短的请求,成本只有 Claude Haiku 4.5 的十分之一。在 Cursor 设置 > Models 里打开即可。

Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%图6

@cursor_ai 的帖子,北京时间 10 月 8 日 2:14

「便宜 10 倍」跟官方定价对得上,就是 10 万 token 以内那一档。

Cursor 还附了一张自家 CursorBench 4.0 的成本曲线,横轴是平均每个任务花多少钱,越往右越便宜:

Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%图7

Cursor 帖子配图:CursorBench 4.0 得分与平均每任务成本

Haiku 5.5 那条粉线挤在最右边,成本最低。分数比 Opus 5.5、Sonnet 5.5 低一截,但和 Gemini 3.8 Flash、GPT-5.6 Sol 这几条线放在一起看,并不吃亏。

升级前要注意的坑

从 Haiku 4.5 换过来,不只是改个模型名。迁移文档列了不少破坏性变化:

• token 变多:同样文字约多 30% token,max_tokens 和成本估算要重算

• 思考配置变了:旧的 budget_tokens 写法会直接报 400 错误,要改成 adaptive,用 effort 控制力度

• 采样参数基本不能用:temperature、top_p、top_k 建议都删掉,乱填会报错

• 不支持预填:消息不能以 assistant 结尾让模型接着写,要改用结构化输出或改写提示

• 电脑操作换工具:要改用新的 computer_toolset_20260801,还新增了浏览器操作工具

• 可能直接拒答:有安全分类器,会返回 refusal,没有服务端兜底

• 没有 Priority Tier:在 Haiku 4.5 上买了优先级容量的,要另做打算

文档里还提到,在 Claude Code 里输入 /claude-api migrate,可以让它自动帮你改代码。

安全方面

官方说,Haiku 5.5 在几乎所有对齐评估上都比 Haiku 4.5 好,出格行为少了很多,配合滥用的意愿也更低。

网络安全的限制比 Haiku 4.5 严,但比最近其他几个新模型松一些。防御类任务放得更宽,渗透测试这类更像攻击的手法还是拦着。

生物方面的限制和 Sonnet 5、Sonnet 5.5、Opus 5 一样。需要更宽权限的机构,可以申请生命科学和网络安全两个验证计划。

顺手发的几项更新

• Sonnet 5.5 缓存读取降价一半:每百万 token 从 0.20 美元降到 0.10 美元。官方估计大多数智能体任务因此便宜约 20%

• Max 5x 订阅:每月送 100 美元 API 额度

• Max 20x 订阅:每月送 200 美元 API 额度

• Team 订阅:每月最多 500 美元,团队共用

• SDK 更新:Python 和 TypeScript SDK 加入电脑操作和浏览器操作(测试版)

这些 API 额度本周陆续发放,所有模型都能用,用在自己的代码或第三方工具里都行。

大家怎么看

Anthropic 的 Thariq(@trq212,约 36 万关注)转发时说:

We've heard how much people love Haiku and it's back in 5.5, cheaper, faster than ever before. In fact it's 10x cheaper than Haiku 4.5 under 100k tokens. Try it with computer use, workflows and in the API.

我们听到了大家有多喜欢 Haiku,它在 5.5 回来了,比以往更便宜、更快。事实上,10 万 token 以内它比 Haiku 4.5 便宜 10 倍。去电脑操作、工作流和 API 里试试吧。

Claude Haiku 5.5 来了:短请求便宜 9 成,操作电脑从 15.7% 跳到 72.4%图8

@trq212 的帖子,北京时间 10 月 8 日 2:18

他是 Anthropic 自己人,下面两条来自外部账号。

AI 资讯账号 TestingCatalog(@testingcatalog,约 7.9 万关注)的总结抓了重点:

It is the first Haiku model to have an adjustable effort setting. On benchmarks, it is a big leap in performance at Computer Use and Agentic Coding across the group.

这是第一个能调节思考力度的 Haiku 模型。基准测试上,它在电脑操作和智能体编程方面整体是一次大跃进。

Vercel 官方技术账号 Vercel Developers(@vercel_dev,约 4.6 万关注)宣布 AI Gateway 已经上线,列了 4 个卖点:

Fastest Claude model at standard speed. Built for subagents and summarization. First Haiku with effort levels. ZDR supported.

标准速度下最快的 Claude 模型;为子智能体和摘要而生;第一个有力度档位的 Haiku;支持零数据保留(ZDR)。

最后说两句

Haiku 4.5 那会儿,小模型更像是「便宜但凑合」。

Haiku 5.5 把短请求价格砍到十分之一,电脑操作和命令行任务又追上来一大截。官方很直白:复杂活交给大模型,量大的杂活交给它。

真正要盯的是 10 万 token 这条线,还有新分词器多出来的那部分 token。账算清楚了,再决定往哪儿切。

另外,以上成绩都是 Anthropic 和合作方自己测的,独立评测还得再等等。

相关链接

• 官方发布页:Introducing Claude Haiku 5.5

https://www.anthropic.com/claude-haiku-5-5

• Claude Haiku 产品页

https://www.anthropic.com/claude/haiku

• Haiku 5.5 系统卡

https://www.anthropic.com/claude-haiku-5-5-system-card

• 模型总览(规格与 ID)

https://platform.claude.com/docs/en/models/overview

• API 价格

https://platform.claude.com/docs/en/about-claude/pricing

• Haiku 5.5 迁移指南

https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide

• Max 和 Team 每月 API 额度说明

https://support.claude.com/en/articles/17154008

• Claude 官方帖

https://x.com/claudeai/status/2107894039626277339

• Cursor 官方帖

https://x.com/cursor_ai/status/2107897245282799864

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI 电脑
more
这个像手机一样大的设备,其实是一台AI电脑!
三分钟扫出千余病毒,Reddit网友吐槽“长辈电脑”成重灾区
电脑手机“养”不活的维修人,拼命挤进机器人行业
烛火驱动算力:DIY蒸汽朋克电脑以150毫瓦功耗运行经典游戏
华为鸿蒙电脑拿下央企大单!
印度首富的“云电脑”野心:用订阅制重塑PC换机周期,还是只是权宜之计?
千问电脑来了!当思考成为商品,阿里的野心比你看到的还要大
奥特曼播客曝猛料:Astra操作电脑已达人类水平!
王思聪102万元组装的电脑,五年后竟然值这个数!
库克清空弹夹!2nm,韬定律,最强AI电脑
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号