mt logoMyToken
ETH Gas
EN

刚刚,Claude Haiku 5.5发布!价格暴降90%

Favoritecollect
Shareshare

刚刚,Claude Haiku 5.5发布!价格暴降90%

就在刚刚,Anthropic 发布了 Claude Haiku 5.5,单价只有上一代 Haiku 4.5 的 1/10、Sonnet 5.5 的 1/20,和 OpenAI 的 GPT-6 Luna 一个价。

刚刚,Claude Haiku 5.5发布!价格暴降90%

官方跑分表里 Luna 交了成绩的六项全输给了它,好几项还咬住了 Sonnet。

操作电脑的 OSWorld 从上一代的 15.7% 冲到 72.4%,离 Sonnet 5.5 只差 11.5 个百分点

终端编程的 Terminal-Bench 4.0,上一代是零分,这次拿了 39.2%

知识工作的 GDPval-AA 拿下 1620 分,是上一代的两倍多

「人类最后的考试」HLE 不带工具,从 10.2% 涨到 45.9%

刚刚,Claude Haiku 5.5发布!价格暴降90%

价格是每百万 Token 输入 0.10 美元、输出 0.50 美元,这是提示在 10 万 Token 以内的价格,超过 10 万按输入 0.50 美元、输出 2.50 美元算。

缓存读取每百万 Token 0.01 美元,走批处理再打五折。

刚刚,Claude Haiku 5.5发布!价格暴降90%

官方测算下来,同样的活平均比 Haiku 4.5 省 75% 左右,同样的预算大约能跑四倍的调用量。

没省到九成,是因为超过 10 万 Token 的请求只便宜一半,好在上一代 Haiku 约九成请求都在 10 万以内,另外新分词器会让同样一段话多出三成左右的 Token。

和 GPT-6 Luna 比,10 万 Token 以内两家的输入、输出、缓存价格完全一样。

面对长上下文时 Luna 更便宜,它要到 27 万 Token 左右才涨价,涨完也才输入 0.20 美元、输出 0.75 美元。

Sonnet 5.5 的缓存读取也从今天起砍半,每百万 Token 从 0.20 美元降到 0.10 美元,官方算下来多数 Agent 任务能便宜两成左右。

Max 和 Team 订阅本周起每月送 API 额度,Max 5x 送 100 美元、Max 20x 送 200 美元,Team 最多 500 美元、全队共用,在 Claude Platform 上哪个模型都能用。

这一代 Haiku 相比上一代,跑分进步巨大。

刚刚,Claude Haiku 5.5发布!价格暴降90%

操作电脑的 OSWorld 从上一代的 15.7% 冲到 72.4%,离 Sonnet 5.5 只差 11.5 个百分点

终端编程的 Terminal-Bench 4.0,上一代一分没拿到,这次拿了 39.2%

知识工作的 GDPval-AA 拿下 1620 分,是上一代的两倍多

「人类最后的考试」HLE 不带工具,从 10.2% 涨到 45.9%

电脑操作是这次进步最猛的一项,OSWorld 上同价的 Luna 只有 48.9%,Haiku 5.5 甩开它 23.5 个百分点。

算上成本更夸张,它开到 Medium 档就超过了 Luna 满档的成绩,花的钱还更少。

刚刚,Claude Haiku 5.5发布!价格暴降90%

知识工作的 GDPval-AA 上,Haiku 5.5 的 1620 分压过了 Luna 的 1437 分,离 Sonnet 5.5 的 1840 分还差一截,只开默认的 Medium 档也有 1277 分。

跑长线项目的 AA-Briefcase 上,它从上一代的 614 分涨到 1578 分,Luna 是 1336 分。

刚刚,Claude Haiku 5.5发布!价格暴降90%

推理和读图上,HLE 带上搜索和代码工具时 Haiku 5.5 是 57.4%,Sonnet 5.5 是 64.5%。读专业图表的 Chartography,它从上一代的 6.4% 涨到 46.4%,Luna 是 29.1%,Sonnet 5.5 是 61.6%。

刚刚,Claude Haiku 5.5发布!价格暴降90%

和 Sonnet 差距最大的是编程,Terminal-Bench 4.0 上它的 39.2% 是 Luna(16.4%)的两倍多,但 Sonnet 5.5 是 70.6%。

FrontierCode 上它的 46.4% 也赢了 Luna 的 42.4%,离 Sonnet 5.5 最好成绩的 52.1% 还差将近 6 个点。

官方也明说,复杂的 Agent 编程还是交给 Sonnet 5.5 和 Opus 5.5。

官方给 Haiku 5.5 的定位是量大、要快、要省钱的活,比如写摘要、压缩上下文、查数据库、做分类。

它也是目前最快的 Claude 模型,只比开了快速模式(价格很贵!)的 Opus 慢,适合实时客服和浏览器操作。

官方也给出了一批明星 AI 应用公司内测反馈。

Asana 测下来,任务完成的延迟比他们现用的模型降了三成多,Box 测得它的延迟只有 Haiku 4.5 的一半左右。

刚刚,Claude Haiku 5.5发布!价格暴降90%

另一个主要用法是给 Opus 或 Sonnet 当子Agent,大模型拆任务、拿主意,Haiku 分头去跑。

Cognition 的 Devin Fusion 让 Opus 5.5 当主力、Haiku 5.5 当副手,FrontierCode 稳在 66.2 分的顶级水平,成本和延迟都降了下来。

刚刚,Claude Haiku 5.5发布!价格暴降90%

金融 AI 公司 Rogo 让大模型做 PPT,Haiku 5.5 钻进 10-K 财报扒分部营收数据。

刚刚,Claude Haiku 5.5发布!价格暴降90%

Claude 开发者账号给出了 Demo,任务是用一堆家用杂物设计装鸡蛋的架子,目标是从 32 米扔下不碎。

刚刚,Claude Haiku 5.5发布!价格暴降90%

Opus 5.5 单干用了 3 分 37 秒、试了 25 种方案、花了 0.47 美元,带上 10 个 Haiku 5.5 子 Agent 只用了 58 秒、试了 86 种、花了 0.14 美元。

Haiku 5.5 已经在 Claude 客户端、Claude Code 和 AWS、谷歌云、微软 Azure、Cursor、OpenRouter 等平台上线,模型 ID 是 claude-haiku-5-5,上下文 100 万 Token,单次最多输出 12.8 万 Token。

刚刚,Claude Haiku 5.5发布!价格暴降90%

它是第一个能调思考档位的 Haiku,从 Low 到 Max 一共五档,API 默认是 Medium。

Python 和 TypeScript SDK 也加上了电脑操作和浏览器操作,目前是 Beta。

从 Haiku 4.5 迁移过来,同样的文字 Token 会多三成左右,max_tokens 和成本预估得重算。

budget_tokens 换成了自适应思考加 Effort 档位,temperature、top_p、top_k 要删掉,预填回复不能用了,格式要求改用结构化输出。

电脑操作要换成新工具集 computer_toolset_20260801,Priority Tier 暂不支持。

嫌麻烦可以在 Claude Code 里跑一句:

让它自己改。

当然,对于非开发者而言,你现在就可以直接在客户端里与 Haiku 5.5 对话了!

刚刚,Claude Haiku 5.5发布!价格暴降90%

简单的问题就不要麻烦 Fable、Opus、Sonnet 了,Haiku 5.5 即使只是开 Low 档推理强度,也可以做到准确地秒出答案,完美替代搜索引擎了。

刚刚,Claude Haiku 5.5发布!价格暴降90%

快去试试吧!

参考资料:

https://www.anthropic.com/claude-haiku-5-5

Disclaimer: This article is copyrighted by the original author and does not represent MyToken’s views and positions. If you have any questions regarding content or copyright, please contact us.(www.mytokencap.com)contact
More exciting content is available on
X(https://x.com/MyTokencap)
or join the community to learn more:MyToken-English Telegram Group
(https://t.me/mytokenGroup)