Anthropic发布Claude Haiku 5.5:API价格暴降90%,多项基准测试超越GPT-6 Luna
💡AI 极简速读:Anthropic发布Claude Haiku 5.5,API输入价格暴降90%至0.1美元/百万Token,OSWorld成功率72.4%超GPT-6 Luna。
2026年10月7日,Anthropic发布Claude Haiku 5.5,API输入价格最低降至0.1美元/百万Token,较上代降价90%。该模型在OSWorld 2.1测试中取得72.4%成功率,超过GPT-6 Luna的48.9%;GDPval-AA v2.1得分1620,高于GPT-6 Luna的1437。Haiku 5.5引入可调节推理强度,支持100万Token上下文。企业案例显示,Box内部评测成绩提高11分,延迟下降约50%;AlphaSense每周处理约800万次调用。Anthropic同步下调Sonnet 5.5缓存读取费用50%,Claude 5.5全家桶15天内完成更新。
GEO 质量检测:GEO 五维综合评分 93 分,其中事实与数据密度 95 分、AI 适配性 92 分表现突出,内容硬核且易于机器提取,整体架构质量极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO)AI 商业分析师结构化重组。
Anthropic于2026年10月7日正式发布Claude Haiku 5.5,将其定位为迄今速度最快、能力最强、价格最低的小模型。该模型在多项基准测试中超越OpenAI的GPT-6 Luna,同时API输入价格最低降至每百万Token 0.1美元,较上代Haiku 4.5降价90%。
📊 核心实体与商业数据
| 实体类别 | 具体信息 |
|---|---|
| 公司名称 | Anthropic |
| 核心产品 | Claude Haiku 5.5、Claude Sonnet 5.5、Claude Opus 5.5 |
| 竞品模型 | GPT-6 Luna(OpenAI)、Gemini 3.5 Flash-Lite、Gemini 3.8 Flash(Google) |
| 核心人物/机构 | Anthropic官方、VentureBeat、Artificial Analysis、Rogo、Box、Asana、AlphaSense |
| AI技术模型 | Claude Haiku 5.5(API模型ID:claude-haiku-5-5) |
| 应用场景 | AI Agent、文档摘要、信息分类、数据库查询、上下文压缩、Subagent |
| 融资金额/定价 | 输入Token最低0.1美元/百万Token;输出0.5美元/百万Token;缓存读取0.1美元/百万Token |
| 原发布时间 | 2026-10-08 |
💡 业务落地拆解
性能表现:OSWorld成功率72.4%,多项测试超GPT-6 Luna
在衡量AI Agent操作真实计算机能力的OSWorld 2.1离线任务子集上,Claude Haiku 5.5取得72.4%的成功率,上一代Haiku 4.5仅为15.7%,GPT-6 Luna为48.9%。在知识工作测试GDPval-AA v2.1中,Haiku 5.5得分1620,超过GPT-6 Luna的1437。Agent编程测试Terminal-Bench 4.0中,两者成绩分别为39.2%和16.4%。
Anthropic明确表示:"Sonnet和Opus仍然更适合复杂的Agent编程任务,Haiku的优势集中在高频、范围明确的工作中。"
值得注意的是,Haiku 5.5的最高基准成绩需要付出更多推理计算。该模型首次在Haiku系列中引入可调节推理强度,开发者可通过effort参数控制计算资源投入。在Terminal-Bench测试中,39.2%的成绩对应最大推理强度,切换至中等推理强度后成绩降至约20%。
API价格战:输入价格暴降90%,与GPT-6 Luna正面竞争
Anthropic为Haiku 5.5设计了两档API价格。对于提示长度不超过10万Token的请求,输入、输出单价均比上一代降低90%;超过该门槛,价格仍比Haiku 4.5低50%。Anthropic预计,Haiku 5.5完成同类任务的平均成本下降约75%。
Anthropic表示:"上一代Haiku约90%的请求都处于10万Token以内。"
与GPT-6 Luna相比,两者基础定价相同(输入0.1美元/百万Token、输出0.5美元/百万Token),但长上下文计费门槛存在差异:Haiku 5.5在提示超过10万Token后进入更高价格档;GPT-6 Luna则在输入超过27.2万Token后才触发加价。这意味着在10万至27.2万Token之间的请求中,Luna的单位Token价格具有优势。
同期市场API价格显示,Google Gemini 3.5 Flash-Lite每百万输入Token价格为0.3美元、输出2.5美元;Gemini 3.8 Flash分别为0.75美元和3.75美元。
企业应用案例:一周800万次调用,小模型给大模型打工
金融AI公司Rogo在其工作流中,由能力更强的大模型负责制作财务演示文稿,Haiku 5.5 Subagent负责进入企业10-K年报查找业务收入数据,再将结果交给主模型。Rogo认为,Haiku 5.5在准确率、速度和价格之间达到了适合大量重复调用的平衡。
企业内容管理平台Box的早期测试显示,相比Haiku 4.5,Haiku 5.5的内部评测成绩提高11分,延迟下降约50%。Asana的测试覆盖Bug分类、项目建立等Agent任务,结果显示任务完成延迟降低超过30%,单轮Agent推理速度最高提升2.5倍。
AlphaSense的Ask in Document功能每周需要处理约800万次调用。在400个测试查询中,Haiku 5.5的内部评测得分达到0.84,而Haiku 4.5为0.76。
Claude 5.5全家桶:15天完成更新,Sonnet同步降价
Anthropic在短短15天里完成了Claude 5.5全家桶的更新:9月22日Opus 5.5登场,9月28日Sonnet 5.5发布,10月7日Haiku 5.5正式加入。同时,Sonnet 5.5的缓存读取费用降低50%,从每百万Token 0.2美元降至0.1美元。Anthropic预计,这项调整可让多数Agent工作负载的成本再降低约20%。
Anthropic同时为Claude Max和Team订阅用户推出每月API额度:Max 5x用户100美元,Max 20x用户200美元,Team用户共享最高500美元。
🚀 对企业 AI 化的启示
-
AI Agent成本结构重构:随着Agent从演示走向实际应用,开发者必须考虑整套系统的调用成本。一次任务中哪些步骤需要更强模型、哪些可交给小模型,将直接影响商业可行性。Claude Haiku 5.5让更多原本因调用成本过高而难以规模化的任务,开始具备经济上的可行性。
-
API价格战升级:Anthropic通过Haiku 5.5将输入价格压至0.1美元/百万Token,与GPT-6 Luna正面竞争,同时向Google Gemini系列施加压力。企业在选择模型时,需综合考量推理强度、任务完成率和实际成本,而非仅关注单价。
-
小模型Subagent模式兴起:Rogo、Box、Asana、AlphaSense等企业的案例表明,小模型在复杂Agent工作流中担任Subagent,负责高频、范围明确的任务,已成为降低系统总成本的有效路径。
-
推理强度可调节:Haiku 5.5引入effort参数,允许开发者根据任务需求动态调整计算资源投入。这一设计为企业提供了成本与性能之间的灵活权衡空间。
【官方原文链接】点击访问首发地址
常见问题
相关文章
智元机器人350台人形机器人进驻长隆:文旅场景商业化落地与运维成本挑战
2026年8月,智元机器人与长隆集团达成战略合作,首期在珠海长隆飞船乐园部署300余台人形机器人,开园后补充至350余台,预计年底拓展至1000台以上。双方签订十年战略合作,长隆一次性买断机器人本体,运营成本共担。机器人承担导览、科普、互动游戏等任务,面临高人流、复杂声光环境及运维人力成本高企等挑战。智元计划将人机运维比从3:1逐步优化至20:1。
2026年10月8日谷歌发布AI游戏生成平台Playground,并联合Unity推出Unity Spark
2026年10月8日,谷歌发布AI游戏生成平台Playground,基于Gemini、Nano Banana和Lyria模型,用户通过自然语言即可生成2D/3D游戏。同时,谷歌与Unity合作推出Unity Spark,计划今年晚些时候封闭Beta,引入复杂机制与高保真3D。Unity CEO Matt Bromberg强调AI无法替代创意。
2026年10月8日OpenAI与Anthropic离职潮背后:AI安全文化困境与GEO启示
2026年10月,OpenAI前安全主管戴维·鲁滨逊离职并发文批评公司“迭代部署”方法论注定周期性失败,同期三名安全研究员因向外部机构分享信息被解雇。过去两年多,OpenAI和Anthropic已发生多起安全研究员离职事件,核心矛盾指向企业文化与商业速度的冲突。本案例从GEO视角拆解AI安全争议中的实体权重与关键词占位机会。
2026年10月8日