币圈界报道:

Anthropic发布Claude Haiku 5.5:算力效率与经济性双重突破

周三,Anthropic正式推出其最新一代小型语言模型Claude Haiku 5.5,定位为当前成本最低、运行最快且综合能力最强的轻量级AI系统。该模型专为高负载场景优化,涵盖文档摘要、数据库检索等任务,并适用于对延迟敏感的应用,如实时客户服务交互及网页自动化操作。

计费机制革新:输入输出费率降至原价十分之一

面向集成至自有产品的开发人员,若提示词长度不超过10万token,Haiku 5.5的输入费用为每百万token 0.10美元,输出则为0.50美元。这一定价与OpenAI近期发布的GPT-6 Luna持平。相较此前4.5版本的1美元与5美元费率,降幅达90%;对于超出限额的请求,费用亦削减50%。鉴于约九成旧有请求均在限内,且新版本采用更细粒度分词策略,预计平均使用成本将减少近75%。

核心应用场景聚焦重复性任务,但表现远超预期

该模型的设计初衷是应对客户支持对话与长文本摘要等高频、结构化工作流。尽管任务本身偏向标准化与非创造性,但实测结果表明其具备显著超越同类产品的推理能力。在OSWorld 2.1测试中(评估AI执行多步骤真实系统操作的能力),Haiku 5.5成功率高达72.4%,大幅领先于GPT Luna的48.9%。

复杂任务表现亮眼,首次尝试准确率实现飞跃

在Terminal-Bench 4.0测试中,要求AI代理通过自主命令行操作完成专业级任务,成功标准为首次尝试即正确。Haiku 5.5达成39.2%的首次成功率,远超Luna的16.4%与前代Haiku 4.5的0%。相比之下,旗舰模型Claude Sonnet 5.5得分为70.6%。

性能验证:逻辑推理仍有局限,需谨慎对待输出

在一项基础逻辑问题测试中,模型响应速度接近即时,但最终答案出现偏差。这提醒用户,即便在高速场景下,仍不可完全依赖其判断结果,尤其在涉及精确决策的环节。

专业能力评级提升,奠定行业领先地位

根据GDPval-AA v2.1测试(基于国际象棋Elo体系评估44种职业任务表现),Haiku 5.5获得1620分,高于Luna的1437分,较前代4.5版本的735分实现跨越式增长。

新增智能调节功能,支持动态权衡成本与精度

此次发布首次引入“努力程度”可调设置,允许用户在响应速度与智能水平之间灵活切换。此外,Anthropic还将同系列旗舰模型Sonnet 5.5的缓存读取费率下调至每百万token 0.10美元,针对已处理内容提供显著折扣。

密集迭代背后的战略布局

Haiku 5.5紧随Opus 5.5(9月22日)与Sonnet 5.5(9月28日)发布,构成完整Claude 5.5系列。后者被官方定义为该系列的收官之作。此次更新发生在首席执行官Dario Amodei呼吁行业放缓模型能力升级步伐之后,凸显公司在性能与责任之间的平衡考量。

全平台上线并配套激励计划

目前,Claude Haiku 5.5已在Claude官网、Amazon Web Services、Google Cloud及Microsoft Azure全面上线,模型标识为claude-haiku-5-5。本周还启动了月度API额度优惠:Max 5x订阅者可获100美元额度,Max 20x用户享200美元,团队计划成员则可共享最高500美元的资源池。