摘要:Anthropic推出全新小型语言模型Haiku 5.5,以更低价格、更快响应和更强能力刷新行业标准。在多项基准测试中超越GPT Luna,同时支持可调节智能程度,助力开发者高效部署高并发应用。

币圈界报道:
Anthropic发布Claude Haiku 5.5:算力效率与经济性双重突破
周三,Anthropic正式推出其最新一代小型语言模型Claude Haiku 5.5,定位为当前成本最低、运行最快且综合能力最强的轻量级AI系统。该模型专为高负载场景优化,涵盖文档摘要、数据库检索等任务,并适用于对延迟敏感的应用,如实时客户服务交互及网页自动化操作。
计费机制革新:输入输出费率降至原价十分之一
面向集成至自有产品的开发人员,若提示词长度不超过10万token,Haiku 5.5的输入费用为每百万token 0.10美元,输出则为0.50美元。这一定价与OpenAI近期发布的GPT-6 Luna持平。相较此前4.5版本的1美元与5美元费率,降幅达90%;对于超出限额的请求,费用亦削减50%。鉴于约九成旧有请求均在限内,且新版本采用更细粒度分词策略,预计平均使用成本将减少近75%。
核心应用场景聚焦重复性任务,但表现远超预期
该模型的设计初衷是应对客户支持对话与长文本摘要等高频、结构化工作流。尽管任务本身偏向标准化与非创造性,但实测结果表明其具备显著超越同类产品的推理能力。在OSWorld 2.1测试中(评估AI执行多步骤真实系统操作的能力),Haiku 5.5成功率高达72.4%,大幅领先于GPT Luna的48.9%。
复杂任务表现亮眼,首次尝试准确率实现飞跃
在Terminal-Bench 4.0测试中,要求AI代理通过自主命令行操作完成专业级任务,成功标准为首次尝试即正确。Haiku 5.5达成39.2%的首次成功率,远超Luna的16.4%与前代Haiku 4.5的0%。相比之下,旗舰模型Claude Sonnet 5.5得分为70.6%。
性能验证:逻辑推理仍有局限,需谨慎对待输出
在一项基础逻辑问题测试中,模型响应速度接近即时,但最终答案出现偏差。这提醒用户,即便在高速场景下,仍不可完全依赖其判断结果,尤其在涉及精确决策的环节。
专业能力评级提升,奠定行业领先地位
根据GDPval-AA v2.1测试(基于国际象棋Elo体系评估44种职业任务表现),Haiku 5.5获得1620分,高于Luna的1437分,较前代4.5版本的735分实现跨越式增长。
新增智能调节功能,支持动态权衡成本与精度
此次发布首次引入“努力程度”可调设置,允许用户在响应速度与智能水平之间灵活切换。此外,Anthropic还将同系列旗舰模型Sonnet 5.5的缓存读取费率下调至每百万token 0.10美元,针对已处理内容提供显著折扣。
密集迭代背后的战略布局
Haiku 5.5紧随Opus 5.5(9月22日)与Sonnet 5.5(9月28日)发布,构成完整Claude 5.5系列。后者被官方定义为该系列的收官之作。此次更新发生在首席执行官Dario Amodei呼吁行业放缓模型能力升级步伐之后,凸显公司在性能与责任之间的平衡考量。
全平台上线并配套激励计划
目前,Claude Haiku 5.5已在Claude官网、Amazon Web Services、Google Cloud及Microsoft Azure全面上线,模型标识为claude-haiku-5-5。本周还启动了月度API额度优惠:Max 5x订阅者可获100美元额度,Max 20x用户享200美元,团队计划成员则可共享最高500美元的资源池。
声明:本站所有文章内容,均为采集网络资源,不代表本站观点及立场,不构成任何投资建议!如若内容侵犯了原著者的合法权益,可联系本站删除。
