摘要:Anthropic发布Claude Sonnet 5.5,强调在性能提升的同时实现30%以上成本降低。尽管基准测试分数仍是参考,但企业更关注实际部署中的效率与开销,标志着AI评估进入以成本为核心的新阶段。

币圈界报道:
Anthropic推出Claude Sonnet 5.5:成本效益成新衡量标尺
9月28日,Anthropic正式发布其Claude 5.5系列的第二款产品——Claude Sonnet 5.5。此次发布正值公司筹备首次公开募股的关键节点,凸显出市场对模型经济性日益增长的关注。在传统性能指标之外,企业愈发重视模型在完成任务过程中所消耗的资源与支出,推动评估体系向综合效率倾斜。
运行速度跃升三成,单位任务成本显著压缩
据官方披露,相较于前代Sonnet 5,Sonnet 5.5在多数场景下的执行效率提升超过30%。即便保持原有代币定价不变,其在相同任务下的实际使用成本最高可削减三成。这一优化主要源于系统在达成同等输出质量时,对输入与输出代币的调用量大幅减少。
定价策略稳定,用量优化带来实质收益
Sonnet 5.5的计费标准为每百万输入代币2美元,输出代币10美元,缓存读取则为0.20美元。相比之下,面向复杂推理的Opus 5.5版本,输入与输出价格分别为4美元和20美元。前者专精于代码生成、文档撰写及表格处理等常规操作,定位清晰。这使得企业在选择模型时,不再盲目追求峰值性能,而更倾向于选用能稳定交付结果且成本更低的方案。
性能分数非唯一标准,实际开销更具决定性
尽管Sonnet 5.5在Terminal-Bench 4.0测试中取得70.6%的成绩,远超前代的10.3%,但第三方分析平台的数据揭示了更深层逻辑:该模型在智能量表上得分为56,单任务预估成本为7.60美元;而GPT-6 Sol虽仅获48分,但成本仅为1.06美元;小米MiMo-V2.6-Pro得分46,成本低至0.13美元。此类差异促使企业重构工作流设计,将高复杂度任务交由高端模型处理,其余日常任务则由经济型模型承担。
AI算力成本持续走低,趋势不可逆
Epoch AI于9月22日发布的报告显示,自2023年起,达到特定性能水平的AI模型,其单位成本每季度平均下降约47%,年降幅接近13倍。Cryptopolitan在9月29日的报道指出,企业正从“追求最强模型”转向“选择最适配成本的模型”,低廉的代币价格也促使组织更多地采用多模型协同架构。
便宜代币不等于省钱,总支出仍在攀升
然而,成本下降并未带来整体支出缩减。根据Gartner于8月17日发布的《2028年代理工作流AI推理成本预测》,随着模型效率提高,企业对复杂工作流的需求激增,导致总代币消耗量上升。报告揭示了一种“推理悖论”:越便宜的计算单元,反而可能催生更高的总账单。高级分析师Will Sommer在2026年8月17日的评论中强调:“单纯依赖更优的代币经济学无法解释或控制未来成本。”
谁真正享受低成本红利?可及性仍受多重制约
微软《全球AI扩散报告》指出,低门槛模型有助于提升发展中国家的技术可及性。尽管模型本身成本降低,但能否落地仍取决于本地网络基础设施、算力支持与专业人才储备。对企业而言,Sonnet 5.5的推出印证了市场演进方向:最优解并非最强模型,而是能在合理预算内高效完成任务的工具。预计即将发布的Haiku 5.5将进一步强化这一趋势,使通用型任务的执行成本进一步压低,令企业难以再为简单任务支付高价提供正当理由。
声明:本站所有文章内容,均为采集网络资源,不代表本站观点及立场,不构成任何投资建议!如若内容侵犯了原著者的合法权益,可联系本站删除。
