币圈界报道:

Anthropic推出Claude Sonnet 5.5:成本效益成新衡量标尺

9月28日,Anthropic正式发布其Claude 5.5系列的第二款产品——Claude Sonnet 5.5。此次发布正值公司筹备首次公开募股的关键节点,凸显出市场对模型经济性日益增长的关注。在传统性能指标之外,企业愈发重视模型在完成任务过程中所消耗的资源与支出,推动评估体系向综合效率倾斜。

运行速度跃升三成,单位任务成本显著压缩

据官方披露,相较于前代Sonnet 5,Sonnet 5.5在多数场景下的执行效率提升超过30%。即便保持原有代币定价不变,其在相同任务下的实际使用成本最高可削减三成。这一优化主要源于系统在达成同等输出质量时,对输入与输出代币的调用量大幅减少。

定价策略稳定,用量优化带来实质收益

Sonnet 5.5的计费标准为每百万输入代币2美元,输出代币10美元,缓存读取则为0.20美元。相比之下,面向复杂推理的Opus 5.5版本,输入与输出价格分别为4美元和20美元。前者专精于代码生成、文档撰写及表格处理等常规操作,定位清晰。这使得企业在选择模型时,不再盲目追求峰值性能,而更倾向于选用能稳定交付结果且成本更低的方案。

性能分数非唯一标准,实际开销更具决定性

尽管Sonnet 5.5在Terminal-Bench 4.0测试中取得70.6%的成绩,远超前代的10.3%,但第三方分析平台的数据揭示了更深层逻辑:该模型在智能量表上得分为56,单任务预估成本为7.60美元;而GPT-6 Sol虽仅获48分,但成本仅为1.06美元;小米MiMo-V2.6-Pro得分46,成本低至0.13美元。此类差异促使企业重构工作流设计,将高复杂度任务交由高端模型处理,其余日常任务则由经济型模型承担。

AI算力成本持续走低,趋势不可逆

Epoch AI于9月22日发布的报告显示,自2023年起,达到特定性能水平的AI模型,其单位成本每季度平均下降约47%,年降幅接近13倍。Cryptopolitan在9月29日的报道指出,企业正从“追求最强模型”转向“选择最适配成本的模型”,低廉的代币价格也促使组织更多地采用多模型协同架构。

便宜代币不等于省钱,总支出仍在攀升

然而,成本下降并未带来整体支出缩减。根据Gartner于8月17日发布的《2028年代理工作流AI推理成本预测》,随着模型效率提高,企业对复杂工作流的需求激增,导致总代币消耗量上升。报告揭示了一种“推理悖论”:越便宜的计算单元,反而可能催生更高的总账单。高级分析师Will Sommer在2026年8月17日的评论中强调:“单纯依赖更优的代币经济学无法解释或控制未来成本。”

谁真正享受低成本红利?可及性仍受多重制约

微软《全球AI扩散报告》指出,低门槛模型有助于提升发展中国家的技术可及性。尽管模型本身成本降低,但能否落地仍取决于本地网络基础设施、算力支持与专业人才储备。对企业而言,Sonnet 5.5的推出印证了市场演进方向:最优解并非最强模型,而是能在合理预算内高效完成任务的工具。预计即将发布的Haiku 5.5将进一步强化这一趋势,使通用型任务的执行成本进一步压低,令企业难以再为简单任务支付高价提供正当理由。