微软推出新一代决策评分模型,实测性能全面领先

10月10日,微软官方博客宣布其最新研发的决策评分模型Microsoft-Decision-1正式上线,部署于Microsoft Foundry与OpenRouter平台。该模型专为路由、分类、优先排序、验证及工作流管理等高精度任务设计,展现出卓越的判断能力与执行效率。

多维度基准测试表现优异,速度与准确率双冠

在覆盖近15万个问题的盲测评估中,该模型在36项权威基准上均取得最优准确率,同时成为实测响应速度最快的系统:较第二名H2O-Lightning-4B v1.1提升2.5倍,比GPT-6 Sol快达35倍,显著优化了复杂决策链的处理效率。

基于Qwen3.5-9B微调,具备高鲁棒性与可解释性

模型以Qwen3.5-9B为基础进行后训练,具备对固定选项输出校准概率分数的能力,增强结果可信度。内部测试显示,在同一请求经受八种扰动后,平均仅1.3%出现决策反转,体现极强的稳定性与抗干扰能力。

定价策略优化,大规模应用成本大幅降低

该模型采用差异化计费模式:输入每百万token收费0.042美元,输出免费。在实际应用场景中,XBOX Research已利用其处理超万条用户反馈并完成精准归类,其处理速度是GPT-6 Sol的14倍,单位成本仅为后者的二百分之一。