Qwen3.8-27B智能力指数突破52分,逼近行业顶尖水平

Artificial Analysis近日公布Qwen3.8-27B独立评测结果,该270亿参数稠密模型在Intelligence Index测试中取得52分,与DeepSeek V4 Flash 0731及GPT-5.6 Luna Max持平,仅以1分之差落后于DeepSeek V4 Pro 0813与GLM-5.2。相较上一代Qwen3.6-27B的38分,性能跃升显著。

代理能力表现亮眼,多项指标实现反超

在专测复杂任务执行能力的Agentic Index中,Qwen3.8-27B达到51分,超越DeepSeek V4 Pro的50分、DeepSeek V4 Flash的48分以及GPT-5.6 Luna的47分,展现出在工具调用、任务规划与多步推理上的突出优势。

高分背后的巨大计算开销引关注

评测过程中,模型共生成约1.6亿输出Token,明显呈现“以大量输出换取智能表现”的特征。尽管官方默认推理档位为xhigh,支持medium、low及关闭思考模式,但本次评测未明确标注所用配置,因此尚无法确认该成绩是否基于默认设置达成。