Qwen3.8-27B智能力指数突破52分,逼近行业顶尖水平
Artificial Analysis近日公布Qwen3.8-27B独立评测结果,该270亿参数稠密模型在Intelligence Index测试中取得52分,与DeepSeek V4 Flash 0731及GPT-5.6 Luna Max持平,仅以1分之差落后于DeepSeek V4 Pro 0813与GLM-5.2。相较上一代Qwen3.6-27B的38分,性能跃升显著。
代理能力表现亮眼,多项指标实现反超
在专测复杂任务执行能力的Agentic Index中,Qwen3.8-27B达到51分,超越DeepSeek V4 Pro的50分、DeepSeek V4 Flash的48分以及GPT-5.6 Luna的47分,展现出在工具调用、任务规划与多步推理上的突出优势。
高分背后的巨大计算开销引关注
评测过程中,模型共生成约1.6亿输出Token,明显呈现“以大量输出换取智能表现”的特征。尽管官方默认推理档位为xhigh,支持medium、low及关闭思考模式,但本次评测未明确标注所用配置,因此尚无法确认该成绩是否基于默认设置达成。
声明:本站所有文章内容,均为采集网络资源,不代表本站观点及立场,不构成任何投资建议!如若内容侵犯了原著者的合法权益,可联系本站删除。
币安 Binance
币安交易所是全球加密货币交易所,注册奖励 500 U
