AMD正式接入Qwen3.8 27B模型,推动本地化推理落地

根据AMD官方博客披露,公司已在其最新技术生态中集成Qwen3.8 27B大模型,支持用户通过llama.cpp等主流开源框架,在配备Ryzen AI Max+处理器的终端设备以及拥有32GB显存的Radeon AI PRO R9700显卡系统上开展本地化模型推理任务。

多平台性能实测结果公布,推理效率显著

初步测试数据显示,搭载Ryzen AI Max+ 395处理器的设备可实现高达24.5 tokens/s的推理速度,而采用Radeon AI PRO R9700显卡的系统则达到51.8 tokens/s,展现出强大的异构计算能力与优化水平。

LM Studio助力快速部署,降低使用门槛

为提升用户体验,用户可通过LM Studio等可视化工具便捷完成模型加载与运行测试,大幅缩短调试周期,加速本地AI应用的开发与验证流程。