阿里发布超大规模开源模型,全面开放免费接口

据B.AI披露,阿里巴巴最新推出的多模态混合专家模型Qwen3.8-Flash已正式入驻该平台,并于8月27日启动免费API服务。该模型具备强大的文本理解与生成能力,为开发者提供低成本高效率的技术支持。

模型参数架构优化,实现高效推理与低延迟响应

该模型总参数量达1250亿,其中包含510亿个N-gram嵌入向量;在实际运行中,每token仅激活60亿参数,显著降低计算开销,提升推理速度。其原生支持26.2万token的上下文长度,并可通过YaRN技术扩展至100万token,适用于复杂长文本处理任务。

融合前沿注意力机制,强化信息提取与智能交互能力

通过集成GDN与QSA双注意力机制,模型在长序列建模中展现出卓越的精准度与上下文捕捉能力,能够有效支撑代码辅助、自动化工作流构建及结构化文档分析等应用场景,推动AI应用向深度化发展。