DeepSeek加速布局国产算力生态,启动大规模模型训练迁移

据香港雅虎财经报道,DeepSeek创始人梁文锋对外披露公司核心战略动向,明确将优先采用华为昇腾系列芯片开展大模型训练工作,标志着其正式开启从英伟达CUDA生态向华为CANN体系的深度迁移。

国产算力替代进程提速,2026年进入关键落地窗口期

根据规划,DeepSeek拟依托华为新一代训练芯片,预计于2026年第四季度至2027年第一季度期间完成部署,并以此为基础开展新一代大模型的训练任务。该阶段被视为实现算力自主的关键节点。

底层重构挑战严峻,研发投入构成重大战略投入

此次迁移涉及对现有模型架构与底层代码的系统性重写,技术复杂度高,整体研发成本显著上升。尽管面临巨大挑战,公司仍将此视为保障长期算力安全的核心举措。

行业标杆意义凸显,但多重不确定性仍存

业内专家指出,若DeepSeek成功实现大规模模型在国产芯片上的完整训练流程,将成为国内软硬件协同发展的典范案例。然而,生态兼容性、性能优化效率及芯片交付节奏等变量,仍是影响战略成败的重要因素。