多模型编码转换测试:性能趋近但开销悬殊

丹麦开发者DHH于8月27日开展实验,对当前主流AI模型在将Python库迁移至Rust的任务中进行横向对比。结果显示,Fable以45分钟最快完成,但耗资高达550美元;Soul与Grok分别用时约1.5小时,支出约为Fable的十分之一;而DeepSeek Pro虽耗时最长(2小时45分钟),却仅产生23美元成本。

输出一致性凸显技术收敛趋势

值得注意的是,三款模型生成的最终代码结果完全一致,表明在特定任务上,顶尖模型的逻辑推理与代码生成能力已趋于同质化,技术边界正逐步模糊。