中国最先进 AI 模型仍用Nvidia 芯片,迁移到华为需要大量重写和优化

中国多家大模型开发者称,中国最先进 AI 模型仍在 Nvidia 芯片上训练。转用国产芯片的主要障碍是软件生态和迁移成本:CUDA 代码无法直接运行在华为昇腾芯片上,需要大量重写和优化。一名研究人员估算,其团队迁移后时间和成本至少增加 50%。

一名工程师称,开放源代码模型迁移到昇腾,约需两三名工程师额外工作一个月;只发布模型权重、未公开源代码的模型,可能需要约 10 名工程师额外工作半年以上。部分团队已使用国产芯片,美团 6 月称,LongCat-2.0 完全在 5 万张国产算力卡集群上训练和运行,但未披露供应商。

上一篇:

下一篇: