华为发布昇腾大模型：无GPU训练高数大题仅需2秒！

作者：AI在线 2025-05-30 04:00

最近，华为通过其新推出的 “昇腾 Pangu Ultra MoE” 系统展示了一个令人惊叹的突破:一个近万亿参数的 MoE 大模型在短短2秒内就能理解并解答一道高等数学题。而这一切都在没有使用 GPU 的情况下实现，显示出华为在自主可控的国产算力和模型训练方面的强大能力。在技术层面，华为的团队成功提升了训练系统的整体性能，通过智能选择并行策略和优化计算通信，大幅提高了集群的训练效率。

最近，华为通过其新推出的 “昇腾 + Pangu Ultra MoE” 系统展示了一个令人惊叹的突破:一个近万亿参数的 MoE 大模型在短短2秒内就能理解并解答一道高等数学题。而这一切都在没有使用 GPU 的情况下实现，显示出华为在自主可控的国产算力和模型训练方面的强大能力。

在技术层面，华为的团队成功提升了训练系统的整体性能，通过智能选择并行策略和优化计算通信，大幅提高了集群的训练效率。在其技术报告中，华为详尽披露了在 CloudMatrix384超节点上进行的多项技术创新，包括改进的通信机制和负载均衡策略。这些创新使得大规模 MoE 训练的专家并行通信开销几乎降至零，同时有效平衡了计算负载。

此外，华为在提高单节点算力方面也取得了显著成效。他们通过优化训练算子的执行，成功将微批处理规模提升至原来的两倍，同时解决了算子下发的效率问题。这种技术的进步意味着，华为的系统在面对复杂计算任务时，能够更加高效地利用现有资源。

华为的这一系列技术创新不仅让 MoE 模型的训练效率大幅提升，更为未来大规模 AI 模型的训练与应用打开了新的可能性。

DeepSeek 系列新模型上线华为昇腾社区：一键获取，开箱即用

据华为官方公众号，2 月 4 日，DeepSeek-R1、DeepSeek-V3、DeepSeek-V2、Janus-Pro 正式上线昇腾社区，支持一键获取 DeepSeek 系列模型，支持昇腾硬件平台上开箱即用，推理快速部署。

2/5/2025 3:40:10 PM 清源

华为昇腾 384 超节点 Atlas 900 SuperPoD 被评选为本次 WAIC 2025 镇馆之宝

AI在线 7 月 28 日消息，2025 世界人工智能大会（WAIC）于 7 月 26 日在上海世博中心启幕。本次 WAIC，华为首次线下展出昇腾 384 超节点 Atlas 900 A3 SuperPoD，该产品基于超节点架构，通过总线技术实现 384 个 NPU 之间的大带宽低时延互联，解决集群内计算、存储等各资源之间的通信瓶颈。据华为中国官方消息，昇腾 384 超节点 Atlas 900 SuperPoD 被评选为本次 WAIC 2025 镇馆之宝，其主要有以下 3 大优势：① 超大带宽超节点内任意两个 AI 处理器之间通信带宽，相较于传统架构提升 15 倍，超节点内单跳时延降低 10 倍。

7/28/2025 11:20:37 AM 归泷

华为发布昇腾大模型：无GPU训练高数大题仅需2秒！

相关资讯

华为昇腾适配支持 DeepSeek-R1 复现项目 Open R1

DeepSeek 系列新模型上线华为昇腾社区：一键获取，开箱即用

华为昇腾 384 超节点 Atlas 900 SuperPoD 被评选为本次 WAIC 2025 镇馆之宝