当前位置:首页 > Deepseek应用场景 > 正文内容

比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1

3个月前 (04-11)Deepseek应用场景239

近日,硅基流动创始人袁进辉在华为云生态大会上宣布,硅基流动联合华为云基于 CloudMatrix 384超节点昇腾云服务和高性能推理框架 SiliconLLM,用大规模专家并行最佳实践正式上线 DeepSeek-R1。

该服务在保证单用户 20 TPS水平前提下,单卡 Decode吞吐突破 1920 Tokens/s,可比肩 H100 部署性能。同时,经过主流测试集验证及大规模线上盲测,在昇腾算力部署 DeepSeek-R1的模型精度与 DeepSeek官方保持一致。


其中,通过架构的全面创新,基于新型高速总线架构的 CloudMatrix超节点集群在总算力、互联带宽、内存带宽上领先业界。

此前,硅基流动在大模型云服务平台 SiliconCloud首发推出了基于昇腾云的稳定生产级 DeepSeek-V3 & R1 推理服务,并支持模型私有化集群部署,这次合作推动基于国产算力的 DeepSeek-R1推理服务持续升级。


DeepSeek风暴席卷全球,特别是以其高效、低成本的 MoE架构为应对大模型推理挑战打开了局面。不过,如果没有强大的 AI Infra 技术能力,要想部署好 DeepSeek并非易事。

DeepSeek使用了大规模专家并行(Expert Parallelism,大 EP并行)的 MoE模型架构,若采用单机部署方案,最终的性能远不如 DeepSeek官方公布的部署方案,且至少有数倍成本差距。更具挑战的是,虽然 DeepSeek公开了大 EP 并行方案,但技术难度较大,业内还没有其他团队快速复现这一部署方法。

针对这些难题,硅基流动与华为云联合攻关实现了技术突破。我们在 CloudMatrix 384超节点昇腾云服务上部署 DeepSeek-R1 时采纳了大规模专家并行方案,通过多专家负载均衡和极致通信优化,实现高吞吐及更高性能,大幅提升了用户体验。同时,我们使用昇腾高性能算子库,以及硅基流动推理加速框架 SiliconLLM在模型、机制、算子上的协同优化,实现在国产算力上,不损失模型精度的情况下,获得 DeepSeek-R1 推理效率与资源利用率的显著提升。

硅基流动与华为云的合作不仅提供坚实的全国产软硬件体系部署方案,让 DeepSeek推理服务更经济高效,也展现了 AI 生态合作的强大能量。硅基流动将继续加深与华为云的联合创新,共同提升产品体验,加速模型在更多场景落地。


“比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1” 的相关文章

DeepSeek详细介绍DeepSeek在教育领域有哪些重要应用场景?

DeepSeek详细介绍DeepSeek在教育领域有哪些重要应用场景?

总结:DeepSeek作为基于深度学习的智能语音搜索器,不仅能在文本中进行语音识别和理解,还可以在教育领域发挥重要作用。以下是一些详细介绍教育领域内的重要应用场景: 1. **教学计划查找*...

昆明轨道集团正式启用DeepSeek

昆明轨道集团正式启用DeepSeek

云南网讯(记者 赵岗)2月19日,记者从昆明轨道集团获悉,DeepSeek大模型日前已在集团正式上线,助力内部多场景效率提升。昆明轨道集团“2331”发展战略(编织轨道综合交通规划建设网、运营服务网,...

“英伟达焦虑:若DeepSeek用中企芯片…”

“英伟达焦虑:若DeepSeek用中企芯片…”

【文/观察者网 林琛力】据路透社报道,当地时间5月1日,英伟达高管与美国众议院外交事务委员会举行闭门会议,英伟达首席执行官黄仁勋在会上表达了对中国企业AI能力不断增强的担忧。据悉,当日会议的主题包括中...

江门多家企事业单位“牵手”DeepSeek

江门多家企事业单位“牵手”DeepSeek

今年以来从政务服务到创意创作从企业研发生产到产品升级千行百业纷纷接入DeepSeek它宛如一把钥匙开启各行各业智能化变革的大门市委十四届八次全会暨全市高质量发展大会强调,要实施“人工智能+”行动计划,...

安卓首家接入DeepSeek背后:看见女性力量

安卓首家接入DeepSeek背后:看见女性力量

在人类社会的历史进程中,女性的力量从来不容小觑,她们以不同的方式在各个领域诠释着自身价值。今天,我们将目光投向科技领域:中国科技部最新统计显示,我国女性科技工作者总量达4260万人,在科研人员总量中占...

为什么DeepSeek回答前总先“嗯”一下

为什么DeepSeek回答前总先“嗯”一下

在人工智能与人类对话的边界逐渐融合消弭的今天,许多用户发现DeepSeek的回复中常常出现一个有趣的细节——这个AI似乎格外喜欢在回答中插入“嗯”这样的语气词。这个看似简单的小习惯,背后其实藏着人工智...