当前位置:首页 > Deepseek应用场景 > 正文内容

比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1

1周前 (04-11)Deepseek应用场景64

近日,硅基流动创始人袁进辉在华为云生态大会上宣布,硅基流动联合华为云基于 CloudMatrix 384超节点昇腾云服务和高性能推理框架 SiliconLLM,用大规模专家并行最佳实践正式上线 DeepSeek-R1。

该服务在保证单用户 20 TPS水平前提下,单卡 Decode吞吐突破 1920 Tokens/s,可比肩 H100 部署性能。同时,经过主流测试集验证及大规模线上盲测,在昇腾算力部署 DeepSeek-R1的模型精度与 DeepSeek官方保持一致。


其中,通过架构的全面创新,基于新型高速总线架构的 CloudMatrix超节点集群在总算力、互联带宽、内存带宽上领先业界。

此前,硅基流动在大模型云服务平台 SiliconCloud首发推出了基于昇腾云的稳定生产级 DeepSeek-V3 & R1 推理服务,并支持模型私有化集群部署,这次合作推动基于国产算力的 DeepSeek-R1推理服务持续升级。


DeepSeek风暴席卷全球,特别是以其高效、低成本的 MoE架构为应对大模型推理挑战打开了局面。不过,如果没有强大的 AI Infra 技术能力,要想部署好 DeepSeek并非易事。

DeepSeek使用了大规模专家并行(Expert Parallelism,大 EP并行)的 MoE模型架构,若采用单机部署方案,最终的性能远不如 DeepSeek官方公布的部署方案,且至少有数倍成本差距。更具挑战的是,虽然 DeepSeek公开了大 EP 并行方案,但技术难度较大,业内还没有其他团队快速复现这一部署方法。

针对这些难题,硅基流动与华为云联合攻关实现了技术突破。我们在 CloudMatrix 384超节点昇腾云服务上部署 DeepSeek-R1 时采纳了大规模专家并行方案,通过多专家负载均衡和极致通信优化,实现高吞吐及更高性能,大幅提升了用户体验。同时,我们使用昇腾高性能算子库,以及硅基流动推理加速框架 SiliconLLM在模型、机制、算子上的协同优化,实现在国产算力上,不损失模型精度的情况下,获得 DeepSeek-R1 推理效率与资源利用率的显著提升。

硅基流动与华为云的合作不仅提供坚实的全国产软硬件体系部署方案,让 DeepSeek推理服务更经济高效,也展现了 AI 生态合作的强大能量。硅基流动将继续加深与华为云的联合创新,共同提升产品体验,加速模型在更多场景落地。


“比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1” 的相关文章

宿迁移动助力举办“DeepSeek人工智能大讲堂” 赋能政企数智转型

宿迁移动助力举办“DeepSeek人工智能大讲堂” 赋能政企数智转型

为加速人工智能与工业经济深度融合,3月11日宿迁移动助力宿迁市工信局成功举办“DeepSeek人工智能大讲堂”,宿迁市工信局全体成员、各县区工信部门负责人及重点企业代表约150人参会。 宿迁移动总经理...

淮北市人民政府网站完成DeepSeek大模型接入

淮北市人民政府网站完成DeepSeek大模型接入

日前,市人民政府网站完成DeepSeek大模型接入工作,同步梳理并接入全市政府网站群近153万条海量数据。自上线以来,DeepSeek大模型智能问答累计处理各类咨询、办事等业务请求超1.5万件次,政民...

“DeepSeek医生”也能上岗“诊疗”了!人工智能自动生成处方靠谱吗?

“DeepSeek医生”也能上岗“诊疗”了!人工智能自动生成处方靠谱吗?

据中央广播电视总台中国之声《新闻纵横》报道,最近,人工智能的春风席卷各大领域,医疗行业也在经历着一场深刻的变革。各地多家医院纷纷引入国产AI大模型DeepSeek,并通过本地化部署将其应用于临床、科研...

航宇科技携手涵道科技实现DeepSeek本地化部署

航宇科技携手涵道科技实现DeepSeek本地化部署

每经AI快讯,2月27日,贵州航宇科技发展股份有限公司公众号消息,航宇科技与涵道空天(上海)智能科技有限公司达成深度合作,通过本地化部署 DeepSeek 智能系统致力于实现从研发、生产到服务的全链条...

英伟达新GPU再王炸,也得靠蹭DeepSeek卖卡

英伟达新GPU再王炸,也得靠蹭DeepSeek卖卡

一身皮衣黄仁勋,GTC 2025上意气风发。虽然最近英伟达的股票跌得比较狠,甚至来到了10年来的最低点,但这不影响老黄,对最新的GPU们信心满满。时间回拨到2月初,DeepSeek的发布在AI领域掀起...

“AI+”行动提速!中国人寿持续布局DeepSeek

“AI+”行动提速!中国人寿持续布局DeepSeek

人工智能是新一轮科技革命和产业变革的重要驱动力,近期DeepSeek强势“出圈”,在业界引发广泛关注,也成为全国两会热词。中国人寿集团推动各成员单位接入DeepSeek人工智能平台,在智能协同、智能客...