当前位置:首页 > Deepseek最新资讯 > 正文内容

全面适配!京东云将DeepSeek推理场景性能提升50%

5个月前 (03-03)Deepseek最新资讯301

央广网北京3月3日消息 在DeepSeek为期五天的“开源周”中,其连续开源的五大核心技术(FlashMLA、DeepEP、DeepGEMM、DualPipe & EPLB、3FS文件系统),惊艳全球。

京东云率先宣布完成对这五项技术的全栈适配,在模型推理效率、算力资源利用率及数据管理等领域实现突破性优化,综合Flash MLA、DeepEP、FP8 GEMM、DualPipe四方面的调优,在DeepSeek推理场景下性能提升50%。

全面适配五大技术,DeepSeek推理场景性能提升50%

作为DeepSeek开源首日的重磅技术,Flash MLA通过动态调度GPU的显存与算力资源,解决了传统方法处理变长序列时的资源浪费问题。

京东vGPU AI算力平台通过支持Flash MLA的FP8格式来提升推理性能,使单Token的 KV Cache显存占用相比Multi-head Attention降低57倍,配合最新的投机推理技术,以极低的显存需求,在高并发请求场景下保证了推理的吞吐量和延迟表现。

此外,针对用于DeepSeek开源的通信库DeepEP,京东云vGPU AI算力平台已全面支持EP模式下的分布式推理,显著提高推理吞吐。通过整合DeepEP作为通信后端,针对机内通信使用NVLink传输数据,机间通信使用NVSHMEM接口走RDMA网络,同时通过灵活的GPU SM数量利用控制,增大GPU算力资源利用率以及减少对计算算子的性能串。

更低成本更高效率,让大模型真正用起来

针对客户大模型的使用需求,京东云vGPU AI算力平台,为用户提供更高推理性能、更多国产芯片适配、更多高数据安全的大模型服务,让大模型真正用起来。

在推理性能方面,针对DeepSeek大模型技术特点,京东云通过推理加速与内核驱动级优化,提升单台服务器推理性能50%。

在国产芯片适配方面,京东云已完成从底层算力到大模型和业务应用的全面国产化适配,包括十余家国产化AI算力,确保自主可控。

在数据安全方面,通过机密容器AI全场景密态计算和先进的容器隔离技术,确保模型数据的机密性与完整性,为用户提供金融级安全防护。

目前,在河南鹤壁、江苏宿迁、山东滨州、广西北海、山西大同,京东云已经助力多地政府基于现有基础设施本地化部署DeepSeek,既满足本地政务业务,又让当地企业不用投入资源,即可通过政务云调用DeepSeek。


标签: DeepSeek

“全面适配!京东云将DeepSeek推理场景性能提升50%” 的相关文章

DeepSeek官方辟谣:假消息!发生了什么?

DeepSeek官方辟谣:假消息!发生了什么?

3月11日,针对DeepSeek将在3月17日发布下一代R2模型的传闻,DeepSeek官方企业咨询账号在用户群中回应称,“辟谣:R2发布为假消息。”3月11日,据东方财经援引媒体报道,有市场消息称,...

“AI+”行动提速!中国人寿持续布局DeepSeek

“AI+”行动提速!中国人寿持续布局DeepSeek

人工智能是新一轮科技革命和产业变革的重要驱动力,近期DeepSeek强势“出圈”,在业界引发广泛关注,也成为全国两会热词。中国人寿集团推动各成员单位接入DeepSeek人工智能平台,在智能协同、智能客...

突传重磅,获顶级域名认可!DeepSeek引爆“新生意”,已有上千人购买

突传重磅,获顶级域名认可!DeepSeek引爆“新生意”,已有上千人购买

国际投行集体唱多A股DeepSeek不仅震撼了硅谷,还震撼了华尔街。最近一周以来,高盛、美银、德银等国际知名投行轮番发布研报,看好中国科技股,建议做多中国股市。华尔街唱多中国股市的声音正如潮水般涌来。...

西安工业大学研究团队发布基于DeepSeek的智能仿真想定新范式

西安工业大学研究团队发布基于DeepSeek的智能仿真想定新范式

【西安工业大学研究团队发布基于DeepSeek的智能仿真想定新范式】财联社5月15日电,西安工业大学傅妍芳教授团队近日通过人工智能实现军事仿真想定的自动生成。传统指挥员48小时的编排,AI能用48秒重...

海尔消费金融部署DeepSeek,客服质检效率显著提升

海尔消费金融部署DeepSeek,客服质检效率显著提升

随着人工智能技术的飞速发展,金融行业的数字化转型步伐也在不断加快。海尔消费金融作为行业内的佼佼者,率先引入了前沿的AI模型DeepSeek,以提升客服质检效率,进一步优化客户体验。DeepSeek作为...

从DeepSeek-R1看AI国产化的全球突围

从DeepSeek-R1看AI国产化的全球突围

近期,中国初创公司深度求索(DeepSeek)推出的大模型DeepSeek-R1引发全球关注。这款完全基于国产技术研发的AI产品,不仅在自然语言处理、多模态交互等领域展现出不逊于国际顶尖模型的性能,更...