当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库

3周前 (02-25)Deepseek最新资讯51

【DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库】财联社2月25日电,DeepSeek在“开源周”的第二天向公众开源了DeepEP。据介绍,DeepEP是第一个用于MoE(混合专家)模型训练和推理的EP(Expert Parallelism,专家并行)通信库,可以实现高效且优化的全对全通信,支持包括FP8在内的低精度运算,适配现代高性能计算需求。同时,DeepEP针对NVLink到RDMA的非对称带宽转发场景进行了深度优化,不仅提供了高吞吐量,还支持SM(Streaming Multiprocessors)数量控制,兼顾训练和推理任务的高吞吐量表现。对于延迟敏感的推理解码场景,DeepEP还提供了纯RDMA的低延迟内核,支持自适应路由,能实现更灵活的GPU资源控制,满足不同场景需求。

“DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库” 的相关文章

女子手麻求医无果,借助DeepSeek确诊“雷诺病”

女子手麻求医无果,借助DeepSeek确诊“雷诺病”

“天都塌了!病人用DeepSeek后质疑我的治疗方案,气得我自己又查了一遍指南,才发现指南更新了……”前不久,广东一位医学博主的发帖引发了广泛关注。不仅有患者找DeepSeek开方,更有患者通过它找对...

西部利得基金完成DeepSeek大模型本地化部署

西部利得基金完成DeepSeek大模型本地化部署

西部利得基金宣布,公司在数字化建设领域取得重要进展,完成了DeepSeek多个大模型的本地化部署,并搭建了公司内部AI应用平台。这一举措不仅标志着公司在智能化转型上的突破性进展,也为后续在投研、风控、...

当虹科技“DeepSeek+BlackEye”大模型一体机首发

当虹科技“DeepSeek+BlackEye”大模型一体机首发

当虹科技2月21日发布全新一代“DeepSeek+BlackEye”多模态大模型一体机,为传媒行业发展再次注入新活力。当虹科技副总裁、传媒事业部总经理叶建华表示,DeepSeek+BlackEye多模...

湛江科技学院DeepSeek版“智能招生问答系统”来啦!

湛江科技学院DeepSeek版“智能招生问答系统”来啦!

湛江科技学院的智能招生问答系统已经华丽大变身,深度融合了DeepSeek大模型,全新升级,重新上线啦!  湛江科技学院的智能招生问答系统已经华丽大变身,深度融合了DeepSeek大模型,全新升级,重新...

福建首家接入DeepSeek中医院来了 电信助力开启AI诊疗新时代

福建首家接入DeepSeek中医院来了 电信助力开启AI诊疗新时代

随着智慧医疗建设推进,人工智能技术在医疗领域的应用不断深化,成为提升医疗服务质量与效率的重要抓手。近日,中国电信福建公司充分发挥云网融合与数字技术优势,助力福建省人民医院成为全省首个接入DeepSee...

欧阳明高谈DeepSeek:助力全民智驾加速落地

欧阳明高谈DeepSeek:助力全民智驾加速落地

本报记者张硕北京报道2月25日,在中国电动汽车百人会论坛(2025)专家媒体交流会上,中国科学院院士、中国电动汽车百人会副理事长欧阳明高表示,2025年中国汽车市场将迎来结构性变局,插电混动车型将增长...