当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

5个月前 (02-26)Deepseek最新资讯314

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

至顶AI实验室:DeepSeek完全实用手册V1.5,技术原理·使用技巧·部署进展(PDF版)

至顶AI实验室:DeepSeek完全实用手册V1.5,技术原理·使用技巧·部署进展(PDF版)

好的产品一定是能久经市场考验的,DeepSeek 无疑就是今年最好的产品之一。距离DeepSeek R1发布已经快3个月了,通过微信指数我们可以看到,DeepSeek的热度依然很高。但我们相信,过去的...

中国AI大厂,被Deepseek掀了牌桌之后

中国AI大厂,被Deepseek掀了牌桌之后

本文来自微信公众号:极客公园 (ID:geekpark),作者:连冉,题图来自:AI生成过去几个月,尤其是2025年一季度,国内大厂在AI大模型领域的声量明显低调了不少。最直观的感受就是,发布会明显少...

2连板禾盛新材:控股子公司部分产品接入Deepseek模型 但未与Deepseek签署服务合作协议

2连板禾盛新材:控股子公司部分产品接入Deepseek模型 但未与Deepseek签署服务合作协议

【2连板禾盛新材:控股子公司部分产品接入Deepseek模型 但未与Deepseek签署服务合作协议】财联社2月19日电,禾盛新材发布异动公告,近期市场对Deepseek相关概念关注度较高,公司就相关...

德州市公路巡查中心举行DeepSeek培训交流会

德州市公路巡查中心举行DeepSeek培训交流会

为紧跟科技发展最新趋势,提升干部职工对人工智能技术的理解与应用能力,助力工作提效能,3月3日,德州市公路巡查中心特邀中国电信人工智能领域专家团队,举办“DeepSeek应用与赋能业务”专题讲座。授课专...

人工智能赋能职业教育,北京八维集团引入DeepSeek

人工智能赋能职业教育,北京八维集团引入DeepSeek

在科技飞速发展的当下,人工智能(AI)已成为推动各行业变革的核心力量,职业教育领域自然也不例外。北京八维集团作为职业教育的领军者,敏锐洞察到人工智能带来的巨大机遇,近日正式引入先进的大语言模型 Dee...

平凉市成功接入DeepSeek大模型,“萍萍助手”上线运行

平凉市成功接入DeepSeek大模型,“萍萍助手”上线运行

3月6日,平凉市成功接入DeepSeek大模型,在市政府网站、甘肃政务服务网平凉子站、12345热线平台上线“萍萍助手”智能问答功能,赋能数字政府建设,实现智能问答场景应用创新。“萍萍助手”“萍萍助手...