当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

6个月前 (02-25)Deepseek最新资讯318

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。

据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。

贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。

上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

deepseek的历史对话记录能保存多久?

deepseek的历史对话记录能保存多久?

deepseek的历史对话记录能保存多久?Deepseek的历史对话记录默认保存时间为180天。您可以在账户的历史记录页面查看和管理这些记录。如果需要长期保存重要对话,建议手动导出并备份。相关问题怎么...

DeepSeek被山寨域名包围

DeepSeek被山寨域名包围

围绕新应用展开的形形色色的碰瓷行为大行其道,显然值得警惕。▲近期,仿冒DeepSeek的网站、钓鱼网站大量出现。图/IC photo文| 吴振在爆火全网后,DeepSeek(深度求索)首次发布公开声明...

DeepSeek将于下周陆续开源5个代码库 每日解锁新内容

DeepSeek将于下周陆续开源5个代码库 每日解锁新内容

 DeepSeek今日宣布,接下来一周,会陆续来源5个代码库,每日都有新内容解锁,进一步分享新的进展。DeepSeek介绍,当前在线服务的模块已经经过测试、部署完备,可以投入生产环境。公司将...

DeepSeek刮起AI新潮流,雷军、李东生呼吁监管要系紧缰绳

DeepSeek刮起AI新潮流,雷军、李东生呼吁监管要系紧缰绳

2025年,人工智能再一次站上了全国两会的“C位”。去年,“人工智能+”首次被写进政府工作报告。而今年,政府工作报告再提“人工智能+”,与之相关的“具身智能”“人工智能手机和电脑”“智能机器人”等关键...

DeepSeek宣布开源DeepGEMM

DeepSeek宣布开源DeepGEMM

【DeepSeek宣布开源DeepGEMM】财联社2月26日电,Deepseek于开源周第三天宣布开源DeepGEMM。DeepGEMM 是一个专为简洁高效的 FP8 通用矩阵乘法(GEMM)设计的库...

DeepSeek正式登陆中山!DeepSeek本地化部署涵盖 “DeepSeek+产业智造” “DeepSeek+民生服务” “DeepSeek+政务应用”三大领域

DeepSeek正式登陆中山!DeepSeek本地化部署涵盖 “DeepSeek+产业智造” “DeepSeek+民生服务” “DeepSeek+政务应用”三大领域

2月18日,中山市完成国内领先的人工智能大模型DeepSeek本地化部署,全面开启AI技术赋能产业发展、智慧民生和高效政务新篇章,为建设创新之城和人才重地注入新活力。目前,DeepSeek本地化部署涵...