当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

8个月前 (02-24)Deepseek最新资讯416

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。


据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。


贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。


上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

DeepSeek创始人梁文锋,首登全球富豪榜

DeepSeek创始人梁文锋,首登全球富豪榜

3月27日,胡润研究院发布《2025胡润全球富豪榜》,今年40岁的DeepSeek创始人梁文锋第一次上榜,小米集团56岁的雷军成为财富增长最快的中国企业家。在AI领域,梁文锋和OpenAI 39岁的S...

飞书低代码平台已全面接入Deepseek R1模型能力

飞书低代码平台已全面接入Deepseek R1模型能力

钛媒体App 2月14日消息,飞书低代码平台已全面接入Deepseek R1模型能力。平台提供大量AI增强能力,开发者可在流程中直接调用DeepSeekR1模型,对数据进行批量自动化处理。此外,页面中...

文心一言:请详细介绍Deepseek在办公行业应用有哪些?

文心一言:请详细介绍Deepseek在办公行业应用有哪些?

文心一言:请详细介绍Deepseek在办公行业应用有哪些?DeepSeek在办公行业的应用十分广泛,以下是对其应用的具体介绍:一、文档处理与创作自动写作与编辑:DeepSeek能够辅助写作,如生成创意...

DeepSeek加持 杭州机场热线变民航首个AI大模型智能呼叫中心

DeepSeek加持 杭州机场热线变民航首个AI大模型智能呼叫中心

5月16日零点,杭州机场96299智能呼叫中心顺利完成新旧系统无缝衔接及测试运行工作,上线投入运营。基于DeepSeek大模型技术,升级后的96299热线成为全国民航首个AI大模型智能呼叫中心,开创了...

DeepSeek问世,加快联想全栈AI战略落地

DeepSeek问世,加快联想全栈AI战略落地

3月4日,在2025年世界移动通信大会期间,世界互联网大会国际组织在西班牙巴塞罗那举办以“打造融合、普惠、绿色的AI算力新生态”为主题的“AI算力发展”专题论坛。联想集团执行副总裁刘军表示,联想已经形...

多地政务系统接入DeepSeek,意味着什么?

多地政务系统接入DeepSeek,意味着什么?

昨日,丰台区政务和数据局联手中国经济信息社和北京丰台城市数字科技集团有限公司,成功在政务云本地部署了DeepSeek大模型环境,并在全市率先将其应用于政务服务领域,上线了“丰小政”数智助手。DeepS...