当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

7个月前 (02-25)Deepseek最新资讯340

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。

据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。

贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。

上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

和而泰:智能化业务板块已接入DeepSeek大模型并完成本地化部署和测试

和而泰:智能化业务板块已接入DeepSeek大模型并完成本地化部署和测试

金融界4月2日消息,有投资者在互动平台向和而泰提问:请问贵公司多个行业数智化模型(方案)已全面接入DeepSeek并进行了本地化部署,同时已启动应用于多个行业头部客户业务场景的相关合作项目。这些行业数...

青云科技:未与DeepSeek签署服务合作协议

青云科技:未与DeepSeek签署服务合作协议

每经快讯,青云科技(688316)2月12日晚间发布股票交易异常波动暨严重异常波动公告,公司旗下部分产品进行了DeepSeek的接入,但公司未与DeepSeek签署服务合作协议,与其没有业务合作,该事...

运营商全面接入DeepSeek意味着什么?

运营商全面接入DeepSeek意味着什么?

《科创板日报》2月12日讯 近日,三大运营商宣布全面接入DeepSeek,给市场带来了一波不小的冲击。中国电信率先成为国内首家实现DeepSeek模型全栈国产化推理服务落地的运营商级云平台;...

保姆级教程:DeepSeek+即梦AI 快速生成图文海报(含思维导图笔记)

保姆级教程:DeepSeek+即梦AI 快速生成图文海报(含思维导图笔记)

Deepseek+即梦AI生成图文海报详细教程来啦,文末还整理成了竖屏思维导图笔记,一图get关键点!Hi,我是做思维导图笔记的小贤!一个好消息!即梦AI 接入Deepseek啦!生图或生视频效率起飞...

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?<think> 嗯,用户之前问过DeepSeek在科技领域哪些应用场景,我详细回答了自动驾驶、智能视频、推荐、助...

DeepSeek要掀数据存储的“桌子”?

DeepSeek要掀数据存储的“桌子”?

最近这几天,业界关注度最高的无疑是DeepSeek的几个开源项目,几乎每一个都会在该领域里带来一些惊喜。数据猿作为大数据领域的专业媒体,一直从数据层面来关注行业的进展。不得不说,在算法和算力层面很热闹...