当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

7个月前 (02-26)Deepseek最新资讯397

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

剧本早已写好?Deepseek预测次回合猜中国米晋级方式和绝杀球员

剧本早已写好?Deepseek预测次回合猜中国米晋级方式和绝杀球员

直播吧05月07日讯 今日凌晨,欧冠半决赛次回合的战火熊熊燃起,一场堪称史诗级的巅峰对决激情上演。国际米兰与巴塞罗那狭路相逢,双方鏖战至加时赛,最终国米以4 - 3的比分力克巴萨,昂首挺进决赛。回顾此...

促更多AI场景应用开发 高职院校首个DeepSeek+Hi Agent开发实战在深信院开课

促更多AI场景应用开发 高职院校首个DeepSeek+Hi Agent开发实战在深信院开课

深圳新闻网2025年3月10日讯(深圳商报首席记者 吴吉)最近,DeepSeek爆火,为我们打开了一扇全新的认知大门。如何将DeepSeek融入专业课程学习,成为学院人才培养的新抓手?最近,深圳信息职...

搭载国内首个Deep Research功能,元知平台让用户零门槛免费用满血DeepSeek

搭载国内首个Deep Research功能,元知平台让用户零门槛免费用满血DeepSeek

未来式智能今天推出元知:让满血DeepSeek R1触手可及未来式智能作为国内领先的AI智能体构建平台,始终致力于通过前沿的AI技术,为10亿知识工作者提升10倍生产力为愿景。今天,未来式智能推出元知...

广东多地政府部门接入DeepSeek

广东多地政府部门接入DeepSeek

【广东多地政府部门接入DeepSeek】财联社2月15日电,广东多地政府部门开始在政务系统部署接入DeepSeek。据了解,2月8日,深圳市龙岗区政务服务和数据管理局已经在政务外网部署上线了DeepS...

学烧菜、学剪视频,老年居民学用DeepSeek解锁智能生活

学烧菜、学剪视频,老年居民学用DeepSeek解锁智能生活

随着人工智能发展火热,DeepSeek问世后掀起了一股全民学习的热潮。近日,四平路街道阜新路社区睦邻中心组织开展了专门的教学活动,教老年人如何使用Deepseek并普及人工智能知识,助力老年人跨越“数...

科德数控:已部署DeepSeek等AI大模型进行本地化验证

科德数控:已部署DeepSeek等AI大模型进行本地化验证

金融界3月11日消息,有投资者在互动平台向科德数控提问:董秘您好!请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSeek有哪些成本、收益方面的...