当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

8个月前 (02-26)Deepseek最新资讯459

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

DeepSeek刮起AI新潮流,雷军、李东生呼吁监管要系紧缰绳

DeepSeek刮起AI新潮流,雷军、李东生呼吁监管要系紧缰绳

2025年,人工智能再一次站上了全国两会的“C位”。去年,“人工智能+”首次被写进政府工作报告。而今年,政府工作报告再提“人工智能+”,与之相关的“具身智能”“人工智能手机和电脑”“智能机器人”等关键...

调用 DeepSeek 的 API 会导致数据泄露吗?

调用 DeepSeek 的 API 会导致数据泄露吗?

调用 DeepSeek 的 API 会导致数据泄露吗?调用DeepSeek的API可能会导致数据泄露。以下是主要原因和建议措施:主要原因:未授权访问:DeepSeek的服务API接口(如http://...

联想与沐曦DeepSeek一体机上市首月发货量突破千台

联想与沐曦DeepSeek一体机上市首月发货量突破千台

【联想与沐曦DeepSeek一体机上市首月发货量突破千台】《科创板日报》7日讯,《科创板日报》记者获悉,联想集团与沐曦股份合作的首个国产DeepSeek一体机解决方案发布一个月以来,截至今日,其累计发...

大厂接入DeepSeek,自己的大模型怎么办?

大厂接入DeepSeek,自己的大模型怎么办?

现在还要没有接入DeepSeek的科技大厂吗?盘点下来,好像还真没有了。从国外的英伟达、亚马逊、微软等头部大厂,到国内的BAT、华为和字节跳动,DeepSeek出圈后不就,但凡叫得上名的科技大厂都做出...

DeepSeek算力需求暴降,为什么全球算力竞赛反而更疯狂了?

DeepSeek算力需求暴降,为什么全球算力竞赛反而更疯狂了?

春节期间,国产大模型DeepSeek-R1的横空出世,一度让人们看到了“降本增效”的曙光。DeepSeek-R1以更低的成本和算力需求,实现了世界一流的模型性能,打破了大模型领域“烧钱买芯片”的传统路...

辽宁省疾控中心接入DeepSeek 提高疾控精准性时效性

辽宁省疾控中心接入DeepSeek 提高疾控精准性时效性

近日,省疾病预防控制中心正式宣布接入DeepSeek,成为东北地区首家引入AI技术全面赋能公共卫生管理的省级疾控机构,为我省疾病预防控制战线和智慧疾控建设赋予全新内驱力。目前,省疾病预防控制中心已初步...