当前位置:首页 > Deepseek应用场景 > 正文内容

英伟达宣布创造满血 DeepSeek 推理世界记录

3个月前 (03-19)Deepseek应用场景179

IT之家 3 月 19 日消息,英伟达在今日举行的 NVIDIA GTC 2025 上宣布其 NVIDIA Blackwell DGX 系统创下 DeepSeek-R1 大模型推理性能的世界纪录。

据介绍,在搭载了八块 Blackwell GPU 的单个 DGX 系统上运行 6710 亿参数的满血 DeepSeek-R1 模型可实现每用户每秒超 250 token 的响应速度,系统最高吞吐量突破每秒 3 万 token。

英伟达表示,随着 NVIDIA 平台继续在最新的 Blackwell Ultra GPU 和 Blackwell GPU 上突破推理极限,其性能将会继续不断提高。

▲ 运行 TensorRT-LLM 软件的 NVL8 配置的 NVIDIA B200 GPU

单节点配置:DGX B200(8 块 GPU)与 DGX H200(8 块 GPU)

测试参数:最新测试采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

英伟达表示,通过硬件和软件的结合,他们自 2025 年 1 月以来成功将 DeepSeek-R1 671B 模型的吞吐量提高了约 36 倍。

节点配置:DGX B200(8 块 GPU)、DGX H200(8 块 GPU)、两个 DGX H100(8 块 GPU)系统

测试参数:依然采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token;并发性 MAX

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

与 Hopper 架构相比,Blackwell 架构与 TensorRT 软件相结合可实现显著的推理性能提升。

英伟达表示,包括 DeepSeek-R1、Llama 3.1 405B 和 Llama 3.3 70B,运行 TensorRT 软件并使用 FP4 精度的 DGX B200 平台与 DGX H200 平台相比已经提供了 3 倍以上的推理吞吐量提升。

英伟达表示,在对模型进行量化以利用低精度计算优势时,确保精度损失最小化是生产部署的关键。IT之家注意到,在 DeepSeek-R1 模型上,相较于 FP8 基准精度,TensorRT Model Optimizer 的 FP4 训练后量化(PTQ)技术在不同数据集上仅产生微乎其微的精度损失。


“英伟达宣布创造满血 DeepSeek 推理世界记录” 的相关文章

国产开源模型强势追击!DeepSeek与OpenAI最新模型实测对决

国产开源模型强势追击!DeepSeek与OpenAI最新模型实测对决

《科创板日报》5月29日讯 DeepSeek昨晚通过微信交流群通知,其DeepSeek R1模型完成小版本升级,并在今日凌晨开源了最新版本模型DeepSeek-R1-0528。代码测试平台L...

“云”栖山水境,茶醉一“县”春!与DeepSeek共游云南宝藏小城

“云”栖山水境,茶醉一“县”春!与DeepSeek共游云南宝藏小城

这是藏在横断山南部山脉峡谷中的“山水画廊”,是镶嵌在澜沧江畔的璀璨明珠,是云南唯一以“云”字命名的县。让我们跟着DeepSeek的脚步,走进有一个叫“云”的地方——“沧江明珠”云县。远山碧水 相映升辉...

宸展光电:目前研发的新产品可接入DeepSeek

宸展光电:目前研发的新产品可接入DeepSeek

证券日报网讯 5月7日,宸展光电在投资者互动交流平台上,针对投资者关于DeepSeek技术应用的相关提问,给出了专业且审慎的回应。有投资者关心宸展光电产品接入DeepSeek技术所需的硬件条件,公司明...

开启智慧医疗新篇章 四川广元这家医院率先完成DeepSeek本地化部署

开启智慧医疗新篇章 四川广元这家医院率先完成DeepSeek本地化部署

封面新闻记者 刘彦谷3月7日,记者从广元市中心医院了解到,在医疗行业加速数字化转型的关键节点,该院在区域内率先完成基于国产化服务器的DeepSeek智能中枢本地化部署。这一举措通过构建自主可控的AI基...

科技平权与文化普惠的时代浪潮,DeepSeek与珠江桥牌的时代共鸣

科技平权与文化普惠的时代浪潮,DeepSeek与珠江桥牌的时代共鸣

当国产AI公司DeepSeek以技术普惠的雄姿风靡全球科技圈之际,珠江桥牌提出一酱做成广东招牌菜的新式产品,巧妙地化解着现代生活的种种困境。就像美国博主“吃货老外铁蛋儿”,他用一口地道的大连方言,生动...

怎么设置deepseek的快捷检索?

怎么设置deepseek的快捷检索?

怎么设置deepseek的快捷检索?要设置DeepSeek的快捷检索,您可以通过创建一个快捷指令来实现。以下是详细的步骤:下载并打开快捷指令App:在App Store中下载并安装“快捷指令”应用。创...