当前位置:首页 > Deepseek应用场景 > 正文内容

英伟达宣布创造满血 DeepSeek 推理世界记录

8个月前 (03-19)Deepseek应用场景437

IT之家 3 月 19 日消息,英伟达在今日举行的 NVIDIA GTC 2025 上宣布其 NVIDIA Blackwell DGX 系统创下 DeepSeek-R1 大模型推理性能的世界纪录。

据介绍,在搭载了八块 Blackwell GPU 的单个 DGX 系统上运行 6710 亿参数的满血 DeepSeek-R1 模型可实现每用户每秒超 250 token 的响应速度,系统最高吞吐量突破每秒 3 万 token。

英伟达表示,随着 NVIDIA 平台继续在最新的 Blackwell Ultra GPU 和 Blackwell GPU 上突破推理极限,其性能将会继续不断提高。

▲ 运行 TensorRT-LLM 软件的 NVL8 配置的 NVIDIA B200 GPU

单节点配置:DGX B200(8 块 GPU)与 DGX H200(8 块 GPU)

测试参数:最新测试采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

英伟达表示,通过硬件和软件的结合,他们自 2025 年 1 月以来成功将 DeepSeek-R1 671B 模型的吞吐量提高了约 36 倍。

节点配置:DGX B200(8 块 GPU)、DGX H200(8 块 GPU)、两个 DGX H100(8 块 GPU)系统

测试参数:依然采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token;并发性 MAX

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

与 Hopper 架构相比,Blackwell 架构与 TensorRT 软件相结合可实现显著的推理性能提升。

英伟达表示,包括 DeepSeek-R1、Llama 3.1 405B 和 Llama 3.3 70B,运行 TensorRT 软件并使用 FP4 精度的 DGX B200 平台与 DGX H200 平台相比已经提供了 3 倍以上的推理吞吐量提升。

英伟达表示,在对模型进行量化以利用低精度计算优势时,确保精度损失最小化是生产部署的关键。IT之家注意到,在 DeepSeek-R1 模型上,相较于 FP8 基准精度,TensorRT Model Optimizer 的 FP4 训练后量化(PTQ)技术在不同数据集上仅产生微乎其微的精度损失。


“英伟达宣布创造满血 DeepSeek 推理世界记录” 的相关文章

中信建投回应“DeepSeek挑战”

中信建投回应“DeepSeek挑战”

中信建投总经理金剑华在2024年度业绩说明会上表示:DeepSeek带来技术赋能机遇,券商可以应用AI技术深度融入投研与交易环节,但目前在复杂资产配置、客户信任构建等场景仍需要人工干预。(资事堂)...

蚂蚁集团或布局AI智能眼镜产品 DeepSeek加速终端落地

蚂蚁集团或布局AI智能眼镜产品 DeepSeek加速终端落地

据科技媒体报道,蚂蚁集团正在招聘AI智能眼镜的产品专家。根据职位描述可知,该职位主要负责AI智能眼镜应用相关的产品,要求有2C产品的经验,并且熟悉市面上各位VR、AR和AI智能眼镜。这则招聘信息或显示...

deepseek能用来干啥-deepseek有什么用途

deepseek能用来干啥-deepseek有什么用途

DeepSeek是一款基于人工智能技术的工具,旨在帮助用户高效处理和分析数据、生成内容、优化工作流程等。其应用场景非常广泛,具体功能和使用场景包括但不限于以下几个方面:一、数据分析与可视化数据导入:支...

面对AI,哪些行业更有前景?当我们让DeepSeek来pk专家……

面对AI,哪些行业更有前景?当我们让DeepSeek来pk专家……

惊!浙大二院胸外科主任医师:DeepSeek给出的诊断和我们非常接近!多名科主任发声,56秒出诊断,专家都不如它,很怕被淘汰失业!当DeepSeek火爆全球,当“AI+”辅助实现的工作场景越来越普遍,...

中信证券:DeepSeek,当前AI产业链投资催化剂

中信证券:DeepSeek,当前AI产业链投资催化剂

中信证券发布研报称,认为Deepseek在模型训练成本降低方面的最佳实践,料将刺激科技巨头采用更为经济的方式加速前沿模型的探索和研究,同时将使得大量AI应用得以解锁和落地。算法训练带来的规模报酬递增效...

雄帝科技接入DeepSeek大模型 场景AI能力再升级

雄帝科技接入DeepSeek大模型 场景AI能力再升级

人民财讯3月2日电,记者从雄帝科技获悉,近日,雄帝科技全面接入DeepSeek大模型,通过深化DeepSeek大模型的本地化部署与场景适配,构建覆盖智慧政务、智慧交通等多个垂直场景的深度智能化解决方案...