当前位置:首页 > Deepseek应用场景 > 正文内容

英伟达宣布创造满血 DeepSeek 推理世界记录

6个月前 (03-19)Deepseek应用场景340

IT之家 3 月 19 日消息,英伟达在今日举行的 NVIDIA GTC 2025 上宣布其 NVIDIA Blackwell DGX 系统创下 DeepSeek-R1 大模型推理性能的世界纪录。

据介绍,在搭载了八块 Blackwell GPU 的单个 DGX 系统上运行 6710 亿参数的满血 DeepSeek-R1 模型可实现每用户每秒超 250 token 的响应速度,系统最高吞吐量突破每秒 3 万 token。

英伟达表示,随着 NVIDIA 平台继续在最新的 Blackwell Ultra GPU 和 Blackwell GPU 上突破推理极限,其性能将会继续不断提高。

▲ 运行 TensorRT-LLM 软件的 NVL8 配置的 NVIDIA B200 GPU

单节点配置:DGX B200(8 块 GPU)与 DGX H200(8 块 GPU)

测试参数:最新测试采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

英伟达表示,通过硬件和软件的结合,他们自 2025 年 1 月以来成功将 DeepSeek-R1 671B 模型的吞吐量提高了约 36 倍。

节点配置:DGX B200(8 块 GPU)、DGX H200(8 块 GPU)、两个 DGX H100(8 块 GPU)系统

测试参数:依然采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token;并发性 MAX

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

与 Hopper 架构相比,Blackwell 架构与 TensorRT 软件相结合可实现显著的推理性能提升。

英伟达表示,包括 DeepSeek-R1、Llama 3.1 405B 和 Llama 3.3 70B,运行 TensorRT 软件并使用 FP4 精度的 DGX B200 平台与 DGX H200 平台相比已经提供了 3 倍以上的推理吞吐量提升。

英伟达表示,在对模型进行量化以利用低精度计算优势时,确保精度损失最小化是生产部署的关键。IT之家注意到,在 DeepSeek-R1 模型上,相较于 FP8 基准精度,TensorRT Model Optimizer 的 FP4 训练后量化(PTQ)技术在不同数据集上仅产生微乎其微的精度损失。


“英伟达宣布创造满血 DeepSeek 推理世界记录” 的相关文章

金价上涨!DeepSeek回答能不能入手黄金

金价上涨!DeepSeek回答能不能入手黄金

3月14 日,国际金价飙升了40多美元,国内黄金市场也迎来大幅涨价,众多知名品牌的足金首饰售价纷纷跨越 900 元 / 克的关口。那么,从投资角度讲,眼下是不是入手黄金的时机?记者问询了DeepSee...

贝因美:已在内部系统接入DeepSeek 会逐步向客户提供智能化服务

贝因美:已在内部系统接入DeepSeek 会逐步向客户提供智能化服务

人民财讯3月11日电,贝因美(002570)3月11日在互动平台表示,公司正积极探索AI赋能和智能育儿等新技术的发展机会,目前已在内部系统接入DeepSeek,待数据库信息完善后,会逐步向客户提供智能...

从DeepSeek-R1看AI国产化的全球突围

从DeepSeek-R1看AI国产化的全球突围

近期,中国初创公司深度求索(DeepSeek)推出的大模型DeepSeek-R1引发全球关注。这款完全基于国产技术研发的AI产品,不仅在自然语言处理、多模态交互等领域展现出不逊于国际顶尖模型的性能,更...

宁夏路网中心举办DeepSeek培训 AI赋能推动智慧交通发展

宁夏路网中心举办DeepSeek培训 AI赋能推动智慧交通发展

宁夏新闻网讯(记者 胡俊)4月24日,宁夏路网监测与应急处置中心举办DeepSeek专题培训班,深化人工智能技术应用能力,推动交通行业智能化转型,以高质量党建聚力实施交通运输提质增效攻坚年。本次培训聚...

首台全国产化部署DeepSeek一体机,无锡造!

首台全国产化部署DeepSeek一体机,无锡造!

“写一篇关于申威平台完成DeepSeek适配的报道。”眨眼间,一篇关于申威平台与DeepSeek共同打造国产AI新生态的文稿就出现在屏幕上,从适配的意义、技术细节、应用场景、未来计划等各个方面阐述中国...

科技平权与文化普惠的时代浪潮,DeepSeek与珠江桥牌的时代共鸣

科技平权与文化普惠的时代浪潮,DeepSeek与珠江桥牌的时代共鸣

当国产AI公司DeepSeek以技术普惠的雄姿风靡全球科技圈之际,珠江桥牌提出一酱做成广东招牌菜的新式产品,巧妙地化解着现代生活的种种困境。就像美国博主“吃货老外铁蛋儿”,他用一口地道的大连方言,生动...