当前位置:首页 > Deepseek应用场景 > 正文内容

英伟达宣布创造满血 DeepSeek 推理世界记录

IT之家 3 月 19 日消息,英伟达在今日举行的 NVIDIA GTC 2025 上宣布其 NVIDIA Blackwell DGX 系统创下 DeepSeek-R1 大模型推理性能的世界纪录。

据介绍,在搭载了八块 Blackwell GPU 的单个 DGX 系统上运行 6710 亿参数的满血 DeepSeek-R1 模型可实现每用户每秒超 250 token 的响应速度,系统最高吞吐量突破每秒 3 万 token。

英伟达表示,随着 NVIDIA 平台继续在最新的 Blackwell Ultra GPU 和 Blackwell GPU 上突破推理极限,其性能将会继续不断提高。

▲ 运行 TensorRT-LLM 软件的 NVL8 配置的 NVIDIA B200 GPU

单节点配置:DGX B200(8 块 GPU)与 DGX H200(8 块 GPU)

测试参数:最新测试采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

英伟达表示,通过硬件和软件的结合,他们自 2025 年 1 月以来成功将 DeepSeek-R1 671B 模型的吞吐量提高了约 36 倍。

节点配置:DGX B200(8 块 GPU)、DGX H200(8 块 GPU)、两个 DGX H100(8 块 GPU)系统

测试参数:依然采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token;并发性 MAX

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

与 Hopper 架构相比,Blackwell 架构与 TensorRT 软件相结合可实现显著的推理性能提升。

英伟达表示,包括 DeepSeek-R1、Llama 3.1 405B 和 Llama 3.3 70B,运行 TensorRT 软件并使用 FP4 精度的 DGX B200 平台与 DGX H200 平台相比已经提供了 3 倍以上的推理吞吐量提升。

英伟达表示,在对模型进行量化以利用低精度计算优势时,确保精度损失最小化是生产部署的关键。IT之家注意到,在 DeepSeek-R1 模型上,相较于 FP8 基准精度,TensorRT Model Optimizer 的 FP4 训练后量化(PTQ)技术在不同数据集上仅产生微乎其微的精度损失。


“英伟达宣布创造满血 DeepSeek 推理世界记录” 的相关文章

山石网科发布DeepSeek大模型应用一体机解决方案

山石网科发布DeepSeek大模型应用一体机解决方案

每经快讯,据山石网科微信公众号3月3日消息,近日,山石网科发布DeepSeek大模型应用一体机解决方案,致力于为用户提供一站式“算力+大模型+安全应用”服务能力。山石网科股票山石网科发布deepsee...

继基础电信运营商后,广东多地政府部门接入DeepSeek

继基础电信运营商后,广东多地政府部门接入DeepSeek

当下,DeepSeek朋友圈正持续“扩容”:一方面,其访问使用量急速上升,已成为最快突破3000万日活跃用户量的应用;而移动、电信、联通三家基础电信企业已全面接入DeepSeek。此外,广东多地政府部...

DeepSeek接入个人知识,回答速度飞快,确实可以封神了!

DeepSeek接入个人知识,回答速度飞快,确实可以封神了!

DeepSeek-R1正在引起越来越多人的关注,近来收到很多读者后台留言,虽然无法逐一作答,但是大家的问题我都阅读了。总结来看,大家普遍关心三类DeepSeek接入个人知识的相关问题:1)DeepSe...

中国中化AI平台接入DeepSeek

中国中化AI平台接入DeepSeek

记者 王雅洁 2月14日晚间,中国中化集团官方消息,其人工智能平台已成功接入DeepSeek系列模型,包括DeepSeek-R1和DeepSeek-V3等。一名能源行业分析人士认为,中国中化...

如何找到并启用微信内的DeepSeek功能(附排查方法)

如何找到并启用微信内的DeepSeek功能(附排查方法)

我的iOS微信和安卓微信都有接入DeepSeek的AI搜索功能,而且用了10多天,重度用户一枚。作为过来人,有必要给不知道的人分享下经验。 一句话总结,微信内的DeepSeek功能有多个登入口,...

湖南大模型+DeepSeek 助力智能诊疗

湖南大模型+DeepSeek 助力智能诊疗

湖南日报3月12日讯(全媒体记者 王铭俊)记者今天从智慧眼科技股份有限公司获悉,该公司大模型砭石与DeepSeek的本地化部署应用,已在长沙市第一医院落地。智慧眼人工智能研究院院长胡频博士介绍,“砭石...