当前位置:首页 > Deepseek应用场景 > 正文内容

英伟达宣布创造满血 DeepSeek 推理世界记录

IT之家 3 月 19 日消息,英伟达在今日举行的 NVIDIA GTC 2025 上宣布其 NVIDIA Blackwell DGX 系统创下 DeepSeek-R1 大模型推理性能的世界纪录。

据介绍,在搭载了八块 Blackwell GPU 的单个 DGX 系统上运行 6710 亿参数的满血 DeepSeek-R1 模型可实现每用户每秒超 250 token 的响应速度,系统最高吞吐量突破每秒 3 万 token。

英伟达表示,随着 NVIDIA 平台继续在最新的 Blackwell Ultra GPU 和 Blackwell GPU 上突破推理极限,其性能将会继续不断提高。

▲ 运行 TensorRT-LLM 软件的 NVL8 配置的 NVIDIA B200 GPU

单节点配置:DGX B200(8 块 GPU)与 DGX H200(8 块 GPU)

测试参数:最新测试采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

英伟达表示,通过硬件和软件的结合,他们自 2025 年 1 月以来成功将 DeepSeek-R1 671B 模型的吞吐量提高了约 36 倍。

节点配置:DGX B200(8 块 GPU)、DGX H200(8 块 GPU)、两个 DGX H100(8 块 GPU)系统

测试参数:依然采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token;并发性 MAX

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

与 Hopper 架构相比,Blackwell 架构与 TensorRT 软件相结合可实现显著的推理性能提升。

英伟达表示,包括 DeepSeek-R1、Llama 3.1 405B 和 Llama 3.3 70B,运行 TensorRT 软件并使用 FP4 精度的 DGX B200 平台与 DGX H200 平台相比已经提供了 3 倍以上的推理吞吐量提升。

英伟达表示,在对模型进行量化以利用低精度计算优势时,确保精度损失最小化是生产部署的关键。IT之家注意到,在 DeepSeek-R1 模型上,相较于 FP8 基准精度,TensorRT Model Optimizer 的 FP4 训练后量化(PTQ)技术在不同数据集上仅产生微乎其微的精度损失。


“英伟达宣布创造满血 DeepSeek 推理世界记录” 的相关文章

济宁中山公用水务率先完成DeepSeek网络安全本地化部署

济宁中山公用水务率先完成DeepSeek网络安全本地化部署

目前,济宁中山公用水务有限公司完成DeepSeek大模型的本地化部署工作,顺利接入公司自主搭建的Web应用防火墙,为公司网络安全及信息管理升级注入强大动力。DeepSeek大模型的本地化部署是公司提升...

国内多所高校推出DeepSeek相关课程 杭州电子科技大学:几分钟名额就被抢光

国内多所高校推出DeepSeek相关课程 杭州电子科技大学:几分钟名额就被抢光

近日,DeepSeek在全社会引发关注。北京青年报记者注意到,新学期以来,国内多所高校开设了和DeepSeek相关的课程,鼓励学生学习、掌握DeepSeek相关的技术和知识。杭州电子科技大学教务处负责...

谁是“造物主”?关于DeepSeek的冷思考

谁是“造物主”?关于DeepSeek的冷思考

原创 小复 复旦大学出版社我们正在经历一场静默的“创世记”:AI生成媲美人类的作品基因编辑重塑生命密码元宇宙构建平行宇宙究竟谁才是这个时代的“造物主”?2025年1月20日,幻方量化旗下AI公司深度求...

DeepSeek带动对冲基金快速涌入中国股市

DeepSeek带动对冲基金快速涌入中国股市

据彭博社16日报道,中国人工智能公司DeepSeek的技术突破,正促使股票资金从印度回流到中国。彭博社称,随着DeepSeek推动中国科技行业形势看涨,以及中国将出台更多利好经济措施的预期,全球对冲基...

deepseek目前帮到你的行业了吗?

deepseek目前帮到你的行业了吗?

帮到了,帮孩子分析数学题,教孩子怎么写作文,让孩子感觉写作文就是在做选择题写评论豪言片语北京 10小时前我之前是做开发的。公司强制要求所有开发人员必须装AI辅助编程的插件,确实可以提高一部分效率,我觉...

传音控股:传音控股旗下Infinix、TECNO品牌已接入DeepSeek

传音控股:传音控股旗下Infinix、TECNO品牌已接入DeepSeek

每经AI快讯,有投资者在投资者互动平台提问:董秘您好!请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSeek有哪些成本、收益方面的考量?如果公...