英伟达已适配 DeepSeek-V4 AI 模型,GB200 NVL72 开箱性能超 150 tokens / sec / user
英伟达Blackwell平台适配DeepSeek-V4 AI模型,GB200 NVL72性能超150 tokens/sec/user!支持100万Token上下文,提供NIM微服务与vLLM框架部署方案。
4 月 25 日消息,英伟达今天(4 月 25 日)发布博文,宣布其 NVIDIA Blackwell 平台已适配 DeepSeek-V4-Pro 与 DeepSeek-V4-Flash 两款模型,开发者可通过 NVIDIA NIM 微服务下载部署,或利用 SGLang 与 vLLM 框架进行定制化推理。
英伟达在博文指出,DeepSeek-V4-Pro 拥有 1.6T 总参数量与 49B 激活参数,定位高级推理任务;DeepSeek-V4-Flash 版本则为 284B 总参数量与 13B 激活参数,主打高速高效场景。

两款模型均支持 100 万 Token 上下文窗口与最高 38.4 万 Token 输出长度,覆盖长文本编码、文档分析等核心应用,并采用 MIT 开源协议。
实测数据显示,DeepSeek-V4-Pro 在 NVIDIA GB200 NVL72 上开箱即用性能超 150 tokens / sec / user,借助 vLLM 的 Day 0 配方,开发者可在 Blackwell B300 上快速部署。随着 Dynamo、NVFP4 及 CUDA 内核的深度优化,预期性能将进一步提升。

部署生态方面,开发者可通过 NVIDIA NIM 微服务下载部署,或利用 SGLang 与 vLLM 框架进行定制化推理。SGLang 提供低延迟、均衡及最大吞吐量三种配方;vLLM 则支持多节点扩展至 100 个以上 GPU,具备工具调用与推测解码能力。

附上参考
Build with DeepSeek V4 Using NVIDIA Blackwell and GPU-Accelerated Endpoints
- 1经典RO全面翻新!《仙境传说 Zero:全球版》公测时间定了!
- 2碾压一众网红脸!三大国产神作女主神颜,美到老外都痴迷
- 3真的要公测了?韩国MMO《命运方舟》手游大规模招募AI人才
- 4因玩梗“不玩是GAY”!《完蛋!我被男同学包围了》遭LGBT围攻
- 5国产黑马《逃离鸭科夫》销量破380万!制作人透露后续计划
- 6PS5版8.3分,PC版仅4.5分!同一款游戏评分差距为啥会这么大?
- 7游戏早报:《魔兽》新项目要来了?钢铁侠或在复联6登场
- 8主播停播、好友弃玩,《英雄联盟》怀旧模式怎么就不火了?
- 9坚持传统手搓工艺!《黑神话》美术总监表态:不会用AI赶工
- 107月国产游戏出海收入榜单出炉:第一名竟然不是腾讯系游戏

