本文由第三方AI基于17173文章http://news.17173.com/content/06112026/120400777.shtml提炼总结而成,可能与原文真实意图存在偏差。不代表网站观点和立场。推荐点击链接阅读原文细致比对和校验。
150 tokens/s!NVIDIA为谷歌DiffusionGemma提供首日支持:RTX/DGX全系可用
2026-06-11 12:04:00
神评论
17173 新闻导语
NVIDIA全面支持谷歌DiffusionGemma!RTX/DGX系列可用,150 tokens/s速度,免费开源,无需联网,本地部署更安全。点击了解详情!
NVIDIA宣布为谷歌DeepMind最新发布的开放模型DiffusionGemma提供首日支持,覆盖GeForce RTX GPU、RTX PRO平台和DGX系统全系列。
DiffusionGemma基于Gemma 4架构,总参数25.2亿,推理时仅激活3.8亿参数,支持256K上下文长度,并针对NVIDIA硬件深度优化。。

与传统自回归模型逐个生成token不同,它采用文本扩散架构,每步可并行去噪256个tokens,在NVIDIA GPU上速度提升约4倍。
性能方面,NVIDIA通过Tensor Core架构和CUDA软件栈实现了无需额外调优即可获得优异性能。单块H100 GPU可达每秒1000 token,在DGX Spark上达150 tokens/s。
该模型支持BF16/NVFP4精度格式,开发者可通过Hugging Face Transformers在RTX 5090或DGX Spark上快速原型验证,生产环境可使用vLLM进行部署。
该模型采用Apache 2.0许可证开源,支持文本与图像多模态输入,支持完全运行于本地RTX或DGX平台,无需联网、无需按token付费。
目前已在Hugging Face Transformers、vLLM、Unsloth等框架中获得初始支持。
对于Windows开发者,RTX 5090用户可立即下载体验;专业级用户则可选用RTX PRO 6000工作站或DGX Station完成大规模部署和微调任务。

【来源:快科技】
热门测试游戏
- 1王祖贤致天下少侠:期待相遇于大荒!18周年专属问候请查收
- 2光影细节拉满!国产虚幻5大作《诡秘之主》全新实机视频曝光
- 3取消点卡,《逆水寒》想给经典MMO一个新答案?
- 4人宠合一!《伊莫》实机曝光,抓宠开放世界终于有新活了
- 5等了十年!《彩虹六号》国服终于开测,这十年到底卡在哪?
- 6《三国杀》IP首款战棋游戏《三国杀:天命棋局》6月18日开启测试
- 7离了大谱的网游!《Sol: Enchant》吹过的牛逼到底有多牛逼?
- 8狂卖1600万份后,《弧光猎人》是怎么理解“撤离射击”这个品类的?
- 9《无冕余烬》流放之路+方舟?从养成内核到后续游玩搬砖评估!
- 10韩国像素MMO新作《鬼怪世界》公开世界观,预约7月开启

