150 tokens/s！NVIDIA为谷歌DiffusionGemma提供首日支持：RTX/DGX全系可用 - 丁丁打折网

丁丁打折网 - 网友优惠券分享网站,有688999个用户

京东优惠券小米有品优惠券

苏宁易购优惠券小米有品优惠券当当网优惠券京东优惠券

注册

登录

当前位置 : 首页>电脑数码>150 tokens/s！NVIDIA为谷歌DiffusionGemma提供首日支持：RTX/DGX全系可用

150 tokens/s！NVIDIA为谷歌DiffusionGemma提供首日支持：RTX/DGX全系可用

6月11日消息，NVIDIA宣布为谷歌DeepMind最新发布的开放模型DiffusionGemma提供首日支持，覆盖GeForce RTX GPU、RTX PRO平台和DGX系统全系列。

DiffusionGemma基于Gemma 4架构，总参数25.2亿，推理时仅激活3.8亿参数，支持256K上下文长度，并针对NVIDIA硬件深度优化。。

150 tokens/s！NVIDIA为谷歌DiffusionGemma提供首日支持：RTX/DGX全系可用

与传统自回归模型逐个生成token不同，它采用文本扩散架构，每步可并行去噪256个tokens，在NVIDIA GPU上速度提升约4倍。

性能方面，NVIDIA通过Tensor Core架构和CUDA软件栈实现了无需额外调优即可获得优异性能。单块H100 GPU可达每秒1000 token，在DGX Spark上达150 tokens/s。

该模型支持BF16/NVFP4精度格式，开发者可通过Hugging Face Transformers在RTX 5090或DGX Spark上快速原型验证，生产环境可使用vLLM进行部署。

该模型采用Apache 2.0许可证开源，支持文本与图像多模态输入，支持完全运行于本地RTX或DGX平台，无需联网、无需按token付费。

目前已在Hugging Face Transformers、vLLM、Unsloth等框架中获得初始支持。

对于Windows开发者，RTX 5090用户可立即下载体验；专业级用户则可选用RTX PRO 6000工作站或DGX Station完成大规模部署和微调任务。

150 tokens/s！NVIDIA为谷歌DiffusionGemma提供首日支持：RTX/DGX全系可用

购物经验
晒单广场

热门商城

更多

热门优惠券

更多

ROTHSCROOSTER旗舰店满49减16

有效期至: 2025-01-25

立即领取
萨布森旗舰店满1299减800

有效期至: 2025-01-17

立即领取
哲高玩具旗舰店满69减33

有效期至: 2025-01-05

立即领取
戴·可·思官方旗舰店满196减27

有效期至: 2025-04-01

立即领取
佳婴旗舰店满30减3

有效期至: 2025-01-10

立即领取
ROTHSCROOSTER旗舰店满19减8

有效期至: 2025-01-25

立即领取
荣业官方旗舰店满20减10

有效期至: 2025-01-04

立即领取
戴·可·思（Dexter）母婴京东自营旗舰店满48减10

有效期至: 2025-01-12

立即领取
KOKOROCARE旗舰店满158减100

有效期至: 2025-03-28

立即领取
RODEL官方旗舰店满59减30

有效期至: 2025-01-02

立即领取

最新优惠券

更多

优惠券免费领取: 京东优惠券; 携程网优惠券; 苏宁易购优惠券; 国美优惠券; 美团优惠券

综合商城: 唯品会优惠券; 聚美优品优惠券; 1号店优惠券; 亚马逊优惠券; 大众点评优惠券

最新加入: Casetify优惠券; StockX优惠券; cdkeys优惠券; New Vitality优惠券; LaMer优惠券

站长推荐: 蔻驰优惠券; 爱奇艺优惠券; adidas优惠券; Design Within Reach优惠券; 植村秀优惠券

热门导航: PUMA彪马优惠券; Puzzle Master优惠券; 饿了么优惠券; nike优惠券; airbnb优惠券

金牌信誉: Neato Robotics优惠券; ebay优惠券; 美团酒店优惠券; Coggles优惠券; 猪八戒网优惠券

丁丁打折网©版权所有,未经许可严禁复制或镜像 ICP证: 湘ICP备2023003002号-11

Powered by 丁丁打折网本站为非营利性网站,本站内容均来自网络转载或网友提供,如有侵权或夸大不实请及时联系我们删除!本站不承担任何争议和法律责任!
技术支持:丁丁网 dddazhe@hotmail.com & 2010-2020 All rights reserved