正文内容 评论(0

150 tokens/s!NVIDIA为谷歌DiffusionGemma提供首日支持:RTX/DGX全系可用
2026-06-11 10:55:52  出处:快科技 作者:红茶 编辑:红茶     评论(0)点击可以复制本篇文章的标题和链接复制对文章内容进行纠错纠错

快科技6月11日消息,NVIDIA宣布为谷歌DeepMind最新发布的开放模型DiffusionGemma提供首日支持,覆盖GeForce RTX GPU、RTX PRO平台和DGX系统全系列。

DiffusionGemma基于Gemma 4架构,总参数25.2亿,推理时仅激活3.8亿参数,支持256K上下文长度,并针对NVIDIA硬件深度优化。。

150 tokens/s!NVIDIA为谷歌DiffusionGemma提供首日支持:RTX/DGX全系可用

与传统自回归模型逐个生成token不同,它采用文本扩散架构,每步可并行去噪256个tokens,在NVIDIA GPU上速度提升约4倍。

性能方面,NVIDIA通过Tensor Core架构和CUDA软件栈实现了无需额外调优即可获得优异性能。单块H100 GPU可达每秒1000 token,在DGX Spark上达150 tokens/s。

该模型支持BF16/NVFP4精度格式,开发者可通过Hugging Face Transformers在RTX 5090或DGX Spark上快速原型验证,生产环境可使用vLLM进行部署。

该模型采用Apache 2.0许可证开源,支持文本与图像多模态输入,支持完全运行于本地RTX或DGX平台,无需联网、无需按token付费。

目前已在Hugging Face Transformers、vLLM、Unsloth等框架中获得初始支持。

对于Windows开发者,RTX 5090用户可立即下载体验;专业级用户则可选用RTX PRO 6000工作站或DGX Station完成大规模部署和微调任务。

150 tokens/s!NVIDIA为谷歌DiffusionGemma提供首日支持:RTX/DGX全系可用

【本文结束】如需转载请务必注明出处:快科技

责任编辑:红茶

文章内容举报

  • 支持打赏
  • 支持0

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...