首页 > 教程攻略 > 热点新闻 >NVIDIA为谷歌DiffusionGemma提供首日支持,RTX与DGX全系可用

NVIDIA为谷歌DiffusionGemma提供首日支持,RTX与DGX全系可用

来源:互联网 时间:2026-07-27 21:11:22

谷歌DeepMind最新发布的开放模型DiffusionGemma,其性能表现如何?对于广大开发者和研究者而言,最关心的问题莫过于它能否在自己的硬件上流畅运行,以及能带来多大的效率提升。NVIDIA近日宣布的首日支持,为这些问题给出了明确的答案。

NVIDIA为谷歌DiffusionGemma提供首日支持,RTX与DGX全系可用

NVIDIA宣布,其全系列GeForce RTX GPU、RTX PRO平台以及DGX系统,均已为DiffusionGemma模型提供首日支持。这意味着,无论是个人开发者还是企业级用户,都可以立即在自己的NVIDIA硬件上部署和运行这一最新模型,无需漫长的等待或复杂的适配过程。

模型架构与性能优势

DiffusionGemma基于Gemma 4架构构建,总参数为25.2亿,但在推理时仅激活3.8亿参数,并支持高达256K的上下文长度。其核心优势在于采用了文本扩散架构,与传统自回归模型逐个生成token的方式不同,它每步可并行去噪多达

256个tokens

。这一设计在NVIDIA GPU上实现了约

4倍的推理速度提升

硬件性能与部署方案

得益于NVIDIA Tensor Core架构和CUDA软件栈的深度优化,该模型无需额外调优即可获得优异性能。具体而言,在单块H100 GPU上,推理速度可达每秒1000 token;而在DGX Spark系统上,性能更是达到了

每秒150个token

。模型支持BF16和NVFP4精度格式,开发者可通过Hugging Face Transformers在RTX 5090或DGX Spark上进行快速原型验证,生产环境则推荐使用vLLM进行部署。

该模型采用Apache 2.0许可证开源,支持文本与图像的多模态输入。一个关键特点是,它可以完全运行于本地的RTX或DGX平台,无需联网,也无需按token付费,为数据安全和成本控制提供了保障。目前,该模型已在Hugging Face Transformers、vLLM、Unsloth等主流框架中获得初始支持。对于Windows平台的开发者,RTX 5090用户可立即下载体验;而需要进行大规模部署和微调的专业级用户,则可选用RTX PRO 6000工作站或DGX Station来完成相关任务。