
DiffusionGemma 是由 Google DeepMind 开发的生成式模型。该模型基于 26B A4B 混合专家(MoE)Gemma 4 架构,采用离散扩散方式生成 token。这一开源权重模型具备多模态能力,可处理文本、图像和视频输入,并生成文本输出。
DiffusionGemma-4-26B-A4B-IT NIM 容器搭载 DiffusionGemma-4-26B-A4B-IT 模型,可作为可下载 NIM 镜像,通过 NVIDIA NGC 完成部署。该模型由 Google DeepMind 研发,是一款开放权重的多模态生成模型,支持文本、图像、视频三类输入,依托离散扩散技术输出文本内容。
该容器组件可用于商业及非商业场景。
容器内搭载的模型并非由 NVIDIA 所有或研发,而是依据第三方需求定制开发。详情可查看非 NVIDIA 官方模型卡:diffusiongemma-4-26B-A4B-it Model Card。
适用协议:该 NIM 容器受 NVIDIA 软件许可协议 及 NVIDIA AI 产品专属条款 约束;模型使用需遵守 NVIDIA 开放模型协议。 补充协议:Apache 2.0、Gemma 使用条款、Gemma 禁止使用规范。
使用者需确保在使用 NVIDIA 提供的模型时,严格遵守当地各项适用法律法规。
全球
NGC:2026年06月10日,访问链接:link
Build.nvidia.com:2026年06月10日,访问链接:link
DiffusionGemma-4-26B-A4B-IT NIM 容器包含以下模型:
| 模型名称及链接 | 适用场景 | 模型拉取方式 |
|---|---|---|
| diffusiongemma-4-26B-A4B-it | 多模态推理、代码编写、函数调用、长上下文分析、图像理解、视频理解、多语言对话、多轮对话 | 自动拉取 |
这款可下载 NIM 提供兼容 OpenAI 接口规范的推理服务,面向 DiffusionGemma-4-26B-A4B-IT 模型。
API 接口地址
/v1/chat/completions - 对话补全/v1/models - 查看可用模型列表/health/ready - 健康检查该系列 AI 模型专为 NVIDIA GPU 加速系统设计及优化。借助 NVIDIA 硬件(如 GPU 核心)与软件框架(如 CUDA 库),模型的训练与推理速度远超纯 CPU 运行方案。
NVIDIA 认为,打造可信人工智能是所有人的共同责任,我们已制定相关规范与机制,支撑各类 AI 应用的开发工作。开发者需联合内部团队,确保相关软件组件符合所属行业与业务场景要求,并防范产品被违规滥用。
请确保所有输入图像均具备合法使用权限。若图像中包含人物、个人健康信息或知识产权相关内容,模型生成结果不会对画面主体进行模糊处理,也不会改变主体比例。
如遇到模型质量问题、使用风险、安全漏洞或其他 AI 相关问题,请在此提交反馈:here
依托行业通用标准接口,NIM 的部署与集成操作简单便捷。前往 NIM 容器页面,查看版本文档、部署指南等相关资料。
查阅社区知识库、提交问题工单:https://forums.developer.nvidia.com/