diffusiongemma-26B-A4B-it
最新标签
文件大小
0.00 GB
多节点支持
多架构支持
最新版本安全扫描结果
视觉多模态理解 Transformers Pytorch Nvidia License

diffusiongemma-26B-A4B-it
容器镜像
校验资质

更新1970-01-01

DiffusionGemma 是由 Google DeepMind 开发的生成式模型。该模型基于 26B A4B 混合专家(MoE)Gemma 4 架构,采用离散扩散方式生成 token。这一开源权重模型具备多模态能力,可处理文本、图像和视频输入,并生成文本输出。

DiffusionGemma-4-26B-A4B-IT 概述

简介

DiffusionGemma-4-26B-A4B-IT NIM 容器搭载 DiffusionGemma-4-26B-A4B-IT 模型,可作为可下载 NIM 镜像,通过 NVIDIA NGC 完成部署。该模型由 Google DeepMind 研发,是一款开放权重的多模态生成模型,支持文本、图像、视频三类输入,依托离散扩散技术输出文本内容。

该容器组件可用于商业及非商业场景。

第三方相关说明

容器内搭载的模型并非由 NVIDIA 所有或研发,而是依据第三方需求定制开发。详情可查看非 NVIDIA 官方模型卡:diffusiongemma-4-26B-A4B-it Model Card

许可与使用条款

适用协议:该 NIM 容器受 NVIDIA 软件许可协议NVIDIA AI 产品专属条款 约束;模型使用需遵守 NVIDIA 开放模型协议。 补充协议:Apache 2.0Gemma 使用条款Gemma 禁止使用规范

使用者需确保在使用 NVIDIA 提供的模型时,严格遵守当地各项适用法律法规。

部署区域

全球

发布日期

NGC:2026年06月10日,访问链接:link

Build.nvidia.com:2026年06月10日,访问链接:link

程序分类

DiffusionGemma-4-26B-A4B-IT NIM 容器包含以下模型:

模型名称及链接 适用场景 模型拉取方式
diffusiongemma-4-26B-A4B-it 多模态推理、代码编写、函数调用、长上下文分析、图像理解、视频理解、多语言对话、多轮对话 自动拉取

支持显卡

  • 通用显卡

部署说明

这款可下载 NIM 提供兼容 OpenAI 接口规范的推理服务,面向 DiffusionGemma-4-26B-A4B-IT 模型。

API 接口地址

  • /v1/chat/completions - 对话补全
  • /v1/models - 查看可用模型列表
  • /health/ready - 健康检查

该系列 AI 模型专为 NVIDIA GPU 加速系统设计及优化。借助 NVIDIA 硬件(如 GPU 核心)与软件框架(如 CUDA 库),模型的训练与推理速度远超纯 CPU 运行方案。

伦理规范说明

NVIDIA 认为,打造可信人工智能是所有人的共同责任,我们已制定相关规范与机制,支撑各类 AI 应用的开发工作。开发者需联合内部团队,确保相关软件组件符合所属行业与业务场景要求,并防范产品被违规滥用。

请确保所有输入图像均具备合法使用权限。若图像中包含人物、个人健康信息或知识产权相关内容,模型生成结果不会对画面主体进行模糊处理,也不会改变主体比例。

如遇到模型质量问题、使用风险、安全漏洞或其他 AI 相关问题,请在此提交反馈:here

技术支持

NIM 快速上手

依托行业通用标准接口,NIM 的部署与集成操作简单便捷。前往 NIM 容器页面,查看版本文档、部署指南等相关资料。

NVIDIA 开发者社区论坛

查阅社区知识库、提交问题工单:https://forums.developer.nvidia.com/