
此 NIM 容器托管了 Gemma 4 31B IT 模型。该模型是由 Google DeepMind 构建的开放多模态模型,支持文本和图像输入,并生成文本输出。它旨在消费级 GPU 和工作站上,为推理、智能体工作流(agentic workflows)、编程和多模态理解提供前沿级性能,并支持 256K token 的超大上下文窗口。该模型采用了混合注意力机制,交替使用局部滑动窗口注意力和全局注意,在全局层中使用统一键值(Unified Keys and Values),并辅以比例旋转位置嵌入(p-RoPE)技术,以保障卓越的长文本处理性能。 该容器组件已就绪,可供商业使用。
此 NIM 容器托管了 Gemma 4 31B IT 模型。该模型是由 Google DeepMind 构建的开放多模态模型,支持文本和图像输入,并生成文本输出。它旨在消费级 GPU 和工作站上,为推理、智能体工作流(agentic workflows)、编程和多模态理解提供前沿级性能,并支持 256K token 的超大上下文窗口。该模型采用了混合注意力机制,交替使用局部滑动窗口注意力和全局注意,在全局层中使用统一键值(Unified Keys and Values),并辅以比例旋转位置嵌入(p-RoPE)技术,以保障卓越的长文本处理性能。
该容器组件已就绪,可供商业使用。
管理条款:此 NIM 容器受 NVIDIA 软件许可协议 和 NVIDIA AI 产品特定条款 约束。此模型的使用受 NVIDIA 开放模型许可协议 约束。附加信息:Apache License, Version 2.0。
您有责任确保使用 NVIDIA 提供的模型时遵守所有适用的法律法规。
全球
Build.NVIDIA.com: 2026年4月2日,访问 链接
Gemma 4 31B IT 容器包含了 Gemma 4 31B IT 模型。
| 模型名称及链接 | 使用场景 | 如何拉取模型 |
|---|---|---|
| Gemma 4 31B IT https://build.nvidia.com/google/gemma-4-31b-it | 专为推理、编程辅助、多模态理解和智能体工作流设计。 | 自动 |
我们的 AI 模型专为 NVIDIA GPU 加速系统设计并经过优化。通过利用 NVIDIA 硬件(如 GPU 核心)和软件框架(如 CUDA 库),与仅使用 CPU 的方案相比,该模型可实现更快的训练和推理速度。
nvcr.io/nim/google/gemma-4-31b-it:1.7.0-variant
nvcr.io/nim/google/gemma-4-31b-it:latest
请查看 NGC 上的“安全扫描 (Security Scanning)”选项卡以获取最新的安全扫描结果。 对于扫描结果中列出的某些开源漏洞,NVIDIA 以漏洞可利用性交换 (VEX) 文档的形式提供响应。您可以在“安全扫描”选项卡中查阅并下载 VEX 信息。
NVIDIA 认为可信 AI 是一项共同责任,我们已经制定了相关政策和实践,以支持广泛 AI 应用的开发。当根据我们的服务条款下载或使用时,开发人员应与其内部团队协作,确保这些软件组件符合相关行业及使用场景的要求,并防止不可预见的产品误用。
用户对模型的输入和输出负责。用户有责任在部署前确保该模型的安全集成,包括实施防护栏 (guardrails) 以及其他安全机制。
请在此处反馈质量、风险、安全漏洞或 NVIDIA AI 相关问题。
得益于我们的行业标准 API,NIM 的部署和集成非常简单。请访问 VLM NIM 页面 获取发布文档、部署指南等更多信息。
获取社区知识库文章和支持案例:(https://forums.developer.nvidia.com/)