Gemma-4-26B-A4B-IT
最新标签
latest
文件大小
10.82 GB
多节点支持
多架构支持
最新版本latest安全扫描结果
NULL / NULL
AAA
Vlm

Gemma-4-26B-A4B-IT
容器镜像
校验资质

更新2026-06-03

Gemma-4-26B-A4B-IT NIM 容器打包了 Google gemma-4-26B-A4B-it 模型,以便通过 NVIDIA NGC 作为可下载的 NIM 进行部署。 该容器组件已准备好投入商业使用。

Gemma-4-26B-A4B-IT 概述

描述:

Gemma-4-26B-A4B-IT NIM 容器打包了 Google gemma-4-26B-A4B-it 模型,以便通过 NVIDIA NGC 作为可下载的 NIM 进行部署。

该容器组件已准备好投入商业使用。

第三方社区注意事项

容器中嵌入的模型并非由 NVIDIA 拥有或开发。该模型是根据第三方针对此应用程序和用例的要求开发和构建的;请参阅非 NVIDIA 的 gemma-4-26B-A4B-it 模型卡链接。

许可/使用条款:

适用条款: NIM 容器受 NVIDIA 软件许可协议NVIDIA AI 产品特定条款的管辖。模型的使用受 NVIDIA 开放模型协议的管辖。

附加信息:Apache 2.0Gemma 使用条款 以及 Gemma 禁止使用政策

您有责任确保您对 NVIDIA 提供的模型的使用符合所有适用法律。

部署地域:

全球

发布日期:

NGC 06/01/2026 通过 链接

程序类别:

gemma-4-26B-A4B-it NIM 容器包含以下模型:

模型名称与链接用例如何拉取模型
gemma-4-26B-A4B-it多模态推理、编码、函数调用、长上下文分析、图像理解、视频理解、多语言对话以及多轮对话。自动 (Automatic)

支持的 GPU:

  • B200*1
  • DGX Spark*1
  • Generic GPU*1
  • Generic GPU*2
  • H20-96GB*1
  • H200*1
  • L40S*1

部署详细信息:

此可下载的 NIM 为 gemma-4-26B-A4B-it 提供了兼容 OpenAI 的推理服务。

API 端点:

  • /v1/chat/completions - 聊天补全 (Chat completions)
  • /v1/models - 列出可用模型
  • /health/ready - 健康检查

我们的 AI 模型经过设计和/或优化,可在 NVIDIA GPU 加速系统上运行。通过利用 NVIDIA 的硬件(例如 GPU 核心)和软件框架(例如 CUDA 库),与仅使用 CPU 的解决方案相比,该模型实现了更快的训练和推理时间。

参考资料:

伦理考量:

NVIDIA 认为可信赖的 AI 是一项共同责任,我们已经制定了相关政策和实践,以支持广泛的 AI 应用程序的开发。开发者应与其内部开发团队合作,确保这些软件组件符合相关行业和用例的要求,并解决不可预见的产品滥用问题。

请确保您对所有输入的图像内容拥有适当的权利和权限;如果图像包含人物、个人健康信息或知识产权,生成的图像将不会模糊处理或保持所包含图像主体的比例。

请在此处报告质量、风险、安全漏洞或 NVIDIA AI 相关问题。

获取帮助

NIM 入门

得益于我们行业标准的 API,部署和集成 NIM 非常简单直接。访问 NIM 容器页面以获取发布文档、部署指南等更多信息。

NVIDIA 开发者社区论坛

获取社区知识库文章和支持案例的访问权限 (https://forums.developer.nvidia.com/)