Nvidia Models
访问官网
Nvidia 英伟达
模型仓库
模型下载
详情介绍
NVIDIA AI Models 是 NVIDIA 官方的 AI 模型平台,汇集并分发由社区构建的优质 AI 模型,通过 NVIDIA AI 推理平台加速,可在 NVIDIA 加速基础设施上运行。平台涵盖 DeepSeek、Gemma、Llama、Qwen、Kimi、Nemotron、Phi 等主流模型,支持 TensorRT-LLM 优化、NIM 微服务部署、Ollama 部署等多种方式。
🚀 最新动态
- 模型生态丰富:覆盖 DeepSeek、Gemma、Llama、Qwen、Kimi、Nemotron、Phi、gpt-oss 等主流模型
- TensorRT-LLM 优化:通过 NVIDIA TensorRT-LLM 实现推理性能极致优化
- NIM 微服务:生产就绪的 API 一键部署,支持快速原型设计与生产部署
- FP4 量化:支持 DeepSeek R1 等模型的 FP4 量化,降低推理成本
- 多平台支持:从数据中心 GPU (Blackwell、Hopper) 到 Windows RTX、Jetson 边缘设备
🎯 核心功能
- 社区模型分发:汇集 DeepSeek、Gemma、Llama、Qwen、Kimi 等热门开源模型
- TensorRT-LLM 加速:NVIDIA 深度优化,实现极致推理性能
- NIM 微服务部署:生产就绪容器,API 调用即可使用
- Ollama 部署:支持 Ollama 快速部署到所有 NVIDIA GPU
- NeMo 框架定制:端到端 NeMo 框架,支持自定义模型微调
- 多平台覆盖:数据中心、工作站、边缘设备全平台支持
- FP4/量化支持:模型量化降低部署成本,提升推理速度
💡 适用场景
- AI 模型部署:企业级生产环境部署,NIM 微服务保障
- 推理加速:TensorRT-LLM 优化,最大化 GPU 利用率
- 边缘 AI:Jetson 设备上的边缘推理部署
- 模型定制:NeMo 框架支持数据自定义微调
- 多模型对比:统一平台测试不同模型性能
💪 平台优势
- NVIDIA 官方:NVIDIA 官方维护,质量与性能保障
- 极致优化:TensorRT-LLM 深度释放 NVIDIA GPU 算力
- 生产就绪:NIM 微服务提供生产级支持与 SLA
- 生态丰富:覆盖国内外主流开源模型
- 全平台:从云到端,NVIDIA 全产品线覆盖
- 工具链完整:NeMo + TensorRT-LLM + NIM 完整开发部署链路