NVIDIA

Model Optimizer

NVIDIA 统一模型优化库:量化、剪枝、蒸馏、NAS、投机解码与稀疏。

更新于 2026-09

产品概览
概览
厂商NVIDIA

简介

NVIDIA Model Optimizer(ModelOpt,Apache-2.0)把量化(PTQ/QAT)、剪枝、知识蒸馏、投机解码、稀疏与 NAS 等技术收进同一 Python 库,服务 Hugging Face / Megatron / Diffusers / ONNX 等到 TensorRT-LLM、NeMo 的部署路径。安装:pip install -U "nvidia-modelopt[all]"。来源:GitHub NVIDIA/Model-Optimizer、PyPI nvidia-modelopt、nvidia.github.io/Model-Optimizer。

  • PTQ / QAT 量化压缩
  • 剪枝与知识蒸馏
  • 投机解码与稀疏
  • 对接 TensorRT-LLM / NeMo
  • pip 安装 nvidia-modelopt
开源模型优化推理加速NVIDIA开发者工具

界面截图