简介
NVIDIA Model Optimizer(ModelOpt,Apache-2.0)把量化(PTQ/QAT)、剪枝、知识蒸馏、投机解码、稀疏与 NAS 等技术收进同一 Python 库,服务 Hugging Face / Megatron / Diffusers / ONNX 等到 TensorRT-LLM、NeMo 的部署路径。安装:pip install -U "nvidia-modelopt[all]"。来源:GitHub NVIDIA/Model-Optimizer、PyPI nvidia-modelopt、nvidia.github.io/Model-Optimizer。
- PTQ / QAT 量化压缩
- 剪枝与知识蒸馏
- 投机解码与稀疏
- 对接 TensorRT-LLM / NeMo
- pip 安装 nvidia-modelopt
界面截图
可左右滑动,或使用方向键、Home 和 End 浏览截图。
