Nvidia Model Optimizer: A unified library of SOTA model optimization techniques like quantization, pruning, Neural Architecture Search (NAS), distillation, speculative decoding, etc. It compresses deep learning models for downstream deployment frameworks like TensorRT-LLM, TensorRT, vLLM, etc. to optimize inference speed.
No known vulnerabilities in the latest version
Based on latest version 0.46.0. If you're running an older version, check OSV for your specific version.
[](/packages/nvidia-modelopt)
<a href="/packages/nvidia-modelopt"><img src="/api/badges/nvidia-modelopt?period=month" alt="PyPI Stats"></a>