# NVIDIA/Model-Optimizer

A unified library of SOTA model optimization techniques like quantization, distillation, pruning, neural architecture search, speculative decoding, etc. It compresses deep learning models for downstream deployment frameworks like TensorRT-LLM, TensorRT, vLLM, etc. to optimize inference speed.

## Repository

- [Catalog detail page](https://awesomeclaudeplugins.com/NVIDIA/Model-Optimizer)
- [GitHub repository](https://github.com/NVIDIA/Model-Optimizer)
- Stars: 3618
- Forks: 569
- 1 plugin entries are reported.

## Catalog provenance

- Publication state: indexable
- Quality note: Canonical repository has a description and validated plugin count.
- Catalog snapshot: Aug 31, 2026
- Repository metadata source: public GitHub API when available

## Installation

When this repository exposes a Claude Code marketplace, add it with:

```bash
/plugin marketplace add NVIDIA/Model-Optimizer
```
