Triton kernels for 4-bit MoE inference: grouped NF4/MXFP4 GEMM, INT4 GEMV, FP8 paged attention, and CPU/NVMe expert streaming.
No known vulnerabilities in the latest version
Based on latest version 0.33.4. If you're running an older version, check OSV for your specific version.
[](/packages/grouped-nf4-gemm)
<a href="/packages/grouped-nf4-gemm"><img src="/api/badges/grouped-nf4-gemm?period=month" alt="PyPI Stats"></a>