CoolFace
Modelpublic

minjaechoi/nemotron3-nano-30b-a3b-2p02bit-r18

sourceHugging Faceupdated 8d agoView on Hugging Face
0likes261downloads
Model Card

NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 — 2.0217-bit routed experts (r18)

Internal research checkpoint. Routed experts average 2.0217 bits; every other weight is BF16. Weights are stored dequantized in BF16 tensors and load with stock transformers / vLLM.

Base modelnvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16
Routed-expert average2.0217 bits
Internal IDr18

License follows the base model.