nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 Text Generation • 67B • Updated 26 days ago • 744k • 436
nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8 Text Generation • 124B • Updated 26 days ago • 69.6k • 280
Running 4.04k The Ultra-Scale Playbook 🌌 4.04k The ultimate guide to training LLM on large GPU Clusters