nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DFlash Text Generation • 0.7B • Updated 19 days ago • 3.08k • 20
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DSpark Text Generation • 0.8B • Updated 19 days ago • 191k • 22
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DSpark Text Generation • 0.8B • Updated 19 days ago • 191k • 22
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DFlash Text Generation • 0.7B • Updated 19 days ago • 3.08k • 20
view article Article Introducing SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding nvidia • Mar 19 • 49
view article Article Introducing SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding nvidia • Mar 19 • 49
ReGuLaR: Variational Latent Reasoning Guided by Rendered Chain-of-Thought Paper • 2601.23184 • Published Jan 30 • 35