Check out how nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 achieved 116.84 tokens/sec on text generation on NVIDIA DGX Spark with vLLM!
View full benchmark at nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 - Spark Arena Benchmark
Check out how nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 achieved 116.84 tokens/sec on text generation on NVIDIA DGX Spark with vLLM!
View full benchmark at nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 - Spark Arena Benchmark