[Benchmark] nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4

Check out how nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 achieved 116.84 tokens/sec on text generation on NVIDIA DGX Spark with vLLM!

View full benchmark at nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 - Spark Arena Benchmark