New pre-built vLLM Docker Images for NVIDIA DGX Spark

  • scitrera/dgx-spark-pytorch-dev:2.10.0-cu131 — PyTorch 2.10.0 (with corresponding torchvision and torchaudio), CUDA 13.1.0, NCCL 2.29.2-1

  • scitrera/dgx-spark-vllm:0.14.0-t4 — vLLM 0.14.0ish (git 9b693d0), PyTorch 2.10.0, CUDA 13.1.0, Transformers 4.57.6, Triton 3.5.1, NCCL 2.29.2-1

  • scitrera/dgx-spark-vllm:0.14.0-t5 — vLLM 0.14.0ish (git 63227ac), PyTorch 2.10.0, CUDA 13.1.0, Transformers 5.0.0-rc? (git 0dfb28e1), Triton 3.5.1, NCCL 2.29.2-1; Patch for is_deepseek_mla() included for the benefit of GLM-4.7-Flash.

FYI. Tested GLM-4.7-Flash using ray and -tp4 on 4 spark cluster using scitrera/dgx-spark-vllm:0.14.0-t5 image.