Also, I don’t know how OP is getting Qwen3.5 27B @ 30 tps on DGX Spark That number is impossible for a Dense model on DGX Spark’s Unified Memory (273 Gbps) My personal experiments showed it’s 4 tokens/sec for that model on the Spark
Qwen3 27B Performance Claims Disputed on DGX Spark Hardware
By
–