2 DGX Sparks. Qwen3.8 Flash Next NVFP4.
64 users, independent prompts + KV caches.
32,768 output tokens in 78.82s:
415.7 tok/s
Video: 1K stress. Usable-context test passed 64K/user at C16, zero leakage. Testing Spark limits, not a production recipe.
@NVIDIAAI