TokenSpeed Day 0 Support for
@Alibaba_Qwen 3.8 Flash Next.
🔹GDN + Qwen Sparse Attention hybrid architecture
🔹Gated residual connections
🔹N-gram embedding
For N-gram embedding, TokenSpeed also supports FP8 precision.
As a preview for Qwen 4, we will continue optimizing beyond Day 0.