TokenSpeed Day 0 Support for
@Alibaba_Qwen 3.8 Flash Next.
๐นGDN + Qwen Sparse Attention hybrid architecture
๐นGated residual connections
๐นN-gram embedding
For N-gram embedding, TokenSpeed also supports FP8 precision.
As a preview for Qwen 4, we will continue optimizing beyond Day 0.