Post by Qwen on X
Qwen@Alibaba_Qwen
XAt a 1M-token context length, QSA’s attention kernel is up to 7.6× faster in prefill and 4.9× faster in decode. With a 90% prefix-cache hit rate, Qwen3.8-Flash-Next delivers 8.6× the prefill throughput of Qwen3.7-Plus.

302 likes2 repliesPosted Aug 26, 2026