llama.cpp merges MTP support for Qwen Flash Next
A pull request adding MTP support for Qwen4Exp was merged into llama.cpp after 17 hours of work, enabling MTP with Qwen Flash Next. Corresponding GGUF quantizations have been published on Hugging Face.