llama.cpp : le support du MTP arrive pour Qwen Flash Next
La pull request #29761 du dépôt ggml-org/llama.cpp, signée am17an, ajoute le support du MTP pour Qwen Flash Next. Elle a été fusionnée après 17 heures de développement. Des quants sont déjà disponibles sur Hugging Face (ggml-org/Qwen3.8-Flash-Next-GGUF), et l'auteur du post se demande s'il est temps de délaisser Qwen 3.8 27B.
open-sourcedev
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 1 oct. 2026 · 13:51 — voir la méthode.