Les travaux sur MTP pour Qwen Flash Next reprennent dans llama.cpp
Les travaux sur MTP avec Qwen Flash Next et llama.cpp ont redémarré. Des quants GGUF sont publiés sur le dépôt ggml-org de Hugging Face, sous le nom Qwen3.8-Flash-Next-GGUF, et une pull request a été ouverte sur le dépôt llama.cpp. L'auteur de la dépêche précise qu'il s'agit encore de travaux en cours.
open-sourcedev
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 1 oct. 2026 · 06:25 — voir la méthode.