llama.cpp : un utilisateur bloque sur les fichiers MTP de Qwen3.8-Flash-Next sur deux DGX Spark
Un utilisateur de r/LocalLLaMA fait tourner deux DGX Spark en cluster, où deepseek-flash fonctionne déjà. Il cherche à tester la version MTP de Qwen3.8-Flash-Next (unsloth) avec llama-server, mais sa commande de lancement provoque un blocage de la machine. Il dispose de deux fichiers MTP — un « shared » et un classique — sans savoir comment les utiliser.
open-sourcematérieldev
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 8 oct. 2026 · 08:53 — voir la méthode.