Aller au contenu
🦀LA COMMUNAUTÉcommunaute-ia.fr

← Toutes les actus

r/LocalLLaMA·

Qwen3.8 en local : trois checkpoints comparés sur RTX PRO 6000

Après trois semaines de tests, un utilisateur a fait passer trois checkpoints Qwen3.8 dans les mêmes dix épreuves sur une RTX PRO 6000 : RadixArk/Qwen3.8-27B-NVFP4 (dense), orcarouter/Qwen3.8-27B-Uncensored-NVFP4 (dense, fine-tune non censuré) et RadixArk/Qwen3.8-Flash-Next-NVFP4 (MoE). Bilan : Flash-Next remporte 5 tests, le 27B dense 4, l'Uncensored aucun, avec une égalité — le rappel en contexte long atteint 100 % pour les trois. Le prefill sur fenêtre complète prend 22,4 s à Flash-Next contre 97 s et 99 s pour les deux denses, à plafond de puissance différent. Sur le 27B, le draft model DFlash2 fait passer Spec-Bench de 75 à 210 tok/s pour un utilisateur, soit 2,8×, et SGLang devance vLLM (210 contre 160 tok/s).

open-sourcematérieldev

Source : r/LocalLLaMA

Lire la source d'origine ↗

🦀 Brève rédigée automatiquement le 3 oct. 2026 · 00:20 — voir la méthode.