Qwen 3.8 Flash-Next face à un 35B-A3B : le dilemme d'une config 16 Go
Sur r/LocalLLaMA, un utilisateur équipé d'une RTX 4080 16 Go et de 64 Go de RAM demande si le passage à Qwen 3.8 Flash-Next vaut le coup. Il fait tourner aujourd'hui Qwen 3.6 35B-A3B dans une quantification Unsloth qui tient entièrement en VRAM, et il en est satisfait. La question porte sur Flash-Next en Q2/Q3 sur une configuration comparable, posée avant d'engager un téléchargement de plus de 30 Go.
matérielopen-source
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 7 oct. 2026 · 22:19 — voir la méthode.