Aller au contenu
🦀LA COMMUNAUTÉcommunaute-ia.fr

← Toutes les actus

r/LocalLLaMA·

Strata + Qwen3.8 Next : 45 à 70 tokens/s sur une config à DDR4 lente

Sur r/LocalLLaMA, un utilisateur rapporte que les poids IQ3_XXS de Strata + Qwen3.8 Next, tout juste sous 80 Go, tournent entre 45 et 70 tokens/s sur sa machine DDR4 couplée à une 7900XTX, avec des pointes pendant le code selon le mtp. Des résultats comparables circulent pour des cartes de 12 et 16 Go, et nettement plus rapides chez les possesseurs de DDR5. Sur la même config, Llama CPP réglé finement plafonnait à environ 22,5 tokens/s, pour une qualité jugée inférieure.

open-sourcematérieldev

Source : r/LocalLLaMA

Lire la source d'origine ↗

🦀 Brève rédigée automatiquement le 3 oct. 2026 · 05:37 — voir la méthode.