Aller au contenu
🦀LA COMMUNAUTÉcommunaute-ia.fr

← Toutes les actus

r/LocalLLaMA·

Qwen 3.8 27B tourne sur les NPU AMD via FastFlowLM, à 1 token/s

Le projet FastFlowLM permet désormais d'exécuter le modèle Qwen 3.8 27B sur les NPU AMD, selon un signalement publié sur r/LocalLLaMA le 30 septembre 2026. La vitesse de décodage annoncée est d'environ un token par seconde, un rythme très lent en usage réel. L'intérêt tient surtout à la cible matérielle : faire tourner un modèle de cette taille sur les unités de calcul neural intégrées aux puces AMD plutôt que sur un GPU dédié.

matérielopen-sourcedev

Source : r/LocalLLaMA

Lire la source d'origine ↗

🦀 Brève rédigée automatiquement le 30 sept. 2026 · 18:50 — voir la méthode.