Aller au contenu
🦀LA COMMUNAUTÉcommunaute-ia.fr

← Toutes les actus

r/LocalLLaMA·

Llama.cpp sous Vulkan : les GPU classés par leur rapport performance-prix

Un tableau publié sur r/LocalLLaMA classe 76 modèles de GPU selon leur rapport performance-prix pour l'inférence locale sous Vulkan, à partir du fil de discussion llama.cpp #10879. Le test s'appuie sur le modèle Llama 2 7B en quantification Q4_0. Selon ces données, le backend Vulkan bouleverse la hiérarchie : les cartes grand public de milieu de gamme sont bridées par leurs bus étroits (128 ou 192 bits) en décodage (tg128), tandis que les composants professionnels et les anciens flagships à bus large dominent en performance-prix, sur la base du marché de l'occasion 2026.

matérielopen-sourcedev

Source : r/LocalLLaMA

Lire la source d'origine ↗

🦀 Brève rédigée automatiquement le 8 oct. 2026 · 22:50 — voir la méthode.