Llama.cpp sous Vulkan : les GPU classés par leur rapport performance-prix
Un tableau publié sur r/LocalLLaMA classe 76 modèles de GPU selon leur rapport performance-prix pour l'inférence locale sous Vulkan, à partir du fil de discussion llama.cpp #10879. Le test s'appuie sur le modèle Llama 2 7B en quantification Q4_0. Selon ces données, le backend Vulkan bouleverse la hiérarchie : les cartes grand public de milieu de gamme sont bridées par leurs bus étroits (128 ou 192 bits) en décodage (tg128), tandis que les composants professionnels et les anciens flagships à bus large dominent en performance-prix, sur la base du marché de l'occasion 2026.
matérielopen-sourcedev
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 8 oct. 2026 · 22:50 — voir la méthode.