Un eval de 469 tests compare les fine-tunes de Qwen3.8-27B aux modèles frontière
Un utilisateur de r/LocalLLaMA a mené un eval de 469 tests sur des fine-tunes de Qwen3.8-27B, lancés avec llama.cpp et les mêmes réglages de raisonnement, face à Opus 5.5, Astra et Qwen3.8-Flash-Next via OpenRouter. Son modèle retenu est 28x plus lent que les modèles frontière, un écart qu'il juge plus clément avec du meilleur matériel. Il appelle OpenRouter à rendre obligatoire la mention de la quantization.
open-sourcerecherchedevmatériel
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 8 oct. 2026 · 03:48 — voir la méthode.