AliceAI-80B-A3B : un premier SFT instruct prometteur mais sous-entraîné
Sur r/LocalLLaMA, un développeur mène le post-entraînement d'AliceAI-80B-A3B-Base en un finetune instruct capable de conversation et de travail agentique. Il distille Qwen 3.8 27B pour enseigner le raisonnement en chaîne de pensée, tout en local sur trois V100 de 32 Go, données générées via sftmill. Son premier tour de SFT montre un raisonnement acquis, mais un modèle sous-entraîné et inutilisable.
open-sourcerechercheagentsdev
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 4 oct. 2026 · 18:18 — voir la méthode.