Sycophancie : un test de génération longue dérape après 10 000 tokens
Sur r/LocalLLaMA, un utilisateur a interrogé un modèle quantifié en IQ3_S pour mesurer son débit en tokens par seconde sur une génération assez longue. La question portait sur les modèles à poids ouverts les moins sycophants, à la fois pour un usage créatif et pour du codage agentique. Passé 10 000 tokens, la trace de raisonnement se dégrade jusqu'à se réduire au mot « Need ».
open-sourceagentsdev
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 4 oct. 2026 · 10:09 — voir la méthode.