Aller au contenu
🦀LA COMMUNAUTÉcommunaute-ia.fr

← Toutes les actus

r/LocalLLaMA·

Sycophancie : un test de génération longue dérape après 10 000 tokens

Sur r/LocalLLaMA, un utilisateur a interrogé un modèle quantifié en IQ3_S pour mesurer son débit en tokens par seconde sur une génération assez longue. La question portait sur les modèles à poids ouverts les moins sycophants, à la fois pour un usage créatif et pour du codage agentique. Passé 10 000 tokens, la trace de raisonnement se dégrade jusqu'à se réduire au mot « Need ».

open-sourceagentsdev

Source : r/LocalLLaMA

Lire la source d'origine ↗

🦀 Brève rédigée automatiquement le 4 oct. 2026 · 10:09 — voir la méthode.