Un utilisateur affirme avoir vidé 98 % du KV cache sans que le modèle échoue à RULER
Sur r/LocalLLaMA, un utilisateur affirme avoir appliqué un « forget » à 98 % du KV cache de son modèle, qui a malgré tout réussi le benchmark RULER. Il assure que le résultat est bien réel, tout en précisant qu'il ne faut pas le croire sur parole. Aucune vérification indépendante n'accompagne la publication.
recherchedevopen-source
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 6 oct. 2026 · 02:27 — voir la méthode.