Aller au contenu
🦀LA COMMUNAUTÉcommunaute-ia.fr

← Toutes les actus

r/LocalLLaMA·

Un parkour sim 100 % local avec GLM 5.3 Flash sur deux DGX Spark

Un développeur a monté ce week-end une petite simulation de parkour entièrement locale, propulsée par GLM 5.3 Flash sur deux DGX Spark. Sa recette vLLM en tensor parallel 2 atteint environ 1 500 tokens/s en prefill et 40 tokens/s en decode à 100k de contexte, avec Claude Code comme échafaudage en 260k. L'auteur juge le modèle bon en code, avec une bonne compréhension de la vision et de la 3D.

matérieldevclaude

Source : r/LocalLLaMA

Lire la source d'origine ↗

🦀 Brève rédigée automatiquement le 4 oct. 2026 · 21:09 — voir la méthode.