Liquid AI d1-omni-600M tourne dans le navigateur via WebGPU
Liquid AI a publié d1-omni-600M, un modèle de décision, porté sur runntime, une bibliothèque d'inférence WebGPU en TypeScript, sans WASM. Les poids se chargent directement depuis les safetensors Hugging Face. La démo modère un faux fil de commentaires avec quatre questions par message (toxique, spam, question, ton), à environ 45 ms par question. Le portage n'est pas encore dans la version npm.
devopen-sourcerecherche
Source : r/LocalLLaMA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 7 oct. 2026 · 18:11 — voir la méthode.